El gateway MCP de LiteLLM: la segunda puerta de entrada, el catálogo de herramientas que nadie factura y por qué filtrarlo puede empeorar la selección11 sept. 2026
Enrutado por prefijo: lo que LiteLLM no hace, quién sí lo hace y cuánto mejora de verdad11 sept. 2026
Humanos y agentes en el mismo gateway: por qué `priority` no prioriza, el 429 que tumba el pool entero y las dos formas de separar el tráfico10 sept. 2026
Claves virtuales, presupuestos y límites en LiteLLM: la capa que decide quién consume la GPU, y las cuatro cosas que la documentación cuenta mal8 sept. 2026
LiteLLM en día 2: un worker por pod, seis mil segundos de timeout y las otras cinco cosas que hay que cambiar antes de abrir tráfico8 sept. 2026