Claves virtuales, presupuestos y límites en LiteLLM: la capa que decide quién consume la GPU, y las cuatro cosas que la documentación cuenta mal8 sept. 2026
Kubeflow a fondo: qué piezas valen la pena en una plataforma LLM on-premise y cuáles ya tienes31 ago. 2026
Volcano y Kueue: gang scheduling, colas y cuotas GPU para cargas distribuidas en Kubernetes16 jun. 2026