Knative y scale-to-zero para inferencia LLM: cuándo apagar la GPU ahorra y cuándo te cuesta el SLO31 ago. 2026
Kubeflow a fondo: qué piezas valen la pena en una plataforma LLM on-premise y cuáles ya tienes31 ago. 2026