Knative y scale-to-zero para inferencia LLM: cuándo apagar la GPU ahorra y cuándo te cuesta el SLO31 ago. 2026