El harness reproducible: medir coste, rendimiento y energía en un solo experimento auditable16 jun. 2026
Del SLO al número de GPUs: cómo dimensionar y justificar la inversión en hardware de inferencia16 jun. 2026
Energía en el TCO y en la regulación: coste, PUE, CSRD y la nueva obligación europea de reporte para centros de datos16 jun. 2026
Sesgo de medición y reproducibilidad: por qué dos benchmarks del mismo modelo dan cifras que difieren hasta 7×16 jun. 2026
TCO completo de un cluster GPU on-premise: del capex al €/GPU-hora all-in y el break-even contra cloud16 jun. 2026
Cloud GPU: on-demand, reserved y spot — y por qué los neoclouds cambian el tablero (con precios 2026)16 jun. 2026
Leaderboards de energía de LLM: cómo comparar modelos por Wh/token y elegir por eficiencia16 jun. 2026
Benchmarks de calidad de LLM: la trampa de la contaminación y las herramientas OSS para no mentirse16 jun. 2026
Comparativa de motores de serving LLM en frontera de Pareto: vLLM, SGLang, TRT-LLM y Dynamo16 jun. 2026
Chargeback y showback de GPU en multi-tenancy: cómo repartir el coste del cluster entre equipos15 jun. 2026
On-premise soberano vs hyperscalers: el caso con datos (coste, energía, rendimiento y soberanía)14 jun. 2026
Energía por token en España: metodología, el mercado eléctrico y los casos de especulación14 jun. 2026
Coste, rendimiento y energía: los tres ejes de la inferencia LLM y la identidad que los une13 jun. 2026