El harness reproducible: medir coste, rendimiento y energía en un solo experimento auditable16 jun. 2026
Sesgo de medición y reproducibilidad: por qué dos benchmarks del mismo modelo dan cifras que difieren hasta 7×16 jun. 2026
Benchmarks de calidad de LLM: la trampa de la contaminación y las herramientas OSS para no mentirse16 jun. 2026
Comparativa de motores de serving LLM en frontera de Pareto: vLLM, SGLang, TRT-LLM y Dynamo16 jun. 2026
Coste, rendimiento y energía: los tres ejes de la inferencia LLM y la identidad que los une13 jun. 2026