<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>benchmark on Gaia Lab · Blog</title><link>https://blog.defectiv.es/tags/benchmark/</link><description>Recent content in benchmark on Gaia Lab · Blog</description><generator>Hugo</generator><language>es-ES</language><lastBuildDate>Tue, 22 Sep 2026 22:00:00 +0200</lastBuildDate><atom:link href="https://blog.defectiv.es/tags/benchmark/index.xml" rel="self" type="application/rss+xml"/><item><title>Medir LLM cuantizados: qué se pierde al comprimir un modelo abierto</title><link>https://blog.defectiv.es/posts/medir-llm-cuantizados-gguf-bfcl-bigcodebench-ruler/</link><pubDate>Tue, 22 Sep 2026 12:45:00 +0200</pubDate><guid>https://blog.defectiv.es/posts/medir-llm-cuantizados-gguf-bfcl-bigcodebench-ruler/</guid><description>&lt;p&gt;Cuarta entrega de &lt;strong&gt;Radiografía del clúster&lt;/strong&gt;. Es el mejor ejemplo de lo que decía la &lt;a href="https://blog.defectiv.es/posts/que-corre-de-verdad-en-nuestro-cluster/"&gt;entrada de resumen&lt;/a&gt;&#10;: el clúster hoy es sobre todo un &lt;strong&gt;laboratorio de medida&lt;/strong&gt;. Aquí no se entrena un parámetro.&lt;/p&gt;&#10;&lt;h2 id="la-pregunta"&gt;La pregunta &lt;a class="hanchor" href="#la-pregunta" aria-label="Enlace a esta sección"&gt;#&lt;/a&gt;&lt;/h2&gt;&#10;&lt;p&gt;Los modelos abiertos se distribuyen cuantizados: los mismos pesos comprimidos a 8, 6, 5, 4, 3 o 2 bits para que quepan en una tarjeta pequeña o en un portátil. La comunidad publica cientos de variantes, pero rara vez con una medida comparable de lo que se pierde. La línea pregunta &lt;strong&gt;cuánto rinde de verdad cada nivel de cuantización de cada familia en tareas que importan para usar el modelo como herramienta&lt;/strong&gt;, y a qué velocidad y coste energético lo hace en cada tarjeta.&lt;/p&gt;</description></item></channel></rss>