<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>benchmark on Gaia Lab · Blog</title><link>https://blog.defectiv.es/de/tags/benchmark/</link><description>Recent content in benchmark on Gaia Lab · Blog</description><generator>Hugo</generator><language>de-DE</language><lastBuildDate>Wed, 23 Sep 2026 09:00:00 +0200</lastBuildDate><atom:link href="https://blog.defectiv.es/de/tags/benchmark/index.xml" rel="self" type="application/rss+xml"/><item><title>Quantisierte LLMs messen: Was beim Komprimieren eines offenen Modells verloren geht</title><link>https://blog.defectiv.es/de/posts/medir-llm-cuantizados-gguf-bfcl-bigcodebench-ruler/</link><pubDate>Tue, 22 Sep 2026 12:45:00 +0200</pubDate><guid>https://blog.defectiv.es/de/posts/medir-llm-cuantizados-gguf-bfcl-bigcodebench-ruler/</guid><description>&lt;p&gt;Dritte Folge von &lt;strong&gt;Cluster-Röntgenbild&lt;/strong&gt;. Sie ist das beste Beispiel für das, was der &lt;a href="https://blog.defectiv.es/de/posts/que-corre-de-verdad-en-nuestro-cluster/"&gt;Überblicksbeitrag&lt;/a&gt;&#10; sagte: Der Cluster ist heute vor allem ein &lt;strong&gt;Messlabor&lt;/strong&gt;. Hier wird kein einziger Parameter trainiert.&lt;/p&gt;&#10;&lt;h2 id="die-frage"&gt;Die Frage &lt;a class="hanchor" href="#die-frage" aria-label="Enlace a esta sección"&gt;#&lt;/a&gt;&lt;/h2&gt;&#10;&lt;p&gt;Offene Modelle werden quantisiert verteilt: dieselben Gewichte, komprimiert auf 8, 6, 5, 4, 3 oder 2 Bit, damit sie auf eine kleine Karte oder ein Notebook passen. Die Community veröffentlicht Hunderte Varianten, aber selten mit einer vergleichbaren Messung dessen, was verloren geht. Die Linie fragt, &lt;strong&gt;wie viel jede Quantisierungsstufe jeder Familie in Aufgaben wirklich leistet, die für den Einsatz des Modells als Werkzeug zählen&lt;/strong&gt;, und mit welcher Geschwindigkeit und welchen Energiekosten sie das auf jeder Karte tut.&lt;/p&gt;</description></item></channel></rss>