Flacher Score, verstärkte Ausfälle: Wie das Error Budget Schäden bei quantisierten LLM Agents verdeckt
arXiv:2607.27275v1 Announce Type: new Abstract: Post-Training-Quantisierung auf 4-Bit-Gewichte wird weit verbreitet als nahezu verlustfrei gemeldet. Wir testen diese Aussage für Multi-Turn, Tool-Calling Agents, wo es jetzt am meisten zählt. Auf τ²-bench, über zwei Open-Weight-Modellfamilien in dichten und MoE-Varianten.