Induktion belohnungsfreier Bewertungsrubriken, die Über-Zuschreibung bei Agent-Evaluierung reduzieren
arXiv:2608.13564v1 Ankündigungstyp: neu Abstract: Die Bewertung von Language-Model-Agenten im großen Maßstab stützt sich zunehmend auf ein zweites Language Model als automatischen Richter, da das Gold-Signal, eine ausführbare Umgebungsbelohnung, teuer, langsam oder zur Bereitstellungszeit nicht verfügbar ist. Ein solcher Richter ist eine belohnungsfreie