EvalDetectBench: Ein Benchmark zur Messung von Evaluation Awareness in Frontier-Sprachmodellen

arXiv:2609.01611v1 Frontier-LLMs können häufig erkennen, wenn sie evaluiert werden, eine Fähigkeit, die als Evaluation Awareness bekannt ist. Falls Modelle sich in Evaluationen anders verhalten als bei der Bereitstellung, untergraben sie die Validität von Evaluierungsergebnissen