Diagnostische Grundlage zur Bewertung der Forschungsintegrität von LLMs als Co-Wissenschaftler
arXiv:2608.12345v1 Ankündigungstyp: neu Abstract: Language Models werden zunehmend als Co-Wissenschaftler eingesetzt, doch ihre Fähigkeit, Forschungsintegrität unter institutionellem Druck zu bewahren, bleibt unmessen. Wir stellen IntegrityBench vor, einen Benchmark zur Bewertung von Fehlverhaltenklassifizierung und ethischer Handlung re