Eine kollektive Leistungsgrenze in Frontier-Large-Language-Models bei richtlinienkonformer und fallspezifischer onkologischer Entscheidungsfindung

arXiv:2608.28592v1 Ankündigungstyp: neu Abstract: Large Language Models (LLMs) erzielen hohe Punktzahlen bei medizinischen Wissensexamen, doch die reale Onkologie ist kein Wissenstest – sie ist eine Abfolge von Richtlinien-Pfad-Entscheidungen, Eskalationsbeurteilungen und Verpflichtungen unter Unsicherheit. Bestehende Benchmarks