Verbesserte Konfidenzschätzungen für Black-Box Large Language Models

arXiv:2608.19323v1 Ankündigungstyp: neu Abstract: Unsicherheitsquantifizierung (UQ) ist essentiell für den sicheren Betrieb von Large Language Models (LLMs). Bestehende Methoden, von verbalisiertem Vertrauen bis zu solchen, die mehrere Generierungen erfordern, sind oft Zero-Shot und erzeugen Scores, die Unsicherheit quantifizieren