RENDER: Kontrolle von leserseitigen Belegen in der LLM-Memory-Evaluierung

arXiv:2608.23568v1 Ankündigungstyp: neu Abstract: Memory- und RAG-Evaluierungen behandeln die Eingabe des antwortgebenden Modells oft als Implementierungsdetail, obwohl Systeme dieselbe Historie als Memory-Eintrag, Zusammenfassung, typisiertem Datensatz oder unverarbeiteter Ausschrift darstellen können. Wir führen RENDER ein, ein Benchmark-Kontrollwerkzeug, das