ThinkReset: Konstruktion einer lernbaren Zwischenschnittstelle für begrenzten Kontext bei längerfristiger Reasoning
arXiv:2607.28642v1 Längere Chain-of-Thought Reasoning verbessert die Leistung bei komplexen Problemen, führt aber auch zu Redundanzansammlung, Kontext-Overflow und Fehler-Verankerung. Wir argumentieren, dass unter beschränkten Kontext-Fenstern der Kern-Engpass nicht die Trajektorie-Kompression ist