Skalierung von Post-Training-Ternarisierung auf Qwen3-8B: Fähigkeitsbeibehaltung, Reproduzierbarkeit, verlustfreie Komprimierung und gepackte Ausführung

arXiv:2609.09240v1 Neuer Beitrag: Ultra-Low-Bit-Language-Models versprechen Reduktionen bei Speicherung und Memory-Traffic, doch eine nominale “1,58-Bit”-Bezeichnung spezifiziert nicht die bereitgestellte Darstellung oder ihre Ausführungskosten. Wir untersuchen eine Hochskalierung einer aggressiven Post-Training-Konvertierungs-Pipeline