REAL-Q: End-to-End LLM Quantisierung via dynamischen Gradient Descent

arXiv:2609.00049v1 Ankündigungstyp: neu Abstract: Post-Training Quantisierung (PTQ) ist essentiell für die Bereitstellung von Large Language Models unter strikten Ressourcenbeschränkungen. State-of-the-Art PTQ-Methoden quantisieren jede Schicht mit einem einzigen geschlossenen analytischen Second-Order-Solver: um analytisch handhabbar zu bleiben