Semalith v1.4: Ein kalibrierter 184M Safety Classifier mit State-of-the-Art Prompt-Injection-Erkennung bei 44x weniger Parametern als Llama-Guard-3-8B

arXiv:2607.22545v1 Ankündigung: Neue Arbeit. Abstract: Der Einsatz großer Sprachmodelle in Finanzdienstleistungen und agentengestützten Szenarien erfordert Safety Classifier, die gleichzeitig Prompt Injection, Compliance und allgemeinen Schaden bewältigen – eine Kombination, die keine bestehende Open-Source-Lösung in einer einzigen