Willst du nicht, dass dein LLM einen Atomwaffeneinsatz empfiehlt? Versuche, es auf Japanisch zu fragen

arXiv:2608.12373v1 Ankündigungstyp: neu Abstract: Large Language Models werden zunehmend in strategischen und beratenden Kontexten eingesetzt, doch ihre Safety-Alignment-Bewertung erfolgt typischerweise nur auf Englisch. Wir testen neun Modelle von sechs Anbietern und prüfen, ob die Sprache eines Prompts die Entscheidung eines Modells verändern kann