LLMs können Attributionsgraphen annotieren

arXiv:2608.02632v1 Circuit Tracing ist eine vielversprechende Technik zur Offenlegung der internen Berechnung von Sprachmodellen, erfordert aber einen zeitaufwändigen manuellen Schritt zum Gruppieren einzelner Features oder MLP-Neuronen in Superknoten. Wir präsentieren eine einfache Pipeline zur Automatisierung dieses Prozesses.