InferenceBench: Ein Benchmark für offene LLM-Inferenz-Optimierung durch KI-Agents
arXiv:2607.20468v1 Ankündigungstyp: neu Abstract: KI-Agents werden zunehmend zur Automatisierung von Forschungs- und Entwicklungsaufgaben eingesetzt, doch bestehende Benchmarks evaluieren sie typischerweise an vordefinierten Arbeitsabläufen oder engen Aktionsräumen. Selbst nominell offene Aufgaben können oft durch Abruf bekannter