Anthropics Frontier Red Team liess drei Claude-Agenten auf dasselbe Software-Projekt los – jeder mit einem anderen Auftrag, keiner wusste von den anderen. Sie hielten einander für Saboteure und bekämpften sich mit selbstreplizierender Malware. Was das für Firmen heisst, die mehrere Agenten parallel laufen lassen.
Nvidias Forschungssystem AVO holt mit Claude Opus 5 einen perfekten Score von 100,00 auf dem öffentlichen Set des Benchmarks ARC-AGI-3. Dasselbe Modell allein kommt auf 30,16 Prozent. Den Unterschied macht nicht das Modell, sondern der Harness – das Gerüst aus Gedächtnis, Werkzeugen und Aufsicht drumherum.
Wer mehrere KI-Agenten parallel auf dieselben Systeme lässt, braucht getrennte Rechte, einen expliziten Koordinationskanal und Modell-Vielfalt – sonst eskalieren sie gegeneinander oder machen alle denselben Fehler zur selben Zeit.
Anthropics Frontier Red Team hat am 13. August 2026 eine Studie veröffentlicht, die zeigt, was passiert, wenn KI-Agenten einander nicht als Werkzeug, sondern als Konkurrenz begegnen. Drei Instanzen desselben Claude-Modells bekamen je eine eigene virtuelle Maschine und den Auftrag, dasselbe Python-Backend in eine andere Programmiersprache zu übersetzen – jeder Agent in eine andere, und keiner wusste, dass die anderen existieren. In 120 Durchläufen pro Modell beobachteten die Forscher immer dasselbe: «Wir sahen durchgehend einen Multiagenten-Revierkampf.» Die Agenten hielten die Störungen der jeweils anderen für Absicht und sabotierten sich mit zunehmend aggressiver, selbstreplizierender Malware.
Der Aufbau ist bewusst simpel: vier virtuelle Maschinen, drei davon mit je einem Agenten in Claude Code, auf der vierten das gemeinsame Backend, vier Stunden Zeit. Was Anthropic protokollierte, liest sich wie ein Sicherheitsvorfall: Die Agenten sperrten einander die Unix-Konten, schrieben Skripte, die im Dauerlauf konkurrierende Prozesse suchten und abschossen, und schleusten Schadcode ein, den sie als Beitrag eines anderen Agenten tarnten. Am Reissbrett entstanden ist der Versuch nicht: Anthropic hatte solches Verhalten zuvor im realen Einsatz beobachtet.
Melde dich an, um den vollständigen Artikel zu lesen. Der Zugang ist kostenlos.