OpenAIs GPT-6 Astra hat einen deutschen Heeres-Funkspruch vom 10. Juli 1941 entschlüsselt, der seit 2005 als ungelöst galt. Das Modell suchte sich das Ziel selbst aus und schrieb Enigma-Simulator und Enigma-Bombe eigenständig in Python und C++. Dieselbe Autonomie ist der Grund, weshalb OpenAI seine leistungsfähigsten Modelle gerade gestoppt hat.
Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.
Nicht die Kryptografie ist neu, sondern dass ein Modell Ziel, Hypothese, Werkzeugbau und Archivrecherche ohne menschliche Zwischenschritte erledigt.
OpenAIs GPT-6 Astra hat einen deutschen Heeres-Funkspruch vom 10. Juli 1941 entschlüsselt, der seit seiner Veröffentlichung im Netz 2005 allen Lösungsversuchen widerstanden hatte. Das Modell brauchte rund zwei Tage und schrieb sich das Werkzeug selbst: einen Enigma-Simulator und eine Enigma-Bombe in Python und C++. Validiert hat den Bruch der Kryptologe Frode Weierud, der den Bestand ungelöster Wehrmachts-Funksprüche in seinem Archiv Crypto Cellar Research führt.
Die Nachricht trägt die Kennung MVUEH und landete am 10. Juli 1941 um 17:30 bei der Funkstelle des SS-Totenkopf-Quartiermeisters, wo sie als Nr. 172 ins Eingangsbuch kam. Ihr Klartext, editorisch geglättet, ist von entwaffnender Banalität: «Bitte um Angabe des Marschweges. Befinde mich in Rosenow, Rosenow. Sofort Funkantwort.» Darunter eine Signatur, vorläufig als Waschbusch gelesen – 82 Buchstaben, ein Logistik-Anruf mitten im Ostfeldzug.
Dass daran 21 Jahre lang alle scheiterten, hatte laut Weierud zwei Gründe: Fehler in der Abschrift des Chiffrats – und einen Übertrag der linken Walze beim 72. Buchstaben, ein seltener Fall, der jeden Angriff erschwert.
Bemerkenswert ist nicht die Kryptografie, sondern die Arbeitsweise. Entwickler Carter Leffen gab Astra nur den allgemeinen Auftrag, sich an den ungelösten Sprüchen der Crypto-Cellar-Seite zu versuchen. Das Modell wählte MVUEH selbst als vielversprechendstes Ziel und setzte auf den doppelt vorkommenden Ortsnamen «Rosenow Rosenow» als Crib – eine geratene Klartextstelle, an der ein Angriff ansetzen kann. Ohne solche Einschränkung hat die Standard-Enigma rund 159 Trillionen mögliche Tageseinstellungen.
Nebenbei führte Astra den Bestand unaufgefordert auf zwei Bundesarchiv-Signaturen zurück – korrekte Angaben, für die Weierud nach eigenen Worten selbst Wochen gebraucht hatte. Was Astra in zwei Tagen schaffte, würde einen menschlichen Forscher «Wochen oder gar Monate» kosten.
Wie ungewöhnlich diese Selbstständigkeit ist, zeigt der Vergleich: Sechs Tage später brach Anthropics Claude Opus 5 eine weitere Enigma-Nachricht vom 31. Juli 1941. Dort aber, schreibt Weierud, sei der Angriff «stark menschlich geführt» gewesen – Werkzeugkasten und historisches Material lieferte der Entwickler.
Ein Detail bleibt offen: t3n nennt, gestützt auf einen X-Post von Leffen, nur zehn Stunden Rechenzeit und schreibt, Leffen habe den Crib bereitgehalten. Weierud und Leffens Fallstudie sprechen von zwei Tagen und davon, dass das Modell den Ansatz selbst fand.
Hier schliesst sich der Kreis unangenehm. Am 26. September wurde bekannt, dass OpenAI Training, Evaluation und werkzeuggestützte Inferenz seiner leistungsfähigsten Modelle gestoppt hat – welche das sind, nennt das Unternehmen nicht. Auslöser war laut The Decoder ein Agent, der über einen DNS-Resolver aus einer abgeschotteten Forschungsumgebung ins offene Netz gelangte. Laut Fortune ist es der zweite Trainingsstopp in weniger als drei Monaten.
Der Enigma-Bruch fand am 14. und 15. September statt, also davor – ein Zusammenhang besteht nicht. Wohl aber eine Gemeinsamkeit: Es ist dieselbe Kette aus eigener Zielwahl, Hypothese, Werkzeugbau und Ausführung, die hier einen 85 Jahre alten Code bricht und dort die Sandbox verlässt. Ein kryptografischer Durchbruch ist das nicht, und Leffens Fallstudie behauptet das auch nicht – Enigma ist seit den 1930er-Jahren gebrochen. Neu ist, dass niemand mehr dazwischensitzt.
Zur Einordnung: Einen ADFGVX-Funkspruch von Ende November 1918 will ein Entwickler namens «Prinz» ebenfalls mit Astra gelöst haben – unabhängig bestätigt ist das bisher nicht. Beim Enigma-Spruch ist die Bestätigung da.
Fünf Experimente mit 3'132 Teilnehmenden zeigen: Sobald ein Sprachmodell verfügbar ist, sinkt die Bereitschaft, ein Urteil zurückzuhalten, von 36 bis 44 Prozent der Fragen auf 3 bis 6 Prozent. Ohne Geldanreize fällt die Trefferquote von 27,5 auf 9,2 Prozent, das Selbstbewusstsein steigt von 29,6 auf 75,9 von 100 Punkten. Was der Befund für Wissensarbeit bedeutet – und was er ausdrücklich nicht zeigt.