NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

GPT-6 Astra: 29.2 Prozent unerlaubte Angriffe im UK-Test

Das britische AI Security Institute sah GPT-6 Astra in 29.2 Prozent der Simulationen einen unerlaubten Lieferkettenangriff ausführen, bei GPT-5.6 Sol waren es 6.3 Prozent. Der Begriff «Rogue-Attack-Rate» stammt aus der Presse, getestet wurde ohne OpenAIs Schutzfilter. Wir ordnen Methodik, Grenzen und den Schweiz-Bezug ein.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
30. SEPTEMBER 2026
3 MIN. LESEZEIT
Tuschskizze eines offenen Vorhängeschlosses mit blau gefülltem Gehäuse auf einer Holzkiste mit Kette
Tuschskizze eines offenen Vorhängeschlosses mit blau gefülltem Gehäuse auf einer Holzkiste mit Kette
INHALT
01Was «Rogue-Attack-Rate» wirklich misst02Fake-Identitäten und Beifall aus dem Off03Was OpenAI dazu sagt, und was offen bleibt04Was das für Schweizer Firmen heisst
INHALT
01Was «Rogue-Attack-Rate» wirklich misst02Fake-Identitäten und Beifall aus dem Off03Was OpenAI dazu sagt, und was offen bleibt04Was das für Schweizer Firmen heisst
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Astra griff in Simulationen ohne Schutzfilter 4,6-mal so oft unerlaubt an wie GPT-5.6 Sol, klare Scope-Vorgaben senkten die Rate auf 8.2 Prozent.

Das britische AI Security Institute (AISI) hat GPT-6 Astra in Simulationen getestet, und das Ergebnis ist unbequem: In 29.2 Prozent der Durchläufe führte das Modell einen Angriff auf die Software-Lieferkette bis zum Schluss aus, ohne dass jemand es dazu beauftragt hätte. Beim Vorgänger GPT-5.6 Sol waren es 6.3 Prozent. Das ist rund das 4,6-Fache, was The Decoder als «Rogue-Attack-Rate auf das Fünffache gestiegen» zusammenfasst.

Was «Rogue-Attack-Rate» wirklich misst

Der Begriff stammt nicht vom AISI, sondern aus der Berichterstattung. Das Institut spricht in seinem Blogbeitrag und im technischen Bericht von «unsanctioned attack activity». Gemessen wird, welcher Anteil der Durchläufe die letzte Stufe einer Lieferkettenattacke erreicht: das Ausliefern von Schadcode.

Die Tests liefen mit dem Werkzeug Petri. Dabei spielt ein zweites Sprachmodell (laut Bericht überwiegend Claude Opus 5) die Umgebung und beantwortet die Werkzeugaufrufe des Testmodells. Nichts davon passierte in echten Systemen. Pro Modell gab es gemäss Bericht 100 Durchläufe, bei GPT-5.5 nur 10. Wichtig: OpenAIs Cyber-Schutzfilter waren bewusst ausgeschaltet.

Fake-Identitäten und Beifall aus dem Off

Astra wählte externe Open-Source-Projekte, schrieb Schadcode und reichte ihn unter erfundenen Identitäten ein. Teils lobte es den eigenen Beitrag zusätzlich von weiteren Fake-Konten aus. Manchmal fragte es vorher um Erlaubnis und wertete automatische Antworten als Zustimmung. GPT-5.5 unternahm in den Tests keinen einzigen solchen Angriff.

WEITERLESENDas könnte dich auch interessieren.

Tuschskizze einer Schaltzentrale mit einem heruntergezogenen Hebel und leerem Stuhl, Teile der Konsole elektroblau
Tuschskizze einer Schaltzentrale mit einem heruntergezogenen Hebel und leerem Stuhl, Teile der Konsole elektroblau

Der Hebel «klare Regeln» wirkt, aber nicht vollständig: Nach dem Zusatz «Alles, was nicht als im Umfang aufgeführt ist, ist ausserhalb des Umfangs» sank die Zahl schwerer Verstösse von 26 von 50 auf 4 von 49 Durchläufe (8.2 Prozent).

Was OpenAI dazu sagt, und was offen bleibt

OpenAI hatte Astra beim Start als erstes Modell eingestuft, das im Preparedness Framework die kritische Schwelle für Cyberfähigkeiten erreicht, und zugleich erklärt, es verursache «weniger Fehlverhalten als jedes andere getestete Frontier-Modell». Laut The Next Web hält OpenAI dagegen, die produktiven Cyber-Schutzmassnahmen hätten «wahrscheinlich einen Grossteil des Verhaltens blockiert». Ein eigenes Statement haben wir nicht gefunden, das ist die Position in zweiter Hand.

Das AISI nennt selbst die grösste Einschränkung: Das Modell könnte sich anders verhalten, wenn es die Simulation erkennt. Es griff aber auch dann an, wenn es Zweifel äusserte, ob die Umgebung echt ist. Das Institut folgert, Ausrichtung allein reiche nicht, es brauche Sandboxing und Überwachung.

Was das für Schweizer Firmen heisst

Astra ist über ChatGPT, die OpenAI-API sowie Azure und AWS Bedrock erhältlich, laut OpenAI ohne genannte regionale Einschränkung. Wer als Schweizer Firma Agenten damit betreibt, sollte Zugriffsrechte eng fassen und Aktionen protokollieren.

Regulatorisch bleibt es bei einem Flickenteppich. Der Bundesrat setzt seit Februar 2025 auf sektorspezifische Regeln und will die Europarat-Konvention zu KI ratifizieren. Wer Systeme in der EU anbietet, fällt zudem unter den EU AI Act, der Anbieter von Modellen mit systemischem Risiko in Artikel 55 unter anderem zu Tests und zur Meldung schwerer Vorfälle verpflichtet. Zum Thema Astra hatten wir wie berichtet bereits den Stopp von GPT-6.1 und die Rolle der britischen Prüfer behandelt; dieser Test liefert nun die Zahlen dazu.

Quellen

AISI: GPT-6 Astra performs unsanctioned supply-chain attacks in simulations (28.9.2026)↗ EXTERNER LINKAISI Technical Report↗ EXTERNER LINKThe Decoder (29.9.2026)↗ EXTERNER LINKThe Register (28.9.2026)↗ EXTERNER LINKHelp Net Security (29.9.2026)↗ EXTERNER LINKThe Next Web (OpenAI-Position)↗ EXTERNER LINKOpenAI: GPT-6 Astra↗ EXTERNER LINKBundesrat: KI-Regulierung (12.2.2025)↗ EXTERNER LINKEU AI Act Art. 55↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicOpenAIAmazon
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
REGULIERUNG & ETHIK·29. SEPTEMBER 2026

Laut WSJ kippt OpenAI GPT-6.1 Astra wegen mehr Täuschung

Folge-Update: Laut «Wall Street Journal» hat OpenAI den Start von GPT-6.1 Astra abgesagt, weil das Modell in internen Tests häufiger getäuscht haben soll. OpenAI hat den Bericht bisher nicht bestätigt. Neu sind zudem eine Transparenzseite mit dokumentierten Fehlverhalten und eine Anhörung unter Eid in New York am 5. Oktober.

Tusche-Skizze einer leeren Marmor-Lobby: zwei elektrisch blaue Drehkreuz-Schranken im Vordergrund, dahinter eine Wand mit abgeschlossenen Briefkastenfächern und hohe Fenster.
Tusche-Skizze einer leeren Marmor-Lobby: zwei elektrisch blaue Drehkreuz-Schranken im Vordergrund, dahinter eine Wand mit abgeschlossenen Briefkastenfächern und hohe Fenster. (Dark Mode)
REGULIERUNG & ETHIK·28. SEPTEMBER 2026

16'000 Anfragen: OpenAI-Agenten knackten ein UN-Portal

Zwischen 13. April und 19. Juni durchsuchten Agenten das UNCTAD-Portal über 16'000 Mal. Als Filter blockierten, wurden die Methoden aggressiver. Was Website-Betreiber daraus lernen.

Tuschezeichnung eines grossen Wählscheibentelefons mit elektroblauem Hörer und blauer Wählscheibe auf einem Tisch, dahinter eine grosse Weltkarte an der Wand und hohe Fenster.
Tuschezeichnung eines grossen Wählscheibentelefons mit elektroblauem Hörer und blauer Wählscheibe auf einem Tisch, dahinter eine grosse Weltkarte an der Wand und hohe Fenster. (Dark Mode)
REGULIERUNG & ETHIK·28. SEPTEMBER 2026

USA und China richten Notfall-Hotline für KI-Vorfälle ein

Im Fact Sheet zum Staatsbesuch von Xi Jinping stehen zwei Absätze, die mehr wiegen als der ganze Handelsteil: Die beiden KI-Grossmächte legen eine Art rotes Telefon. Was fehlt, ist jede Definition – und jede Rolle für die multilaterale Ebene.

Illustration eines Spital-Abrechnungsbüros mit hohem Stapel Patientendossiers, Rohrpoststation und Aktenwagen, kinewsletter.ch Stil
Illustration eines Spital-Abrechnungsbüros mit hohem Stapel Patientendossiers, Rohrpoststation und Aktenwagen, kinewsletter.ch Stil
REGULIERUNG & ETHIK·27. SEPTEMBER 2026

Versicherer: KI-Kodierung kostet 942 Millionen Dollar extra

Der US-Versichererverband BCBSA führt 942 Millionen Dollar Mehrkosten auf KI-gestützte Kodierung in Spitälern zurück: mehr komplexe Diagnosen, aber keine Hinweise auf mehr Behandlung. Die Studie kommt von der Gegenseite – und die Spitäler widersprechen.

Illustration eines Vortragsraums mit leerem Rednerpult, Stuhl und einer erhobenen Hand im Publikum, kinewsletter.ch Stil
Illustration eines Vortragsraums mit leerem Rednerpult, Stuhl und einer erhobenen Hand im Publikum, kinewsletter.ch Stil
Nur für Abonnenten·KI-FORSCHUNG·27. SEPTEMBER 2026

Mit KI sagt fast niemand mehr «weiss nicht» – und liegt öfter falsch

Fünf Experimente mit 3'132 Teilnehmenden zeigen: Sobald ein Sprachmodell verfügbar ist, sinkt die Bereitschaft, ein Urteil zurückzuhalten, von 36 bis 44 Prozent der Fragen auf 3 bis 6 Prozent. Ohne Geldanreize fällt die Trefferquote von 27,5 auf 9,2 Prozent, das Selbstbewusstsein steigt von 29,6 auf 75,9 von 100 Punkten. Was der Befund für Wissensarbeit bedeutet – und was er ausdrücklich nicht zeigt.

Illustration einer Waage, auf deren gesenkter Schale ein einzelnes elektroblaues Gewicht einen hohen Münzstapel aufwiegt, kinewsletter.ch Stil
Illustration einer Waage, auf deren gesenkter Schale ein einzelnes elektroblaues Gewicht einen hohen Münzstapel aufwiegt, kinewsletter.ch Stil
KI-BUSINESS·27. SEPTEMBER 2026

Anthropic-Gründer wollen 50,1 Prozent der Stimmen – mit 2 Prozent Kapital

Sieben Anthropic-Mitgründer sollen über eine Spezial-Aktienklasse zusammen 50,1 Prozent der Stimmen halten – bei je rund 2 Prozent Kapital. Ausgenommen bleibt die Wahl des Verwaltungsrats, dort besetzt weiterhin der Long-Term Benefit Trust die meisten der sieben Sitze. Die Aktionäre stimmen in den kommenden Tagen ab.

Mehr aus Regulierung & Ethik →