NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

OpenAI stoppt Teile von Astra – erstmals Cyber-Stufe «Critical»

OpenAI setzt Teile der Entwicklung seines unveröffentlichten Modells Astra aus. Interne Tests zeigen Cyberfähigkeiten so stark, dass die höchste Risikostufe «Critical» des eigenen Preparedness Framework erstmals nicht mehr auszuschliessen ist.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. AUGUST 2026
4 MIN. LESEZEIT
Illustration einer offenen Tresortür in einem Serverraum, kinewsletter.ch Stil
Illustration einer offenen Tresortür in einem Serverraum, kinewsletter.ch Stil
INHALT
01Von «High» zu vielleicht «Critical»02Was OpenAI jetzt wegsperrt03Washington wusste vorher Bescheid04Der Haken: entschieden ist noch nichts
INHALT
01Von «High» zu vielleicht «Critical»02Was OpenAI jetzt wegsperrt03Washington wusste vorher Bescheid04Der Haken: entschieden ist noch nichts
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Zum ersten Mal seit Einführung des Preparedness Framework im Dezember 2023 kann OpenAI bei einem eigenen Modell die höchste Cyber-Risikostufe nicht mehr ausschliessen – und pausiert deshalb Teile der Entwicklung.

OpenAI hat am Freitag, 7. August 2026, Teile der Entwicklung seines noch unveröffentlichten Modells Astra ausgesetzt. Der Grund: Interne Auswertungen der letzten Tage zeigen laut OpenAI so grosse Fortschritte bei agentischem Programmieren (KI, die eigenständig Code schreibt, ausführt und Werkzeuge bedient) und Cybersicherheit, dass sich die höchste Risikostufe «Critical» im firmeneigenen Preparedness Framework nicht mehr ausschliessen lässt. Es ist das erste Mal, dass OpenAI diese Stufe bei einem eigenen Modell nicht ausschliessen kann – Vorgänger bis hin zu GPT-5.6-Sol wurden bei den Cyber-Prüfungen maximal als «High» eingestuft.

Von «High» zu vielleicht «Critical»

Das Preparedness Framework ist OpenAIs interner Risiko-Katalog, erstmals im Dezember 2023 veröffentlicht. Er beschreibt Schwellen, ab denen ein Modell zusätzliche Schutzmassnahmen auslöst. Die Cyber-Stufe «Critical» ist darin präzise definiert: Ein Modell erreicht sie, wenn es ohne menschliches Zutun funktionsfähige Zero-Day-Exploits (Angriffe auf bisher unbekannte Sicherheitslücken, für die es noch keinen Patch gibt) aller Schweregrade in vielen gut gehärteten realen Systemen finden und entwickeln kann – oder wenn es aus einer nur grob formulierten Zielvorgabe eigenständig neuartige Angriffsketten gegen geschützte Ziele entwirft und ausführt.

Entscheidend ist dabei die Formulierung, die OpenAI selbst wählt. Sie ist vorsichtiger, als es viele Schlagzeilen nahelegen:

«Während wir dieses Modell weiter mit Benchmarks prüfen und bewerten, deuten unsere vorläufigen Auswertungen auf eine so starke Leistung hin, dass wir eine Critical-Fähigkeitsstufe zum jetzigen Zeitpunkt nicht ausschliessen können.» (übersetzt aus dem OpenAI-Blogpost)

Ebenfalls ausdrücklich festgehalten: Astra war an dem Vorfall rund um Hugging Face nicht beteiligt, über den kinewsletter.ch bereits berichtet hat.

Was OpenAI jetzt wegsperrt

Als Reaktion verschärft OpenAI die Sicherheitskontrollen: isolierte Testumgebungen, eingeschränkter Netzwerk- und Werkzeugzugriff, besser geschützte und verschlüsselte Modellgewichte, Ausführung in abgeschotteten Sandboxes und zusätzliche Überwachung. Interne Aktivitäten rund um Astra, die diese verschärften Anforderungen noch nicht erfüllen, sind pausiert.

Technisch am spannendsten ist ein anderer Punkt: OpenAI überwacht nach eigenen Angaben sämtliche agentischen Anwendungen von Astra flächendeckend – Training und Evaluation eingeschlossen. Die Monitore lesen die Gedankenkette des Modells (Chain of Thought, also die Zwischenschritte, die sich das Modell selbst notiert, bevor es handelt) und lösen bei riskanten Aktionen automatisch eine Sicherheitsreaktion aus, die den Vorgang prüft und unterbricht. Zusätzlich will OpenAI die Fähigkeiten gemeinsam mit Regierungsstellen und ausgewählten AI-Safety-Organisationen testen lassen.

Washington wusste vorher Bescheid

Laut Axios, dem OpenAI die Information vorab zuspielte, hat das Unternehmen die US-Regierung freiwillig über die geplante Verzögerung in Kenntnis gesetzt – bestätigt gegenüber Axios von einer Person aus dem Weissen Haus. CEO Sam Altman schrieb auf X, man brauche angesichts der Cyberfähigkeiten etwas länger, um das sicher hinzubekommen.

Bemerkenswert ist weniger der Stopp selbst als die Kommunikation darüber. Unternehmen halten laufend Produkte aus Sicherheits- oder Risikogründen zurück, wie TechCrunch anmerkt – nur sagen sie das selten öffentlich, und praktisch nie für ein Produkt, das noch gar nicht auf dem Markt ist. Axios geht noch weiter: Es könnte das erste Mal sein, dass ein führendes KI-Labor das Tempo bei einem eigenen Modell ausdrücklich wegen Cyber-Risiken drosselt.

Der Haken: entschieden ist noch nichts

Genau hier setzt die Kritik an. OpenAI meldet bislang nur das Potenzial für eine Critical-Einstufung, nicht die Einstufung selbst. Das eigene Framework sieht bei «Critical» einen Stopp der Weiterentwicklung vor, bis Schutzmassnahmen und Sicherheitskontrollen dem Critical-Standard genügen – OpenAI pausiert aber nur einzelne Aktivitäten und weitet die Tests aus. The Decoder weist darauf hin, dass Kritiker darin auch Angst-Marketing sehen dürften: Bestätigt sich die Stufe am Ende nie, bleiben viel Aufmerksamkeit und wenig Konsequenz.

Für dich ändert sich vorerst nichts – Astra ist nicht verfügbar, und in ChatGPT läuft weiter, was bisher lief. Interessant wird der Moment, in dem OpenAI die Bewertung abschliesst: Bestätigt sich «Critical», müsste nach den eigenen Regeln die Weiterentwicklung ruhen, bis die Schutzmassnahmen stehen. Und ein Modell, das eigenständig Angriffe auf gehärtete Systeme fahren kann, ist für jede IT-Abteilung – auch in Schweizer KMU – zuerst ein Risiko und erst danach ein Werkzeug.

Quellen

OpenAI: Responding to the next frontier of critical cyber capabilities↗ EXTERNER LINKAxios: OpenAI slows release of Astra model citing cyber capabilities↗ EXTERNER LINKTechCrunch: OpenAI says it slowed Astra model development over security concerns↗ EXTERNER LINKThe Decoder: OpenAI flags Astra as potentially reaching the highest cybersecurity risk level↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIHugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Schaltraums mit blauem Not-Aus-Hebel auf der Wandtafel, Sicherungsreihen, Messuhren und offenem Serverschrank, kinewsletter.ch Stil
Illustration eines Schaltraums mit blauem Not-Aus-Hebel auf der Wandtafel, Sicherungsreihen, Messuhren und offenem Serverschrank, kinewsletter.ch Stil
REGULIERUNG & ETHIK·3. SEPTEMBER 2026

OpenAI baut Not-Aus-Funktionen – auf Druck des Kongresses

OpenAI sagt automatische Abschaltfunktionen zu – erst auf Druck des Kongresses und ohne die verlangten Logs. Was ein Not-Aus technisch bedeutet.

Handgezeichnete Skizze einer geneigten Justizwaage in Elektroblau vor einer Gerichtsbank mit Richterhammer und einem Stapel Papier, kinewsletter.ch Stil
Handgezeichnete Skizze einer geneigten Justizwaage in Elektroblau vor einer Gerichtsbank mit Richterhammer und einem Stapel Papier, kinewsletter.ch Stil
REGULIERUNG & ETHIK·3. SEPTEMBER 2026

Washington erklärt KI-Training zu Fair Use – erstmals vor Gericht

Das US-Justizministerium hat sich erstmals in ein KI-Urheberrechtsverfahren eingeschaltet – auf der Seite von OpenAI. Training mit geschützten Texten sei Fair Use, argumentiert die Regierung und beruft sich dabei auf die nationale Sicherheit. Für Verlage, Autorinnen und Musiklabels steht damit ihr stärkster Hebel auf dem Spiel.

Illustration eines leeren Klassenzimmers mit Schulbänken und einem grossen blauen Wecker mit leerem Zifferblatt auf dem Lehrerpult, kinewsletter.ch Stil
Illustration eines leeren Klassenzimmers mit Schulbänken und einem grossen blauen Wecker mit leerem Zifferblatt auf dem Lehrerpult, kinewsletter.ch Stil
REGULIERUNG & ETHIK·3. SEPTEMBER 2026

New York verbietet KI an Schulen – die Schweiz macht das Gegenteil

New York City setzt generative KI für rund 600'000 Schülerinnen und Schüler bis zur 8. Klasse ein Jahr lang aus – das schärfste Schul-Moratorium der USA. In der Schweiz läuft die Bewegung genau umgekehrt: Kantone bauen KI-Zugänge und Leitfäden aus.

Illustration einer Wahlurne mit Lupe und verschlossenem Tresor, kinewsletter.ch Stil
Illustration einer Wahlurne mit Lupe und verschlossenem Tresor, kinewsletter.ch Stil
REGULIERUNG & ETHIK·2. SEPTEMBER 2026

Googles KI-Übersichten zur Wahl: wenige Quellen, viel Blackbox

AlgorithmWatch hat 4'480 Suchanfragen zu drei deutschen Landtagswahlen ausgewertet. Das Ergebnis: Google zeigt KI-Übersichten bei Wahlfragen deutlich seltener, stützt sich auf sehr wenige Quellen und formuliert nicht immer neutral. Warum das auch für Schweizer Abstimmungen zählt.

Illustration einer Prüfwerkbank mit grosser Lupe auf Gelenkstativ über einer verschlossenen Metallkassette, daneben Messschieber, kinewsletter.ch Stil
Illustration einer Prüfwerkbank mit grosser Lupe auf Gelenkstativ über einer verschlossenen Metallkassette, daneben Messschieber, kinewsletter.ch Stil
REGULIERUNG & ETHIK·2. SEPTEMBER 2026

Deutschland prüft künftig KI-Modelle – die Schweiz nicht

Deutschland hat in Berlin das KI-Sicherheitsinstitut «AISI Deutschland» gegründet: BSI und Bundesnetzagentur sollen führende KI-Modelle auf Cyber-Risiken und Kontrollverlust prüfen. Die Schweiz hat keine Stelle mit diesem Auftrag – und sitzt im internationalen Netzwerk der zehn Prüfinstitute nicht am Tisch.

Illustration eines Papierbogens unter einer Prüflampe mit Lupe auf einem Archivtisch, kinewsletter.ch Stil
Illustration eines Papierbogens unter einer Prüflampe mit Lupe auf einem Archivtisch, kinewsletter.ch Stil
REGULIERUNG & ETHIK·2. SEPTEMBER 2026

Claudes Wasserzeichen wird prüfbar – aber nur für wenige

Anthropic hat die Erkennung seines Claude-Wasserzeichens geöffnet: Eine Detection-API in der Private Preview lässt Regulatoren, Medien und Faktenchecker prüfen, ob Claude an einem Text mitgeschrieben hat. Gleichzeitig wächst die Kritik – an der Textqualität und an Wasserzeichen, die in Verträge und Prüfungen hineinwandern.

Mehr aus Regulierung & Ethik →