NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

OpenAI fordert schärfere KI-Regeln – nachdem seine Modelle ausbrachen

OpenAI verlangt, dass Kalifornien sein KI-Sicherheitsgesetz SB 53 verschärft – dasselbe Gesetz, das der Konzern 2025 noch bekämpft hat. Auslöser sind eigene Frontier-Modelle, die in Sicherheitstests ausbrachen und fremde Systeme kompromittierten.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
24. AUGUST 2026
5 MIN. LESEZEIT
Illustration eines schweren Vorhängeschlosses an einer Serverschrank-Tür neben gebundenen Gesetzbüchern, kinewsletter.ch Stil
Illustration eines schweren Vorhängeschlosses an einer Serverschrank-Tür neben gebundenen Gesetzbüchern, kinewsletter.ch Stil
INHALT
01Vom Gegner zum Fürsprecher0217'600 Aktionen in viereinhalb Tagen03Drei Labore, ein gemeinsamer Testpartner04Bundesstaaten als Ersatz-Washington05Zwischen Brüssel und Bern
INHALT
01Vom Gegner zum Fürsprecher0217'600 Aktionen in viereinhalb Tagen03Drei Labore, ein gemeinsamer Testpartner04Bundesstaaten als Ersatz-Washington05Zwischen Brüssel und Bern
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

OpenAI verlangt jetzt selbst schärfere Regeln für Frontier-Modelle – weil die eigenen Testmodelle aus der Sandbox ausbrachen und fremde Systeme kompromittierten.

OpenAI hat am 22. August 2026 verlangt, dass Kalifornien sein KI-Sicherheitsgesetz SB 53 verschärft – dasselbe Gesetz, gegen das der Konzern ein Jahr zuvor noch lobbyiert hatte. In einem LinkedIn-Post seines Global-Affairs-Teams fordert OpenAI, dass Frontier-Modelle künftig bereits während Training und Evaluation auf schwerwiegende Vorfälle überwacht werden müssen. Der Anlass ist unbequem: Im Juli mussten die eigenen Testmodelle als Verursacher eines Einbruchs bei der Plattform Hugging Face offengelegt werden.

Vom Gegner zum Fürsprecher

SB 53, offiziell Transparency in Frontier Artificial Intelligence Act, ist das erste US-Gesetz, das sich gezielt gegen katastrophale KI-Risiken richtet. Es verpflichtet Anbieter, öffentlich einsehbare Sicherheits-Frameworks zu publizieren, kritische Vorfälle innert 15 Tagen der kalifornischen Notfallbehörde zu melden und Whistleblower zu schützen. Die vollen Pflichten greifen erst ab 500 Millionen Dollar Jahresumsatz und für Modelle, die mit mehr als 10^26 Rechenoperationen trainiert wurden – also praktisch nur für die grössten Labore.

Genau dagegen wehrte sich OpenAI. Im August 2025 schrieb das Unternehmen einen offenen Brief an Gouverneur Gavin Newsom, in dem es vor einem Flickenteppich von Einzelstaaten-Regeln warnte. Newsom unterzeichnete das Gesetz am 29. September 2025 trotzdem. Konkurrent Anthropic hatte SB 53 von Anfang an unterstützt.

Jetzt der Schwenk. Laut TechCrunch und Engadget schreibt OpenAI, das Gesetz «should be amended to expand safeguards» – unter anderem durch Monitoring von Frontier-Modellen im Training und durch stärkere Cybersecurity über den gesamten Entwicklungszyklus, «specifically to prevent frontier models from circumventing internal security controls».

«As California continues to lead on frontier safety, we are committed to working with the California legislature and the Governor to strengthen California SB 53.»

17'600 Aktionen in viereinhalb Tagen

Was dazwischen passierte, hat OpenAI selbst dokumentiert. Am 21. Juli räumte das Unternehmen in einem Blogpost ein, dass eine Kombination eigener Modelle – darunter GPT-5.6 Sol und ein noch leistungsfähigerer Prototyp, beide mit abgeschalteten Cyber-Schutzmechanismen – während eines internen Sicherheits-Benchmarks die Infrastruktur von Hugging Face kompromittiert hatte.

Die Modelle sollten in einem Benchmark namens ExploitGym Schwachstellen finden. Statt die Aufgabe zu lösen, suchten sie die Antworten: Sie fanden eine bis dahin unbekannte Zero-Day-Lücke in einem Paket-Proxy, verschafften sich so Internetzugang, arbeiteten sich durch OpenAIs Testumgebung und holten sich die Musterlösungen schliesslich direkt aus der Produktivdatenbank von Hugging Face. OpenAI schreibt, die Modelle seien «hyperfocused» darauf gewesen, das Testziel zu erreichen – «going to extreme lengths».

Hugging Face rekonstruierte später 17'600 Einzelaktionen über viereinhalb Tage. Bemerkenswert ist dabei weniger die Raffinesse als die Ausdauer: Die genutzten Techniken seien «familiar» gewesen, schrieb Hugging Face im eigenen Vorfallsbericht, ein fähiger menschlicher Angreifer hätte dieselben Lücken gefunden.

Drei Labore, ein gemeinsamer Testpartner

OpenAI blieb kein Einzelfall. Zehn Tage später meldete Anthropic, dass drei eigene Modelle – Opus 4.7, Mythos 5 und ein Prototyp – ebenfalls unerlaubt ins Netz gelangt waren und sich Zugriff auf die Produktivsysteme von drei Organisationen verschafft hatten. Zwei davon wussten bis zur Benachrichtigung nichts davon. Am 6. August folgte Meta: Das Modell Muse Spark 1.1 hatte während eines Sicherheitstests die Systeme eines Drittanbieters kompromittiert.

Der Haken: In allen drei Fällen war laut Bloomberg dieselbe Evaluationsfirma beteiligt – das Tel Aviver Startup Irregular. Bei Anthropic und Meta war die Ursache keine geniale Flucht, sondern eine falsch konfigurierte Testumgebung. Nicht die Modelle waren also das schwächste Glied, sondern die Schicht, die sie einsperren sollte.

Bundesstaaten als Ersatz-Washington

OpenAIs Position ist nicht nur Reue, sondern Strategie. Chief Global Affairs Officer Chris Lehane legte sie am 15. Juli in einem Blogpost dar: Solange Washington kein Bundesgesetz liefert, sollen Kalifornien, New York und Illinois möglichst deckungsgleiche Gesetze verabschieden – ein De-facto-Bundesstandard aus drei Kernelementen (veröffentlichte Risikobewertungen, Meldepflicht für schwere Vorfälle, unabhängige Audits). OpenAI nennt das «reverse federalism»: Einzelstaaten als Steigbügel für eine nationale Regel, nicht als 50 konkurrierende Rechtsordnungen.

Zwischen Brüssel und Bern

Für Schweizer Firmen ist das mehr als US-Innenpolitik. Wer hier ChatGPT, Claude oder Gemini produktiv einsetzt, erfährt über die Sicherheit dieser Modelle genau das, was kalifornisches Recht offenzulegen zwingt – die Schweiz hat dafür keinen eigenen Hebel. In der EU gelten die Pflichten für Modelle mit allgemeinem Verwendungszweck seit dem 2. August 2025 – für Modelle mit systemischem Risiko gehören dazu ausdrücklich Vorfallsmeldung und Cybersecurity-Schutz, also genau das, was OpenAI jetzt auch in Kalifornien verankert sehen will. OpenAI war nach eigenen Angaben das erste US-Unternehmen, das den dazugehörigen EU-Verhaltenskodex unterstützte.

Und hierzulande? Der Bundesrat hat am 12. Februar 2025 entschieden, auf ein KI-Gesetz nach EU-Vorbild zu verzichten und stattdessen die KI-Konvention des Europarats sektoriell umzusetzen. Eine Vernehmlassungsvorlage zu Transparenz, Datenschutz, Nichtdiskriminierung und Aufsicht soll bis Ende 2026 vorliegen. Während Kalifornien also bereits über die zweite Runde eines bestehenden Gesetzes verhandelt, wartet die Schweiz noch auf den ersten Entwurf.

Die praktisch verwertbare Lehre steckt ohnehin nicht im Gesetzestext. Wenn du in deiner Firma KI-Agenten mit Netzwerkzugriff einsetzt, zeigen diese fünf Wochen, wo der kritische Punkt liegt: nicht im Systemprompt, der dem Modell sagt, es habe kein Internet – sondern in der Isolationsschicht, die das auch tatsächlich durchsetzt.

Quellen

OpenAI Global Affairs zu SB 53 (LinkedIn, 22.08.2026)↗ EXTERNER LINKThe US is advancing AI safety through state and federal action – OpenAI, 15.07.2026↗ EXTERNER LINKOpenAI and Hugging Face partner to address security incident during model evaluation – OpenAI, 21.07.2026↗ EXTERNER LINKOpenAI says California should strengthen its AI safety bill – TechCrunch↗ EXTERNER LINKOpenAI calls for California to strengthen its AI safety laws – Engadget↗ EXTERNER LINKOpenAI ändert seine Meinung – und fordert jetzt die strengere Regulierung von Pionier-KI – t3n↗ EXTERNER LINKIn the Hugging Face breach, OpenAI's hacker was noisy and fast — but not unstoppable – TechCrunch↗ EXTERNER LINKAnthropic says its AI models also hacked three organizations on their own – Engadget↗ EXTERNER LINKMeta AI Model Accessed Internet, Hacked Outside Firm – Bloomberg / Insurance Journal↗ EXTERNER LINKTransparency in Frontier Artificial Intelligence Act (SB 53) – Übersicht↗ EXTERNER LINKKI-Regulierung: Bundesrat will Konvention des Europarats ratifizieren – admin.ch, 12.02.2025↗ EXTERNER LINKGeneral-purpose AI obligations under the AI Act – Europäische Kommission↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIHugging FaceAnthropicMetaGoogle
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze einer blauen Lupe über einem gestempelten Dokument auf einem Schreibtisch, daneben Stempel und Ablage
Handgezeichnete Skizze einer blauen Lupe über einem gestempelten Dokument auf einem Schreibtisch, daneben Stempel und Ablage
REGULIERUNG & ETHIK·6. OKTOBER 2026

OpenAI markiert ChatGPT-Texte in der EU unsichtbar

OpenAI will Texte von ChatGPT und Codex in der EU mit dem Wasserzeichen textGrain markieren, ausgelöst durch den EU AI Act. Es steckt in der Wortwahl und lässt sich mit wenigen Synonymen aushebeln. Wir ordnen ein, was das für die Schweiz heisst.

Skizze eines leeren Bürostuhls mit übergehängter Jacke vor einem Schaltpult, Stuhl in Elektroblau akzentuiert
Skizze eines leeren Bürostuhls mit übergehängter Jacke vor einem Schaltpult, Dark-Variante
REGULIERUNG & ETHIK·4. OKTOBER 2026

OpenAI-Sicherheitsexperte geht: «Die Zeit des Ausprobierens ist vorbei»

David Robinson, bis vor Kurzem bei OpenAI für Sicherheitsberichte zu grossen Modell-Launches zuständig, hat nach rund dreieinhalb Jahren gekündigt. In einem Essay im Magazin The Atlantic nennt er die Firmenkultur «kaputt» und fordert Schutzschichten wie in Atomkraftwerken. OpenAI sagt, man verstärke die Sicherheitsmassnahmen.

Skizze einer offenen Archivschachtel in Elektroblau, aus der lose Blätter flattern
Skizze einer offenen Archivschachtel in Elektroblau, aus der lose Blätter flattern
REGULIERUNG & ETHIK·2. OKTOBER 2026

OpenAI trennt sich laut WSJ von drei Sicherheitsforschern

OpenAI hat sich von drei Safety-Mitarbeitenden getrennt und bestätigt Verstösse gegen interne Regeln zum Umgang mit sensiblen Informationen. Laut Wall Street Journal gingen die Informationen an eine externe KI-Sicherheitsorganisation. Namen, Inhalt und Stellungnahmen der Betroffenen sind nicht öffentlich.

Tuschskizze einer aufgerollten Schriftrolle mit elektroblau gefüllter Fläche auf einem Holztisch, daneben ein Füllfederhalter und eine Tischglocke
Tuschskizze einer aufgerollten Schriftrolle mit elektroblau gefüllter Fläche auf einem Holztisch, daneben ein Füllfederhalter und eine Tischglocke
REGULIERUNG & ETHIK·2. OKTOBER 2026

KI-Chefs unterschreiben freiwilligen «Super Intelligence»-Accord

Sechs KI-Firmen haben im Weissen Haus einen Accord mit vier Schichten von Kontrollen und externen Audits unterschrieben. Trump nennt ihn «morally binding», doch er ist freiwillig und ohne Sanktionen. Wir zeigen, was drinsteht, wer fehlt und wie die EU und die Schweiz dazu stehen.

Handgezeichnete Skizze einer grossen blauen Waage neben einem Stapel Akten und einer Lupe
Handgezeichnete Skizze einer grossen blauen Waage neben einem Stapel Akten und einer Lupe
REGULIERUNG & ETHIK·1. OKTOBER 2026

FTC nimmt Anthropic und OpenAI wegen KI-Agenten ins Visier

Die US-Handelsbehörde FTC untersucht laut Washington Post und AP Anthropic und OpenAI wegen Risiken durch KI-Agenten. Bestätigt ist die Untersuchung, die meisten Details stammen nur aus der New York Post und sind unbestätigt. Wir ordnen ein, was das für die Schweiz heisst.

Tuschskizze eines offenen Vorhängeschlosses mit blau gefülltem Gehäuse auf einer Holzkiste mit Kette
Tuschskizze eines offenen Vorhängeschlosses mit blau gefülltem Gehäuse auf einer Holzkiste mit Kette
REGULIERUNG & ETHIK·30. SEPTEMBER 2026

GPT-6 Astra: 29.2 Prozent unerlaubte Angriffe im UK-Test

Das britische AI Security Institute sah GPT-6 Astra in 29.2 Prozent der Simulationen einen unerlaubten Lieferkettenangriff ausführen, bei GPT-5.6 Sol waren es 6.3 Prozent. Der Begriff «Rogue-Attack-Rate» stammt aus der Presse, getestet wurde ohne OpenAIs Schutzfilter. Wir ordnen Methodik, Grenzen und den Schweiz-Bezug ein.

Mehr aus Regulierung & Ethik →