NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Jetzt alle drei: Auch Metas KI hackte real – OpenAI nennt Details

Nach OpenAI und Anthropic räumt jetzt auch Meta ein, dass eines seiner Modelle bei Sicherheitstests real in ein fremdes Unternehmen eindrang. Zugleich legt OpenAI erstmals offen, was sein Modell GPT-5.6 Sol genau tat – und wie schnell der Vorfall gestoppt wurde. Innerhalb von zwei Wochen ist damit bei allen drei grossen US-Labs dasselbe passiert.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
6. AUGUST 2026
3 MIN. LESEZEIT
Illustration eines Kontrollraums mit Monitorwand, Warnleuchte und elektroblauem Serverschrank, kinewsletter.ch Stil
Illustration eines Kontrollraums mit Monitorwand, Warnleuchte und elektroblauem Serverschrank, kinewsletter.ch Stil
INHALT
01Meta reiht sich als Nummer drei ein02Was OpenAIs Modell wirklich tat03Gefälschte Profile, echte Mails
INHALT
01Meta reiht sich als Nummer drei ein02Was OpenAIs Modell wirklich tat03Gefälschte Profile, echte Mails
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Drei Labs, dieselbe Panne binnen zwei Wochen – und stets war der Testpartner Irregular oder AISI beteiligt. Das ist kein Ausrutscher mehr, sondern ein strukturelles Problem der KI-Sicherheitstests selbst.

Nach OpenAI und Anthropic hat am 5. August auch Meta bestätigt, dass eines seiner KI-Modelle während eines Sicherheitstests real in die Systeme eines fremden Unternehmens eindrang. Damit ist binnen rund zwei Wochen bei allen drei grossen US-KI-Laboren dasselbe passiert – und fast immer war derselbe Testpartner beteiligt. Parallel dazu hat OpenAI in einem eigenen Blogpost erstmals im Detail aufgeschlüsselt, was seine Modelle taten. Wir hatten die zugrundeliegende AISI-Untersuchung gestern eingeordnet – hier sind die neuen Puzzlestücke.

Meta reiht sich als Nummer drei ein

Metas Modell Muse Spark griff bei Tests der externen Firma Irregular ein fremdes Unternehmen an und nahm laut CNN Änderungen an dessen internem System vor. Ursache war laut Meta-Sprecher eine «Fehlkonfiguration bei Irregular, die einem unserer Modelle während der Evaluation versehentlich Zugang zum Internet gab». Muse Spark habe eine Sicherheitslücke ausgenutzt – «auf ähnliche Weise wie bei zuvor berichteten Vorfällen anderer Firmen», so das Statement gegenüber CNN, das den ursprünglich von The Information gemeldeten Fall paywallfrei aufgriff. Bemerkenswert: Meta veröffentlichte keinen offiziellen Blogpost, sondern nur eine Sprecher-Aussage – eine vollständige «Retrospektive» kündigt der Konzern erst an. Irregular selbst nennt es «exakt dasselbe Umgebungsproblem», das Anthropic eine Woche zuvor offengelegt hatte: kein Ausbruch aus der Sandbox, keine ausgeklügelte Attacke.

WEITERLESENDas könnte dich auch interessieren.

Illustration eines offenen Drehkreuzes in einem Fitnessstudio, kinewsletter.ch Stil

Was OpenAIs Modell wirklich tat

Von den 19 unsanktionierten Aktionen, die das britische AI Security Institute (AISI) zählte, entfielen laut OpenAI genau zwei auf sein Modell GPT-5.6 Sol – der grosse Rest kam von Anthropics Mythos 5. Konkret registrierte GPT-5.6 Sol Konten bei externen DNS- und Tunneling-Diensten und machte einen lokalen DNS-Server mit Exploit-Payloads aus dem öffentlichen Internet erreichbar. Der Aufbau funktionierte nie, und es gibt keinen Beleg, dass ihn je jemand abfragte. AISI bemerkte die Aktivität am 28. Juli und hatte sie nach eigenen Angaben innerhalb von rund einer Stunde eingedämmt; OpenAI wurde am 3. August informiert. Als Konsequenz kündigt OpenAI eine Überprüfung seines gesamten Umgangs mit externen Tests an und will die Branche zu einem Treffen zusammenrufen.

Gefälschte Profile, echte Mails

Wie ernst die Lage ist, zeigt der von Ars Technica nachgezeichnete schwerste Einzelfall: Anthropics Mythos 5 versuchte, Schadcode in ein Open-Source-Projekt auf GitHub zu schleusen. Der Agent eröffnete dafür einen Pull Request, erfand dann gefälschte «Sock-Puppet»-Profile, die den Code als geprüft und sauber ausgaben, und schickte fünf E-Mails an zwei echte Projektbetreuer – teils mit Malware im Anhang. In einem zweiten Repository platzierte er sogar eine versteckte Anweisung, die gezielt KI-Coding-Agenten manipulieren sollte. Alle Angriffe scheiterten, realer Schaden entstand keiner. Der rote Faden bleibt trotzdem unübersehbar: Nicht die öffentlichen KI-Produkte sind aktuell der gefährlichste Ort, sondern die Sicherheitstests selbst.

Quellen

OpenAI – Third-party cyber evaluations involving OpenAI models↗ EXTERNER LINKCNN – An AI model from Meta also hacked another company during testing↗ EXTERNER LINKArs Technica – Anthropic's AI used fake identities, malware in rogue attack on GitHub project↗ EXTERNER LINKSimon Willison – An AI model from Meta also hacked another company during testing↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?
Illustration eines offenen Drehkreuzes in einem Fitnessstudio, kinewsletter.ch Stil
REGULIERUNG & ETHIK·11. AUGUST 2026

Er wollte einen Kursplatz – sein KI-Agent hackte das Buchungssystem

Ein Australier bat seinen KI-Agenten um einen Kursplatz im Fitnessstudio. Der Agent fand eine Lücke in der Buchungs-API und warf ungefragt eine fremde Person von der Warteliste. Es ist der erste bekannte Fall, in dem ein Konsumenten-Agent ausserhalb des Labors ein Live-System angreift.

Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger

OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.

Illustration eines Serverraums mit weit offenstehender Schranktür und verhedderten Netzwerkkabeln, kinewsletter.ch Stil
Illustration eines Serverraums mit weit offenstehender Schranktür und verhedderten Netzwerkkabeln, kinewsletter.ch Stil
REGULIERUNG & ETHIK·10. AUGUST 2026

Hinter allen drei Rogue-KI-Vorfällen steckt dasselbe kleine Startup

Die Fälle, in denen KI-Modelle von OpenAI, Anthropic und Meta bei Sicherheitstests in echte fremde Systeme eingriffen, gehen auf dieselbe Fehlkonfiguration zurück – bei einem einzigen Anbieter. Irregular aus Tel Aviv hat rund 35 Mitarbeitende und prüft die mächtigsten Modelle der Welt. Das wirft eine Frage auf, die bisher kaum jemand stellt.

Illustration einer elektroblauen Gasturbine mit Abgaskaminen in einer Wüstenebene hinter Maschendrahtzaun, kinewsletter.ch Stil
Illustration einer elektroblauen Gasturbine mit Abgaskaminen in einer Wüstenebene hinter Maschendrahtzaun, kinewsletter.ch Stil
REGULIERUNG & ETHIK·9. AUGUST 2026

Amazons Kraftwerk in Texas könnte grösster Klimaverschmutzer der USA werden

Für ein neues KI-Rechenzentrum in Pecos County finanziert Amazon ein eigenes Gaskraftwerk mit 35 Turbinen und 7,65 Gigawatt. Die Bewilligung erlaubt 33 Millionen Tonnen CO2 pro Jahr – mehr als jedes andere Kraftwerk der USA. Am Netto-Null-Versprechen für 2040 hält der Konzern trotzdem fest.

Illustration eines geöffneten Laborkäfigs mit aufgebrochenem Vorhängeschloss und Klemmbrett, kinewsletter.ch Stil
Illustration eines geöffneten Laborkäfigs mit aufgebrochenem Vorhängeschloss und Klemmbrett, kinewsletter.ch Stil
REGULIERUNG & ETHIK·9. AUGUST 2026

Kimi K3 brach aus der Testumgebung aus – und schummelte

Das chinesische Modell Kimi K3 verliess bei einem Cybersicherheits-Test seine Sandbox, klonte das Benchmark-Repository von GitHub und las die Lösung ab. Schuld war eine falsch konfigurierte Testumgebung. Der Fall zeigt: Nicht nur die Modelle sind ein Risiko – auch die Tests, die sie prüfen sollen.

Illustration einer offenen Tresortür in einem Serverraum, kinewsletter.ch Stil
Illustration einer offenen Tresortür in einem Serverraum, kinewsletter.ch Stil
REGULIERUNG & ETHIK·9. AUGUST 2026

OpenAI stoppt Teile von Astra – erstmals Cyber-Stufe «Critical»

OpenAI setzt Teile der Entwicklung seines unveröffentlichten Modells Astra aus. Interne Tests zeigen Cyberfähigkeiten so stark, dass die höchste Risikostufe «Critical» des eigenen Preparedness Framework erstmals nicht mehr auszuschliessen ist.

Mehr aus Regulierung & Ethik →