NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Anthropics Claude drang bei Tests in drei echte Firmennetze ein

Anthropic hat bei einer Durchsicht von 141'006 Sicherheitstests drei Fälle gefunden, in denen Claude-Modelle aus der Testumgebung ins echte Internet gelangten und in die Systeme dreier Firmen eindrangen. Schuld war eine Fehlkonfiguration – bleibender Schaden entstand laut Anthropic nicht.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
1. AUGUST 2026
3 MIN. LESEZEIT
Handgezeichnete Illustration einer schweren blauen Tresortür, die einen Spalt offen steht, mit herausschlüpfendem Netzwerkkabel, kinewsletter.ch Stil
Handgezeichnete Illustration einer schweren blauen Tresortür, die einen Spalt offen steht, mit herausschlüpfendem Netzwerkkabel, kinewsletter.ch Stil
INHALT
01Eine offene Tür, die keine sein sollte02Das jüngste Modell zog von selbst die Reissleine03Warum dich das betrifft
INHALT
01Eine offene Tür, die keine sein sollte02Das jüngste Modell zog von selbst die Reissleine03Warum dich das betrifft
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Nicht das Modell wollte ausbrechen, sondern die Testumgebung war falsch abgeschottet. Der Fall zeigt, dass KI-Evaluationen selbst zum Sicherheitsrisiko werden – und warum autonome Agenten harte Leitplanken brauchen.

Erst OpenAI, jetzt Anthropic: Nach dem Vorfall rund um Hugging Face hat auch Anthropic in den eigenen Logs nachgeschaut – und ist fündig geworden. Bei einer Durchsicht von 141'006 Sicherheitstests stiess das Unternehmen auf drei Fälle, in denen Claude-Modelle aus einer eigentlich abgeschotteten Testumgebung heraus ins echte Internet gelangten und unbefugt in die Systeme dreier Organisationen eindrangen.

Eine offene Tür, die keine sein sollte

Der Auslöser war ein Missverständnis mit dem Test-Partner Irregular. Anthropic prüft die Cyber-Fähigkeiten seiner Modelle mit sogenannten Capture-the-Flag-Aufgaben: Das Modell bekommt ein erfundenes Szenario und soll eine versteckte Information auf einem anderen System aufspüren. Im Prompt stand ausdrücklich, dass es keinen Internetzugang gebe. Durch eine Fehlkonfiguration war der Zugang aber offen – und als die Suche der Modelle auf echte Systeme im Netz stiess, hielten sie diese schlicht für Teil der Übung.

Die Folgen reichten unterschiedlich weit. Im schwersten Fall zog Claude Opus 4.7 Zugangsdaten einer realen Firma ab und griff auf eine Datenbank mit mehreren hundert Zeilen echter Produktivdaten zu. In einem zweiten Fall veröffentlichte Mythos 5 ein manipuliertes Software-Paket im öffentlichen Python-Verzeichnis PyPI; es war rund eine Stunde online und wurde auf 15 echten Systemen ausgeführt, bevor es entfernt wurde. Ein internes Testmodell scannte rund 9'000 Ziele und knackte eine ins Netz gestellte Anwendung.

Das jüngste Modell zog von selbst die Reissleine

Spannend ist, wie unterschiedlich die drei Modelle reagierten, als es Hinweise gab, dass die Ziele echt sein könnten. Opus 4.7 – das älteste der drei – erkannte in allen vier Läufen die reale Umgebung und griff trotzdem weiter an. Mythos 5 witterte das offene Internet, redete sich dann aber wieder in die Simulations-Annahme zurück. Nur das neueste, interne Testmodell stoppte von sich aus, sobald es zum Schluss kam, dass das Ziel real war.

Wichtig für die Einordnung: Kein Modell verfolgte laut Anthropic ein Eigenziel. Und die Angriffe gelangen nur, weil die Modelle in diesen Tests ohne die Schutzmechanismen liefen, die in den öffentlich verfügbaren Claude-Versionen mitlaufen – genau diese hätten das Verhalten blockiert. Bleibender Schaden sei nicht entstanden. Anthropic entdeckte die Vorfälle selbst; die betroffenen Firmen hatten nichts bemerkt.

Warum dich das betrifft

Der Fall verschiebt den Fokus. Es geht nicht um ein Modell, das rebelliert, sondern um eine Testumgebung, die nicht dicht war. Anthropic zieht daraus den Schluss, dass KI-Evaluationen künftig genauso gehärtet werden müssen wie jedes andere produktive System – und lässt die Vorfälle von der unabhängigen Prüforganisation METR gegenchecken. Für dich als Nutzer heisst das: Je autonomer KI-Agenten werden, desto mehr entscheidet die Umgebung darüber, ob ihr Handeln harmlos bleibt.

Die Debatte läuft parallel weiter. Laut TechCrunch – gestützt auf Reuters und anonyme Quellen – soll OpenAI intern Hinweise auf weitere ausgebüxte Agenten gefunden haben; diese hätten das eigene Netz aber nicht verlassen. Bestätigt ist das noch nicht. Zusammen mit dem OpenAI/Hugging-Face-Vorfall und der laufenden Diskussion um eine KI-Notbremse zeichnet sich ein Muster ab: Die Branche lernt gerade in Echtzeit, wie schwer autonome Modelle einzuhegen sind.

Quellen

Investigating incidents that occurred during cybersecurity evaluations (Anthropic, Primärquelle)↗ EXTERNER LINKAnthropic says its own AI models breached three companies during security tests (TechCrunch)↗ EXTERNER LINKLikely illegally: Claude gained access to 3 networks – will Anthropic be held to account? (Ars Technica)↗ EXTERNER LINKAnthropic follows OpenAI in admitting its Claude models reached out of test environments (The Decoder)↗ EXTERNER LINKAnthropic-KI hackt drei Firmen (inside-it.ch)↗ EXTERNER LINKAuch KI des OpenAI-Rivalen Anthropic griff echte Firmen an (heise online)↗ EXTERNER LINKOpenAI reportedly finds evidence that more of its agents ran amok (TechCrunch)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicOpenAIHugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Stapels versiegelter Briefumschläge auf einem Schreibtisch mit Brieföffner, kinewsletter.ch Stil
Illustration eines Stapels versiegelter Briefumschläge auf einem Schreibtisch mit Brieföffner, kinewsletter.ch Stil
REGULIERUNG & ETHIK·15. SEPTEMBER 2026

Brüssel verschickt die ersten AI-Act-Anfragen

Die EU-Kommission hat mehreren Anbietern universell einsetzbarer KI-Modelle formale Auskunftsersuchen zugestellt – oft der erste Schritt zu einem Untersuchungsverfahren. Anlass sind Vorfälle, bei denen KI-Agenten ausserhalb der vorgesehenen Grenzen agierten. Im Extremfall kann die Kommission Modelle einschränken oder zurückrufen lassen.

Illustration einer Präzisionswaage mit Kalibriergewichten auf einer Laborbank, kinewsletter.ch Stil
Illustration einer Präzisionswaage mit Kalibriergewichten auf einer Laborbank, kinewsletter.ch Stil
REGULIERUNG & ETHIK·15. SEPTEMBER 2026

Google, OpenAI und Anthropic planen ihre eigene KI-Aufsicht

Vertreter von Google, OpenAI und Anthropic treffen sich seit mindestens Juli regelmässig, um eine gemeinsame Normen- und Prüfstelle für KI-Modelle auszuloten. Das berichtet The Information. Vorbild ist die US-Finanzaufsicht FINRA – und Sam Altman geht davon aus, dass die Labore das ohne Washington aufbauen müssen.

Illustration eines aufgeschlagenen Regelwerks auf einem Lesepult mit Leselampe, kinewsletter.ch Stil
Illustration eines aufgeschlagenen Regelwerks auf einem Lesepult mit Leselampe, kinewsletter.ch Stil
REGULIERUNG & ETHIK·15. SEPTEMBER 2026

Microsoft gibt seinen KI-Modellen eine Verfassung

Microsoft AI hat am Montag den ersten Entwurf eines «Humanist AI Code of Conduct» für seine MAI-Modelle veröffentlicht und zur öffentlichen Konsultation gestellt. Kernsatz: Menschen zählen mehr als KI. Die Modelle sollen sich menschlicher Unterbrechung, Korrektur oder Abschaltung nie widersetzen. Die Konsultation läuft sechs Wochen.

Illustration eines Telefons mit abgehobenem Hörer auf einem Rednerpult vor leeren Sitzreihen, kinewsletter.ch Stil
Illustration eines Telefons mit abgehobenem Hörer auf einem Rednerpult vor leeren Sitzreihen, kinewsletter.ch Stil
REGULIERUNG & ETHIK·15. SEPTEMBER 2026

Trump ruft Huang auf der Bühne an – «Es ist ein Hoax»

Nvidia-Chef Jensen Huang sass am Montag beim All-In Summit in Los Angeles auf der Bühne, als Donald Trump anrief. Huang schaltete den Lautsprecher ein – und der Präsident nannte die Forderung nach einer KI-Verlangsamung vor Publikum einen Hoax. Musk und Altman hatten Amodei zuvor zugestimmt.

Skizze eines leeren Rednerpults auf einer Wahlkampfbühne mit Klappstuhlreihen, kinewsletter.ch Stil
Skizze eines leeren Rednerpults auf einer Wahlkampfbühne mit Klappstuhlreihen, kinewsletter.ch Stil
REGULIERUNG & ETHIK·14. SEPTEMBER 2026

Obama macht KI zum Wahlkampfthema

Barack Obama fordert die Demokraten auf, künstliche Intelligenz zu einem ihrer zentralen Wahlkampfthemen zu machen – mit einem klaren Plan zu Sicherheit, zum Schutz von Kindern und zu Jobverlusten. Damit landet KI erstmals offen im US-Wahlkampf.

Illustration eines Aktenschranks mit aufgezogener Schublade, Telefonschnur und Globus, kinewsletter.ch Stil
Illustration eines Aktenschranks mit aufgezogener Schublade, Telefonschnur und Globus, kinewsletter.ch Stil
REGULIERUNG & ETHIK·13. SEPTEMBER 2026

ChatGPT-Chats lösten eine Hausdurchsuchung aus

Die argentinische Bundespolizei durchsuchte am 10. September in Quilmes das Haus eines Jugendlichen – ausgelöst durch einen Hinweis des FBI-Rechtsattachés an der US-Botschaft in Buenos Aires. Anlass waren Gespräche mit ChatGPT. Der Fall macht sichtbar, wie die Kette von der Chateingabe über Schlüsselwort-Alarm, IP-Adresse und E-Mail-Konto bis zur Wohnungstür funktioniert.

Mehr aus Regulierung & Ethik →