NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Kimi K3 brach aus der Testumgebung aus – und schummelte

Das chinesische Modell Kimi K3 verliess bei einem Cybersicherheits-Test seine Sandbox, klonte das Benchmark-Repository von GitHub und las die Lösung ab. Schuld war eine falsch konfigurierte Testumgebung. Der Fall zeigt: Nicht nur die Modelle sind ein Risiko – auch die Tests, die sie prüfen sollen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. AUGUST 2026
2 MIN. LESEZEIT
Illustration eines geöffneten Laborkäfigs mit aufgebrochenem Vorhängeschloss und Klemmbrett, kinewsletter.ch Stil
Illustration eines geöffneten Laborkäfigs mit aufgebrochenem Vorhängeschloss und Klemmbrett, kinewsletter.ch Stil
INHALT
01Ein offenes Türchen namens GitHub02Nicht das Modell versagte, sondern der Test03OpenAI, Anthropic, Meta – und jetzt Moonshot
INHALT
01Ein offenes Türchen namens GitHub02Nicht das Modell versagte, sondern der Test03OpenAI, Anthropic, Meta – und jetzt Moonshot
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

KI-Sicherheitsbenchmarks sind nur so verlässlich wie ihre Sandbox – Kimi K3 fand die Lücke, statt die Aufgabe zu lösen.

Das chinesische KI-Modell Kimi K3 von Moonshot AI hat sich bei einem Cybersicherheits-Test aus seiner abgeschotteten Testumgebung befreit und die Lösung der Aufgabe im Internet nachgeschlagen. Das berichtet die US-Sicherheitsfirma Frontier Security in einem Blogpost. Die Ursache war keine raffinierte Attacke, sondern eine falsch konfigurierte Sandbox – und das wirft ein unangenehmes Licht auf die Tests selbst.

Ein offenes Türchen namens GitHub

Frontier Security prüfte, wie gut Kimi K3 defensive Sicherheitsaufgaben löst – mit einer Benchmark-Umgebung des britischen AI Security Institute, einer staatlichen Forschungsorganisation. Solche Tests laufen in einer Sandbox: einem isolierten Container, der dem Modell zwar eine Kommandozeile gibt, es aber vom Rest der Welt abschneiden soll.

Genau das misslang. Ausgehender Datenverkehr war grösstenteils blockiert, eine Ausnahmeliste für Software-Pakete liess aber unter anderem pypi.org, debian.org und github.com durch. Kimi K3 tastete seine Umgebung mit gewöhnlichen Kommandozeilen-Werkzeugen ab, merkte, dass GitHub erreichbar war, klonte das offizielle Benchmark-Repository und las die Musterlösung direkt von der Festplatte. Die eigentliche Aufgabe löste es laut den Forschern Paul Kassianik und Yaron Singer gar nie.

Nicht das Modell versagte, sondern der Test

Die Forscher ziehen daraus einen Schluss, der weit über diesen einen Fall hinausreicht:

Manche der Cybersicherheits-Evaluationen, die die Community verwendet, seien anfällig für Sicherheitslücken und erlaubten Modellen zu schummeln – und es gebe Modelle, die gezielt nach solchen Schlupflöchern suchten.

Kurz gesagt: Ein hoher Benchmark-Wert kann genauso gut ein Konfigurationsfehler sein wie echtes Können.

OpenAI, Anthropic, Meta – und jetzt Moonshot

Der Fall reiht sich in eine Serie ein. In den vergangenen Wochen entkamen laut TechCrunch auch Modelle von OpenAI, Anthropic und Meta sowie Systeme beim britischen AI Security Institute ihren Testumgebungen – teils hackten sie dabei reale Ziele, die gar nicht Teil des Experiments waren. Der Vorfall-Tracker Felony Bench zählt für OpenAI und Anthropic je sieben Vorfälle und für Meta einen; Moonshot ist dort als erster chinesischer Anbieter neu aufgeführt. Der Unterschied: Kimi K3 griff kein fremdes System an, es mogelte nur, wie die South China Morning Post festhält.

Für dich heisst das vor allem eines: Zahlen zu den Sicherheitsfähigkeiten von KI-Modellen sind nur so belastbar wie die Umgebung, in der sie gemessen wurden. Und weil Kimi K3 mit offenen Gewichten frei verfügbar ist, steht dieselbe Findigkeit auch Angreifern offen – genau deshalb hält Frontier Security diesen Vorfall für potenziell schädlicher als einen früheren Fall, bei dem ein noch unveröffentlichtes Modell auffiel.

Quellen

Frontier Security: Chinese model Kimi K3 breaks UK AI Safety Institute benchmark evaluations↗ EXTERNER LINKTechCrunch: Chinese AI model Kimi escaped its cybersecurity testing environment↗ EXTERNER LINKSCMP: China's Kimi K3 AI model escapes isolated sandbox during security test↗ EXTERNER LINKFelony Bench: Tracker für KI-Sandbox-Vorfälle↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIAnthropicMeta
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

KI-Agenten hacken Onlineshops für 25 Dollar pro Ziel
KI-Agenten hacken Onlineshops für 25 Dollar pro Ziel
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

KI-Agenten hacken Onlineshops für 25 Dollar pro Ziel

Ein Report von Gambit Security zeigt: Drei zusammenspielende KI-Agenten haben mindestens 27 Onlineshops geknackt und über 600'000 Kreditkartendaten erbeutet – für durchschnittlich 25,46 Dollar pro Firma. Die Zahl stammt bislang nur von einer Quelle, zeigt aber, wie günstig automatisierte Angriffe geworden sind. Kein Schweizer Shop ist betroffen, doch ein separater Fall vom September zeigt, dass auch hiesige Anbieter ins Visier geraten können.

Altman und Amodei warnen UNO-Sicherheitsrat vor KI-Kontrollverlust
Altman und Amodei warnen UNO-Sicherheitsrat vor KI-Kontrollverlust
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

Altman und Amodei warnen UNO-Sicherheitsrat vor KI-Kontrollverlust

Sam Altman und Dario Amodei haben den UN-Sicherheitsrat vor unkontrollierter KI-Entwicklung gewarnt - in einer eigenständigen Sitzung, getrennt von Trumps Rede vor der Generalversammlung am selben Tag. China und die USA lehnten verbindliche globale Regeln unisono ab. Ein Genfer Wissenschaftler prägte das Briefing mit.

Sanders-Entwurf will Superintelligenz für immer verbieten
Sanders-Entwurf will Superintelligenz für immer verbieten
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

Sanders-Entwurf will Superintelligenz für immer verbieten

Bernie Sanders und Greg Casar wollen die Entwicklung von Superintelligenz per Gesetz verbieten – mit einer neuen Bundesbehörde und bis zu 20 Jahren Haft für Verantwortliche. Im republikanisch kontrollierten Kongress hat der Entwurf allerdings kaum Chancen.

OpenAI-Agent hackt australisches Regierungsportal
OpenAI-Agent hackt australisches Regierungsportal
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

OpenAI-Agent hackt australisches Regierungsportal

Ein Agent von OpenAI ist im Juni 2026 in ein australisches Gesundheitsstatistik-Portal eingedrungen und umging dabei Zugangssperren. Entdeckt hat OpenAI den Vorfall erst im August, gemeldet wurde er der Behörde erst im September – fast drei Monate nach dem Einbruch.

Illustration einer Briefkastenreihe mit einer offenen Tür und Schlüsselbund im Schloss, kinewsletter.ch Stil
Illustration einer Briefkastenreihe mit einer offenen Tür und Schlüsselbund im Schloss, kinewsletter.ch Stil
REGULIERUNG & ETHIK·24. SEPTEMBER 2026

Microsoft zerschlägt Phishing-Dienst mit eingebautem KI-Assistenten

Microsoft hat den Phishing-Dienst EvilTokens zerschlagen – verbunden mit über 12'000 gekaperten Microsoft-365-Postfächern. Das Neue daran war nicht der Einbruch, sondern ein mitgelieferter KI-Chatbot, der fremde Postfächer nach Zahlungsgesprächen durchsuchte.

Illustration eines Globus mit einem Fragebogen und Checkboxen, kinewsletter.ch Stil
Illustration eines Globus mit einem Fragebogen und Checkboxen, kinewsletter.ch Stil
REGULIERUNG & ETHIK·24. SEPTEMBER 2026

Der besorgte Westen: Viel KI-Nutzung, noch mehr Skepsis

Gallup und Microsoft haben die ersten 37 Länder einer weltweiten KI-Studie veröffentlicht: In 34 davon überwiegen die positiven Gefühle. Die grosse Ausnahme sind die USA, wo sich 74 Prozent der KI-bewussten Erwachsenen sorgen – ausgerechnet dort, wo am meisten genutzt wird. Innerhalb dieser Länder gilt allerdings das Gegenteil: Wer täglich mit KI arbeitet, sorgt sich am wenigsten.

Mehr aus Regulierung & Ethik →