NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Chinas GLM-5.2 schlägt Claude beim Bug-Hunting

Ein offenes chinesisches Modell hat im unabhängigen Sicherheits-Test mehr Schwachstellen gefunden als Anthropics Claude – zu einem Sechstel der Kosten und frei zum Herunterladen. Das stellt die US-Exportkontrollen für KI infrage.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
30. JUNI 2026
3 MIN. LESEZEIT
Handgezeichnete Skizze einer grossen Lupe ueber einem Block Programmcode, die einen versteckten Software-Bug aufdeckt, mit elektroblauem Akzent
Handgezeichnete Skizze einer grossen Lupe ueber einem Block Programmcode, die einen versteckten Software-Bug aufdeckt, mit elektroblauem Akzent (Dark Mode)
INHALT
01Was der Test zeigt02Warum GLM-5.2 anders ist03Die politische Sprengkraft04Was du im Kopf behalten solltest
INHALT
01Was der Test zeigt02Warum GLM-5.2 anders ist03Die politische Sprengkraft04Was du im Kopf behalten solltest
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Zhipu AIs frei verfügbares GLM-5.2 schlägt Claude beim Aufspüren von Software-Lücken – und untergräbt damit die Logik der US-Exportbeschränkungen.

Ein kleines chinesisches Modell hat gerade etwas geschafft, das man in Washington nur ungern hört: In einem unabhängigen Sicherheits-Test fand GLM-5.2 von Zhipu AI mehr Schwachstellen als Anthropics Claude – zu einem Sechstel der Kosten und frei zum Herunterladen.

Was der Test zeigt

Die Sicherheitsfirma Semgrep liess mehrere Modelle auf denselben Datensatz los: Sie sollten sogenannte IDOR-Lücken aufspüren – Zugriffsfehler, bei denen eine App nicht prüft, ob du wirklich auf fremde Daten zugreifen darfst. Solche Lücken sind tückisch, weil es keinen verdächtigen Code gibt, sondern nur eine fehlende Prüfung.

Das Ergebnis überraschte selbst die Tester. GLM-5.2 erreichte einen F1-Wert von 39 Prozent und schlug damit Claude Code (37 respektive 28 Prozent) – und das mit nichts als einem Prompt, ohne jede zusätzliche Hilfsstruktur. Pro gefundener Schwachstelle kostete der Lauf rund 17 US-Cent.

«Unter den Modellen, die nur einen Prompt bekamen, schlug die beste Open-Weight-Option Claude Opus 4.8.» – Semgrep Security Research

Warum GLM-5.2 anders ist

Das Modell von Zhipu AI (Z.ai) wurde Mitte Juni veröffentlicht – und zwar open weight unter einer freien MIT-Lizenz. Heisst: Jede und jeder kann die Gewichte herunterladen, lokal betreiben und anpassen. Für Sicherheitsteams, die mit sensiblen Daten arbeiten, ist genau das attraktiv, weil das Modell vollständig im eigenen Haus laufen kann.

Technisch ist GLM-5.2 ein Mixture-of-Experts-Modell mit rund 750 Milliarden Parametern, von denen pro Anfrage nur etwa 40 Milliarden aktiv sind. Das hält die Kosten tief. Auf gängigen Coding-Benchmarks liefert es die stärksten Open-Weight-Werte: 81,0 Punkte auf Terminal-Bench 2.1 (Claude Opus 4.8: 85,0) und 62,1 auf SWE-bench Pro.

Die politische Sprengkraft

Die Pointe liegt im Timing. Genau jene Fähigkeit – eigenständig Software-Lücken finden – hatte die US-Regierung zum Anlass genommen, Anthropics Spitzenmodelle Mythos und Fable mit Exportbeschränkungen zu belegen. Die Idee: Wer Gegnern den Zugang zu solchen Modellen verwehrt, verhindert offensive Cyber-Fähigkeiten.

GLM-5.2 stellt diese Annahme infrage. Während Claude reguliert ist, lässt sich das chinesische Modell weltweit frei herunterladen. Eine Exportkontrolle bringt wenig, wenn vergleichbare Fähigkeit längst offen verfügbar ist.

Was du im Kopf behalten solltest

Der Test betrifft eine einzige Aufgabe, einen einzigen Datensatz – kein Gesamturteil über die Modelle. Semgreps eigene, spezialisierte Pipeline lag mit 53 bis 61 Prozent klar vorn; gute Werkzeuge schlagen also nach wie vor das blanke Modell. Und Zhipu räumt selbst ein, dass GLM-5.2 zu «Reward-Hacking» neigt, also im Training gerne mal die Bewertung austrickste.

Trotzdem bleibt die Botschaft: Open-Weight-Modelle haben eine Schwelle überschritten. Für Schweizer Firmen, die KI sicher und kostenbewusst einsetzen wollen, lohnt sich ein zweiter Blick auf Alternativen jenseits der teuren Frontier-Modelle.

Quellen

Semgrep – We have Mythos at Home: GLM 5.2 beats Claude in our Cyber Benchmarks↗ EXTERNER LINKTech Times – AI Export Controls Fail Their First Real Test: GLM-5.2 Cybersecurity Benchmarks↗ EXTERNER LINKForbes – The bad guys now have a model as powerful as Mythos↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
Anthropic
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

Gemini 3.7 Flash: drei Wochen nach 3.6, halber Preis

Google hat Gemini 3.7 Flash veröffentlicht – nur drei Wochen nach dem Vorgänger und zum halben Einführungspreis. Beim Programmieren legt das Modell deutlich zu, bei Agenten-Benchmarks bleibt GPT-5.6 Terra vorn. Und der Consumer-Agent Gemini Spark, der ab sofort auf 3.7 Flash läuft, ist in der Schweiz gar nicht verfügbar.

Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
NEUE MODELLE·12. AUGUST 2026

Nvidias schnellstes offenes Modell läuft auf einer einzigen GPU

Nemotron 3.5 Lightning erreicht bei Artificial Analysis dieselbe Punktzahl wie OpenAIs gpt-oss-120b – mit einem Viertel der Parameter und dem höchsten gemessenen Tempo unter 134 Modellen. Laut Modellsteckbrief genügt eine einzige H100 oder ein DGX Spark. Für Schweizer Firmen, die Daten im Haus behalten müssen, ist genau das die interessante Zahl.

Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger

OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.

Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

Muse Glimmer: Meta öffnet 30-Milliarden-Modell unter Apache 2.0

Meta Superintelligence Labs hat am 10. August Muse Glimmer veröffentlicht – ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter Apache 2.0 frei verfügbar sind. Quantisiert läuft es auf einer einzelnen Consumer-Grafikkarte. Dazu kommt ein 6'500 Wörter langer Essay von Mark Zuckerberg, der sich wie eine Antwort auf OpenAI und Anthropic liest.

Mehr aus Neue Modelle →