NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

GLM-5.3 ist offen – aber die MIT-Lizenz ist weg

Z.ai hat die Gewichte seines 753-Milliarden-Parameter-Flaggschiffs GLM-5.3 freigegeben – zwei Wochen verspätet und erstmals nicht unter MIT. Die neue Hauslizenz verpflichtet Model-as-a-Service-Anbieter ab 10 Milliarden Dollar Umsatz zu einer Sicherheitsprüfung durch Z.ai. Für alle anderen bleibt das Modell frei – die eigentliche Hürde sind die 810 Gigabyte Speicher, die es braucht.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
30. AUGUST 2026
4 MIN. LESEZEIT
Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
INHALT
01Ein Paragraf, der auf die Grössten zielt02Mehr als doppelt so gut im Exploit-Bau03810 Gigabyte stehen zwischen dir und dem Modell
INHALT
01Ein Paragraf, der auf die Grössten zielt02Mehr als doppelt so gut im Exploit-Bau03810 Gigabyte stehen zwischen dir und dem Modell
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Chinas stärkstes offenes Coding-Modell bringt massiv gestiegene Cyber-Fähigkeiten mit – und zum ersten Mal eine Lizenz, die den ganz Grossen Bedingungen stellt.

Z.ai hat am 28. August 2026 die Gewichte seines Flaggschiffs GLM-5.3 auf Hugging Face freigegeben – zwei Wochen nach dem API-Start und erstmals nicht unter der MIT-Lizenz, die das chinesische Labor seit 2024 für alle neuen Modelle verwendet hat. Das Modell mit 753 Milliarden Parametern steht neu unter einer hauseigenen Lizenz namens «glm-5.3». Herunterladen, verändern, feintunen und kommerziell einsetzen darfst du es weiterhin – aber mit einer neuen Bedingung, die auf sehr grosse Anbieter zielt.

Ein Paragraf, der auf die Grössten zielt

Der Lizenztext im Repository liest sich über weite Strecken wie MIT: nutzen, kopieren, verändern, zusammenführen, veröffentlichen, unterlizenzieren, verkaufen. Neu ist Ziffer 2. Wer ein «Model as a Service»-Geschäft betreibt – also Dritten Inferenz oder Feintuning so anbietet, dass diese echte Kontrolle über Eingaben, Parameter oder Trainingsdaten ausüben – und wer zusammen mit seinen Konzerngesellschaften in zwölf zusammenhängenden Monaten mehr als 10 Milliarden US-Dollar Umsatz erzielt, muss vor jeder kommerziellen Nutzung eine Sicherheitsprüfung von Z.ai bestehen. Umfang und Vorgehen dieser Prüfung bestimmt Z.ai selbst.

Zwei Fälle nimmt die Lizenz ausdrücklich aus: Endprodukte, in denen Modellfähigkeiten nur in einzelne Funktionen eingebettet sind, und das blosse Weiterleiten von Anfragen an fremd gehostete Modelle. Router bleiben also aussen vor, Hyperscaler mit eigenem Hosting nicht. Der Kontrast zum Vorgänger ist scharf: trägt auf Hugging Face weiterhin MIT – genau wie der kleine Bruder GLM-5.3-Flash, . Auffällig ist, was in der neuen Lizenz fehlt: Sie enthält weder einen Abschnitt zur zulässigen Nutzung noch ein einziges Wort zu Cybersicherheit – worauf The New Stack hinweist.

WEITERLESENDas könnte dich auch interessieren.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
GLM-5.2
den wir vor wenigen Tagen vorgestellt haben

Mehr als doppelt so gut im Exploit-Bau

Dabei war genau die Cybersicherheit der offizielle Grund für die Verspätung: Z.ai hielt die Gewichte nach eigenen Angaben zwei Wochen für zusätzliche Sicherheitsprüfungen zurück. Bei GLM-5.2 lagen sie noch am Starttag vor.

Technisch nutzt GLM-5.3 dieselbe Basis wie GLM-5.2, sämtliche Gewinne stammen aus dem Post-Training – also aus dem Feinschliff nach dem eigentlichen Training. Auf dem hauseigenen Z.ai Code Bench meldet die Firma 50 Prozent mehr Coding-Leistung. Auf Terminal Bench 3.0, einem Test für lange Kommandozeilen-Aufgaben, klettert der Wert laut Modelkarte von 4,6 auf 28,3 – der beste offene Wert (Kimi K3: 17,4), aber hinter den geschlossenen Spitzenmodellen (GPT-5.6 Sol: 34,6).

Der spannendere Teil ist die Sicherheitsseite, die Z.ai selbst als «emergente Cyber-Fähigkeit» bezeichnet:

  • CyberGym (Schwachstellen finden): 84,5 – Bestwert der gesamten Vergleichstabelle, vor Fable 5 (83,8) und GPT-5.6 Sol (83,6)
  • ExploitBench (Schwachstellen ausnutzen): 54,4 statt 24,4 beim Vorgänger – mehr als verdoppelt, aber deutlich hinter Fable 5 (78,0) und GPT-5.6 Sol (76,5)
  • ExploitGym: 105 von 869 Aufgaben im 2-Stunden-Budget statt 29 beim Vorgänger

Gemeinsam mit chinesischen Sicherheitsteams hat Z.ai nach eigenen Angaben 2'436 Schwachstellen in knapp 270 Projekten gefunden, laut heise über 100 davon kritisch – unter anderem im Linux-Kernel, in WinRAR, Redis und FFmpeg, die älteste 45 Jahre alt. Öffentlich einsehbar sind bisher nur rund vier Dutzend. Alle diese Zahlen sind Herstellerangaben und wurden bislang von niemandem unabhängig reproduziert.

810 Gigabyte stehen zwischen dir und dem Modell

Für Schweizer Firmen ist die neue Klausel praktisch bedeutungslos: Sie greift nur bei Model-as-a-Service-Anbietern jenseits von 10 Milliarden Dollar Umsatz. Betreibst du das Modell im eigenen oder in einem Schweizer Rechenzentrum für eigene Zwecke oder baust du es in ein Produkt ein, bist du ausdrücklich ausgenommen – der eigentliche Vorteil offener Gewichte bleibt also erhalten: Deine Daten verlassen das Haus nicht.

Die echte Hürde ist die Hardware. In FP8 belegen die Gewichte laut The New Stack rund 810 Gigabyte Speicher; die stark komprimierte 2-Bit-Variante von Unsloth kommt auf 245 Gigabyte und erreicht dabei nach Unsloth-Angaben noch rund 86 Prozent Top-1-Genauigkeit. Das ist Serverschrank-Territorium, kein Arbeitsplatzrechner. Ausgeliefert wird für SGLang, vLLM, Transformers, KTransformers, Unsloth, TokenSpeed und Ascend-NPUs.

Zum Vergleich: Das Schweizer Apertus von ETH Zürich, EPFL und dem Supercomputing-Zentrum CSCS gibt es in 8 und 70 Milliarden Parametern unter Apache 2.0 – deutlich kleiner, dafür ohne jede Zusatzbedingung und mit offengelegten Trainingsdaten. Wer offene Modelle wegen Rechtssicherheit wählt, hat ab jetzt eine Abwägung mehr: die stärkeren Gewichte oder die klarere Lizenz.

Quellen

GLM-5.3 – Modelkarte und Lizenzfeld (Hugging Face)↗ EXTERNER LINKGLM-5.3 License – Lizenztext im Repository↗ EXTERNER LINKZ.ai's GLM-5.3 goes open weight, but its new license aims at hyperscalers (The New Stack)↗ EXTERNER LINKGLM 5.3 verbessert Security-Fähigkeiten (heise online)↗ EXTERNER LINKZhipu AI releases GLM-5.3, claims it's the strongest open-weights coding model (The Decoder)↗ EXTERNER LINKGLM-5: from Vibe Coding to Agentic Engineering (arXiv)↗ EXTERNER LINKGLM-5.2 – Modelkarte mit MIT-Lizenz (Hugging Face)↗ EXTERNER LINKApertus-70B – Modelkarte mit Apache-2.0-Lizenz (Hugging Face)↗ EXTERNER LINKGLM-5.3 is now open-weight – Diskussion auf Hacker News↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
Hugging FaceETH ZürichEPFL
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Mehr aus Neue Modelle →