NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Google öffnet Gemma 4 für alle unter Apache 2.0

Google hat am 2. April seine neue Gemma-4-Familie veröffentlicht – jetzt unter der offenen Apache-2.0-Lizenz statt hinter Googles proprietärem Schleier. Das könnte bedeutender sein als die Benchmarks selbst.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
7. APRIL 2026
2 MIN. LESEZEIT
Aufgeschlagenes Buch mit Edelsteinen und Apache-Federkiel – Gemma 4 Open Source
Aufgeschlagenes Buch mit Edelsteinen und Apache-Federkiel – Gemma 4 Open Source
INHALT
01Die Lizenz zählt mehr als die Performance02Klein, schnell, überall lauffähig03Warum diese Update überhaupt spannend ist04Was kommt jetzt?
INHALT
01Die Lizenz zählt mehr als die Performance02Klein, schnell, überall lauffähig03Warum diese Update überhaupt spannend ist04Was kommt jetzt?
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Apache 2.0 macht Gemma 4 zur ersten echten Open-Source-Alternative für die Entwicklung auf Unternehmensebene.

Die Lizenz zählt mehr als die Performance

Ja, die 31B-Dense-Variante ist mit einem Arena-AI-ELO von 1'452 global die #3 unter den Open-Source-Modellen. Die 26B MoE (Mixture-of-Experts) aktiviert nur 4B Parameter gleichzeitig – eine Quote von "Intelligenz pro Parameter", die es so noch nicht gab. Aber ehrlich? Die echte Nachricht ist die Apache-2.0-Lizenz.

Das bedeutet für dich: Du darfst Gemma 4 trainieren, finetunen, kommerziell nutzen – ohne juristische Hürden. Google hat damit eine echte Barriere abgebaut. VentureBeat fasst es treffend zusammen: Diese Lizenzänderung könnte wichtiger sein als jeder Benchmark-Punkt.

Klein, schnell, überall lauffähig

Die 31B-Version zeigt beeindruckende Zahlen: 89,2 % auf AIME 2026 (mathematisches Denken), 80 % auf LiveCodeBench v6 (Code-Verständnis). Das ist kein Spielzeug-Modell. Gleichzeitig läuft die Variante überraschend schnell. Georgi Gerganov (bekannt von llama.cpp) zeigte, dass Gemma 4 auf M2-Ultra-Hardware 300 Token pro Sekunde verarbeitet.

Noch interessanter: Die Edge-Modelle E2B und E4B. Die E4B-Variante schafft immer noch 42,5 % auf AIME 2026. Das ist nicht wenig für 4 Milliarden Parameter.

Warum diese Update überhaupt spannend ist

Sebastian Raschka merkte an, dass der architektonische Sprung von 27B auf 31B klein ausfällt. Die echten Gewinne kommen aus dem Training-Setup und der Daten-Kurierung. Das zeigt: Google bastelt jetzt an Effizienzmechanismen statt nur an Rohkraft.

Nathan Lambert ist vorsichtig optimistisch, warnt aber vor bekannten Finetuning- und Tooling-Problemen. Die Community muss hier noch nachziehen. Cloudflare hat Gemma 4 bereits auf Workers AI verfügbar gemacht – das bedeutet: Deine nächste Edge-Function könnte damit laufen.

Lightning AI zeigt mit 105,4 Token pro Sekunde bei nur 0,20 Dollar pro Million Tokens, dass das Deployment skaliert. NVIDIA hat mit NVFP4-Quantisierung eine 4-Bit-Kompression veröffentlicht, die 99,7 % der Baseline-Genauigkeit hält.

Was kommt jetzt?

Gemma 4 ist nicht das grösste Modell. Es ist aber das offenste Modell dieser Grösse – und das ist ein echter Shift. Für Teams, die an KI-Anwendungen bauen, ohne sich an OpenAI, Anthropic oder Meta binden zu wollen, ist das eine echte Option geworden. Die Infrastruktur-Partner haben bereits reagiert. Jetzt ist die Frage: Werden die Developer-Tools und Fine-Tuning-Recipes folgen?

Das Potenzial steckt in der Kombination: offene Lizenz, solide Performance auf kleinerer Hardware, aktive Deployment-Partner. Nicht revolutionär – aber pragmatisch. Und genau das braucht es gerade in der KI-Infrastruktur.

Quellen

VentureBeat↗ EXTERNER LINKLatent Space↗ EXTERNER LINKInterconnects↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
GoogleOpenAIAnthropicMeta
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Mehr aus Neue Modelle →