NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Googles dritter Flash in sechs Wochen – plus ein Cyber-Modell

Gemini 3.8 Flash kostet gleich viel wie der Vorgänger – die Cyber-Variante gibt es nur für geprüfte Verteidiger. Das Frontier-Modell fehlt weiter.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
3. SEPTEMBER 2026
4 MIN. LESEZEIT
Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
INHALT
01Fast auf Augenhöhe mit Opus 502Gleicher Preis, 40 Prozent teurere Rechnung03Über 70 Prozent Treffer in 20 Sprachen04650 Partner und eine Türsteher-Regel05Drei Labore, dieselbe Bewegung
INHALT
01Fast auf Augenhöhe mit Opus 502Gleicher Preis, 40 Prozent teurere Rechnung03Über 70 Prozent Treffer in 20 Sprachen04650 Partner und eine Türsteher-Regel05Drei Labore, dieselbe Bewegung
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Der Token-Preis bleibt gleich, die Rechnung pro Aufgabe steigt trotzdem um rund 40 Prozent – und die spannendste Variante des Modells bekommst du gar nicht.

Google hat am 2. September 2026 Gemini 3.8 Flash vorgestellt – den dritten günstigen Flash-Release innerhalb von sechs Wochen und nur drei Wochen nach 3.7 Flash. Der Einführungspreis bleibt unverändert bei 0,75 US-Dollar je Million Input-Token und 3,75 Dollar je Million Output-Token, gültig bis Ende 2026. Dazu kommt eine zweite, abgeschottete Variante: Gemini 3.8 Flash Cyber ist ausschliesslich über das ebenfalls neu gestartete Fairwind-Programm für geprüfte Verteidiger zu haben. Was weiterhin fehlt, ist Googles grosses Frontier-Modell.

Fast auf Augenhöhe mit Opus 5

Auf DeepSWE v1.1 – einem Test für lange, zusammenhängende Programmieraufgaben, die eine KI von Anfang bis Ende selbst löst – erreicht 3.8 Flash laut Googles eigenen Zahlen 73,7 Prozent. Zum Vergleich: Claude Opus 5 kommt auf 74,0 Prozent, GPT-5.6 Sol auf 72,7 Prozent, der eigene Vorgänger 3.7 Flash nur auf 65,3 Prozent.

Der Punkt ist weniger der erste Platz als die Preisklasse: Opus 5 kostet gemäss The Decoder 5,00 respektive 25,00 Dollar je Million Token, GPT-5.6 Sol 4,00 und 20,00 Dollar. Selbst nach dem Ende der Einführungsphase – ab 1. Januar 2027 verlangt Google 1,50 und 7,50 Dollar – bliebe Gemini 3.8 Flash pro Token deutlich günstiger. Auf HLE-Verified, einem Test für mehrstufiges Denken quer über MINT-, Geistes- und Berufsfelder, meldet Google 54,9 Prozent.

Gleicher Preis, 40 Prozent teurere Rechnung

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil

Genau hier liegt der Haken. Die unabhängige Benchmark-Plattform Artificial Analysis hebt 3.8 Flash im Intelligence Index von 56 auf 59 Punkte – gleichauf mit GPT-5.6 Sol und Grok 4.6. Die Kosten pro gelöster Aufgabe steigen aber von 0,40 auf 0,58 Dollar, also um rund 40 Prozent, obwohl der Token-Preis identisch geblieben ist.

Der Grund steht ungewöhnlich offen im Blogpost von Google selbst – hier in der Übersetzung:

Diese Leistungsgewinne stammen aus einer zentralen Design-Entscheidung: 3.8 Flash arbeitet härter.

Konkret heisst das: mehr Denkschritte, mehr Tool-Aufrufe, mehr verbrauchte Token. Google empfiehlt deshalb ausdrücklich, für effizienzkritische Anwendungen entweder ein tieferes Effort-Level zu wählen oder gleich bei 3.7 Flash zu bleiben, das voll unterstützt weiterläuft. Für dich als Entwickler oder Budgetverantwortliche bedeutet das: Der Listenpreis pro Token taugt nicht mehr als Kostenvergleich. Was zählt, ist der Preis pro erledigter Aufgabe – und den musst du selbst messen.

Über 70 Prozent Treffer in 20 Sprachen

Die zweite Variante ist die interessantere – und die, die du nicht bekommst. 3.8 Flash Cyber ist auf das Finden und Reparieren von Sicherheitslücken trainiert. Auf einem internen Google-Benchmark, der Schwachstellen über 20 Programmiersprachen hinweg abdeckt, liegt die Erfolgsquote laut Google über 70 Prozent. Auf CyberGym, dem Industriestandard für Schwachstellen in C- und C++-Code, meldet Google 86,2 Prozent – vor GPT-5.6 Sol (83,6 %) und der eigenen Vorgängerversion 3.5 Flash Cyber (77,5 %).

Beim automatischen Patchen, gemessen am externen CWE-Bench, erreicht das Modell 47,2 Prozent pass@1 gegenüber 47,8 Prozent beim führenden Frontier-Modell – praktisch gleichauf, aber deutlich billiger. Google betont, man habe das Reparieren von Lücken bewusst vor offensive Fähigkeiten wie das Ausnutzen gestellt. Aus der Praxis nennt das Unternehmen zwei Zahlen: Das Chrome-Security-Team habe 2,6-mal mehr korrekte Patches erhalten als von den besten kommerziellen Modellen, die deutlich grösser sind. Und Googles Cloud-Vulnerability-Research-Team fand nach eigenen Angaben eine kritische Grundlagen-Schwachstelle in unter zwei Stunden statt in Monaten.

650 Partner und eine Türsteher-Regel

Zugang gibt es nur über Fairwind, das Google am selben Tag startete. Das Programm kombiniert 3.8 Flash Cyber mit CodeMender, einer von Google DeepMind gebauten Werkzeugumgebung, die Patches schreibt und validiert – innerhalb der eigenen Cloud-Umgebung der Organisation. Google spricht von über 650 teilnehmenden Partnern weltweit; SiliconANGLE nennt darunter Snowflake, CrowdStrike und Datadog.

Wer reinkommt, ist bewusst eng gefasst: Regierungen und nationale Cyber-Behörden, Betreiber kritischer Infrastruktur aus Gesundheit, Telekommunikation, Energie und Finanzwesen sowie Anbieter weit verbreiteter Software-Grundlagen. Teilnehmende müssen den Zugang auf ihre eigenen Sicherheits-, Incident-Response- und Penetration-Testing-Teams beschränken und Mehrfaktor-Authentifizierung einsetzen. Parallel meldet Google, die Cybersecurity-Förderung über Google.org übersteige neu 100 Millionen Dollar; 36 Millionen davon flossen bislang in 35 sogenannte Cyber-Clinics, die über 1'250 US-Spitäler, Schulbezirke und kommunale Versorger kostenlos unterstützt haben.

Drei Labore, dieselbe Bewegung

Der eigentliche Trend liegt nicht bei Google allein. Nur einen Tag vor diesem Release stufte OpenAI sein kommendes Modell Astra erstmals in die höchste Cyber-Risikoklasse ein und drosselte den Zugang. Anthropics Cyber-Modell Claude Mythos 5 taucht in Googles eigener CyberGym-Tabelle auf. Drei grosse Labore bauen also gleichzeitig Modelle, die Schwachstellen finden können – und alle drei entscheiden sich gegen offene Verfügbarkeit und für gestuften Zugang mit Prüfung.

Bleibt die Frage, die The Decoder stellt: Ist die Kadenz von drei Flash-Modellen in sechs Wochen ein Zeichen von Stärke oder eine Ablenkung davon, dass Gemini 3.5 Pro und Gemini 4 weiter auf sich warten lassen? Der neue DeepMind-Chef Koray Kavukcuoglu habe klargemacht, so The Decoder, dass Google nicht nur auf Preis-Leistung optimieren, sondern auch bei roher Leistungsfähigkeit führen wolle. Der Beweis dafür steht noch aus.

Quellen

Introducing Gemini 3.8 Flash and 3.8 Flash Cyber (Google, 02.09.2026)↗ EXTERNER LINKProactive cyber defense for governments and enterprises – Fairwind Program (Google, 02.09.2026)↗ EXTERNER LINKGemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA (The Decoder, 02.09.2026)↗ EXTERNER LINKGoogle launches two Gemini 3.8 models with cutting-edge reasoning capabilities (SiliconANGLE, 02.09.2026)↗ EXTERNER LINKGemini 3.8 Flash – Intelligence, Performance & Price Analysis (Artificial Analysis)↗ EXTERNER LINKGemini 3.8 Flash rolling out three weeks after last release (9to5Google, 02.09.2026)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
GoogleAnthropicxAIOpenAI
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
NEUE MODELLE·3. SEPTEMBER 2026

Fei-Fei Lis Atlas baut 3D-Welten aus wenigen Fotos

World Labs hat Atlas vorgestellt: ein Weltmodell, das aus einer Handvoll Fotos begehbare 3D-Szenen erzeugt, rekonstruiert und simuliert — bis zu eine Minute Video in 1440p mit frei gewählter Kameraführung, wahlweise als echte 3D-Geometrie. Verfügbar ist es bisher nur im Early Access, und alle Vergleichszahlen stammen von World Labs selbst.

Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Muse Spark 1.3: Meta setzt auf sparsam statt Spitzenplatz

Meta hat Muse Spark 1.3 veröffentlicht: 62 Punkte im Artificial Analysis Intelligence Index, einen hinter Claude Opus 5 – aber zum Achtel des Preises von Claude Fable 5.1. Die beworbene Sparsamkeit stammt allerdings aus Metas eigener Messung, und die Open-Weights-Frage ist offener denn je.

Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·2. SEPTEMBER 2026

Claude Fable 5.1: stärker beim Coden, günstiger im Betrieb

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht: deutlich bessere Werte bei agentischem Coding und Recherche, dazu ein um 75 Prozent gesenkter Cache-Preis – doch bei voller Effort-Stufe rechnet Artificial Analysis vor, dass die Rechnung höher ausfällt als bei Opus 5.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
NEUE MODELLE·30. AUGUST 2026

GLM-5.3 ist offen – aber die MIT-Lizenz ist weg

Z.ai hat die Gewichte seines 753-Milliarden-Parameter-Flaggschiffs GLM-5.3 freigegeben – zwei Wochen verspätet und erstmals nicht unter MIT. Die neue Hauslizenz verpflichtet Model-as-a-Service-Anbieter ab 10 Milliarden Dollar Umsatz zu einer Sicherheitsprüfung durch Z.ai. Für alle anderen bleibt das Modell frei – die eigentliche Hürde sind die 810 Gigabyte Speicher, die es braucht.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Mehr aus Neue Modelle →