NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Gemini 3.7 Flash: drei Wochen nach 3.6, halber Preis

Google hat Gemini 3.7 Flash veröffentlicht – nur drei Wochen nach dem Vorgänger und zum halben Einführungspreis. Beim Programmieren legt das Modell deutlich zu, bei Agenten-Benchmarks bleibt GPT-5.6 Terra vorn. Und der Consumer-Agent Gemini Spark, der ab sofort auf 3.7 Flash läuft, ist in der Schweiz gar nicht verfügbar.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
14. AUGUST 2026
3 MIN. LESEZEIT
Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
INHALT
01Codequalität springt um neun Punkte020,75 Dollar gegen 2 Dollar03Wo GPT-5.6 Terra weiterhin vorn liegt04Für Schweizer Abonnenten bleibt Spark zu
INHALT
01Codequalität springt um neun Punkte020,75 Dollar gegen 2 Dollar03Wo GPT-5.6 Terra weiterhin vorn liegt04Für Schweizer Abonnenten bleibt Spark zu
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Das Preis-Leistungs-Verhältnis ist das eigentliche Argument: 0,75 statt 2,00 Dollar pro Million Input-Token bei besserer Codequalität. Schweizer Abonnenten profitieren allerdings nur, wenn sie selbst entwickeln – Spark bleibt hier gesperrt.

Google hat am 13. August 2026 Gemini 3.7 Flash vorgestellt – nur drei Wochen nach dem Vorgänger 3.6 Flash. Das Modell ist laut Google das bisher intelligenteste Arbeitstier des Konzerns für Programmieren und KI-Agenten und startet zum Einführungspreis von 0,75 US-Dollar pro Million Input-Token, der Hälfte dessen, was 3.6 Flash beim Launch kostete. Für Schweizer Nutzer hat die Ankündigung einen Haken: Gemini Spark, Googles persönlicher KI-Agent, läuft ab sofort auf dem neuen Modell – ist hierzulande aber gar nicht verfügbar.

Codequalität springt um neun Punkte

Die grössten Zuwächse meldet Google beim Programmieren. Auf FrontierCode 1.1 Main – einem Benchmark der Firma Cognition, der die Qualität produktionsreifen Codes misst – erreicht 3.7 Flash 43,6 Prozent statt 34,4 Prozent. Bei DeepSWE v1.1, das länger laufende Software-Engineering-Aufgaben prüft, sind es 65,3 statt 49,0 Prozent. Auch abseits von Code legt das Modell zu: beim Verständnis komplexer Dokumente (GDP.pdf) von 22,0 auf 34,0 Prozent, bei der Automatisierung von Geschäftsabläufen (AutomationBench) von 17,0 auf 30,4 Prozent. In der WebDev Arena, wo Modelle im direkten Vergleich Weboberflächen bauen, steigt der Elo-Wert von 1538 auf 1588.

Bemerkenswert ist, wie das zustande kam: Laut der Modellkarte von Google DeepMind basiert 3.7 Flash auf 3.6 Flash – gleiche Architektur, gleiche Trainingsdaten. Google führt den Sprung auf Entwickler-Feedback und algorithmische Verbesserungen zurück.

0,75 Dollar gegen 2 Dollar

Der Preis ist das eigentliche Argument. Eine Million Input-Token kosten 0,75 Dollar, eine Million Output-Token 3,75 Dollar. Zum Vergleich: In Googles eigener Übersicht verlangt Claude Sonnet 5 dafür 2,00 respektive 10,00 Dollar, GPT-5.6 Terra 2,00 und 12,00 Dollar.

Zwei Details stehen im Kleingedruckten. Der Einführungspreis läuft am 31. Dezember 2026 aus – ab dem 1. Januar 2027 werden 1,50 und 7,50 Dollar fällig. Und er gilt für 3.6 und 3.7 Flash gleichermassen: Wer beim älteren Modell bleibt, zahlt ab sofort denselben Preis für die schwächere Leistung.

Wo GPT-5.6 Terra weiterhin vorn liegt

Googles Vergleichstabelle zeigt allerdings auch, dass «besser als die Konkurrenz» nicht durchgängig stimmt. Bei DeepSWE v1.1 liegt GPT-5.6 Terra mit 69,6 Prozent vor Gemini, bei Terminal-bench 2.1 mit 87,4 gegen 85,8 Prozent, bei agentischer Computernutzung (OSWorld-2.0) mit 50,2 gegen 47,9 Prozent. Claude Sonnet 5 wiederum führt bei Wissensarbeit (GDPVal-AA v2, Elo 1598 gegen 1525). Im Artificial Analysis Intelligence Index, der mehrere Tests zusammenfasst, kommt 3.7 Flash auf 56 Punkte – knapp vor Sonnet 5 mit 55, aber hinter Terra mit 57.

Vorn liegt Gemini also dort, wo Google den Fokus gesetzt hat: Codequalität, Weboberflächen, Dokumente, Geschäftsprozesse. Wer lange Agentenläufe im Terminal braucht, findet anderswo mehr – dann allerdings zum mehrfachen Preis.

Für Schweizer Abonnenten bleibt Spark zu

Gemini Spark, der Agent, der laut Google rund um die Uhr eigenständig Aufgaben übernimmt, läuft ab sofort ebenfalls auf 3.7 Flash. Google beziffert die Reichweite auf «über 160 Länder» und verlinkt dabei auf die eigene Support-Seite. Dort steht, dass Spark überall dort verfügbar ist, wo es die Gemini-Apps gibt – «ausser im Europäischen Wirtschaftsraum, in Nigeria, der Schweiz und dem Vereinigten Königreich».

Die Schweiz ist dort separat neben dem EWR aufgeführt, was korrekt ist: EWR-Mitglied ist sie nicht. Konkret heisst das für dich: Wer hier ein Google-AI-Pro- oder -Ultra-Abo bezahlt, merkt vom Modell-Upgrade nichts, weil er Spark gar nicht erst nutzen kann. Das Modell selbst ist davon nicht betroffen. Wer über die Gemini API, AI Studio, Android Studio oder Antigravity entwickelt, arbeitet ab sofort mit 3.7 Flash. Der Ausschluss trifft die Konsumentenseite – nicht die Entwicklerseite.

Quellen

Introducing Gemini 3.7 Flash – Google (Primärquelle)↗ EXTERNER LINKGemini 3.7 Flash Model Card – Google DeepMind↗ EXTERNER LINKGemini Spark – verfügbare Länder (Google Support)↗ EXTERNER LINKGemini 3.7 Flash lands with coding gains and undercuts its predecessor's price by 50% – The Decoder↗ EXTERNER LINKGemini 3.7 Flash launch – 9to5Google↗ EXTERNER LINKFrontierCode Benchmark – Cognition↗ EXTERNER LINKDeepSWE Benchmark – Datacurve↗ EXTERNER LINKWebDev Arena Leaderboard – Arena.ai↗ EXTERNER LINKGemini API Pricing – Google AI for Developers↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
GoogleAnthropic
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
NEUE MODELLE·12. AUGUST 2026

Nvidias schnellstes offenes Modell läuft auf einer einzigen GPU

Nemotron 3.5 Lightning erreicht bei Artificial Analysis dieselbe Punktzahl wie OpenAIs gpt-oss-120b – mit einem Viertel der Parameter und dem höchsten gemessenen Tempo unter 134 Modellen. Laut Modellsteckbrief genügt eine einzige H100 oder ein DGX Spark. Für Schweizer Firmen, die Daten im Haus behalten müssen, ist genau das die interessante Zahl.

Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger

OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.

Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

Muse Glimmer: Meta öffnet 30-Milliarden-Modell unter Apache 2.0

Meta Superintelligence Labs hat am 10. August Muse Glimmer veröffentlicht – ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter Apache 2.0 frei verfügbar sind. Quantisiert läuft es auf einer einzelnen Consumer-Grafikkarte. Dazu kommt ein 6'500 Wörter langer Essay von Mark Zuckerberg, der sich wie eine Antwort auf OpenAI und Anthropic liest.

Mehr aus Neue Modelle →