NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Googles Modell schreibt Text, wie ein Bild entsteht

Googles neues, offenes Modell DiffusionGemma erzeugt Text nicht Wort für Wort, sondern ganze Blöcke auf einmal – wie ein Bildgenerator aus Rauschen ein Motiv schärft. Das macht es bis zu viermal schneller und lässt es lokal auf dem eigenen Rechner laufen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
12. JUNI 2026
2 MIN. LESEZEIT
Handgezeichnete Skizze eines Blatt Papiers, auf dem sich aus einer Wolke verstreuter Tintenpunkte Textzeilen bilden, daneben ein Füllfederhalter und ein kleiner Computer
Handgezeichnete Skizze eines Blatt Papiers, auf dem sich aus einer Wolke verstreuter Tintenpunkte Textzeilen bilden, daneben ein Füllfederhalter und ein kleiner Computer (Dark Mode)
INHALT
01Schreiben, wie ein Bild entsteht02Viermal schneller – mit einem Haken03Läuft auf dem eigenen Rechner
INHALT
01Schreiben, wie ein Bild entsteht02Viermal schneller – mit einem Haken03Läuft auf dem eigenen Rechner
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

DiffusionGemma überträgt den Trick der Bildgeneratoren auf Text: ganze Blöcke statt Wort für Wort – viermal schneller und offen für den eigenen Rechner.

Die meisten KI-Modelle schreiben Text Wort für Wort, von links nach rechts. Googles neues DiffusionGemma macht es anders – und ist dabei bis zu viermal schneller.

Schreiben, wie ein Bild entsteht

Der Name verrät den Trick. Bildgeneratoren wie Midjourney starten mit einem Bild aus reinem Rauschen und schärfen es Schritt für Schritt zum fertigen Motiv – das nennt man Diffusion. DiffusionGemma überträgt genau dieses Prinzip auf Text: Statt ein Wort nach dem anderen vorherzusagen, entwirft das Modell einen ganzen Block von bis zu 256 Zeicheneinheiten auf einmal und verfeinert ihn parallel.

Weil dabei viele Teile gleichzeitig statt nacheinander entstehen, wird das Ganze deutlich schneller. Auf einer professionellen NVIDIA-H100-Grafikkarte schafft das Modell über 1000 Zeicheneinheiten pro Sekunde, auf einer High-End-Gamerkarte (RTX 5090) immerhin noch über 700.

Viermal schneller – mit einem Haken

Das Tempo hat seinen Preis. Google selbst nennt DiffusionGemma ein experimentelles Modell und räumt ein: Die Textqualität liegt unter der des regulären Gemma 4. Wer maximale Qualität braucht, soll laut Google weiterhin das Standardmodell nehmen.

Technisch ist DiffusionGemma ein Mixture-of-Experts-Modell – vereinfacht gesagt sind im Modell viele Spezialisten versammelt, von denen je nach Aufgabe nur ein Teil aktiv wird. Von insgesamt 26 Milliarden Parametern sind pro Anfrage nur rund 3,8 Milliarden im Einsatz. Das hält den Rechenaufwand tief.

Läuft auf dem eigenen Rechner

Der für viele wichtigste Punkt: DiffusionGemma ist offen und unter der freien Apache-2.0-Lizenz verfügbar. Quantisiert (also auf weniger Speicher zusammengestaucht) passt es in die 18 Gigabyte einer guten Consumer-Grafikkarte.

Konkret heisst das: Man kann das Modell lokal auf dem eigenen Gerät laufen lassen, ohne dass Daten an einen Cloud-Anbieter wandern. Gerade in der Schweiz, wo Datenschutz und digitale Souveränität hoch im Kurs stehen – Stichwort das hiesige offene Sprachmodell Apertus – ist das ein Argument. Für schnelle Entwürfe, Autovervollständigung oder Tests ist ein vier Mal schnelleres Modell auf dem eigenen Laptop attraktiv, auch wenn der letzte Schliff dann von einem stärkeren Modell kommt.

Quellen

Google – DiffusionGemma: 4x faster text generation↗ EXTERNER LINKMarkTechPost – Google AI Releases DiffusionGemma, a 26B MoE Open Model Using Text Diffusion↗ EXTERNER LINKTechnology.org – Google's DiffusionGemma Generates Text 4x Faster on Local GPUs↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
NEUE MODELLE·28. JULI 2026

Microsoft baut sein erstes Cyber-Modell – und braucht OpenAI weiter

Microsoft AI hat MAI-Cyber-1-Flash vorgestellt, das erste eigene Modell nur für Cybersecurity. Laut Microsoft erreicht es im Verbund mit dem Agenten-System MDASH 96 Prozent auf dem Benchmark CyberGym und halbiert die Kosten. Die härtesten 10 Prozent der Fälle gehen aber weiterhin an GPT-5.4 von OpenAI.

Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
NEUE MODELLE·23. JULI 2026

Google bringt Gemini 3.6 Flash – schneller und günstiger

Google veröffentlicht Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber. Das Aufmacher-Modell ist gleichzeitig günstiger und effizienter als sein Vorgänger und braucht rund 17 Prozent weniger Ausgabe-Tokens.

Illustration einer Schaltzentrale mit elektroblauen Monitoren, kinewsletter.ch Stil
Illustration einer Schaltzentrale mit elektroblauen Monitoren, kinewsletter.ch Stil
NEUE MODELLE·21. JULI 2026

Alibaba zeigt Qwen3.8 – angeblich Nummer zwei hinter Fable 5

Alibaba hat an der World AI Conference in Shanghai Qwen3.8-Max vorgestellt – ein multimodales Modell mit angeblich 2,4 Billionen Parametern, das nur Anthropics Fable 5 nachstehen soll. Belegt ist davon noch nichts: keine Benchmarks, keine Lizenz, keine offenen Gewichte. Der Release zeigt vor allem, wie schnell Chinas Labore an die Weltspitze drängen.

Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Muratis erstes Modell ist offen – und bewusst nicht das beste

Thinking Machines Lab veröffentlicht Inkling: 975 Milliarden Parameter, offene Gewichte. Laut der Firma bewusst nicht das stärkste Modell – sondern ein Rohling zum Feintunen.

Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Kimi K3 erreicht Frontier-Niveau – und beendet die Billig-Ära

Moonshot AI hat Kimi K3 vorgestellt: 2,8 Billionen Parameter, eine Million Token Kontext, offene Gewichte ab dem 27. Juli. Das Modell spielt auf Augenhöhe mit den besten US-Systemen – und kostet dreimal so viel wie sein Vorgänger. Die Zeit der chinesischen Kampfpreise ist damit vorbei.

Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent
Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·10. JULI 2026

GPT-5.6 für alle: OpenAI bringt drei Modelle zu drei Preisen

Seit dem 9. Juli ist OpenAIs neue Generation GPT-5.6 öffentlich verfügbar – in drei Stufen namens Sol, Terra und Luna, deren Preise von 1 bis 30 Dollar pro Million Token reichen. Zuvor hatte eine staatliche Sicherheitsprüfung die Freigabe wochenlang verzögert.

Mehr aus Neue Modelle →