NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Gemini Omni Flash: Google macht aus einem Satz ein Video – mit Wasserzeichen

Google hat an der I/O 2026 sein erstes Omni-Modell vorgestellt. Es generiert aus Text, Bild und Audio gleichzeitig ein 10-Sekunden-Video – ab sofort in YouTube Shorts mit SynthID-Watermark.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
21. MAI 2026
3 MIN. LESEZEIT
Illustration zum Artikel «Gemini Omni Flash: Google macht aus einem Satz ein Video – m», kinewsletter.ch Stil
Illustration zum Artikel 02-gemini-omni, kinewsletter.ch Stil (dark)
INHALT
01Ein Modell statt einer Pipeline02Was du heute schon machen kannst03Jedes Video bekommt einen Stempel04Der Druck auf OpenAI wächst05Für dich als Nutzer06Avatar-Mode kommt – aber nicht heute
INHALT
01Ein Modell statt einer Pipeline02Was du heute schon machen kannst03Jedes Video bekommt einen Stempel04Der Druck auf OpenAI wächst05Für dich als Nutzer06Avatar-Mode kommt – aber nicht heute
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Google bringt mit Gemini Omni Flash das erste massentaugliche Video-Modell mit nicht-optionalem SynthID-Wasserzeichen – ein neuer Provenance-Standard.

Google hat an der I/O 2026 sein erstes Omni-Modell vorgestellt: Gemini Omni Flash. Ein Modell, das Text, Bild, Audio und Video gleichzeitig versteht und daraus ein 10-Sekunden-Video mit synchronisiertem Ton erzeugt. Live seit 19. Mai – in der Gemini-App, in Google Flow und in den YouTube Shorts.

Ein Modell statt einer Pipeline

Bisher mussten Video-Generatoren wie Veo, Sora oder Runway mehrere spezialisierte Modelle hintereinanderschalten: eines für die Bildkomposition, eines für die Bewegung, eines für den Ton. Omni Flash macht das in einem einzigen Forward-Pass: Du wirfst Text, ein paar Bilder, eine Sprachaufnahme rein – und bekommst einen fertigen Clip zurück, der alle Modalitäten konsistent verbindet.

Demis Hassabis sprach an der Keynote von einem «World Model»: Omni soll nicht nur hübsche Bilder generieren, sondern Physik, Kausalität und narrative Struktur verstehen. Konkret: Wenn du eine Tasse vom Tisch fallen lässt, soll sie unten zerbrechen – und nicht in Zeitlupe wegfliegen.

Was du heute schon machen kannst

Gemini Omni Flash ist live in folgenden Produkten:

  • Gemini-App (Plus, Pro, Ultra) – Text-zu-Video, Bild-zu-Video, Bild+Audio-zu-Video
  • Google Flow – professionelle Video-Storyboards mit mehreren Szenen
  • YouTube Shorts und YouTube Create – kostenlos, mit Remix-Funktion

Eine Funktion fehlt bewusst: Audio-Editing innerhalb eines generierten Videos. Du kannst also nicht nachträglich die Stimme im Clip ändern oder eine andere Sprache reinsetzen. Google nennt das eine «zurückgehaltene Capability» – mit Verweis auf Deepfake-Risiken.

Jedes Video bekommt einen Stempel

Das Sicherheits-Pendant zum Modell ist SynthID. Jeder Clip, der mit Omni Flash erzeugt wird, bekommt ein unsichtbares Wasserzeichen direkt im Bild- und Audiosignal. Verifizieren kannst du es über die Gemini-App, über Google Chrome oder über die Google-Suche – einfach das Video reinziehen, und du siehst, ob es KI-generiert ist.

SynthID ist nicht optional. Jeder Output trägt ein imperzeptibles Wasserzeichen, das in der Gemini-App, in Chrome und in der Google-Suche verifizierbar ist.

Damit setzt Google einen Standard, den weder OpenAI noch xAI bisher flächendeckend ausrollen. Wenn YouTube Shorts ab dieser Woche markierte Omni-Videos in den Feed kippt, wird SynthID quasi über Nacht zur weltweit am breitesten ausgerollten Provenance-Technologie.

Der Druck auf OpenAI wächst

Sora 2 von OpenAI gilt qualitativ als ebenbürtig, ist aber nicht in einem Massenprodukt mit dreistelligen Millionen-Nutzern verfügbar. Mit Omni Flash kombiniert Google drei Vorteile, die OpenAI fehlen:

  1. Verteilungskanal – YouTube hat über 2 Milliarden Nutzer
  2. Konsumenten-Hardware – Android-Geräte mit Gemini ab Werk
  3. Provenance-Infrastruktur – SynthID + C2PA in Search und Chrome

Das ist die eigentliche I/O-Botschaft: Google verschenkt Video-Generation nicht aus Grosszügigkeit, sondern macht sie zum Standard – damit Sora, Veo und Runway nicht zum Standard werden.

Für dich als Nutzer

Wenn du YouTube Shorts oder die Gemini-App nutzt, kannst du diese Woche das erste Mal Videos direkt per Chat erzeugen. Für Schweizer Content-Creators heisst das: Ein Drehtag wird oft günstiger durch ein 20-Sekunden-Prompt-Set. Aber: Sobald dein Clip eine Person zeigt, die etwas sagt, was sie nie gesagt hat, weist SynthID ihn als KI-generiert aus. Was wie eine Einschränkung wirkt, ist faktisch ein Branchenvorteil – wer ehrlich kommuniziert, gewinnt Vertrauen.

Avatar-Mode kommt – aber nicht heute

Google hat einen zweiten Omni-Modus angeteasert: Avatar Mode. Damit könnte ein Nutzer sich selbst in beliebige Videos hineinsetzen lassen. Diese Fähigkeit ist explizit «held back» bis weitere Sicherheitsmechanismen greifen. Heisst: Spätestens Anfang 2027 dürfte dieser Modus kommen – und dann wird die nächste Welle der Deepfake-Debatten losgehen.

Quellen

Introducing Gemini Omni (Google Blog)↗ EXTERNER LINKGoogle's Gemini Omni turns images, audio, and text into video (TechCrunch)↗ EXTERNER LINKGoogle launches Gemini Omni Flash (The Next Web)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
GoogleOpenAIxAI
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Mehr aus Neue Modelle →