NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
22. AUGUST 2026
3 MIN. LESEZEIT
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
INHALT
01Drei von elf – der Rest ist Rückstand020,64 Megapixel sind die Obergrenze03Kein Download bei Hugging Face04Für Schweizer Teams zählt der Datenweg
INHALT
01Drei von elf – der Rest ist Rückstand020,64 Megapixel sind die Obergrenze03Kein Download bei Hugging Face04Für Schweizer Teams zählt der Datenweg
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Bildverständnis zum Flash-Tarif ist ein echtes Angebot – aber es gibt keine Gewichte, keinen zweiten Anbieter und bisher keine unabhängige Messung.

DeepSeek hat am 21. August 2026 ein experimentelles Bildmodell freigeschaltet: deepseek-v4-flash-vision-exp ergänzt das günstige Textmodell V4-Flash um Bildverständnis – laut DeepSeeks Change Log ohne Preisaufschlag und mit derselben Textleistung wie das Basismodell. Auf der Vergleichstabelle, die DeepSeek selbst zum Release publiziert hat, rückt das Modell damit in die Nähe von Anthropics Spitzenmodell Claude Opus 4.8. Zugänglich ist es ausschliesslich über die API – Modellgewichte gibt es diesmal keine.

Drei von elf – der Rest ist Rückstand

DeepSeeks Tabelle vergleicht elf Benchmarks. Auf drei davon liegt die Vision-Variante vor Opus 4.8: DeepSWE (59,3 zu 58,0), Agents' Last Exam (27,3 zu 25,7) und ZeroBench (35,0 zu 34,0). Auf den anderen acht liegt sie zurück, teilweise klar – bei NL2Repo, einem Test für das Bauen ganzer Code-Repositories aus einer Beschreibung, trennen die beiden 12 Punkte (57,7 zu 69,7).

Wichtig für die Einordnung: Alle diese Zahlen stammen von DeepSeek, gemessen im hauseigenen Testgerüst «DeepSeek Harness Minimal Mode». Eine unabhängige Messung existiert Stand heute nicht – bei Artificial Analysis, der üblichen Referenz für Modellvergleiche, hat das Modell noch keinen Eintrag.

0,64 Megapixel sind die Obergrenze

Die aufschlussreichste Zahl steht nicht in der Benchmark-Tabelle, sondern in der API-Dokumentation. DeepSeek rechnet jedes Bild vor der Verarbeitung auf rund 800 × 800 Pixel herunter – das sind 0,64 Megapixel, knapp ein Drittel eines Full-HD-Bildschirms. Ein Bild kostet dadurch höchstens 384 Tokens, egal ob du 2000 oder 5000 Pixel Kantenlänge hochlädst, und bis zu 600 Bilder passen in eine einzige Anfrage.

Der Rest bleibt, wie du ihn von V4-Flash kennst: 1 Million Tokens Kontextfenster und 0,22 US-Dollar pro Million Input-Tokens ausserhalb der Stosszeiten, laut DeepSeeks Preisliste exakt der Tarif des Textmodells. Für Screenshots, Diagramme und Browser-Automatisierung ist das ein sehr günstiges Angebot. Für gescannte A4-Seiten mit Kleingedrucktem ist es knapp – die Auflösung ist der Preis für den Preis.

Kein Download bei Hugging Face

Genau hier bricht DeepSeek mit der eigenen Linie. V4-Flash und V4-Pro liegen unter MIT-Lizenz auf Hugging Face – das Textmodell V4-Flash-0731 wurde dort seit dem Release Ende Juli über 2,8 Millionen Mal heruntergeladen. Für die Vision-Variante gibt es kein solches Repository, weder auf Hugging Face noch auf GitHub. Auch OpenRouter führt genau einen Anbieter für das Modell: DeepSeek selbst. SiliconANGLE hält fest, dass DeepSeek angesichts seiner Open-Source-Historie später eine frei verfügbare Version nachreichen könnte – versprochen hat es das Unternehmen nicht.

Das ist die zweite Hälfte einer Bewegung, die wir vor einer Woche schon beim Agenten-Framework Harness beobachtet haben: Die Werkzeuge werden verschenkt, die Modelle wandern hinter die API.

Für Schweizer Teams zählt der Datenweg

Konkret heisst das: Wer Rechnungen, Screenshots oder Kundendokumente durch dieses Modell schickt, schickt sie an eine chinesische API – eine Alternative gibt es nicht. Beim rein textbasierten V4-Flash hattest du dank MIT-Lizenz noch die Wahl, es auf eigener Infrastruktur zu betreiben; bei der Vision-Variante fällt diese Option weg. Das Preisargument bleibt stark – die Abwägung verschiebt sich vom Tarif zum Datenweg.

Quellen

DeepSeek API Change Log – DeepSeek-V4-Flash-Vision-Exp Release (21.08.2026)↗ EXTERNER LINKDeepSeek API Docs – Vision Guide↗ EXTERNER LINKDeepSeek API Docs – Models & Pricing↗ EXTERNER LINKHugging Face – deepseek-ai/DeepSeek-V4-Flash-0731 (MIT-Lizenz)↗ EXTERNER LINKThe Decoder – Deepseek releases experimental Flash vision model that rivals Opus 4.8 on agent benchmarks (21.08.2026)↗ EXTERNER LINKSiliconANGLE – DeepSeek debuts multimodal language model competitive with Opus 4.8 (21.08.2026)↗ EXTERNER LINKOpenRouter – DeepSeek V4 Flash Vision Exp (21.08.2026)↗ EXTERNER LINKCaixin Global – DeepSeek Enters the Multimodal AI Race with Experimental Vision Model (22.08.2026)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
DeepSeekAnthropicHugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
NEUE MODELLE·6. OKTOBER 2026

Reflection AI zeigt Beam, offenes Modell gegen China

Das US-Start-up Reflection AI stellt Beam vor, ein Modell mit offenen Gewichten und 501 Milliarden Parametern. Es soll chinesischen Modellen mit deutlich weniger Rechenaufwand Konkurrenz machen. Alle Zahlen sind Herstellerangaben, die Gewichte folgen im Oktober.

Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt; die Maske ist leuchtend blau.
Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt
NEUE MODELLE·3. OKTOBER 2026

Tavus: Fast jeder Zweite hält KI-Avatar Griffin für echt

Das US-Startup Tavus meldet, dass 48 Prozent der Testpersonen seinen KI-Videoavatar Griffin nach einer Minute für einen Menschen hielten. Die Zahl stammt vom Hersteller, die Stichprobe war mit 54 Personen klein. Für die Schweiz ist sie trotzdem ein Warnsignal, weil Betrüger Video-Fälschungen bisher selten, Stimmklone dafür umso öfter einsetzen.

Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
NEUE MODELLE·1. OKTOBER 2026

Gemini 4 Argon: Google startet bei den Cyber-Verteidigern

Google stellt Gemini 4 Argon vor, zunächst nur für ausgewählte Cybersecurity-Organisationen im Fairwind-Programm. Laut Google findet und patcht das Modell kritische Schwachstellen selbstständig. Wir ordnen Zahlen, Bloomberg-Zweifel und den Schweiz-Bezug ein.

Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
NEUE MODELLE·30. SEPTEMBER 2026

GPT-6.1 Sol: fast Astra-Niveau zu einem Fünftel des Preises

OpenAI hat am DevDay GPT-6.1 Sol vorgestellt: laut Hersteller fast auf Astra-Niveau, aber für 2 statt 10 Dollar pro Million Eingabe-Tokens. Die Fehlerrate sinkt gegenüber GPT-6 Sol von 11,4 auf 7,7 Prozent. Verfügbar in ChatGPT Work, Codex und API, nicht im normalen Chat.

Handgezeichnete Skizze einer grossen blauen Stoppuhr neben einem Münzstapel und Zahnrädern, dahinter Tempo-Linien
Handgezeichnete Skizze einer grossen blauen Stoppuhr neben einem Münzstapel und Zahnrädern, dahinter Tempo-Linien
NEUE MODELLE·29. SEPTEMBER 2026

Sonnet 5.5: 30 % schneller zum gleichen Preis wie Sonnet 5

Anthropic bringt Claude Sonnet 5.5: mehr als 30 % schneller und laut Anthropic bis zu 30 % günstiger pro Aufgabe, bei unverändertem Token-Preis. Auf mehreren Benchmarks liegt es nur knapp hinter Opus 5.5. Wir zeigen, wo der Haken liegt und wann sich der Wechsel lohnt.

Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
KI-FORSCHUNG·27. SEPTEMBER 2026

GPT-6 Astra knackt Enigma-Funkspruch von 1941 – in zwei Tagen

OpenAIs GPT-6 Astra hat einen deutschen Heeres-Funkspruch vom 10. Juli 1941 entschlüsselt, der seit 2005 als ungelöst galt. Das Modell suchte sich das Ziel selbst aus und schrieb Enigma-Simulator und Enigma-Bombe eigenständig in Python und C++. Dieselbe Autonomie ist der Grund, weshalb OpenAI seine leistungsfähigsten Modelle gerade gestoppt hat.

Mehr aus Neue Modelle →