NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
22. AUGUST 2026
3 MIN. LESEZEIT
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
INHALT
01Drei von elf – der Rest ist Rückstand020,64 Megapixel sind die Obergrenze03Kein Download bei Hugging Face04Für Schweizer Teams zählt der Datenweg
INHALT
01Drei von elf – der Rest ist Rückstand020,64 Megapixel sind die Obergrenze03Kein Download bei Hugging Face04Für Schweizer Teams zählt der Datenweg
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Bildverständnis zum Flash-Tarif ist ein echtes Angebot – aber es gibt keine Gewichte, keinen zweiten Anbieter und bisher keine unabhängige Messung.

DeepSeek hat am 21. August 2026 ein experimentelles Bildmodell freigeschaltet: deepseek-v4-flash-vision-exp ergänzt das günstige Textmodell V4-Flash um Bildverständnis – laut DeepSeeks Change Log ohne Preisaufschlag und mit derselben Textleistung wie das Basismodell. Auf der Vergleichstabelle, die DeepSeek selbst zum Release publiziert hat, rückt das Modell damit in die Nähe von Anthropics Spitzenmodell Claude Opus 4.8. Zugänglich ist es ausschliesslich über die API – Modellgewichte gibt es diesmal keine.

Drei von elf – der Rest ist Rückstand

DeepSeeks Tabelle vergleicht elf Benchmarks. Auf drei davon liegt die Vision-Variante vor Opus 4.8: DeepSWE (59,3 zu 58,0), Agents' Last Exam (27,3 zu 25,7) und ZeroBench (35,0 zu 34,0). Auf den anderen acht liegt sie zurück, teilweise klar – bei NL2Repo, einem Test für das Bauen ganzer Code-Repositories aus einer Beschreibung, trennen die beiden 12 Punkte (57,7 zu 69,7).

Wichtig für die Einordnung: Alle diese Zahlen stammen von DeepSeek, gemessen im hauseigenen Testgerüst «DeepSeek Harness Minimal Mode». Eine unabhängige Messung existiert Stand heute nicht – bei Artificial Analysis, der üblichen Referenz für Modellvergleiche, hat das Modell noch keinen Eintrag.

0,64 Megapixel sind die Obergrenze

Die aufschlussreichste Zahl steht nicht in der Benchmark-Tabelle, sondern in der API-Dokumentation. DeepSeek rechnet Bild vor der Verarbeitung auf rund herunter – das sind 0,64 Megapixel, knapp ein Drittel eines Full-HD-Bildschirms. Ein Bild kostet dadurch höchstens , egal ob du 2000 oder 5000 Pixel Kantenlänge hochlädst, und bis zu 600 Bilder passen in eine einzige Anfrage.

WEITERLESENDas könnte dich auch interessieren.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
jedes
800 × 800 Pixel
384 Tokens

Der Rest bleibt, wie du ihn von V4-Flash kennst: 1 Million Tokens Kontextfenster und 0,22 US-Dollar pro Million Input-Tokens ausserhalb der Stosszeiten, laut DeepSeeks Preisliste exakt der Tarif des Textmodells. Für Screenshots, Diagramme und Browser-Automatisierung ist das ein sehr günstiges Angebot. Für gescannte A4-Seiten mit Kleingedrucktem ist es knapp – die Auflösung ist der Preis für den Preis.

Kein Download bei Hugging Face

Genau hier bricht DeepSeek mit der eigenen Linie. V4-Flash und V4-Pro liegen unter MIT-Lizenz auf Hugging Face – das Textmodell V4-Flash-0731 wurde dort seit dem Release Ende Juli über 2,8 Millionen Mal heruntergeladen. Für die Vision-Variante gibt es kein solches Repository, weder auf Hugging Face noch auf GitHub. Auch OpenRouter führt genau einen Anbieter für das Modell: DeepSeek selbst. SiliconANGLE hält fest, dass DeepSeek angesichts seiner Open-Source-Historie später eine frei verfügbare Version nachreichen könnte – versprochen hat es das Unternehmen nicht.

Das ist die zweite Hälfte einer Bewegung, die wir vor einer Woche schon beim Agenten-Framework Harness beobachtet haben: Die Werkzeuge werden verschenkt, die Modelle wandern hinter die API.

Für Schweizer Teams zählt der Datenweg

Konkret heisst das: Wer Rechnungen, Screenshots oder Kundendokumente durch dieses Modell schickt, schickt sie an eine chinesische API – eine Alternative gibt es nicht. Beim rein textbasierten V4-Flash hattest du dank MIT-Lizenz noch die Wahl, es auf eigener Infrastruktur zu betreiben; bei der Vision-Variante fällt diese Option weg. Das Preisargument bleibt stark – die Abwägung verschiebt sich vom Tarif zum Datenweg.

Quellen

DeepSeek API Change Log – DeepSeek-V4-Flash-Vision-Exp Release (21.08.2026)↗ EXTERNER LINKDeepSeek API Docs – Vision Guide↗ EXTERNER LINKDeepSeek API Docs – Models & Pricing↗ EXTERNER LINKHugging Face – deepseek-ai/DeepSeek-V4-Flash-0731 (MIT-Lizenz)↗ EXTERNER LINKThe Decoder – Deepseek releases experimental Flash vision model that rivals Opus 4.8 on agent benchmarks (21.08.2026)↗ EXTERNER LINKSiliconANGLE – DeepSeek debuts multimodal language model competitive with Opus 4.8 (21.08.2026)↗ EXTERNER LINKOpenRouter – DeepSeek V4 Flash Vision Exp (21.08.2026)↗ EXTERNER LINKCaixin Global – DeepSeek Enters the Multimodal AI Race with Experimental Vision Model (22.08.2026)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
DeepSeekAnthropicHugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

Gemini 3.7 Flash: drei Wochen nach 3.6, halber Preis

Google hat Gemini 3.7 Flash veröffentlicht – nur drei Wochen nach dem Vorgänger und zum halben Einführungspreis. Beim Programmieren legt das Modell deutlich zu, bei Agenten-Benchmarks bleibt GPT-5.6 Terra vorn. Und der Consumer-Agent Gemini Spark, der ab sofort auf 3.7 Flash läuft, ist in der Schweiz gar nicht verfügbar.

Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
NEUE MODELLE·12. AUGUST 2026

Nvidias schnellstes offenes Modell läuft auf einer einzigen GPU

Nemotron 3.5 Lightning erreicht bei Artificial Analysis dieselbe Punktzahl wie OpenAIs gpt-oss-120b – mit einem Viertel der Parameter und dem höchsten gemessenen Tempo unter 134 Modellen. Laut Modellsteckbrief genügt eine einzige H100 oder ein DGX Spark. Für Schweizer Firmen, die Daten im Haus behalten müssen, ist genau das die interessante Zahl.

Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger

OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.

Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

Muse Glimmer: Meta öffnet 30-Milliarden-Modell unter Apache 2.0

Meta Superintelligence Labs hat am 10. August Muse Glimmer veröffentlicht – ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter Apache 2.0 frei verfügbar sind. Quantisiert läuft es auf einer einzelnen Consumer-Grafikkarte. Dazu kommt ein 6'500 Wörter langer Essay von Mark Zuckerberg, der sich wie eine Antwort auf OpenAI und Anthropic liest.

Mehr aus Neue Modelle →