NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

DeepSeek kontert OpenAI: Fast Luna-Niveau zu 60 Prozent tieferen Kosten

Keine 24 Stunden nach OpenAIs grosser Preissenkung legt DeepSeek nach: Das Update V4 Flash 0731 erreicht laut Artificial Analysis fast das Niveau von GPT-5.6 Luna – kostet pro Aufgabe aber rund 60 Prozent weniger. Die Modellgewichte sind frei verfügbar, unter MIT-Lizenz.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
1. AUGUST 2026
2 MIN. LESEZEIT
Illustration eines grossen blauen Preisschilds an einer Schnur, das von einer Schere durchtrennt wird, kinewsletter.ch Stil
Illustration eines grossen blauen Preisschilds an einer Schnur, das von einer Schere durchtrennt wird, kinewsletter.ch Stil
INHALT
01OpenAIs Preisoffensive hielt genau einen Tag02Zehn Punkte Sprung im Intelligence Index03167 Gigabyte zum Selberhosten
INHALT
01OpenAIs Preisoffensive hielt genau einen Tag02Zehn Punkte Sprung im Intelligence Index03167 Gigabyte zum Selberhosten
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Der Preiskrieg um günstige KI ist eröffnet: OpenAI senkt die Preise um 80 Prozent, DeepSeek unterbietet noch am selben Tag um weitere 60 Prozent pro Aufgabe – mit offenen Gewichten obendrauf. Wer Agenten-Workloads in grossem Volumen fährt, bekommt brauchbare Intelligenz gerade im Wochentakt günstiger.

Keine 24 Stunden nachdem OpenAI die Preise seiner günstigen Modelle drastisch gesenkt hat, kontert DeepSeek: Am 31. Juli veröffentlichte das chinesische KI-Lab DeepSeek-V4-Flash-0731 – ein Update seines Budget-Modells, das laut dem unabhängigen Benchmark-Portal Artificial Analysis fast das Niveau von OpenAIs GPT-5.6 Luna erreicht, pro Aufgabe aber rund 60 Prozent weniger kostet. Die Modellgewichte stehen unter MIT-Lizenz frei auf Hugging Face – zum Herunterladen und Selberhosten.

OpenAIs Preisoffensive hielt genau einen Tag

Am 30. Juli hatte OpenAI die Preise für GPT-5.6 Luna um 80 Prozent gesenkt – auf 0.20 Dollar pro Million Input-Tokens und 1.20 Dollar pro Million Output-Tokens. Tags darauf erklärte Finanzchefin Sarah Friar in einem Grundsatzpapier «abundant intelligence» – günstige Intelligenz im Überfluss – zur Firmenstrategie. Noch am selben Tag unterbot DeepSeek: 0.14 Dollar Input, 0.28 Dollar Output. Der grössere Hebel steckt im Caching (Zwischenspeichern bereits verarbeiteter Eingaben): Wiederholte Anfragen kosten bei DeepSeek 98 Prozent weniger, üblich in der Branche sind 90.

Zehn Punkte Sprung im Intelligence Index

Im Artificial Analysis Intelligence Index klettert das neue Flash-Modell auf 50 Punkte – zehn mehr als der Vorgänger vom April und nur noch einen Punkt hinter Luna. Damit ist es laut dem Portal das Modell mit dem besten Preis-Leistungs-Verhältnis überhaupt. DeepSeeks eigene Model Card meldet vor allem Fortschritte bei Agenten-Aufgaben: Im Terminal Bench 2.1 etwa 82.7 Punkte statt bisher 61.8 – Herstellerangaben, die unabhängige Nachtests noch bestätigen müssen. Blogger Simon Willison nennt es bereits «möglicherweise das beste Preis-Leistungs-Modell am Markt».

167 Gigabyte zum Selberhosten

Technisch bleibt es ein Mixture-of-Experts-Modell (nur ein Bruchteil der 304 Milliarden Parameter ist pro Anfrage aktiv) mit einem Kontextfenster von einer Million Tokens. Der Download umfasst 167 Gigabyte – auf eigener Hardware machbar. Konkret heisst das: Auch Schweizer Unternehmen mit strengen Datenschutz-Vorgaben können ein Modell nahe am Frontier-Budget-Niveau komplett intern betreiben. Und wer einfach nur die API nutzt, profitiert vom Preiskrieg direkt – brauchbare Intelligenz wird gerade im Wochentakt günstiger.

Quellen

DeepSeek-V4-Flash-0731 – Model Card (Hugging Face, Primärquelle)↗ EXTERNER LINKDeepSeek API – Models & Pricing (offizielle Preisliste)↗ EXTERNER LINKNew Deepseek Flash model matches OpenAI's GPT-5.6 Luna at roughly 60 percent lower cost (The Decoder)↗ EXTERNER LINKdeepseek-ai/DeepSeek-V4-Flash-0731 (Simon Willison)↗ EXTERNER LINKAdvancing the price-performance frontier with GPT-5.6 (OpenAI)↗ EXTERNER LINKBuilding abundant intelligence (OpenAI, Sarah Friar)↗ EXTERNER LINKOpenAI goes full China pricing mode with an 80 percent cut to its most affordable GPT-5.6 model (The Decoder)↗ EXTERNER LINKAdvancing the price-performance frontier with GPT-5.6 (Simon Willison, Einordnung Preissenkung)↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer Filmklappe mit elektroblauen Balken neben Tonangel-Mikrofon und Scheinwerfer, im Hintergrund ein Fenster mit Schwarzwald-Tannen, kinewsletter.ch Stil
Illustration einer Filmklappe mit elektroblauen Balken neben Tonangel-Mikrofon und Scheinwerfer, im Hintergrund ein Fenster mit Schwarzwald-Tannen, kinewsletter.ch Stil
NEUE MODELLE·6. AUGUST 2026

FLUX 3 Video: KI-Clips mit Ton – jetzt für alle verfügbar

Black Forest Labs macht sein Videomodell FLUX 3 Video über die API allgemein verfügbar: bis zu 20 Sekunden Video mit nativ mitgeneriertem Ton, Lippensynchronisation auf Deutsch und einem günstigen Draft-Modus. In internen Tests sieht sich das Freiburger KI-Studio an der Spitze.

Illustration einer Balkenwaage mit elektroblauem Ständer, auf der einen Schale Münzen, auf der anderen gerollte Dokumente, kinewsletter.ch Stil
Illustration einer Balkenwaage mit elektroblauem Ständer, auf der einen Schale Münzen, auf der anderen gerollte Dokumente, kinewsletter.ch Stil
KI-TOOLS & APPS·6. AUGUST 2026

Meta greift Claude Code an: 92 Prozent Rabatt fürs Datenteilen

Meta Superintelligence Labs lanciert mit Muse Code einen Terminal-Coding-Agenten als direkte Konkurrenz zu Claude Code und Codex – angetrieben vom neuen Modell Muse Spark 1.2. Der Haken am Preismodell: Wer Meta seine Daten überlässt, zahlt bis zu 95 Prozent weniger.

Illustration eines Wachhäuschens mit Schranke und elektroblauem Rundschild, kinewsletter.ch Stil
Illustration eines Wachhäuschens mit Schranke und elektroblauem Rundschild, kinewsletter.ch Stil
KI-TOOLS & APPS·5. AUGUST 2026

Mistral Shieldstral: Offenes 3B-Sicherheitsmodell schlägt siebenmal grössere Guard-Modelle

Mistral hat Shieldstral veröffentlicht: einen offenen Sicherheits-Classifier mit nur 3 Milliarden Parametern, der Texte und Bilder moderiert. Die Regeln bekommt das Modell als Klartext-Frage zur Laufzeit — laut Mistral erreicht oder übertrifft es damit Guard-Modelle bis zu siebenfacher Grösse und läuft auf einer einzigen 16-GB-Grafikkarte.

Illustration eines offenen Banktresors mit Büchern und einem Handwagen, Sketch-Stil mit elektroblauen Akzenten, kinewsletter.ch Stil
Illustration eines offenen Banktresors mit Büchern und einem Handwagen, Sketch-Stil mit elektroblauen Akzenten, kinewsletter.ch Stil
NEUE MODELLE·4. AUGUST 2026

Qwen3.8-Max: Alibaba liefert nach – und verspricht offene Gewichte

Alibaba hat Qwen3.8-Max voll lanciert: 2,4 Billionen Parameter, 1 Million Token Kontext und Case Studies, in denen das Modell tagelang autonom arbeitet. Nächste Woche sollen die Gewichte folgen – es wäre das erste Max-Klasse-Modell, das offen verfügbar wird.

Illustration einer elektroblauen Filmkamera mit Filmrollen auf Holzstativ vor einem kleinen Studio-Set, kinewsletter.ch Stil
Illustration einer elektroblauen Filmkamera mit Filmrollen auf Holzstativ vor einem kleinen Studio-Set, kinewsletter.ch Stil
NEUE MODELLE·2. AUGUST 2026

ByteDance Seedance 2.5: 30-Sekunden-Videos mit Ton in einem Durchgang

ByteDance hat Seedance 2.5 vorgestellt: Das Videomodell generiert neu 30 Sekunden Video samt Ton in einem einzigen Durchgang – doppelt so viel wie der Vorgänger und rund dreimal so viel wie Googles Gemini Omni Flash. Clips lassen sich mehrfach zu Minuten-Videos verlängern. Verfügbar ist das Modell vorerst nur auf ByteDances China-Plattformen, die API soll folgen.

Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
KI-FORSCHUNG·2. AUGUST 2026

OpenAI kündigt Astra an – mit zehn gelösten Mathe-Problemen

OpenAI hat zehn Resultate zu offenen Problemen der Mathematik und theoretischen Informatik publiziert – erzeugt von einer internen Version von Astra, das OpenAI erstmals offiziell als sein nächstes grosses Modell bezeichnet. Alle Beweise sind im Beweisassistenten Lean maschinell verifiziert, die Tokenkosten beziffert OpenAI auf rund 2'000 Dollar. Die Mathe-Community reagiert zwischen Begeisterung und Sinnkrise.

Mehr aus Neue Modelle →