NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

DeepSeek kontert OpenAI: Fast Luna-Niveau zu 60 Prozent tieferen Kosten

Keine 24 Stunden nach OpenAIs grosser Preissenkung legt DeepSeek nach: Das Update V4 Flash 0731 erreicht laut Artificial Analysis fast das Niveau von GPT-5.6 Luna – kostet pro Aufgabe aber rund 60 Prozent weniger. Die Modellgewichte sind frei verfügbar, unter MIT-Lizenz.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
1. AUGUST 2026
2 MIN. LESEZEIT
Illustration eines grossen blauen Preisschilds an einer Schnur, das von einer Schere durchtrennt wird, kinewsletter.ch Stil
Illustration eines grossen blauen Preisschilds an einer Schnur, das von einer Schere durchtrennt wird, kinewsletter.ch Stil
INHALT
01OpenAIs Preisoffensive hielt genau einen Tag02Zehn Punkte Sprung im Intelligence Index03167 Gigabyte zum Selberhosten
INHALT
01OpenAIs Preisoffensive hielt genau einen Tag02Zehn Punkte Sprung im Intelligence Index03167 Gigabyte zum Selberhosten
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Der Preiskrieg um günstige KI ist eröffnet: OpenAI senkt die Preise um 80 Prozent, DeepSeek unterbietet noch am selben Tag um weitere 60 Prozent pro Aufgabe – mit offenen Gewichten obendrauf. Wer Agenten-Workloads in grossem Volumen fährt, bekommt brauchbare Intelligenz gerade im Wochentakt günstiger.

Keine 24 Stunden nachdem OpenAI die Preise seiner günstigen Modelle drastisch gesenkt hat, kontert DeepSeek: Am 31. Juli veröffentlichte das chinesische KI-Lab DeepSeek-V4-Flash-0731 – ein Update seines Budget-Modells, das laut dem unabhängigen Benchmark-Portal Artificial Analysis fast das Niveau von OpenAIs GPT-5.6 Luna erreicht, pro Aufgabe aber rund 60 Prozent weniger kostet. Die Modellgewichte stehen unter MIT-Lizenz frei auf Hugging Face – zum Herunterladen und Selberhosten.

OpenAIs Preisoffensive hielt genau einen Tag

Am 30. Juli hatte OpenAI die Preise für GPT-5.6 Luna um 80 Prozent gesenkt – auf 0.20 Dollar pro Million Input-Tokens und 1.20 Dollar pro Million Output-Tokens. Tags darauf erklärte Finanzchefin Sarah Friar in einem Grundsatzpapier «abundant intelligence» – günstige Intelligenz im Überfluss – zur Firmenstrategie. Noch am selben Tag unterbot DeepSeek: 0.14 Dollar Input, 0.28 Dollar Output. Der grössere Hebel steckt im Caching (Zwischenspeichern bereits verarbeiteter Eingaben): Wiederholte Anfragen kosten bei DeepSeek 98 Prozent weniger, üblich in der Branche sind 90.

Zehn Punkte Sprung im Intelligence Index

Im Artificial Analysis Intelligence Index klettert das neue Flash-Modell auf 50 Punkte – zehn mehr als der Vorgänger vom April und nur noch einen Punkt hinter Luna. Damit ist es laut dem Portal das Modell mit dem besten Preis-Leistungs-Verhältnis überhaupt. DeepSeeks eigene Model Card meldet vor allem Fortschritte bei Agenten-Aufgaben: Im Terminal Bench 2.1 etwa 82.7 Punkte statt bisher 61.8 – Herstellerangaben, die unabhängige Nachtests noch bestätigen müssen. Blogger Simon Willison nennt es bereits «möglicherweise das beste Preis-Leistungs-Modell am Markt».

WEITERLESENDas könnte dich auch interessieren.

Illustration einer Destillationsapparatur, die leuchtend blaue Flüssigkeit in einen kleinen Kolben tropft, kinewsletter.ch Stil
Illustration einer Destillationsapparatur, die leuchtend blaue Flüssigkeit in einen kleinen Kolben tropft, kinewsletter.ch Stil

167 Gigabyte zum Selberhosten

Technisch bleibt es ein Mixture-of-Experts-Modell (nur ein Bruchteil der 304 Milliarden Parameter ist pro Anfrage aktiv) mit einem Kontextfenster von einer Million Tokens. Der Download umfasst 167 Gigabyte – auf eigener Hardware machbar. Konkret heisst das: Auch Schweizer Unternehmen mit strengen Datenschutz-Vorgaben können ein Modell nahe am Frontier-Budget-Niveau komplett intern betreiben. Und wer einfach nur die API nutzt, profitiert vom Preiskrieg direkt – brauchbare Intelligenz wird gerade im Wochentakt günstiger.

Quellen

DeepSeek-V4-Flash-0731 – Model Card (Hugging Face, Primärquelle)↗ EXTERNER LINKDeepSeek API – Models & Pricing (offizielle Preisliste)↗ EXTERNER LINKNew Deepseek Flash model matches OpenAI's GPT-5.6 Luna at roughly 60 percent lower cost (The Decoder)↗ EXTERNER LINKdeepseek-ai/DeepSeek-V4-Flash-0731 (Simon Willison)↗ EXTERNER LINKAdvancing the price-performance frontier with GPT-5.6 (OpenAI)↗ EXTERNER LINKBuilding abundant intelligence (OpenAI, Sarah Friar)↗ EXTERNER LINKOpenAI goes full China pricing mode with an 80 percent cut to its most affordable GPT-5.6 model (The Decoder)↗ EXTERNER LINKAdvancing the price-performance frontier with GPT-5.6 (Simon Willison, Einordnung Preissenkung)↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?
NEUE MODELLE·1. AUGUST 2026

Inkling-Small: Muratis Viertel-Modell überholt sein eigenes Flaggschiff

Zwei Wochen nach seinem ersten offenen Modell legt Mira Muratis Thinking Machines Lab nach: Inkling-Small hat 276 Milliarden Parameter, steht unter Apache-2.0-Lizenz und landet laut Artificial Analysis nur einen Punkt hinter dem rund dreieinhalbmal grösseren Flaggschiff. Auf Coding-Benchmarks schlägt der Kleine das Original sogar.

Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
NEUE MODELLE·28. JULI 2026

Microsoft baut sein erstes Cyber-Modell – und braucht OpenAI weiter

Microsoft AI hat MAI-Cyber-1-Flash vorgestellt, das erste eigene Modell nur für Cybersecurity. Laut Microsoft erreicht es im Verbund mit dem Agenten-System MDASH 96 Prozent auf dem Benchmark CyberGym und halbiert die Kosten. Die härtesten 10 Prozent der Fälle gehen aber weiterhin an GPT-5.4 von OpenAI.

Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
NEUE MODELLE·23. JULI 2026

Google bringt Gemini 3.6 Flash – schneller und günstiger

Google veröffentlicht Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber. Das Aufmacher-Modell ist gleichzeitig günstiger und effizienter als sein Vorgänger und braucht rund 17 Prozent weniger Ausgabe-Tokens.

Illustration einer Schaltzentrale mit elektroblauen Monitoren, kinewsletter.ch Stil
Illustration einer Schaltzentrale mit elektroblauen Monitoren, kinewsletter.ch Stil
NEUE MODELLE·21. JULI 2026

Alibaba zeigt Qwen3.8 – angeblich Nummer zwei hinter Fable 5

Alibaba hat an der World AI Conference in Shanghai Qwen3.8-Max vorgestellt – ein multimodales Modell mit angeblich 2,4 Billionen Parametern, das nur Anthropics Fable 5 nachstehen soll. Belegt ist davon noch nichts: keine Benchmarks, keine Lizenz, keine offenen Gewichte. Der Release zeigt vor allem, wie schnell Chinas Labore an die Weltspitze drängen.

Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Muratis erstes Modell ist offen – und bewusst nicht das beste

Thinking Machines Lab veröffentlicht Inkling: 975 Milliarden Parameter, offene Gewichte. Laut der Firma bewusst nicht das stärkste Modell – sondern ein Rohling zum Feintunen.

Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Kimi K3 erreicht Frontier-Niveau – und beendet die Billig-Ära

Moonshot AI hat Kimi K3 vorgestellt: 2,8 Billionen Parameter, eine Million Token Kontext, offene Gewichte ab dem 27. Juli. Das Modell spielt auf Augenhöhe mit den besten US-Systemen – und kostet dreimal so viel wie sein Vorgänger. Die Zeit der chinesischen Kampfpreise ist damit vorbei.

Mehr aus Neue Modelle →