NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

DeepSeek macht 75-Prozent-Rabatt permanent – und ist 34-mal günstiger als GPT-5.5

Der chinesische Anbieter DeepSeek macht den 75-Prozent-Rabatt auf sein Flaggschiff V4-Pro dauerhaft. Output-Tokens kosten 34-mal weniger als GPT-5.5 – mit Compliance-Haken für die Schweiz.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
25. MAI 2026
3 MIN. LESEZEIT
Skizze DeepSeek Preisschild mit Walfisch und wankenden Konkurrenz-Türmen
Skizze DeepSeek Preisschild Dark Mode, kinewsletter.ch Stil
INHALT
01Aus der Promo wird der neue Preis02Architektur und Hardware machen es möglich03Reaktion der Konkurrenz: bisher still04Für dich konkret – und der Compliance-Haken05Ausblick
INHALT
01Aus der Promo wird der neue Preis02Architektur und Hardware machen es möglich03Reaktion der Konkurrenz: bisher still04Für dich konkret – und der Compliance-Haken05Ausblick
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

DeepSeek zementiert seinen Preiskampf-Vorsprung – wer auf Open-Weights ausweicht, kann den Schweizer Datenschutz-Vorteil sogar mitnehmen.

Der chinesische KI-Anbieter DeepSeek hat am 22. Mai bekannt gegeben, dass der ursprünglich befristete 75-Prozent-Rabatt auf sein Flaggschiff-Modell V4-Pro nicht ausläuft – sondern zum dauerhaften neuen Standardpreis wird. Output-Tokens kosten jetzt rund 34-mal weniger als bei GPT-5.5.

Aus der Promo wird der neue Preis

Der Rabatt sollte ursprünglich am 31. Mai um 15:59 UTC enden. Stattdessen kommuniziert DeepSeek auf WeChat und X: Die reduzierten Preise bleiben. Konkret heisst das pro Million Tokens:

  • Input (Cache-Miss): $0.435 (vorher $1.74)
  • Input (Cache-Hit): $0.003625 (vorher $0.0145)
  • Output: $0.87 (vorher $3.48)

Zum Vergleich: Bei GPT-5.5 zahlst du derzeit $5 pro Million Input-Tokens und $30 pro Million Output-Tokens. Bei Claude Opus 4.7 sind es $5 Input und $25 Output. Damit ist DeepSeek V4-Pro je nach Tarif 11- bis 34-mal günstiger als die westlichen Frontier-Modelle – bei einem Kontextfenster von 1 Million Tokens und kompatibel mit OpenAI- und Anthropic-API-Formaten.

Architektur und Hardware machen es möglich

V4-Pro nutzt laut DeepSeek einen hybriden Aufmerksamkeitsmechanismus, der die Rechenlast pro Inferenz auf rund 27 Prozent der Vorgängergeneration drückt und den Speicherbedarf auf ein Zehntel. Bloomberg und Cryptopolitan vermuten zudem, dass DeepSeek inzwischen Huawei Ascend 950-Chips in grösserer Stückzahl nutzt – statt der unter US-Exportkontrolle stehenden Nvidia-Hardware. DeepSeek selbst kommentiert das nicht, aber genau diese Hardware-Unabhängigkeit würde die Marge selbst zu Schleuderpreisen erklären.

Der Effekt: Was als Marketing-Aktion gestartet ist, wird zum strukturellen Wettbewerbsmoat. The Decoder spricht von einer neuen Eskalationsstufe im globalen Preiskrieg.

Reaktion der Konkurrenz: bisher still

OpenAI, Anthropic und Google haben sich bisher nicht öffentlich zu DeepSeeks Permanent-Pricing geäussert. Das ist auffällig, denn die strategische Lage ist unbequem: GPT-5.5 wurde gegenüber GPT-5.4 sogar im Preis verdoppelt (Input von $2.50 auf $5), Claude bleibt stabil, aber alle westlichen Frontier-Modelle sind jetzt zehn- bis dreissigmal teurer als der chinesische Marktführer mit vergleichbarem Kontextfenster.

Für dich konkret – und der Compliance-Haken

Für Schweizer Unternehmen verändert sich die Make-or-Buy-Rechnung. Ein KMU, das heute CHF 5'000 pro Monat für GPT-5.5-basierte Workflows ausgibt, käme auf DeepSeek V4-Pro mit vergleichbarer Modellklasse auf rund CHF 150 bis 450 pro Monat. Bei Customer-Support-Bots, RAG-Pipelines oder grossvolumiger Dokumentenverarbeitung sind das schnell fünfstellige Einsparungen pro Jahr.

Aber: DeepSeek ist ein chinesisches Unternehmen, und die offizielle API verarbeitet Daten in China. Das kollidiert direkt mit:

  • revDSG/EDÖB-Anforderungen für Personendaten
  • FINMA-Outsourcing-Richtlinien im Finanzsektor
  • Berufsgeheimnissen (Anwälte, Ärzte, Treuhänder)
  • Intern oft strengen «No-China»-Policies in regulierten Branchen

Der Workaround: DeepSeek-Modelle sind Open Weights. Du kannst sie über Anbieter wie OpenRouter, Together AI oder Fireworks beziehen – oder bei Schweizer Hostern wie Exoscale oder Infomaniak auf europäischen GPUs selbst betreiben. Dann bleibt der Preisvorteil, aber die Daten verlassen die Schweiz nicht.

Ausblick

Der Preiskrieg um Frontier-Modelle ist seit April 2026 spürbar – DeepSeek hatte damals bereits Zhipu und MiniMax in China unter Druck gesetzt. Mit der Permanent-Erklärung verlagert sich der Druck jetzt internationale. Für die nächsten Monate erwartet The Next Web Reaktionen aus dem Westen: entweder direkte Preissenkungen bei OpenAI und Anthropic – oder eine stärkere Betonung von Latenz, Zuverlässigkeit und Datenschutz als Differenzierungsmerkmale.

Quellen

DeepSeek API Pricing (offiziell)↗ EXTERNER LINKBloomberg↗ EXTERNER LINKThe Decoder (DE)↗ EXTERNER LINKEngadget↗ EXTERNER LINKThe Next Web↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
DeepSeekAnthropicOpenAINvidiaGoogle
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Mehr aus Neue Modelle →