NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

600-Milliarden-Modell für einen Dollar pro Million Token

StepFun hat am 20. September 2026 Step 5 Preview gestartet: ein Sparse-MoE-Modell mit rund 600 Milliarden Parametern, 1 Million Token Kontext und einem Listenpreis von 1 US-Dollar pro Million Input-Token. Die Gewichte sollen am 15. Oktober offengelegt werden.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
21. SEPTEMBER 2026
2 MIN. LESEZEIT
Skizze einer Waage mit Münzen und Dokumentenstapel in Elektroblau, kinewsletter.ch Stil
Skizze einer Waage mit Münzen und Dokumentenstapel in Elektroblau, kinewsletter.ch Stil
INHALT
0127 von 600 Milliarden pro Token02Für Schweizer KMU zählt der 15. Oktober03Was bis zum Gewichts-Drop offen bleibt
INHALT
0127 von 600 Milliarden pro Token02Für Schweizer KMU zählt der 15. Oktober03Was bis zum Gewichts-Drop offen bleibt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Frontier-nahe Qualität wird zur Commodity — für Schweizer KMU zählt aber weniger die China-API als die Frage, ob sie die Gewichte ab Mitte Oktober selbst hosten können.

Das chinesische KI-Labor StepFun hat am 20. September 2026 Step 5 Preview vorgestellt und die API noch am selben Tag geöffnet. Laut StepFun ist es ein Sparse-MoE-Modell — eine Mixture of Experts, bei der je nach Aufgabe nur ein Teil des Netzwerks rechnet — mit rund 600 Milliarden Parametern insgesamt, von denen pro Token nur etwa 27 Milliarden aktiv sind. Dazu kommen 1 Million Token Kontext und Bild-Input. Der Listenpreis: 1 US-Dollar pro Million Input-Token, 2.70 Dollar für Output, 0.05 Dollar bei einem Cache-Treffer.

27 von 600 Milliarden pro Token

Nur rund 4.5 Prozent der Gewichte werden pro Token angefasst — daher der Preis. StepFun gibt für das Modell 44 Punkte im Artificial Analysis Intelligence Index an. Zum Einordnen: Auf der öffentlichen Rangliste von Artificial Analysis steht Kimi K3 (max) ebenfalls bei 44, GLM-5.3 (max) bei 45, die Spitze — Claude Fable 5.1 und GPT-6 Astra — bei 53. Der Wert für Step 5 Preview ist bisher eine Herstellerangabe und erscheint in der öffentlichen Übersicht von Artificial Analysis noch nicht.

Aussagekräftiger sind zwei Langzeit-Experimente aus StepFuns Ankündigung: Das Modell optimierte in einem 24-Stunden-Budget einen GPU-Kernel auf einer einzelnen Nvidia H100 und erreichte nach rund 22 Stunden 508 TFLOPS. Eine automatisierte Post-Training-Schleife hob ausserdem die AIME24-Genauigkeit eines Qwen3-30B-A3B-Basismodells von 53.3 auf 60 Prozent.

WEITERLESENDas könnte dich auch interessieren.

Skizze eines Mikrofons mit Sprachwellen in Elektroblau, kinewsletter.ch Stil
Skizze eines Mikrofons mit Sprachwellen in Elektroblau, kinewsletter.ch Stil

Für Schweizer KMU zählt der 15. Oktober

Solange das Modell nur als API aus China läuft, ist es für dich vor allem ein Kostenargument — und ein Datenschutzthema. Für die Bekanntgabe von Personendaten ins Ausland verlangt das revidierte Schweizer Datenschutzgesetz einen angemessenen Schutz; China steht nicht auf der Länderliste des Bundesrats, es braucht also zusätzliche Garantien wie Standardvertragsklauseln.

Spannender wird der 15. Oktober 2026, wenn StepFun die Gewichte offenlegen will. Selbst betreiben liesse sich das Modell dann zwar grundsätzlich — nur nicht auf dem Server im Keller: 600 Milliarden Parameter brauchen in BF16 rund 1.2 Terabyte Speicher, noch ohne Kontext. Wer heute souverän arbeiten will, fährt mit kleineren offenen Modellen besser, etwa dem an ETH Zürich, EPFL und CSCS entwickelten Apertus.

Was bis zum Gewichts-Drop offen bleibt

Unter welcher Lizenz und auf welcher Plattform die Gewichte erscheinen, hat StepFun bisher nicht mitgeteilt — davon hängt ab, ob Schweizer Firmen das Modell kommerziell nutzen dürfen. Bis dahin gilt: Für Agenten-Workloads mit sehr langen Kontexten lohnt der Blick auf die Preisliste. Für alles mit Personendaten wartest du besser auf den Oktober.

Quellen

Step 5 Preview: Advancing the Pareto Frontier (StepFun)↗ EXTERNER LINKStepFun Launches Step 5 Preview: A 600B-Total, 27B-Active MoE Model With 1M Context (MarkTechPost)↗ EXTERNER LINKStepFun Launches Step 5 Preview: 600B Sparse MoE, 1M Context, Weights Open Oct 15 (Pandaily)↗ EXTERNER LINKComparison of AI Models across Intelligence, Performance, and Price (Artificial Analysis)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicNvidiaETH ZürichEPFL
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
NEUE MODELLE·16. SEPTEMBER 2026

Gemini 3.8 Live: Google unterbietet OpenAI beim Sprechen

Googles neue Sprachmodelle wechseln mitten im Gespräch zwischen 97 Sprachen und erledigen Tool-Calls im Hintergrund – zu einem Bruchteil der Kosten der Konkurrenz.

Handgezeichnete Illustration: Dirigentenpodest mit Notenstaender vor leeren Orchesterstuehlen, kinewsletter.ch Stil
Handgezeichnete Illustration: Dirigentenpodest mit Notenstaender vor leeren Orchesterstuehlen, kinewsletter.ch Stil
NEUE MODELLE·12. SEPTEMBER 2026

Sakana teilt Fugu auf: ein Modell, das andere Modelle dirigiert

Sakana AI hat Fugu Max und Fugu Ultra v2 veröffentlicht. Beide sind keine klassischen Sprachmodelle, sondern gelernte Dirigenten, die Aufgaben auf einen Pool anderer Modelle verteilen. Fugu Max kostet 2 US-Dollar pro Million Input-Token – und die Schweiz fällt nicht unter den EU-Ausschluss.

Illustration einer festgezurrten blauen Transportkiste vor einem Stapel leerer Holzkisten, kinewsletter.ch Stil
Illustration einer festgezurrten blauen Transportkiste vor einem Stapel leerer Holzkisten, kinewsletter.ch Stil
NEUE MODELLE·11. SEPTEMBER 2026

DeepSeek macht KI-Agenten radikal billiger – mit einem Speichertrick

DeepSeeks neues Modell V4.1-Flash braucht nur noch ein Viertel Speicher – und schlägt auf einem Coding-Benchmark knapp Claude Opus 5. Die Gewichte stehen unter MIT-Lizenz.

Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
NEUE MODELLE·4. SEPTEMBER 2026

OpenAI ruft die AGI-Ära aus – mit GPT-6 Astra

OpenAI hat GPT-6 Astra veröffentlicht. Präsident Greg Brockman spricht vom «generationellen Sprung» und beendet das Briefing mit «Welcome to the AGI era».

Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Fei-Fei Lis Atlas baut 3D-Welten aus wenigen Fotos

World Labs hat Atlas vorgestellt: ein Weltmodell, das aus einer Handvoll Fotos begehbare 3D-Szenen erzeugt, rekonstruiert und simuliert — bis zu eine Minute Video in 1440p mit frei gewählter Kameraführung, wahlweise als echte 3D-Geometrie. Verfügbar ist es bisher nur im Early Access, und alle Vergleichszahlen stammen von World Labs selbst.

Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Muse Spark 1.3: Meta setzt auf sparsam statt Spitzenplatz

Meta hat Muse Spark 1.3 veröffentlicht: 62 Punkte im Artificial Analysis Intelligence Index, einen hinter Claude Opus 5 – aber zum Achtel des Preises von Claude Fable 5.1. Die beworbene Sparsamkeit stammt allerdings aus Metas eigener Messung, und die Open-Weights-Frage ist offener denn je.

Mehr aus Neue Modelle →