NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
27. AUGUST 2026
3 MIN. LESEZEIT
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
INHALT
01Sechs Milliarden Parameter, die wirklich rechnen02Der Benchmark-Vorsprung hat ein Sternchen03Offene Gewichte, aber keine Apache-Lizenz
INHALT
01Sechs Milliarden Parameter, die wirklich rechnen02Der Benchmark-Vorsprung hat ein Sternchen03Offene Gewichte, aber keine Apache-Lizenz
Inoo GmbH
Präsentiert & entwickelt von
kinewsletter.ch ist ein Projekt der Inoo GmbH

KI-Beratung und Softwareentwicklung aus dem St. Galler Rheintal.

inoo.ch →
DAS WICHTIGSTE IN KÜRZE

Sparsame Architektur schlägt rohe Grösse: Qwen trainiert für ein Neuntel der Kosten des Vorgängers und unterbietet das eigene Flaggschiff um den Faktor zwölf – der Haken sind Herstellerbenchmarks und eine Lizenz, die keine Apache 2.0 ist.

Alibabas Qwen-Team hat am 26. August Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 bereits vorwegnimmt. Es trägt 125 Milliarden Parameter, rechnet pro Token aber nur mit 6 Milliarden davon und kostet über die QwenCloud-API 0.16 Dollar pro Million Eingabe- und 0.47 Dollar pro Million Ausgabe-Tokens. Zum Vergleich: Alibabas eigenes Flaggschiff Qwen3.8-Max verlangt 2 beziehungsweise 6 Dollar – rund das Zwölffache.

Sechs Milliarden Parameter, die wirklich rechnen

Möglich macht das eine Mixture-of-Experts-Architektur: Statt das ganze Netzwerk zu aktivieren, schickt das Modell jedes Token nur durch eine kleine Auswahl von Spezialisten – hier 10 von 512, plus einen fest aktiven. Dazu kommt eine neue N-gram-Embedding-Schicht mit 51 Milliarden Parametern: eine Art Nachschlagetabelle für häufige Wortgruppen, die sich in normalen Arbeitsspeicher auslagern lässt, statt teuren GPU-Speicher zu belegen.

Der Effekt aufs Budget ist der eigentliche Punkt: Laut dem Qwen-Team hat das Training nur rund ein Neuntel dessen gekostet wie beim Vorgänger Qwen3.7-Plus – und liefert trotzdem bessere Ergebnisse beim Programmieren und bei Büroaufgaben. Das Kontextfenster liegt nativ bei 262'144 Tokens und lässt sich auf eine Million erweitern.

Der Benchmark-Vorsprung hat ein Sternchen

Qwens veröffentlichte Zahlen sind eindrücklich: 58.7 Punkte auf DeepSWE 1.1, 62.5 auf SWE-bench Pro – Tests, bei denen eine KI eigenständig Fehler in echten Software-Projekten finden und beheben muss. Claude Opus 4.6 kommt dort auf 53.4. Bei Büroaufgaben ist der Abstand noch grösser: 73.9 gegenüber 45.1 für DeepSeek-V4-Flash auf CoWorkBench, 55.7 gegenüber 27.6 für den eigenen Vorgänger auf JobBench.

Der Haken: Das sind durchwegs Herstellerangaben, gemessen auf Qwens eigenen Test-Aufbauten. Unabhängige Nachmessungen fehlen bislang. Und Flash-Next führt nicht überall – auf «Humanity's Last Exam» liegt Claude Opus 4.6 mit 40.0 zu 35.9 vorn, auf NL2Repo-Bench DeepSeek-V4-Flash mit 54.2 zu 48.1.

Offene Gewichte, aber keine Apache-Lizenz

Für Schweizer Firmen steckt der interessanteste Teil im Kleingedruckten. Die Gewichte stehen auf Hugging Face zum Download – aber unter der Qwen Community License 1.0, nicht unter Apache 2.0 wie das kleinere Qwen3.8-27B. Interner Einsatz im eigenen Betrieb ist erlaubt. Wer das Modell dagegen als API weiterverkauft oder daraus ein eigenständiges KI-Produkt für Coding oder Büroarbeit baut, braucht laut Lizenztext eine separate Vereinbarung mit Qwen.

Auch die On-Prem-Rechnung geht nur bedingt auf: Die Gewichte sind selbst in der komprimierten FP8-Variante rund 173 Gigabyte gross, in voller Präzision 335. Das ist ein Server mit mehreren GPUs, keine Workstation im Büroschrank. Für ein KMU, das seine Daten im Haus behalten will, führt der Weg damit über einen Hosting-Partner mit passender Hardware.

Bleibt der Preisdruck. Wenn ein Modell dieser Klasse für 0.16 Dollar pro Million Tokens läuft, wird es für OpenAI und Anthropic schwieriger, Aufpreise für Standardaufgaben zu rechtfertigen. Und Qwen4, das auf genau dieser Architektur aufbauen soll, ist noch gar nicht da.

Quellen

Qwen3.8-Flash-Next – Modelcard (Hugging Face, Primärquelle)↗ EXTERNER LINKQwen Community License 1.0 – Volltext (Hugging Face)↗ EXTERNER LINKQwen3.8-Flash-Next-FP8 – Modelcard (Hugging Face)↗ EXTERNER LINKQwenLM/Qwen3.8-Flash-Next – README und Tech Report (GitHub)↗ EXTERNER LINKQwen3.8-Flash-Next – Ankündigung im Qwen-Blog↗ EXTERNER LINKQwen3.8-Flash – Preise und Limits (QwenCloud)↗ EXTERNER LINKQwen3.8-Max – Vergleichspreise (QwenCloud)↗ EXTERNER LINKQwen3.8-Flash-Next (ModelScope)↗ EXTERNER LINKAlibaba releases Qwen3.8-Flash-Next, targeting 'ultimate cost efficiency' (The Decoder)↗ EXTERNER LINKQwen3.8-Flash-Next Previews Qwen4 Architecture With 6B Active Parameters (Unite.AI)↗ EXTERNER LINKAlibaba's Qwen Team Releases Qwen3.8-Flash-Next (MarkTechPost)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicDeepSeekHugging FaceOpenAI
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze eines Sortierraums mit Fächerwand, blauer Stoppuhr auf dem Tisch, drei blau gefüllten Fächern und einem Briefstapel
Handgezeichnete Skizze eines Sortierraums mit Fächerwand, blauer Stoppuhr auf dem Tisch, drei blau gefüllten Fächern und einem Briefstapel
NEUE MODELLE·11. OKTOBER 2026

Microsoft Decision-1: Entscheiden statt schreiben

Microsoft startet Decision-1, ein Modell, das für Antwortoptionen Wahrscheinlichkeiten liefert statt Text. Laut Microsoft ist es 35-mal schneller als GPT-6 Sol und kostet 0,042 Dollar pro Million Input-Tokens. Alle Zahlen sind Herstellerangaben.

Handgezeichnete Skizze einer grossen Holzkiste mit blauer Seilschleife, die an einem Flaschenzug in einer Lagerhalle hängt, daneben Wandkalender und Stroh
Handgezeichnete Skizze einer grossen Holzkiste mit blauer Seilschleife, die an einem Flaschenzug in einer Lagerhalle hängt, daneben Wandkalender und Stroh
NEUE MODELLE·8. OKTOBER 2026

Mistral Large 4: Eine Billion Parameter aus Europa

Mistral stellt Large 4 als öffentliche Vorschau vor: rund eine Billion Parameter, in Europa trainiert, offene Gewichte bis Ende Oktober. Die Benchmarks sind Herstellerangaben, die Lizenz ist noch offen. Wir ordnen ein, was das für Schweizer Firmen heisst.

Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
NEUE MODELLE·6. OKTOBER 2026

Reflection AI zeigt Beam, offenes Modell gegen China

Das US-Start-up Reflection AI stellt Beam vor, ein Modell mit offenen Gewichten und 501 Milliarden Parametern. Es soll chinesischen Modellen mit deutlich weniger Rechenaufwand Konkurrenz machen. Alle Zahlen sind Herstellerangaben, die Gewichte folgen im Oktober.

Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt; die Maske ist leuchtend blau.
Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt
NEUE MODELLE·3. OKTOBER 2026

Tavus: Fast jeder Zweite hält KI-Avatar Griffin für echt

Das US-Startup Tavus meldet, dass 48 Prozent der Testpersonen seinen KI-Videoavatar Griffin nach einer Minute für einen Menschen hielten. Die Zahl stammt vom Hersteller, die Stichprobe war mit 54 Personen klein. Für die Schweiz ist sie trotzdem ein Warnsignal, weil Betrüger Video-Fälschungen bisher selten, Stimmklone dafür umso öfter einsetzen.

Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
NEUE MODELLE·1. OKTOBER 2026

Gemini 4 Argon: Google startet bei den Cyber-Verteidigern

Google stellt Gemini 4 Argon vor, zunächst nur für ausgewählte Cybersecurity-Organisationen im Fairwind-Programm. Laut Google findet und patcht das Modell kritische Schwachstellen selbstständig. Wir ordnen Zahlen, Bloomberg-Zweifel und den Schweiz-Bezug ein.

Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
NEUE MODELLE·30. SEPTEMBER 2026

GPT-6.1 Sol: fast Astra-Niveau zu einem Fünftel des Preises

OpenAI hat am DevDay GPT-6.1 Sol vorgestellt: laut Hersteller fast auf Astra-Niveau, aber für 2 statt 10 Dollar pro Million Eingabe-Tokens. Die Fehlerrate sinkt gegenüber GPT-6 Sol von 11,4 auf 7,7 Prozent. Verfügbar in ChatGPT Work, Codex und API, nicht im normalen Chat.

Mehr aus Neue Modelle →