NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Qwen3.8-Max: Alibaba liefert nach – und verspricht offene Gewichte

Alibaba hat Qwen3.8-Max voll lanciert: 2,4 Billionen Parameter, 1 Million Token Kontext und Case Studies, in denen das Modell tagelang autonom arbeitet. Nächste Woche sollen die Gewichte folgen – es wäre das erste Max-Klasse-Modell, das offen verfügbar wird.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
4. AUGUST 2026
4 MIN. LESEZEIT
Illustration eines offenen Banktresors mit Büchern und einem Handwagen, Sketch-Stil mit elektroblauen Akzenten, kinewsletter.ch Stil
Illustration eines offenen Banktresors mit Büchern und einem Handwagen, Sketch-Stil mit elektroblauen Akzenten, kinewsletter.ch Stil
INHALT
0116 Tage programmieren, ohne dass ein Mensch eingreift02Benchmarks auf Frontier-Niveau – aber selbst gemessen03Offene Gewichte als Kampfansage an Kimi K304Läuft auch in Claude Code – so probierst du es aus
INHALT
0116 Tage programmieren, ohne dass ein Mensch eingreift02Benchmarks auf Frontier-Niveau – aber selbst gemessen03Offene Gewichte als Kampfansage an Kimi K304Läuft auch in Claude Code – so probierst du es aus
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Mit dem Vollrelease von Qwen3.8-Max und der angekündigten Gewichte-Veröffentlichung rückt erstmals ein Frontier-Modell der Max-Klasse in Reichweite der Open-Weights-Community. Alibabas Benchmark-Zahlen nahe Claude und GPT stammen aber aus eigenen Messungen – die unabhängige Bestätigung steht noch aus.

Alibaba hat am Montag Qwen3.8-Max vollständig lanciert – zwei Wochen, nachdem der Konzern das Modell als Preview angekündigt hatte, damals noch ohne Benchmarks und ohne Lizenz. Jetzt liegen die Zahlen auf dem Tisch: 2,4 Billionen Parameter in einer Mixture-of-Experts-Architektur (pro Anfrage sind nur 95 Milliarden davon aktiv), ein Kontextfenster von 1 Million Token und multimodale Fähigkeiten für Dokumente mit über 200 Seiten oder Videos von über 100 Stunden Länge. Der wichtigste Punkt aber: Nächste Woche will Alibaba die Modellgewichte auf Hugging Face und ModelScope veröffentlichen – es wäre das erste Modell der Max-Klasse, das offen verfügbar wird.

16 Tage programmieren, ohne dass ein Mensch eingreift

Alibaba positioniert Qwen3.8-Max nicht als Chatbot, sondern als Modell für Langzeit-Aufgaben: Arbeiten, die sich über Tage statt über einen einzelnen Prompt erstrecken. Belegen soll das eine Serie von Case Studies – alle aus eigenem Haus, also mit der nötigen Portion Skepsis zu lesen.

Die eindrücklichste: Das Modell entwickelte gemäss Qwen-Team 16 Tage lang autonom das Kommandozeilen-Tool oh-my-cli – nahm Nutzeranfragen entgegen, verwandelte sie in GitHub-Issues, schrieb Code, testete und verbesserte ihn. Bilanz: 265 Commits und 127 Pull Requests, ohne einen einzigen menschlichen Eingriff. In einem zweiten Versuch bekam das Modell ein Forschungspaper ohne Code und reproduzierte in rund fünf Tagen alle sechs Hauptresultate – mit 7'600 Zeilen selbst geschriebenem Code und 33 GPU-Trainingsläufen. Anschliessend übertraf es die Methode des Papers auf dem Mathe-Benchmark AIME24 um 2,7 Punkte. In einer weiteren Studie optimierte das Modell einen Krypto-Schaltkreis von 8'298 auf 678 Logikgatter; die Chipfläche schrumpfte dabei um 81 Prozent. Und in einem simulierten E-Commerce-Geschäftsjahr mit Taobao-Daten machte Qwen3.8-Max aus 100'000 Yuan Startkapital 416'252 Yuan – mehr als das Vierfache, und laut Alibaba 38 Prozent mehr als das zweitplatzierte Konkurrenzmodell GLM 5.2.

Benchmarks auf Frontier-Niveau – aber selbst gemessen

In den von Alibaba publizierten Vergleichstabellen landet Qwen3.8-Max nahe an oder über Claude Opus 4.8, Claude Fable 5 und GPT-5.6: 93 Punkte auf PaperBench (Bestwert im Vergleich), 86,6 auf TerminalBench 2.1 – dort knapp hinter GPT-5.6 mit 88,8. Wichtig: Das sind interne Messungen des Herstellers, eine unabhängige Verifizierung steht noch aus.

Einen ersten neutralen Anhaltspunkt liefert die Community-Rangliste Arena.AI, wo Nutzer Modelle blind vergleichen: Dort steht Qwen3.8-Max aktuell auf Platz 5 im Text-Ranking – als bestplatziertes chinesisches Modell, hinter vier Anthropic-Modellen. Bei der Bildanalyse reicht es sogar für Platz 2, nur 13 Punkte hinter Claude Fable 5. Auch die Entwickler-Community reagiert: Auf Hacker News sammelte die Ankündigung über 1'000 Punkte und mehr als 560 Kommentare.

Offene Gewichte als Kampfansage an Kimi K3

Der Zeitpunkt ist kein Zufall. Erst vor einer Woche hatte Moonshot AI Kimi K3 mit offenen Gewichten veröffentlicht – 2,8 Billionen Parameter, ebenfalls 1 Million Token Kontext. Wie inside-it.ch berichtet, beansprucht Alibaba, den heimischen Rivalen in mehreren Tests zu übertreffen. Sollten die Gewichte wie angekündigt erscheinen, hätten binnen zwei Wochen gleich zwei chinesische Frontier-Modelle den Weg in die Open-Weights-Welt gefunden – während die US-Labore ihre Spitzenmodelle geschlossen halten.

Die Börse honoriert den Schritt: Die Alibaba-Aktie legte in Hongkong 7 Prozent zu, die US-Titel stiegen laut CNBC vorbörslich um rund 4 Prozent.

Läuft auch in Claude Code – so probierst du es aus

Praktisch für Entwickler: Qwen3.8-Max unterstützt sowohl das OpenAI- als auch das Anthropic-API-Format und lässt sich damit direkt in Tools wie Claude Code oder Codex einklinken – als Drop-in-Ersatz für die dort üblichen Modelle. Verfügbar ist es ab sofort über Alibabas Cloud-APIs und OpenRouter; ein Parameter namens reasoning_effort regelt in drei Stufen, wie gründlich das Modell nachdenkt. Der Haken für den produktiven Einsatz: Die gehostete Variante läuft auf Alibaba-Infrastruktur – wer sensible Daten verarbeitet, wartet besser auf die offenen Gewichte und betreibt das Modell selbst oder bei einem Schweizer bzw. europäischen Hoster. Ob Alibaba das Versprechen nächste Woche einlöst, und unter welcher Lizenz, ist damit die eigentlich spannende Frage.

Quellen

Qwen Blog: Qwen3.8-Max – A New Bar for Coding and Cowork (Primärquelle)↗ EXTERNER LINKThe Decoder: Alibaba's open-weight Qwen3.8-Max takes on long-horizon AI tasks with 2.4 trillion parameters↗ EXTERNER LINKinside-it.ch: Alibaba will mit neuem KI-Modell Konkurrenz übertrumpfen↗ EXTERNER LINKCNBC: Alibaba shares rally after unveiling Qwen3.8-Max AI model↗ EXTERNER LINKSouth China Morning Post: Alibaba's AI model Qwen3.8-Max made widely accessible ahead of open-weights release↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer elektroblauen Filmkamera mit Filmrollen auf Holzstativ vor einem kleinen Studio-Set, kinewsletter.ch Stil
Illustration einer elektroblauen Filmkamera mit Filmrollen auf Holzstativ vor einem kleinen Studio-Set, kinewsletter.ch Stil
NEUE MODELLE·2. AUGUST 2026

ByteDance Seedance 2.5: 30-Sekunden-Videos mit Ton in einem Durchgang

ByteDance hat Seedance 2.5 vorgestellt: Das Videomodell generiert neu 30 Sekunden Video samt Ton in einem einzigen Durchgang – doppelt so viel wie der Vorgänger und rund dreimal so viel wie Googles Gemini Omni Flash. Clips lassen sich mehrfach zu Minuten-Videos verlängern. Verfügbar ist das Modell vorerst nur auf ByteDances China-Plattformen, die API soll folgen.

Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
KI-FORSCHUNG·2. AUGUST 2026

OpenAI kündigt Astra an – mit zehn gelösten Mathe-Problemen

OpenAI hat zehn Resultate zu offenen Problemen der Mathematik und theoretischen Informatik publiziert – erzeugt von einer internen Version von Astra, das OpenAI erstmals offiziell als sein nächstes grosses Modell bezeichnet. Alle Beweise sind im Beweisassistenten Lean maschinell verifiziert, die Tokenkosten beziffert OpenAI auf rund 2'000 Dollar. Die Mathe-Community reagiert zwischen Begeisterung und Sinnkrise.

Illustration einer Destillationsapparatur, die leuchtend blaue Flüssigkeit in einen kleinen Kolben tropft, kinewsletter.ch Stil
Illustration einer Destillationsapparatur, die leuchtend blaue Flüssigkeit in einen kleinen Kolben tropft, kinewsletter.ch Stil
NEUE MODELLE·1. AUGUST 2026

Inkling-Small: Muratis Viertel-Modell überholt sein eigenes Flaggschiff

Zwei Wochen nach seinem ersten offenen Modell legt Mira Muratis Thinking Machines Lab nach: Inkling-Small hat 276 Milliarden Parameter, steht unter Apache-2.0-Lizenz und landet laut Artificial Analysis nur einen Punkt hinter dem rund dreieinhalbmal grösseren Flaggschiff. Auf Coding-Benchmarks schlägt der Kleine das Original sogar.

Illustration eines grossen blauen Preisschilds an einer Schnur, das von einer Schere durchtrennt wird, kinewsletter.ch Stil
Illustration eines grossen blauen Preisschilds an einer Schnur, das von einer Schere durchtrennt wird, kinewsletter.ch Stil
NEUE MODELLE·1. AUGUST 2026

DeepSeek kontert OpenAI: Fast Luna-Niveau zu 60 Prozent tieferen Kosten

Keine 24 Stunden nach OpenAIs grosser Preissenkung legt DeepSeek nach: Das Update V4 Flash 0731 erreicht laut Artificial Analysis fast das Niveau von GPT-5.6 Luna – kostet pro Aufgabe aber rund 60 Prozent weniger. Die Modellgewichte sind frei verfügbar, unter MIT-Lizenz.

Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
NEUE MODELLE·28. JULI 2026

Microsoft baut sein erstes Cyber-Modell – und braucht OpenAI weiter

Microsoft AI hat MAI-Cyber-1-Flash vorgestellt, das erste eigene Modell nur für Cybersecurity. Laut Microsoft erreicht es im Verbund mit dem Agenten-System MDASH 96 Prozent auf dem Benchmark CyberGym und halbiert die Kosten. Die härtesten 10 Prozent der Fälle gehen aber weiterhin an GPT-5.4 von OpenAI.

Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
NEUE MODELLE·23. JULI 2026

Google bringt Gemini 3.6 Flash – schneller und günstiger

Google veröffentlicht Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber. Das Aufmacher-Modell ist gleichzeitig günstiger und effizienter als sein Vorgänger und braucht rund 17 Prozent weniger Ausgabe-Tokens.

Mehr aus Neue Modelle →