NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

MiniMax M3: viel Kontext, wenig Rechenaufwand

Das chinesische Labor MiniMax bringt mit M3 ein offenes Modell, das eine Million Token verarbeitet – und dafür nur ein Zwanzigstel der Rechenleistung des Vorgängers braucht. Gewichte folgen in zehn Tagen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
5. JUNI 2026
2 MIN. LESEZEIT
Handgezeichnete Skizze eines elektroblau leuchtenden Computerchips auf einem Holzschreibtisch, daneben eine Sanduhr, aufgefaecherte Buchseiten und eine Schreibtischlampe
Handgezeichnete Skizze eines elektroblau leuchtenden Computerchips auf einem Holzschreibtisch, daneben eine Sanduhr, aufgefaecherte Buchseiten und eine Schreibtischlampe (Dark Mode)
INHALT
01Eine Million Token, ein Zwanzigstel Rechenaufwand02Bilder, Videos und der eigene Desktop03Offen schlägt teuer
INHALT
01Eine Million Token, ein Zwanzigstel Rechenaufwand02Bilder, Videos und der eigene Desktop03Offen schlägt teuer
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Offene Modelle aus China holen rasant auf – M3 macht langen Kontext billig und setzt den westlichen Anbietern beim Preis zu.

Das chinesische KI-Labor MiniMax hat am 1. Juni sein neues Modell M3 vorgestellt – ein offenes Sprachmodell, das eine Million Wörter Kontext verarbeitet und dabei deutlich weniger Rechenleistung braucht als seine Vorgänger. Die API ist bereits live, die Modellgewichte und der technische Bericht sollen innerhalb von zehn Tagen frei verfügbar sein.

Eine Million Token, ein Zwanzigstel Rechenaufwand

Das Herzstück von M3 ist eine neue Technik namens MSA (MiniMax Sparse Attention). Vereinfacht gesagt löst sie ein altes Problem: Normalerweise steigt der Rechenaufwand eines Modells im Quadrat zur Textlänge – doppelt so viel Text bedeutet viermal so viel Arbeit. MSA filtert vorab, welche Textteile überhaupt zueinander gehören, und spart damit massiv.

Das Ergebnis ist beachtlich: Bei einem Kontext von einer Million Token – das sind grob 750'000 Wörter, etwa zehn dicke Romane auf einmal – braucht M3 laut MiniMax nur noch ein Zwanzigstel der Rechenleistung des Vorgängers M2. Die Antwortgeschwindigkeit liegt je nach Phase neun- bis fünfzehnmal höher.

Bilder, Videos und der eigene Desktop

M3 wurde von Anfang an multimodal trainiert. Es versteht also nicht nur Text, sondern auch Bilder und Videos – und kann sogar einen Computer selbstständig bedienen, etwa Programme öffnen und Daten eintippen. Beim Programmieren erreicht das Modell nach eigenen Angaben 59 Prozent im anspruchsvollen SWE-Bench-Pro-Test und schlägt damit GPT-5.5 und Gemini 3.1 Pro.

Wichtig zur Einordnung: Diese Zahlen stammen bislang von MiniMax selbst. Unabhängige Tests stehen noch aus, ebenso die versprochenen Modellgewichte.

Offen schlägt teuer

Für dich bedeutet das vor allem eines: Die offene Konkurrenz aus China holt rasant auf. Wer ein Modell mit derart langem Gedächtnis selbst betreiben will – etwa um sensible Firmendaten nicht in fremde Clouds zu schicken – bekommt mit M3 bald eine frei verfügbare Option. Der Einstieg ins Token-Abo beginnt bei 20 Dollar im Monat. Damit setzt MiniMax den westlichen Anbietern genau dort zu, wo es weh tut: beim Preis.

Quellen

MarkTechPost – MiniMax Releases MiniMax M3 with MSA Architecture Supporting 1M-Token Context↗ EXTERNER LINKMiniMax – Models Intro (offizielle Dokumentation)↗ EXTERNER LINKTech Times – MiniMax M3 Open-Weight Coding Model: Frontier Claims, Unverified Benchmarks↗ EXTERNER LINKPandaily – MiniMax Launches M3 Model With 1M Context and Native Multimodal Capabilities↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
Google
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
NEUE MODELLE·4. SEPTEMBER 2026

OpenAI ruft die AGI-Ära aus – mit GPT-6 Astra

OpenAI hat GPT-6 Astra veröffentlicht. Präsident Greg Brockman spricht vom «generationellen Sprung» und beendet das Briefing mit «Welcome to the AGI era».

Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Fei-Fei Lis Atlas baut 3D-Welten aus wenigen Fotos

World Labs hat Atlas vorgestellt: ein Weltmodell, das aus einer Handvoll Fotos begehbare 3D-Szenen erzeugt, rekonstruiert und simuliert — bis zu eine Minute Video in 1440p mit frei gewählter Kameraführung, wahlweise als echte 3D-Geometrie. Verfügbar ist es bisher nur im Early Access, und alle Vergleichszahlen stammen von World Labs selbst.

Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Muse Spark 1.3: Meta setzt auf sparsam statt Spitzenplatz

Meta hat Muse Spark 1.3 veröffentlicht: 62 Punkte im Artificial Analysis Intelligence Index, einen hinter Claude Opus 5 – aber zum Achtel des Preises von Claude Fable 5.1. Die beworbene Sparsamkeit stammt allerdings aus Metas eigener Messung, und die Open-Weights-Frage ist offener denn je.

Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Googles dritter Flash in sechs Wochen – plus ein Cyber-Modell

Gemini 3.8 Flash kostet gleich viel wie der Vorgänger – die Cyber-Variante gibt es nur für geprüfte Verteidiger. Das Frontier-Modell fehlt weiter.

Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·2. SEPTEMBER 2026

Claude Fable 5.1: stärker beim Coden, günstiger im Betrieb

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht: deutlich bessere Werte bei agentischem Coding und Recherche, dazu ein um 75 Prozent gesenkter Cache-Preis – doch bei voller Effort-Stufe rechnet Artificial Analysis vor, dass die Rechnung höher ausfällt als bei Opus 5.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Mehr aus Neue Modelle →