NewsKategorienNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

MiniMax M3: viel Kontext, wenig Rechenaufwand

Das chinesische Labor MiniMax bringt mit M3 ein offenes Modell, das eine Million Token verarbeitet – und dafür nur ein Zwanzigstel der Rechenleistung des Vorgängers braucht. Gewichte folgen in zehn Tagen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
5. JUNI 2026
2 MIN. LESEZEIT
Handgezeichnete Skizze eines elektroblau leuchtenden Computerchips auf einem Holzschreibtisch, daneben eine Sanduhr, aufgefaecherte Buchseiten und eine Schreibtischlampe
Handgezeichnete Skizze eines elektroblau leuchtenden Computerchips auf einem Holzschreibtisch, daneben eine Sanduhr, aufgefaecherte Buchseiten und eine Schreibtischlampe (Dark Mode)
INHALT
01Eine Million Token, ein Zwanzigstel Rechenaufwand02Bilder, Videos und der eigene Desktop03Offen schlägt teuer
INHALT
01Eine Million Token, ein Zwanzigstel Rechenaufwand02Bilder, Videos und der eigene Desktop03Offen schlägt teuer
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Offene Modelle aus China holen rasant auf – M3 macht langen Kontext billig und setzt den westlichen Anbietern beim Preis zu.

Das chinesische KI-Labor MiniMax hat am 1. Juni sein neues Modell M3 vorgestellt – ein offenes Sprachmodell, das eine Million Wörter Kontext verarbeitet und dabei deutlich weniger Rechenleistung braucht als seine Vorgänger. Die API ist bereits live, die Modellgewichte und der technische Bericht sollen innerhalb von zehn Tagen frei verfügbar sein.

Eine Million Token, ein Zwanzigstel Rechenaufwand

Das Herzstück von M3 ist eine neue Technik namens MSA (MiniMax Sparse Attention). Vereinfacht gesagt löst sie ein altes Problem: Normalerweise steigt der Rechenaufwand eines Modells im Quadrat zur Textlänge – doppelt so viel Text bedeutet viermal so viel Arbeit. MSA filtert vorab, welche Textteile überhaupt zueinander gehören, und spart damit massiv.

Das Ergebnis ist beachtlich: Bei einem Kontext von einer Million Token – das sind grob 750'000 Wörter, etwa zehn dicke Romane auf einmal – braucht M3 laut MiniMax nur noch ein Zwanzigstel der Rechenleistung des Vorgängers M2. Die Antwortgeschwindigkeit liegt je nach Phase neun- bis fünfzehnmal höher.

Bilder, Videos und der eigene Desktop

M3 wurde von Anfang an multimodal trainiert. Es versteht also nicht nur Text, sondern auch Bilder und Videos – und kann sogar einen Computer selbstständig bedienen, etwa Programme öffnen und Daten eintippen. Beim Programmieren erreicht das Modell nach eigenen Angaben 59 Prozent im anspruchsvollen SWE-Bench-Pro-Test und schlägt damit GPT-5.5 und Gemini 3.1 Pro.

Wichtig zur Einordnung: Diese Zahlen stammen bislang von MiniMax selbst. Unabhängige Tests stehen noch aus, ebenso die versprochenen Modellgewichte.

Offen schlägt teuer

Für dich bedeutet das vor allem eines: Die offene Konkurrenz aus China holt rasant auf. Wer ein Modell mit derart langem Gedächtnis selbst betreiben will – etwa um sensible Firmendaten nicht in fremde Clouds zu schicken – bekommt mit M3 bald eine frei verfügbare Option. Der Einstieg ins Token-Abo beginnt bei 20 Dollar im Monat. Damit setzt MiniMax den westlichen Anbietern genau dort zu, wo es weh tut: beim Preis.

Quellen

MarkTechPost – MiniMax Releases MiniMax M3 with MSA Architecture Supporting 1M-Token Context↗ EXTERNER LINKMiniMax – Models Intro (offizielle Dokumentation)↗ EXTERNER LINKTech Times – MiniMax M3 Open-Weight Coding Model: Frontier Claims, Unverified Benchmarks↗ EXTERNER LINKPandaily – MiniMax Launches M3 Model With 1M Context and Native Multimodal Capabilities↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent
Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·10. JULI 2026

GPT-5.6 für alle: OpenAI bringt drei Modelle zu drei Preisen

Seit dem 9. Juli ist OpenAIs neue Generation GPT-5.6 öffentlich verfügbar – in drei Stufen namens Sol, Terra und Luna, deren Preise von 1 bis 30 Dollar pro Million Token reichen. Zuvor hatte eine staatliche Sicherheitsprüfung die Freigabe wochenlang verzögert.

Skizze zu Grok 4.5 von SpaceXAI, kinewsletter.ch Stil
Skizze zu Grok 4.5 von SpaceXAI, kinewsletter.ch Stil (dark)
NEUE MODELLE·9. JULI 2026

Grok 4.5: SpaceXAIs günstiger Angriff auf Claude Opus

SpaceXAI hat Grok 4.5 veröffentlicht – ein «Opus-class model» für Coding und agentische Aufgaben, das beim Output rund viermal günstiger ist als Claude Opus 4.8. Die Leistungsvergleiche stammen allerdings aus xAI-eigenen Benchmarks, und selbst dort liegt Grok nicht an der Spitze.

Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent
Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·7. JULI 2026

OpenAIs neue Sprachmodelle antworten schneller – und eines wird günstiger

OpenAI hat zwei neue Realtime-Sprachmodelle veröffentlicht: gpt-realtime-2.1 und die günstigere Mini-Variante. Beide reagieren dank besserem Caching mindestens 25 Prozent schneller – die Technik hinter Sprachassistenten und Telefon-Bots wird flüssiger und billiger.

Illustration eines offenen Serverschranks an einer Werkbank, kinewsletter.ch Stil
Illustration offener Serverschrank, kinewsletter.ch Stil Dark
NEUE MODELLE·7. JULI 2026

Tencent bringt Hy3: offenes 295-Milliarden-Modell, das über seiner Klasse boxt

Nur 21 Mrd. aktive Parameter, Apache-2.0-Lizenz und Self-Hosting: Tencents neues MoE-Modell zielt auf Effizienz statt Grösse.

Illustration: Person am Schreibtisch, der Monitor schaltet sich wieder ein und ein Papierflieger kehrt durchs Fenster zurück – kinewsletter.ch Stil
Illustration Dark Mode: Person am Schreibtisch, Monitor schaltet sich wieder ein – kinewsletter.ch Stil
KI-TOOLS & APPS·2. JULI 2026

Claude Fable 5 ist zurück – mit Gratis-Woche und Benchmark-Sieg

Nach drei Wochen Zwangspause ist Anthropics stärkstes Modell wieder online – bis zum 7. Juli sogar gratis. Und ein neuer Benchmark zeigt, warum das mehr ist als ein Software-Update.

Handgezeichnete Skizze eines Kontrollraums mit Schaltpult und einem heruntergezogenen blauen Hebel, elektroblauer Akzent
Handgezeichnete Skizze eines Kontrollraums mit Schaltpult und einem heruntergezogenen blauen Hebel, elektroblauer Akzent (Dark Mode)
NEUE MODELLE·1. JULI 2026

Claude Sonnet 5: fast Opus-Niveau zum Sonnet-Preis

Anthropics neues Modell Claude Sonnet 5 reicht nahe an das Spitzenmodell Opus 4.8 heran – zum Einführungspreis von 2 statt 5 Dollar pro Million Token. Agentische KI, die eben noch ein Premium-Budget verlangte, wird damit alltagstauglich.

Mehr aus Neue Modelle →