NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

MiniMax M3: viel Kontext, wenig Rechenaufwand

Das chinesische Labor MiniMax bringt mit M3 ein offenes Modell, das eine Million Token verarbeitet – und dafür nur ein Zwanzigstel der Rechenleistung des Vorgängers braucht. Gewichte folgen in zehn Tagen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
5. JUNI 2026
2 MIN. LESEZEIT
Handgezeichnete Skizze eines elektroblau leuchtenden Computerchips auf einem Holzschreibtisch, daneben eine Sanduhr, aufgefaecherte Buchseiten und eine Schreibtischlampe
Handgezeichnete Skizze eines elektroblau leuchtenden Computerchips auf einem Holzschreibtisch, daneben eine Sanduhr, aufgefaecherte Buchseiten und eine Schreibtischlampe (Dark Mode)
INHALT
01Eine Million Token, ein Zwanzigstel Rechenaufwand02Bilder, Videos und der eigene Desktop03Offen schlägt teuer
INHALT
01Eine Million Token, ein Zwanzigstel Rechenaufwand02Bilder, Videos und der eigene Desktop03Offen schlägt teuer
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Offene Modelle aus China holen rasant auf – M3 macht langen Kontext billig und setzt den westlichen Anbietern beim Preis zu.

Das chinesische KI-Labor MiniMax hat am 1. Juni sein neues Modell M3 vorgestellt – ein offenes Sprachmodell, das eine Million Wörter Kontext verarbeitet und dabei deutlich weniger Rechenleistung braucht als seine Vorgänger. Die API ist bereits live, die Modellgewichte und der technische Bericht sollen innerhalb von zehn Tagen frei verfügbar sein.

Eine Million Token, ein Zwanzigstel Rechenaufwand

Das Herzstück von M3 ist eine neue Technik namens MSA (MiniMax Sparse Attention). Vereinfacht gesagt löst sie ein altes Problem: Normalerweise steigt der Rechenaufwand eines Modells im Quadrat zur Textlänge – doppelt so viel Text bedeutet viermal so viel Arbeit. MSA filtert vorab, welche Textteile überhaupt zueinander gehören, und spart damit massiv.

Das Ergebnis ist beachtlich: Bei einem Kontext von einer Million Token – das sind grob 750'000 Wörter, etwa zehn dicke Romane auf einmal – braucht M3 laut MiniMax nur noch ein Zwanzigstel der Rechenleistung des Vorgängers M2. Die Antwortgeschwindigkeit liegt je nach Phase neun- bis fünfzehnmal höher.

Bilder, Videos und der eigene Desktop

M3 wurde von Anfang an multimodal trainiert. Es versteht also nicht nur Text, sondern auch Bilder und Videos – und kann sogar einen Computer selbstständig bedienen, etwa Programme öffnen und Daten eintippen. Beim Programmieren erreicht das Modell nach eigenen Angaben 59 Prozent im anspruchsvollen SWE-Bench-Pro-Test und schlägt damit GPT-5.5 und Gemini 3.1 Pro.

Wichtig zur Einordnung: Diese Zahlen stammen bislang von MiniMax selbst. Unabhängige Tests stehen noch aus, ebenso die versprochenen Modellgewichte.

Offen schlägt teuer

Für dich bedeutet das vor allem eines: Die offene Konkurrenz aus China holt rasant auf. Wer ein Modell mit derart langem Gedächtnis selbst betreiben will – etwa um sensible Firmendaten nicht in fremde Clouds zu schicken – bekommt mit M3 bald eine frei verfügbare Option. Der Einstieg ins Token-Abo beginnt bei 20 Dollar im Monat. Damit setzt MiniMax den westlichen Anbietern genau dort zu, wo es weh tut: beim Preis.

Quellen

MarkTechPost – MiniMax Releases MiniMax M3 with MSA Architecture Supporting 1M-Token Context↗ EXTERNER LINKMiniMax – Models Intro (offizielle Dokumentation)↗ EXTERNER LINKTech Times – MiniMax M3 Open-Weight Coding Model: Frontier Claims, Unverified Benchmarks↗ EXTERNER LINKPandaily – MiniMax Launches M3 Model With 1M Context and Native Multimodal Capabilities↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
Illustration einer Schlosserwerkbank mit blauem Vorhaengeschloss im Schraubstock, kinewsletter.ch Stil
NEUE MODELLE·28. JULI 2026

Microsoft baut sein erstes Cyber-Modell – und braucht OpenAI weiter

Microsoft AI hat MAI-Cyber-1-Flash vorgestellt, das erste eigene Modell nur für Cybersecurity. Laut Microsoft erreicht es im Verbund mit dem Agenten-System MDASH 96 Prozent auf dem Benchmark CyberGym und halbiert die Kosten. Die härtesten 10 Prozent der Fälle gehen aber weiterhin an GPT-5.4 von OpenAI.

Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
Illustration eines blauen Blitzes mit Stoppuhr und Schloss, kinewsletter.ch Stil
NEUE MODELLE·23. JULI 2026

Google bringt Gemini 3.6 Flash – schneller und günstiger

Google veröffentlicht Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber. Das Aufmacher-Modell ist gleichzeitig günstiger und effizienter als sein Vorgänger und braucht rund 17 Prozent weniger Ausgabe-Tokens.

Illustration einer Schaltzentrale mit elektroblauen Monitoren, kinewsletter.ch Stil
Illustration einer Schaltzentrale mit elektroblauen Monitoren, kinewsletter.ch Stil
NEUE MODELLE·21. JULI 2026

Alibaba zeigt Qwen3.8 – angeblich Nummer zwei hinter Fable 5

Alibaba hat an der World AI Conference in Shanghai Qwen3.8-Max vorgestellt – ein multimodales Modell mit angeblich 2,4 Billionen Parametern, das nur Anthropics Fable 5 nachstehen soll. Belegt ist davon noch nichts: keine Benchmarks, keine Lizenz, keine offenen Gewichte. Der Release zeigt vor allem, wie schnell Chinas Labore an die Weltspitze drängen.

Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Muratis erstes Modell ist offen – und bewusst nicht das beste

Thinking Machines Lab veröffentlicht Inkling: 975 Milliarden Parameter, offene Gewichte. Laut der Firma bewusst nicht das stärkste Modell – sondern ein Rohling zum Feintunen.

Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Kimi K3 erreicht Frontier-Niveau – und beendet die Billig-Ära

Moonshot AI hat Kimi K3 vorgestellt: 2,8 Billionen Parameter, eine Million Token Kontext, offene Gewichte ab dem 27. Juli. Das Modell spielt auf Augenhöhe mit den besten US-Systemen – und kostet dreimal so viel wie sein Vorgänger. Die Zeit der chinesischen Kampfpreise ist damit vorbei.

Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent
Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·10. JULI 2026

GPT-5.6 für alle: OpenAI bringt drei Modelle zu drei Preisen

Seit dem 9. Juli ist OpenAIs neue Generation GPT-5.6 öffentlich verfügbar – in drei Stufen namens Sol, Terra und Luna, deren Preise von 1 bis 30 Dollar pro Million Token reichen. Zuvor hatte eine staatliche Sicherheitsprüfung die Freigabe wochenlang verzögert.

Mehr aus Neue Modelle →