NewsKategorienNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Mistral Medium 3.5: Frankreich packt Chat, Reasoning und Code in ein 128B-Modell

Mistral hat Medium 3.5 ausgerollt – ein dichtes 128B-Modell mit 256k Kontext, das Chat, Reasoning und Coding in einem einzigen Set Gewichte vereint. 77,6 Prozent auf SWE-Bench, offene Gewichte unter modifizierter MIT-Lizenz und neue Cloud-Agenten in Vibe und Le Chat.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
3. MAI 2026
2 MIN. LESEZEIT
Skizze eines Schaltraums mit drei Reglern und einzelnem Signallicht, kinewsletter.ch Stil
Skizze eines Schaltraums mit drei Reglern und einzelnem Signallicht, kinewsletter.ch Stil
INHALT
0177,6 Prozent auf SWE-Bench – über Devstral hinaus02Vibe holt Coding-Agenten in die Cloud03Le Chat Work Mode: ein Agent für deinen Arbeitstag04Preis als Kampfansage an die US-Konkurrenz
INHALT
0177,6 Prozent auf SWE-Bench – über Devstral hinaus02Vibe holt Coding-Agenten in die Cloud03Le Chat Work Mode: ein Agent für deinen Arbeitstag04Preis als Kampfansage an die US-Konkurrenz
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Mistral Medium 3.5 schlägt Devstral 2 und positioniert Europa mit offenen Gewichten und kompakter 4-GPU-Architektur als Coding-Frontier-Alternative zu OpenAI und Anthropic.

Mistral hat sein neues Flagship vorgestellt – und damit gleich die ganze Coding-Pipeline neu gedacht. Mistral Medium 3.5 ist ein dichtes 128-Milliarden-Parameter-Modell mit 256k Kontextfenster, das Chat, Reasoning und Coding in einem einzigen Set Gewichte vereint. Veröffentlicht wurde es Ende April mit offenen Gewichten unter modifizierter MIT-Lizenz, gerade jetzt am Wochenende kommen die agentischen Aufsätze dazu.

77,6 Prozent auf SWE-Bench – über Devstral hinaus

Auf dem SWE-Bench Verified-Benchmark – dem Industriestandard für autonome Software-Engineering-Aufgaben – erreicht Medium 3.5 stolze 77,6 Prozent. Damit lässt es Mistrals eigenen Coding-Spezialisten Devstral 2 hinter sich und schlägt auch grössere Open-Weight-Konkurrenten wie Qwen3.5 397B. Der Reasoning-Aufwand ist pro Anfrage konfigurierbar: Schnelle Chat-Antwort oder mehrstufige agentische Schleife – alles dasselbe Modell.

Konkret heisst das: Du brauchst nicht mehr drei verschiedene Modelle für drei verschiedene Use Cases. Bemerkenswert ist auch die Effizienz – Medium 3.5 läuft bereits auf vier GPUs, sowohl on-prem als auch in der Cloud.

Vibe holt Coding-Agenten in die Cloud

Parallel zum Modell hat Mistral Remote Agents in Vibe lanciert. Statt Schritt-für-Schritt im Editor zu arbeiten, schickst du eine Aufgabe per CLI oder Le Chat in die Cloud, läufst mehrere Coding-Jobs parallel und bekommst eine Notification, wenn die Pull Request bereit liegt. Das Konzept entspricht dem, was Anthropic mit Claude Code Routines und OpenAI mit Codex Cloud-Tasks vormacht – Mistral zieht jetzt nach, ohne dafür proprietäre US-Infrastruktur zu brauchen.

Le Chat Work Mode: ein Agent für deinen Arbeitstag

Der dritte Baustein ist Work Mode in Le Chat, ebenfalls auf Medium 3.5 aufgesetzt. Der Modus arbeitet sich durch mehrstufige Aufgaben, ruft Tools parallel auf und bündelt typische Cross-Tool-Workflows: E-Mail, Messages und Kalender in einem Aufschlag durchgehen, Recherchen quer über Web und interne Dokumente fahren. Verfügbar ist Work Mode für Pro-, Team- und Enterprise-Kunden.

Mit Medium 3.5 muss Mistral nicht mehr drei Modelle hochziehen – Chat, Reasoning, Code laufen jetzt aus demselben Stamm.

Preis als Kampfansage an die US-Konkurrenz

Über die API kostet Medium 3.5 1,50 Dollar pro Million Input-Tokens und 7,50 Dollar Output. Das positioniert es deutlich unter Claude Sonnet 4.5 oder GPT-5.5, bei vergleichbaren oder besseren Coding-Werten. Die Kombination aus offenen Gewichten, kompakter Architektur und Cloud-Agenten zeigt, wo Europas Antwort auf das amerikanische Frontier-Tempo hinwill: nicht grösser, sondern besser geschnitten.

Quellen

Mistral AI – Remote agents in Vibe. Powered by Mistral Medium 3.5.↗ EXTERNER LINKHugging Face – Mistral-Medium-3.5-128B↗ EXTERNER LINKThe Decoder – Mistral's new flagship Medium 3.5 folds chat, reasoning, and code↗ EXTERNER LINKTesting Catalog – Mistral AI unveils Medium 3.5 and Work Mode for Le Chat↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Muratis erstes Modell ist offen – und bewusst nicht das beste

Thinking Machines Lab veröffentlicht Inkling: 975 Milliarden Parameter, offene Gewichte. Laut der Firma bewusst nicht das stärkste Modell – sondern ein Rohling zum Feintunen.

Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Kimi K3 erreicht Frontier-Niveau – und beendet die Billig-Ära

Moonshot AI hat Kimi K3 vorgestellt: 2,8 Billionen Parameter, eine Million Token Kontext, offene Gewichte ab dem 27. Juli. Das Modell spielt auf Augenhöhe mit den besten US-Systemen – und kostet dreimal so viel wie sein Vorgänger. Die Zeit der chinesischen Kampfpreise ist damit vorbei.

Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent
Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·10. JULI 2026

GPT-5.6 für alle: OpenAI bringt drei Modelle zu drei Preisen

Seit dem 9. Juli ist OpenAIs neue Generation GPT-5.6 öffentlich verfügbar – in drei Stufen namens Sol, Terra und Luna, deren Preise von 1 bis 30 Dollar pro Million Token reichen. Zuvor hatte eine staatliche Sicherheitsprüfung die Freigabe wochenlang verzögert.

Skizze zu Grok 4.5 von SpaceXAI, kinewsletter.ch Stil
Skizze zu Grok 4.5 von SpaceXAI, kinewsletter.ch Stil (dark)
NEUE MODELLE·9. JULI 2026

Grok 4.5: SpaceXAIs günstiger Angriff auf Claude Opus

SpaceXAI hat Grok 4.5 veröffentlicht – ein «Opus-class model» für Coding und agentische Aufgaben, das beim Output rund viermal günstiger ist als Claude Opus 4.8. Die Leistungsvergleiche stammen allerdings aus xAI-eigenen Benchmarks, und selbst dort liegt Grok nicht an der Spitze.

Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent
Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·7. JULI 2026

OpenAIs neue Sprachmodelle antworten schneller – und eines wird günstiger

OpenAI hat zwei neue Realtime-Sprachmodelle veröffentlicht: gpt-realtime-2.1 und die günstigere Mini-Variante. Beide reagieren dank besserem Caching mindestens 25 Prozent schneller – die Technik hinter Sprachassistenten und Telefon-Bots wird flüssiger und billiger.

Illustration eines offenen Serverschranks an einer Werkbank, kinewsletter.ch Stil
Illustration offener Serverschrank, kinewsletter.ch Stil Dark
NEUE MODELLE·7. JULI 2026

Tencent bringt Hy3: offenes 295-Milliarden-Modell, das über seiner Klasse boxt

Nur 21 Mrd. aktive Parameter, Apache-2.0-Lizenz und Self-Hosting: Tencents neues MoE-Modell zielt auf Effizienz statt Grösse.

Mehr aus Neue Modelle →