NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Inkling-Small: Muratis Viertel-Modell überholt sein eigenes Flaggschiff

Zwei Wochen nach seinem ersten offenen Modell legt Mira Muratis Thinking Machines Lab nach: Inkling-Small hat 276 Milliarden Parameter, steht unter Apache-2.0-Lizenz und landet laut Artificial Analysis nur einen Punkt hinter dem rund dreieinhalbmal grösseren Flaggschiff. Auf Coding-Benchmarks schlägt der Kleine das Original sogar.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
1. AUGUST 2026
2 MIN. LESEZEIT
Illustration einer Destillationsapparatur, die leuchtend blaue Flüssigkeit in einen kleinen Kolben tropft, kinewsletter.ch Stil
Illustration einer Destillationsapparatur, die leuchtend blaue Flüssigkeit in einen kleinen Kolben tropft, kinewsletter.ch Stil
INHALT
01Der Schüler überholt den Lehrer02Effizienz ist das neue Schlachtfeld03Feintunen statt mieten
INHALT
01Der Schüler überholt den Lehrer02Effizienz ist das neue Schlachtfeld03Feintunen statt mieten
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Ein distilliertes Modell mit einem Viertel der Grösse überholt sein eigenes Vorbild beim Programmieren – das bisher stärkste Argument für die Effizienz-These, auf die Murati ihr Startup gebaut hat. Wer offene Modelle selbst betreiben will, bekommt gerade mehr Leistung pro GPU als je zuvor.

Zwei Wochen nach dem ersten offenen Modell legt Thinking Machines Lab nach: Das Startup der früheren OpenAI-Technikchefin Mira Murati hat am 30. Juli Inkling-Small veröffentlicht – ein Modell mit 276 Milliarden Parametern, das unter der freien Apache-2.0-Lizenz steht, nativ Text, Bilder und Audio versteht und ein Kontextfenster von bis zu einer Million Token bietet. Das Erstaunliche daran: Laut der unabhängigen Benchmark-Organisation Artificial Analysis erreicht es 40 Punkte auf dem Intelligence Index – nur einen Punkt weniger als das rund dreieinhalbmal grössere Flaggschiff Inkling (41), über das du hier Mitte Juli gelesen hast.

Der Schüler überholt den Lehrer

Möglich macht das ein zweistufiges Rezept: Zuerst lernte Inkling-Small per On-Policy-Distillation vom grossen Inkling – das kleine Modell trainiert dabei direkt an den Ausgaben des grossen «Lehrers». Danach folgten laut Thinking Machines zwei Wochen agentisches Reinforcement Learning fürs Programmieren. Das Resultat kann sich sehen lassen: Nach Herstellerangaben schlägt der Kleine das Flaggschiff auf mehreren Benchmarks – 80,2 Prozent auf SWE-Bench Verified (Inkling: 77,6), 31,6 Prozent auf Humanity's Last Exam (29,7) und 89,5 Prozent auf GPQA Diamond (87,2). Der Haken: Beim reinen Faktenwissen fällt das kleinere Modell deutlich zurück, auch bei komplexen Agenten-Aufgaben behält das Original die Nase vorn.

Effizienz ist das neue Schlachtfeld

Dass Inkling-Small trotz 276 Milliarden Parametern günstig läuft, liegt an der Mixture-of-Experts-Architektur: Pro Token sind nur 12 Milliarden Parameter aktiv, je nach Aufgabe übernehmen andere Spezialisten im Modell. Damit trifft Murati einen Nerv – praktisch zeitgleich erschien DeepSeek V4 Flash, das bei ähnlicher Grösse denselben Index-Wert erreicht. Inkling-Small ist laut Artificial Analysis allerdings sparsamer: Es braucht im Schnitt rund 24'000 Output-Token pro Aufgabe, DeepSeek V4 Flash 45'000.

Feintunen statt mieten

Die vollen Gewichte liegen auf Hugging Face, kommerzielle Nutzung ist ausdrücklich erlaubt. Genau darauf zielt Muratis Geschäftsmodell: Firmen sollen das Modell über die hauseigene Tinker-Plattform mit eigenen Daten feintunen, statt geschlossene Modelle zu mieten. Für Schweizer Unternehmen, die aus Datenschutzgründen selbst hosten wollen, sinkt damit die Einstiegshürde spürbar – auch wenn 276 Milliarden Parameter weiterhin einen ernsthaften GPU-Cluster voraussetzen und nicht auf den Laptop passen.

Quellen

Introducing Inkling-Small (Thinking Machines Lab, Primärquelle)↗ EXTERNER LINKInkling-Small auf Hugging Face – offizielle Gewichte, Apache 2.0↗ EXTERNER LINKThinking Machines bets on efficiency over size with its second model, Inkling Small (The Decoder)↗ EXTERNER LINKThinking Machines debuts Inkling Small open source AI model (VentureBeat)↗ EXTERNER LINKInkling-Small lands within a point of Inkling on the Intelligence Index (Artificial Analysis)↗ EXTERNER LINKInkling: Our Open-Weights Model (Thinking Machines Lab, erstes Modell)↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer Filmklappe mit elektroblauen Balken neben Tonangel-Mikrofon und Scheinwerfer, im Hintergrund ein Fenster mit Schwarzwald-Tannen, kinewsletter.ch Stil
Illustration einer Filmklappe mit elektroblauen Balken neben Tonangel-Mikrofon und Scheinwerfer, im Hintergrund ein Fenster mit Schwarzwald-Tannen, kinewsletter.ch Stil
NEUE MODELLE·6. AUGUST 2026

FLUX 3 Video: KI-Clips mit Ton – jetzt für alle verfügbar

Black Forest Labs macht sein Videomodell FLUX 3 Video über die API allgemein verfügbar: bis zu 20 Sekunden Video mit nativ mitgeneriertem Ton, Lippensynchronisation auf Deutsch und einem günstigen Draft-Modus. In internen Tests sieht sich das Freiburger KI-Studio an der Spitze.

Illustration einer Balkenwaage mit elektroblauem Ständer, auf der einen Schale Münzen, auf der anderen gerollte Dokumente, kinewsletter.ch Stil
Illustration einer Balkenwaage mit elektroblauem Ständer, auf der einen Schale Münzen, auf der anderen gerollte Dokumente, kinewsletter.ch Stil
KI-TOOLS & APPS·6. AUGUST 2026

Meta greift Claude Code an: 92 Prozent Rabatt fürs Datenteilen

Meta Superintelligence Labs lanciert mit Muse Code einen Terminal-Coding-Agenten als direkte Konkurrenz zu Claude Code und Codex – angetrieben vom neuen Modell Muse Spark 1.2. Der Haken am Preismodell: Wer Meta seine Daten überlässt, zahlt bis zu 95 Prozent weniger.

Illustration eines Wachhäuschens mit Schranke und elektroblauem Rundschild, kinewsletter.ch Stil
Illustration eines Wachhäuschens mit Schranke und elektroblauem Rundschild, kinewsletter.ch Stil
KI-TOOLS & APPS·5. AUGUST 2026

Mistral Shieldstral: Offenes 3B-Sicherheitsmodell schlägt siebenmal grössere Guard-Modelle

Mistral hat Shieldstral veröffentlicht: einen offenen Sicherheits-Classifier mit nur 3 Milliarden Parametern, der Texte und Bilder moderiert. Die Regeln bekommt das Modell als Klartext-Frage zur Laufzeit — laut Mistral erreicht oder übertrifft es damit Guard-Modelle bis zu siebenfacher Grösse und läuft auf einer einzigen 16-GB-Grafikkarte.

Illustration eines offenen Banktresors mit Büchern und einem Handwagen, Sketch-Stil mit elektroblauen Akzenten, kinewsletter.ch Stil
Illustration eines offenen Banktresors mit Büchern und einem Handwagen, Sketch-Stil mit elektroblauen Akzenten, kinewsletter.ch Stil
NEUE MODELLE·4. AUGUST 2026

Qwen3.8-Max: Alibaba liefert nach – und verspricht offene Gewichte

Alibaba hat Qwen3.8-Max voll lanciert: 2,4 Billionen Parameter, 1 Million Token Kontext und Case Studies, in denen das Modell tagelang autonom arbeitet. Nächste Woche sollen die Gewichte folgen – es wäre das erste Max-Klasse-Modell, das offen verfügbar wird.

Illustration einer elektroblauen Filmkamera mit Filmrollen auf Holzstativ vor einem kleinen Studio-Set, kinewsletter.ch Stil
Illustration einer elektroblauen Filmkamera mit Filmrollen auf Holzstativ vor einem kleinen Studio-Set, kinewsletter.ch Stil
NEUE MODELLE·2. AUGUST 2026

ByteDance Seedance 2.5: 30-Sekunden-Videos mit Ton in einem Durchgang

ByteDance hat Seedance 2.5 vorgestellt: Das Videomodell generiert neu 30 Sekunden Video samt Ton in einem einzigen Durchgang – doppelt so viel wie der Vorgänger und rund dreimal so viel wie Googles Gemini Omni Flash. Clips lassen sich mehrfach zu Minuten-Videos verlängern. Verfügbar ist das Modell vorerst nur auf ByteDances China-Plattformen, die API soll folgen.

Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
KI-FORSCHUNG·2. AUGUST 2026

OpenAI kündigt Astra an – mit zehn gelösten Mathe-Problemen

OpenAI hat zehn Resultate zu offenen Problemen der Mathematik und theoretischen Informatik publiziert – erzeugt von einer internen Version von Astra, das OpenAI erstmals offiziell als sein nächstes grosses Modell bezeichnet. Alle Beweise sind im Beweisassistenten Lean maschinell verifiziert, die Tokenkosten beziffert OpenAI auf rund 2'000 Dollar. Die Mathe-Community reagiert zwischen Begeisterung und Sinnkrise.

Mehr aus Neue Modelle →