NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Kimi K3 erreicht Frontier-Niveau – und beendet die Billig-Ära

Moonshot AI hat Kimi K3 vorgestellt: 2,8 Billionen Parameter, eine Million Token Kontext, offene Gewichte ab dem 27. Juli. Das Modell spielt auf Augenhöhe mit den besten US-Systemen – und kostet dreimal so viel wie sein Vorgänger. Die Zeit der chinesischen Kampfpreise ist damit vorbei.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
17. JULI 2026
5 MIN. LESEZEIT
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
INHALT
01Neun von zwölf Monaten an der Spitze02Rund siebenmal Erster, sonst knapp dahinter0351 Prozent – der Haken04Vom 95-Cent-Modell zum 3-Dollar-Modell05Offen heisst nicht: läuft bei dir im Keller06Was Moonshot selbst zugibt
INHALT
01Neun von zwölf Monaten an der Spitze02Rund siebenmal Erster, sonst knapp dahinter0351 Prozent – der Haken04Vom 95-Cent-Modell zum 3-Dollar-Modell05Offen heisst nicht: läuft bei dir im Keller06Was Moonshot selbst zugibt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Chinas offene Modelle sind auf dem Frontier-Niveau angekommen – aber nicht mehr zum Schnäppchenpreis. Und höhere Trefferquote heisst hier auch: mehr Halluzinationen.

Am 16. Juli hat das chinesische Labor Moonshot AI sein neues Modell Kimi K3 vorgestellt: 2,8 Billionen Parameter, offene Gewichte. Es ist das grösste offene Modell, das je angekündigt wurde – und zugleich das teuerste, das je aus China kam. Beides gehört zusammen.

Neun von zwölf Monaten an der Spitze

K3 nutzt eine Mixture-of-Experts-Architektur – vereinfacht gesagt sitzen im Modell viele Spezialisten, von denen pro Anfrage nur wenige aufgeweckt werden. Bei K3 sind es 16 von 896. Das Modell hat also 2,8 Billionen Parameter, rechnet aber jeweils nur mit einem Bruchteil davon. Dazu kommen ein Kontextfenster von einer Million Token (grob: ein paar tausend Seiten auf einmal) sowie die native Verarbeitung von Bildern und Video.

Dahinter steht eine neue Aufmerksamkeits-Architektur namens Kimi Delta Attention. Laut Moonshot beschleunigt sie das Decoding – die Ausgabe von Text – bei Millionen-Kontexten um bis zu das 6,3-Fache.

Moonshot nennt K3 das erste offene Modell der «3T-Klasse» – 2,8 auf 3 aufgerundet, wie der Entwickler Simon Willison trocken anmerkt. Die Krone übernimmt K3 von DeepSeeks V4 Pro mit 1,6 Billionen Parametern. Nach eigenen Angaben haben Kimi-Modelle in neun der vergangenen zwölf Monate die Obergrenze offener Modellgrössen markiert.

Ein Detail mit Sprengkraft: Die Gewichte sind noch gar nicht draussen. Sie sollen bis zum 27. Juli 2026 folgen. Bis dahin kann niemand ausserhalb von Moonshot das Modell unabhängig prüfen, verändern oder selbst betreiben.

Rund siebenmal Erster, sonst knapp dahinter

Auf dem Intelligence Index des unabhängigen Testlabors Artificial Analysis erreicht K3 57 Punkte. Damit liegt es hinter Claude Fable 5 (60) und GPT-5.6 Sol (59) und etwa gleichauf mit Claude Opus 4.8 (56).

Deutlicher fällt der Sprung bei agentischen Aufgaben aus – also Arbeiten, die das Modell über viele Schritte selbstständig erledigt. Auf GDPval v2 klettert K3 auf einen Elo-Wert von 1668; der Vorgänger K2.6 stand bei 1190. Opus 4.8 (1600) bleibt dahinter, Fable 5 (1760) davor. Über alle 35 Tests der Moonshot-Tabelle hinweg wurde K3 rund siebenmal Erster und landete sonst meist auf Platz zwei oder drei.

Und dann ist da der Punkt, der in Silicon Valley für Unruhe sorgt: In Blindtests der Plattform Arena bevorzugten Entwickler Kimi beim Frontend-Coding vor jedem führenden US-Modell – auch vor Fable 5 und GPT-5.6 Sol. Moonshot nennt das Prinzip dahinter «Vision in the Loop»: K3 schreibt Code, betrachtet den gerenderten Screenshot und bessert nach. Bild und Code in einer Schleife.

Zur Einordnung gehört: Der Grossteil dieser Tabelle stammt von Moonshot selbst, und je nach Test kamen unterschiedliche Agenten-Systeme zum Einsatz. Die Zahlen sind also nicht alle unter identischen Bedingungen entstanden.

51 Prozent – der Haken

Artificial Analysis fand aber auch etwas Unangenehmes. K3s Trefferquote stieg von 33 auf 46 Prozent. Gleichzeitig kletterte die Halluzinationsrate von 39 auf 51 Prozent. Konkret heisst das: Das Modell beantwortet mehr Fragen richtig – und erfindet zugleich häufiger etwas, statt zuzugeben, dass es die Antwort nicht kennt. Für Recherche und Faktenarbeit ist das ein ernstes Warnsignal.

Vom 95-Cent-Modell zum 3-Dollar-Modell

Der Preis ist die eigentliche Nachricht. K3 kostet 3 Dollar pro Million Input-Token (30 Cent bei einem Cache-Treffer) und 15 Dollar pro Million Output-Token. Der Vorgänger K2.6 lag bei 95 Cent und 4 Dollar.

Damit liegt K3 exakt auf dem Niveau von Anthropics Claude Sonnet 5 – und ist laut Willison das teuerste Modell, das je ein chinesisches Labor veröffentlicht hat. Pro Aufgabe rechnet Artificial Analysis mit rund 0,94 Dollar: nahe an GPT-5.6 Sol (1,04 Dollar) und etwa halb so teuer wie Opus 4.8 (1,80 Dollar). Von offenen Konkurrenten wie GLM-5.2 (0,32 Dollar) oder DeepSeek V4 Pro (0,04 Dollar) ist K3 aber weit entfernt.

Immerhin arbeitet K3 sparsamer: Es braucht 21 Prozent weniger Output-Token als K2.6 und schneidet dabei besser ab. Die höheren Token-Preise fressen diesen Vorteil meist trotzdem auf.

Die Ära, in der chinesische Modelle vor allem über den Kampfpreis kamen, ist damit vorbei. Wer Frontier-Niveau liefert, verlangt Frontier-Preise – auch in Peking.

Offen heisst nicht: läuft bei dir im Keller

Hier lohnt der zweite Blick, gerade wenn du aus Datenschutzgründen mit Self-Hosting liebäugelst. Moonshot empfiehlt für den Betrieb von K3 Supernode-Konfigurationen mit 64 oder mehr Beschleunigern. «Offene Gewichte» heisst also nicht, dass das Modell auf deinem Laptop oder im Serverraum deiner Firma läuft. Es heisst, dass Cloud-Anbieter und Forschung es prüfen und betreiben können – ein Unterschied, der in der Debatte um digitale Souveränität gerne verschwimmt.

Was Moonshot selbst zugibt

Bemerkenswert offen listet Moonshot die Schwächen: K3 entscheide bei unklaren Vorgaben schon mal eigenmächtig, reagiere empfindlich, wenn ein Agenten-System die Denkhistorie nicht sauber zurückreicht – und zeige beim Nutzererlebnis eine «spürbare Lücke» gegenüber Fable 5 und GPT-5.6 Sol.

«Im Moment ist es eine Frage USA gegen China», sagte Mozilla-Technikchef Raffi Krikorian gegenüber Axios. US-Labore seien «klar beunruhigt».

Auch das gehört dazu: K3 ist erst seit Kurzem verfügbar. Frühe Benchmarks und virale Demos können überzeichnen, wie zuverlässig ein Modell in echter Arbeit wirklich ist. Der ehrliche Test beginnt am 27. Juli – wenn die Gewichte fallen.

Quellen

Kimi K3: Open Frontier Intelligence (Moonshot AI, Primärquelle)↗ EXTERNER LINKKimi's open model K3 nears GPT-5.6 Sol and Fable 5 while signaling the end of super cheap Chinese AI (The Decoder)↗ EXTERNER LINKChina's open-weight Kimi model stuns AI world with frontier-level results (Axios)↗ EXTERNER LINKKimi K3, and what we can still learn from the pelican benchmark (Simon Willison)↗ EXTERNER LINKMoonshotAI: Kimi K3 – API Pricing & Providers (OpenRouter)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicDeepSeek
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
NEUE MODELLE·4. SEPTEMBER 2026

OpenAI ruft die AGI-Ära aus – mit GPT-6 Astra

OpenAI hat GPT-6 Astra veröffentlicht. Präsident Greg Brockman spricht vom «generationellen Sprung» und beendet das Briefing mit «Welcome to the AGI era».

Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Fei-Fei Lis Atlas baut 3D-Welten aus wenigen Fotos

World Labs hat Atlas vorgestellt: ein Weltmodell, das aus einer Handvoll Fotos begehbare 3D-Szenen erzeugt, rekonstruiert und simuliert — bis zu eine Minute Video in 1440p mit frei gewählter Kameraführung, wahlweise als echte 3D-Geometrie. Verfügbar ist es bisher nur im Early Access, und alle Vergleichszahlen stammen von World Labs selbst.

Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Muse Spark 1.3: Meta setzt auf sparsam statt Spitzenplatz

Meta hat Muse Spark 1.3 veröffentlicht: 62 Punkte im Artificial Analysis Intelligence Index, einen hinter Claude Opus 5 – aber zum Achtel des Preises von Claude Fable 5.1. Die beworbene Sparsamkeit stammt allerdings aus Metas eigener Messung, und die Open-Weights-Frage ist offener denn je.

Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Googles dritter Flash in sechs Wochen – plus ein Cyber-Modell

Gemini 3.8 Flash kostet gleich viel wie der Vorgänger – die Cyber-Variante gibt es nur für geprüfte Verteidiger. Das Frontier-Modell fehlt weiter.

Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·2. SEPTEMBER 2026

Claude Fable 5.1: stärker beim Coden, günstiger im Betrieb

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht: deutlich bessere Werte bei agentischem Coding und Recherche, dazu ein um 75 Prozent gesenkter Cache-Preis – doch bei voller Effort-Stufe rechnet Artificial Analysis vor, dass die Rechnung höher ausfällt als bei Opus 5.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Mehr aus Neue Modelle →