NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Claude Fable 5.1: stärker beim Coden, günstiger im Betrieb

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht: deutlich bessere Werte bei agentischem Coding und Recherche, dazu ein um 75 Prozent gesenkter Cache-Preis – doch bei voller Effort-Stufe rechnet Artificial Analysis vor, dass die Rechnung höher ausfällt als bei Opus 5.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
2. SEPTEMBER 2026
4 MIN. LESEZEIT
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
INHALT
01Von 24,7 auf 52,6 Prozent02Warum der Cache die Rechnung macht03Artificial Analysis rechnet dagegen04Mythos 5.1 bleibt hinter Schloss und Riegel05Zürich rechnet mit
INHALT
01Von 24,7 auf 52,6 Prozent02Warum der Cache die Rechnung macht03Artificial Analysis rechnet dagegen04Mythos 5.1 bleibt hinter Schloss und Riegel05Zürich rechnet mit
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Anthropic senkt nicht den Token-Preis, sondern nur den Cache-Read-Preis – wer lange Agenten-Läufe fährt, spart real; wer auf maximale Effort-Stufe setzt, zahlt drauf.

Anthropic hat am 1. September 2026 Claude Fable 5.1 und Claude Mythos 5.1 veröffentlicht – zwei Modelle, die laut Anthropic dasselbe Basismodell teilen und sich nur in den Sicherheitsschranken unterscheiden. Auf dem Forschungs-Benchmark Terminal-Bench-Science 0.1 springt Fable 5.1 von 24,7 auf 52,6 Prozent, beim agentischen Coding-Test Terminal-Bench 4.0 von 42,0 auf 55,8 Prozent. Gleichzeitig senkt Anthropic den Preis für sogenannte Cache-Reads um 75 Prozent, von 1.00 auf 0.25 US-Dollar pro Million Token. Fable 5.1 ist ab sofort auf allen Plattformen verfügbar, Mythos 5.1 nur für geprüfte Organisationen.

Von 24,7 auf 52,6 Prozent

Terminal-Bench-Science misst, wie gut ein Modell wissenschaftliche Aufgaben eigenständig in einer Kommandozeile abarbeitet – recherchieren, Code schreiben, Ergebnisse prüfen, nachbessern. Fable 5.1 mehr als verdoppelt hier den Wert des Vorgängers und liegt klar vor Claude Opus 5 (29,0 Prozent) und OpenAIs GPT-5.6 Sol (22,4 Prozent).

Anthropic liefert die Vorbehalte gleich mit, und das ist erfreulich selten: Der Standardfehler liegt bei ±3,5 bis 4,5 Punkten pro Modell, und das öffentliche Leaderboard weist für dieselben Vorgängermodelle leicht andere Werte aus (Opus 5: 30,0 Prozent, Fable 5: 21,4 Prozent). Ein Sprung von 28 Punkten bleibt trotzdem ein Sprung.

Beim Coding zeigt sich ein interessantes Detail: Auf Terminal-Bench 4.0 erreicht Fable 5.1 55,8 Prozent, das restriktionsärmere – bei identischem Basismodell. Die Lücke von fünf Punkten ist laut Anthropic genau das, was die Cyber-Schutzmechanismen gekostet haben. Beide Modelle arbeiten mit einem von und geben maximal 128'000 Token pro Antwort aus.

WEITERLESENDas könnte dich auch interessieren.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Mythos 5.1 aber 60,9 Prozent
Kontextfenster
1 Million Token

Warum der Cache die Rechnung macht

Cache-Reads sind der Teil der Abrechnung, den kaum jemand auf dem Radar hat. Wenn ein Agent stundenlang an einer Aufgabe arbeitet, liest er denselben Kontext – Dateien, bisherige Schritte, Zwischenergebnisse – immer wieder ein. Genau diese wiederverwendeten Token werden als Cache-Read verrechnet, und bei langen Läufen machen sie den grössten Kostenblock aus.

Anthropic beziffert den Effekt mit Zahlen aus vier Wochen echter Nutzung im August 2026: Bei typischen Arbeitslasten sinken die Gesamtkosten um rund 25 Prozent, bei stark agentischen Aufgaben um bis zu 45 Prozent. Alles andere bleibt gleich teuer: 10 US-Dollar pro Million Input-Token, 50 US-Dollar pro Million Output-Token.

Artificial Analysis rechnet dagegen

Der Analysedienst Artificial Analysis, der Fable 5.1 vor dem Launch testen durfte, widerspricht der Sparbotschaft – nachzulesen in einem Update von The Decoder. Der Grund: Fable 5.1 verbraucht rund 1,7-mal so viele Output-Token wie der Vorgänger. Auf der höchsten Effort-Stufe kostet eine Aufgabe im Intelligence Index deshalb 3.76 US-Dollar – gegenüber 2.34 US-Dollar bei Opus 5, das dabei nur drei Punkte weniger erreicht. Eine Stufe tiefer (extra-high) schrumpft der Abstand auf 2.72 US-Dollar, bleibt aber über dem Opus-Preis.

Kein Widerspruch, sondern die Kehrseite derselben Medaille: Wer viel Kontext wiederliest, spart. Wer viel Text produziert, nicht. Im Intelligence Index selbst führt Fable 5.1 mit 66 Punkten vor Opus 5 (63) und GPT-5.6 Sol (61).

Mythos 5.1 bleibt hinter Schloss und Riegel

Mythos 5.1 ist laut den Claude Platform Docs ausschliesslich für Teilnehmende von Project Glasswing zugänglich – jener im April 2026 gestarteten Sicherheitsinitiative, an der unter anderem AWS, Apple, Cisco, CrowdStrike, Google, Microsoft, NVIDIA und die Linux Foundation beteiligt sind. Der Zugang läuft über zwei Prüfprogramme für Cyberverteidigung und Life Sciences, letzteres in Partnerschaft mit der US-Regierung.

Für dich als Schweizer Leserin oder Leser ist die entscheidende Einschränkung: Mythos 5.1 steht derzeit nur US-Organisationen offen. Anthropic sagt, man koordiniere mit der US-Regierung eine Ausweitung auf internationale Partner – ein Zeitplan fehlt.

Fable 5.1 selbst wird dafür durchlässiger: Die Cyber-Schutzmechanismen greifen laut Anthropic rund 60 Prozent seltener unnötig ein, bei harmlosen Biologie- und Medizinfragen sogar 85 Prozent seltener. Neu darf Fable 5.1 Software-Schwachstellen aufspüren – Exploits dafür bauen aber weiterhin nicht.

Zürich rechnet mit

Anthropic ist in der Schweiz kein Fremdkörper: Seit Februar 2025 betreibt das Unternehmen eine Niederlassung in Zürich, geleitet von Neil Houlsby, der zuvor bei Google DeepMind forschte. Zürich ist Anthropics drittes europäisches Büro nach London und Dublin – und arbeitet laut Greater Zurich Area an den multimodalen Fähigkeiten von Claude.

Praktisch heisst das für Schweizer Entwicklerteams: Der Cache-Rabatt ist real, aber er belohnt ein bestimmtes Muster. Wer Claude Code über Stunden auf einer grossen Codebasis laufen lässt, spürt ihn sofort. Wer den Default übernimmt und auf maximale Effort-Stufe geht, kann günstiger fahren, indem er zu Opus 5 greift (5 US-Dollar Input, 25 US-Dollar Output pro Million Token). Die Effort-Stufe bewusst zu setzen, ist damit erstmals eine echte Budgetentscheidung.

Am Rand, aber nicht unwichtig: Einen Tag vor dem Launch mietete Anthropic laut SiliconANGLE – gestützt auf das Wall Street Journal – Rechenkapazität im Wert von 35 Milliarden US-Dollar beim Cloud-Anbieter Lambda. Eine Woche zuvor waren es 45 Milliarden bei Nscale. Die Modelle werden günstiger, die Infrastruktur dahinter nicht.

Quellen

Introducing Claude Fable 5.1 and Claude Mythos 5.1 (Anthropic, 01.09.2026)↗ EXTERNER LINKClaude Fable 5.1 – Modellübersicht, Spezifikationen und Preise (Claude Platform Docs)↗ EXTERNER LINKProject Glasswing: Securing critical software for the AI era (Anthropic, 07.04.2026)↗ EXTERNER LINKAnthropic's Claude Fable 5.1 promises better coding and research at up to 45 percent less (The Decoder, 01.09.2026)↗ EXTERNER LINKAnthropic launches Claude Fable 5.1 after inking $35B cloud deal with Lambda (SiliconANGLE, 01.09.2026)↗ EXTERNER LINKClaude Fable 5.1 – Intelligence, Performance & Price Analysis (Artificial Analysis)↗ EXTERNER LINKAnthropic appoints leading AI researcher Neil Houlsby to lead their Zurich Office (Greater Zurich Area)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicAmazonAppleGoogleMicrosoft
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
NEUE MODELLE·30. AUGUST 2026

GLM-5.3 ist offen – aber die MIT-Lizenz ist weg

Z.ai hat die Gewichte seines 753-Milliarden-Parameter-Flaggschiffs GLM-5.3 freigegeben – zwei Wochen verspätet und erstmals nicht unter MIT. Die neue Hauslizenz verpflichtet Model-as-a-Service-Anbieter ab 10 Milliarden Dollar Umsatz zu einer Sicherheitsprüfung durch Z.ai. Für alle anderen bleibt das Modell frei – die eigentliche Hürde sind die 810 Gigabyte Speicher, die es braucht.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Mehr aus Neue Modelle →