NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Claude Opus 4.7 ist da – und holt sich die Coding-Krone zurück

Anthropic hat am 16. April sein neues Flaggschiff-Modell vorgestellt. Claude Opus 4.7 übertrifft GPT-5.4 und Gemini 3.1 Pro in den wichtigsten Coding-Benchmarks – und bringt Features mit, die den Alltag von Entwicklern verändern dürften.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
17. APRIL 2026
3 MIN. LESEZEIT
Illustration einer Schaltzentrale mit Monitoren und Servern, kinewsletter.ch Stil
Illustration einer Schaltzentrale mit Monitoren und Servern (Dark Mode), kinewsletter.ch Stil
INHALT
0187,6 Prozent auf SWE-bench – ein neuer Bestwert02Vom Code-Assistenten zum autonomen Kollegen03Dreimal schärfer sehen04Der neue Tokenizer – und sein Haken05Cyber-Sicherheit: Bewusst gebremst06Einordnung: Was bedeutet das für dich?
INHALT
0187,6 Prozent auf SWE-bench – ein neuer Bestwert02Vom Code-Assistenten zum autonomen Kollegen03Dreimal schärfer sehen04Der neue Tokenizer – und sein Haken05Cyber-Sicherheit: Bewusst gebremst06Einordnung: Was bedeutet das für dich?
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Claude Opus 4.7 setzt mit 87,6 Prozent auf SWE-bench Verified einen neuen Bestwert und überholt GPT-5.4 und Gemini 3.1 Pro – für Entwickler der bisher grösste Sprung zwischen zwei Claude-Generationen.

87,6 Prozent auf SWE-bench – ein neuer Bestwert

Die Zahlen sind eindrücklich: Auf SWE-bench Verified, dem Standardtest für reale Software-Engineering-Aufgaben, erreicht Opus 4.7 87,6 Prozent – gegenüber 80,8 Prozent beim Vorgänger Opus 4.6 und 80,6 Prozent bei Googles Gemini 3.1 Pro. Auf dem härteren SWE-bench Pro liegt Opus 4.7 bei 64,3 Prozent, deutlich vor GPT-5.4 (57,7 Prozent) und Gemini 3.1 Pro (54,2 Prozent).

Besonders bemerkenswert: Auf dem neuen MCP-Atlas-Benchmark, der Agenten-Fähigkeiten über mehrere Tools hinweg misst, erreicht Opus 4.7 mit 77,3 Prozent den Bestwert aller getesteten Modelle. Bei GPQA Diamond, dem Test für naturwissenschaftliches Expertenwissen, kommt es auf 94,2 Prozent – praktisch gleichauf mit den Topmodellen von OpenAI und Google.

Vom Code-Assistenten zum autonomen Kollegen

Was die nackten Zahlen nicht zeigen: Opus 4.7 löst laut Anthropic viele Aufgaben, die sein Vorgänger und Sonnet 4.6 schlicht nicht schafften – vier komplexe Tasks auf einem internen 93-Aufgaben-Test, die zuvor keinem Claude-Modell gelangen. Auf CursorBench steigt die Erfolgsrate von 58 auf 70 Prozent, und bei Rakutens Produktions-Benchmark löst das neue Modell dreimal so viele Tickets wie sein Vorgänger.

Dazu kommen praktische Neuerungen: Das xhigh-Effort-Level bietet einen neuen Kompromiss zwischen Qualität und Geschwindigkeit. Der /ultrareview-Befehl in Claude Code simuliert eine Senior-Entwicklerin, die nicht bloss Syntaxfehler findet, sondern subtile Designfehler und Logiklücken aufspürt. Task Budgets – aktuell in Public Beta – geben Entwicklern Kontrolle über den Token-Verbrauch bei längeren Agenten-Sessions. Und der Auto-Mode für Max-Plan-Abonnenten lässt Claude eigenständig entscheiden, wann es nachdenken, Dateien lesen oder Code ausführen soll.

Dreimal schärfer sehen

Die Vision-Fähigkeiten machen einen grossen Sprung: Opus 4.7 verarbeitet Bilder bis 2.576 Pixel an der langen Kante – rund 3,3-mal so viel wie Opus 4.6. Für dich konkret: Screenshots von ganzen Dashboards, dichte Architekturdiagramme oder mehrseitige PDFs lassen sich jetzt deutlich detaillierter analysieren.

Der neue Tokenizer – und sein Haken

Opus 4.7 nutzt einen neuen Tokenizer, der Text effizienter verarbeitet. Dieselbe Eingabe erzeugt je nach Inhalt 1,0- bis 1,35-mal mehr Tokens als bisher. Das heisst: Bei gleichem Text zahlst du unter Umständen etwas mehr – obwohl die Preise auf dem Papier bei 5 Dollar (Input) und 25 Dollar (Output) pro Million Tokens stabil bleiben. Anthropic empfiehlt Entwicklern, ihre Token-Budgets zu überprüfen.

Cyber-Sicherheit: Bewusst gebremst

Interessant ist, was Opus 4.7 nicht kann: Anthropic hat die Cybersecurity-Fähigkeiten bewusst unter das Niveau von Mythos Preview gesenkt. Verdächtige Angriffs-Prompts werden automatisch blockiert. Gleichzeitig gibt es ein neues Cyber Verification Program für legitime Sicherheitsforscher – Penetrationstester, Red-Teamer und Vulnerability-Forscher können sich verifizieren lassen, um Zugriff auf die vollen Fähigkeiten zu erhalten.

Einordnung: Was bedeutet das für dich?

Opus 4.7 ist sofort verfügbar über claude.ai, die API, Amazon Bedrock, Google Vertex AI, Microsoft Foundry und GitHub Copilot. Für Entwickler, die Claude Code nutzen, dürfte der Sprung spürbar sein – insbesondere bei komplexen Refactorings und mehrstündigen Agenten-Workflows. Die Kombination aus höherer Erfolgsrate, grösserem Kontextfenster (1 Million Tokens) und dem neuen Effort-Level macht Opus 4.7 zum aktuell stärksten allgemein verfügbaren Coding-Modell auf dem Markt.

Quellen

Anthropic – Claude Opus 4.7↗ EXTERNER LINKCNBC – Anthropic Claude Opus 4.7↗ EXTERNER LINK9to5Mac – Anthropic Opus 4.7↗ EXTERNER LINKThe Next Web – Opus 4.7 Benchmarks↗ EXTERNER LINKVellum – Opus 4.7 Benchmarks erklärt↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicGoogleOpenAIAmazonMicrosoft
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
NEUE MODELLE·30. AUGUST 2026

GLM-5.3 ist offen – aber die MIT-Lizenz ist weg

Z.ai hat die Gewichte seines 753-Milliarden-Parameter-Flaggschiffs GLM-5.3 freigegeben – zwei Wochen verspätet und erstmals nicht unter MIT. Die neue Hauslizenz verpflichtet Model-as-a-Service-Anbieter ab 10 Milliarden Dollar Umsatz zu einer Sicherheitsprüfung durch Z.ai. Für alle anderen bleibt das Modell frei – die eigentliche Hürde sind die 810 Gigabyte Speicher, die es braucht.

Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
Illustration eines offenen Serverschranks mit Kabelbündel und einer Platine auf einem Wartungswagen, kinewsletter.ch Stil
NEUE MODELLE·28. AUGUST 2026

Chinas GLM-5.3-Flash läuft ohne Nvidia – und trägt MIT-Lizenz

Z.ai hat GLM-5.3-Flash freigegeben: 320 Milliarden Parameter unter MIT-Lizenz, drei Punkte hinter dem grossen Schwestermodell – zum Siebtel des Preises. Die ganze Testphase lief auf chinesischen Chips. Was daran belegt ist und was nicht.

Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
Illustration eines Abakus auf einem Kaufmannstisch mit blauen Kugeln, kinewsletter.ch Stil
NEUE MODELLE·27. AUGUST 2026

Alibaba zeigt die Qwen4-Architektur – zum Zwölftel-Preis

Alibabas Qwen-Team hat Qwen3.8-Flash-Next veröffentlicht – ein Modell mit offenen Gewichten, das die Architektur des kommenden Qwen4 vorwegnimmt. 125 Milliarden Parameter, davon nur 6 Milliarden aktiv pro Token, und ein API-Preis von 0.16 Dollar pro Million Eingabe-Tokens: rund ein Zwölftel dessen, was Alibabas eigenes Flaggschiff kostet.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Mehr aus Neue Modelle →