NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
27. AUGUST 2026
3 MIN. LESEZEIT
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
INHALT
01Drei Grössen, drei Denk-Stufen02Gelernt wird in echten Sandboxen03Drei Stunden Audio in einer Sekunde04Apertus bekommt Gesellschaft
INHALT
01Drei Grössen, drei Denk-Stufen02Gelernt wird in echten Sandboxen03Drei Stunden Audio in einer Sekunde04Apertus bekommt Gesellschaft
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Offen lizenzierte Modelle in 3B-, 8B- und 30B-Grösse machen KI im eigenen Serverraum realistisch – für Betriebe mit Datenschutzauflagen ist genau das der eigentliche Gewinn.

IBM hat am 25. August 2026 die Sprachmodell-Familie Granite 4.2 veröffentlicht: drei Modelle mit 3, 8 und 30 Milliarden Parametern, allesamt unter der Apache-2.0-Lizenz. Heisst konkret: herunterladen, feintunen, produktiv einsetzen – ohne Lizenzgebühr und ohne Nutzungsbeschränkung. Laut IBM Research wurden die Modelle von Grund auf mit rund 15 Billionen Tokens trainiert und sind gezielt für KI-Agenten gebaut, also für Systeme, die Aufgaben nicht nur beschreiben, sondern selbst erledigen.

Drei Grössen, drei Denk-Stufen

Jedes Granite-4.2-Modell lässt sich umschalten. Im Thinking-Modus schreibt es zuerst eine Gedankenkette – eine Art lautes Mitdenken, bevor die eigentliche Antwort kommt. Im Non-Thinking-Modus antwortet es direkt. Dazwischen sitzt ein Low-Effort-Modus, der bei einfachen Fragen nur ein kurzes Denkbudget verbraucht. Wer viele Anfragen verarbeitet, spart damit Rechenzeit und Strom.

Das Kontextfenster – die Textmenge, die ein Modell auf einmal überblickt – liegt laut IBM-Dokumentation bei 128'000 Tokens, beim 30B-Flaggschiff erweitert auf 512'000.

Gelernt wird in echten Sandboxen

Die 8B- und die 30B-Variante durchlaufen zusätzlich eine Trainingsstufe, die IBM agentic RL nennt: Die Modelle üben in abgeschotteten Testumgebungen, echte Code-Repositories zu bearbeiten, ein Terminal zu bedienen und im Web zu recherchieren. Belohnt wird nur, wer die Aufgabe tatsächlich löst.

In IBMs eigenen Messungen erreicht das 30B-Modell auf SWE-Bench Verified – dort müssen echte Fehler in Software-Projekten behoben werden – 57,00, das 8B-Modell 47,67. Das 3B-Modell durchläuft diese Stufe nicht und wird dort gar nicht erst gemessen. Alle drei sprechen Werkzeuge im OpenAI-Format an und laufen auf den verbreiteten Servern vLLM und SGLang – gängige Agenten-Baukästen funktionieren also ohne Bastelei.

Drei Stunden Audio in einer Sekunde

Am selben Tag kam Granite Speech 5.0 Turbo CTC dazu, ein Transkriptionsmodell mit nur 470 Millionen Parametern. IBM misst dafür einen Durchsatzwert (RTFx – wie viel Audio pro Sekunde Rechenzeit verarbeitet wird) von rund 12'600 auf einer einzelnen H200-Grafikkarte, während die bisherigen Geschwindigkeits-Spitzenreiter im Open ASR Leaderboard bei etwa 6'000 liegen. Drei Stunden Aufnahme seien damit in einer Sekunde transkribiert, schreibt IBM.

Apertus bekommt Gesellschaft

Für Schweizer Betriebe ist weniger die Benchmark-Tabelle interessant als die Lizenz. Ein 3B- oder 8B-Modell unter Apache 2.0 läuft auf eigener Hardware – im Serverraum der Klinik, der Gemeindeverwaltung oder des KMU. Wer Personendaten so verarbeitet, muss sie keinem Cloud-Anbieter anvertrauen; gerade bei Datenschutzauflagen ist das der praktische Unterschied.

Damit steht neben Apertus, dem offenen Schweizer Modell von EPFL, ETH Zürich und CSCS, eine weitere frei nutzbare Option – diesmal von einem Konzern, der seine Enterprise-Kundschaft gleich mitbringt. Herunterladen kannst du Granite 4.2 unter anderem über Hugging Face, Ollama und GitHub.

Quellen

Granite 4.2 brings native reasoning to enterprise agents (IBM Research, Primärquelle)↗ EXTERNER LINKGranite 4.2 LLMs: How They're Built (Hugging Face / IBM Granite Team)↗ EXTERNER LINKGranite 4.2 – IBM Granite Docs↗ EXTERNER LINKGranite 4.2 Language Models Collection (Hugging Face)↗ EXTERNER LINKIBM drops open-weight Granite 4.2 family with built-in agentic capabilities under Apache 2.0 (The Decoder)↗ EXTERNER LINKIBM Releases Granite 4.2: Bringing Native Reasoning and Agentic RL to Open Enterprise Models (MarkTechPost)↗ EXTERNER LINKApertus – Fully Open Foundation Model for Sovereign AI (Swiss AI Initiative)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIEPFLETH ZürichHugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
Illustration eines Orrery mit blauer Planetenkugel neben einem offenen Sternatlas mit Zirkel und Lupe, kinewsletter.ch Stil
NEUE MODELLE·4. SEPTEMBER 2026

OpenAI ruft die AGI-Ära aus – mit GPT-6 Astra

OpenAI hat GPT-6 Astra veröffentlicht. Präsident Greg Brockman spricht vom «generationellen Sprung» und beendet das Briefing mit «Welcome to the AGI era».

Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Fei-Fei Lis Atlas baut 3D-Welten aus wenigen Fotos

World Labs hat Atlas vorgestellt: ein Weltmodell, das aus einer Handvoll Fotos begehbare 3D-Szenen erzeugt, rekonstruiert und simuliert — bis zu eine Minute Video in 1440p mit frei gewählter Kameraführung, wahlweise als echte 3D-Geometrie. Verfügbar ist es bisher nur im Early Access, und alle Vergleichszahlen stammen von World Labs selbst.

Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Muse Spark 1.3: Meta setzt auf sparsam statt Spitzenplatz

Meta hat Muse Spark 1.3 veröffentlicht: 62 Punkte im Artificial Analysis Intelligence Index, einen hinter Claude Opus 5 – aber zum Achtel des Preises von Claude Fable 5.1. Die beworbene Sparsamkeit stammt allerdings aus Metas eigener Messung, und die Open-Weights-Frage ist offener denn je.

Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Googles dritter Flash in sechs Wochen – plus ein Cyber-Modell

Gemini 3.8 Flash kostet gleich viel wie der Vorgänger – die Cyber-Variante gibt es nur für geprüfte Verteidiger. Das Frontier-Modell fehlt weiter.

Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·2. SEPTEMBER 2026

Claude Fable 5.1: stärker beim Coden, günstiger im Betrieb

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht: deutlich bessere Werte bei agentischem Coding und Recherche, dazu ein um 75 Prozent gesenkter Cache-Preis – doch bei voller Effort-Stufe rechnet Artificial Analysis vor, dass die Rechnung höher ausfällt als bei Opus 5.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Mehr aus Neue Modelle →