NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

IBM gibt Granite 4.2 frei – ohne Lizenzhaken

IBM veröffentlicht Granite 4.2 in den Grössen 3B, 8B und 30B unter Apache 2.0 – frei herunterladbar, feintunebar, produktiv einsetzbar. Klein genug fürs eigene Rechenzentrum.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
27. AUGUST 2026
3 MIN. LESEZEIT
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
Illustration eines Granitblocks auf einer Steinmetz-Werkbank mit Meissel und Fäustel, daneben eine offene Holzkiste, kinewsletter.ch Stil
INHALT
01Drei Grössen, drei Denk-Stufen02Gelernt wird in echten Sandboxen03Drei Stunden Audio in einer Sekunde04Apertus bekommt Gesellschaft
INHALT
01Drei Grössen, drei Denk-Stufen02Gelernt wird in echten Sandboxen03Drei Stunden Audio in einer Sekunde04Apertus bekommt Gesellschaft
Inoo GmbH
Präsentiert & entwickelt von
kinewsletter.ch ist ein Projekt der Inoo GmbH

KI-Beratung und Softwareentwicklung aus dem St. Galler Rheintal.

inoo.ch →
DAS WICHTIGSTE IN KÜRZE

Offen lizenzierte Modelle in 3B-, 8B- und 30B-Grösse machen KI im eigenen Serverraum realistisch – für Betriebe mit Datenschutzauflagen ist genau das der eigentliche Gewinn.

IBM hat am 25. August 2026 die Sprachmodell-Familie Granite 4.2 veröffentlicht: drei Modelle mit 3, 8 und 30 Milliarden Parametern, allesamt unter der Apache-2.0-Lizenz. Heisst konkret: herunterladen, feintunen, produktiv einsetzen – ohne Lizenzgebühr und ohne Nutzungsbeschränkung. Laut IBM Research wurden die Modelle von Grund auf mit rund 15 Billionen Tokens trainiert und sind gezielt für KI-Agenten gebaut, also für Systeme, die Aufgaben nicht nur beschreiben, sondern selbst erledigen.

Drei Grössen, drei Denk-Stufen

Jedes Granite-4.2-Modell lässt sich umschalten. Im Thinking-Modus schreibt es zuerst eine Gedankenkette – eine Art lautes Mitdenken, bevor die eigentliche Antwort kommt. Im Non-Thinking-Modus antwortet es direkt. Dazwischen sitzt ein Low-Effort-Modus, der bei einfachen Fragen nur ein kurzes Denkbudget verbraucht. Wer viele Anfragen verarbeitet, spart damit Rechenzeit und Strom.

Das Kontextfenster – die Textmenge, die ein Modell auf einmal überblickt – liegt laut IBM-Dokumentation bei 128'000 Tokens, beim 30B-Flaggschiff erweitert auf 512'000.

Gelernt wird in echten Sandboxen

Die 8B- und die 30B-Variante durchlaufen zusätzlich eine Trainingsstufe, die IBM agentic RL nennt: Die Modelle üben in abgeschotteten Testumgebungen, echte Code-Repositories zu bearbeiten, ein Terminal zu bedienen und im Web zu recherchieren. Belohnt wird nur, wer die Aufgabe tatsächlich löst.

In IBMs eigenen Messungen erreicht das 30B-Modell auf SWE-Bench Verified – dort müssen echte Fehler in Software-Projekten behoben werden – 57,00, das 8B-Modell 47,67. Das 3B-Modell durchläuft diese Stufe nicht und wird dort gar nicht erst gemessen. Alle drei sprechen Werkzeuge im OpenAI-Format an und laufen auf den verbreiteten Servern vLLM und SGLang – gängige Agenten-Baukästen funktionieren also ohne Bastelei.

Drei Stunden Audio in einer Sekunde

Am selben Tag kam Granite Speech 5.0 Turbo CTC dazu, ein Transkriptionsmodell mit nur 470 Millionen Parametern. IBM misst dafür einen Durchsatzwert (RTFx – wie viel Audio pro Sekunde Rechenzeit verarbeitet wird) von rund 12'600 auf einer einzelnen H200-Grafikkarte, während die bisherigen Geschwindigkeits-Spitzenreiter im Open ASR Leaderboard bei etwa 6'000 liegen. Drei Stunden Aufnahme seien damit in einer Sekunde transkribiert, schreibt IBM.

Apertus bekommt Gesellschaft

Für Schweizer Betriebe ist weniger die Benchmark-Tabelle interessant als die Lizenz. Ein 3B- oder 8B-Modell unter Apache 2.0 läuft auf eigener Hardware – im Serverraum der Klinik, der Gemeindeverwaltung oder des KMU. Wer Personendaten so verarbeitet, muss sie keinem Cloud-Anbieter anvertrauen; gerade bei Datenschutzauflagen ist das der praktische Unterschied.

Damit steht neben Apertus, dem offenen Schweizer Modell von EPFL, ETH Zürich und CSCS, eine weitere frei nutzbare Option – diesmal von einem Konzern, der seine Enterprise-Kundschaft gleich mitbringt. Herunterladen kannst du Granite 4.2 unter anderem über Hugging Face, Ollama und GitHub.

Quellen

Granite 4.2 brings native reasoning to enterprise agents (IBM Research, Primärquelle)↗ EXTERNER LINKGranite 4.2 LLMs: How They're Built (Hugging Face / IBM Granite Team)↗ EXTERNER LINKGranite 4.2 – IBM Granite Docs↗ EXTERNER LINKGranite 4.2 Language Models Collection (Hugging Face)↗ EXTERNER LINKIBM drops open-weight Granite 4.2 family with built-in agentic capabilities under Apache 2.0 (The Decoder)↗ EXTERNER LINKIBM Releases Granite 4.2: Bringing Native Reasoning and Agentic RL to Open Enterprise Models (MarkTechPost)↗ EXTERNER LINKApertus – Fully Open Foundation Model for Sovereign AI (Swiss AI Initiative)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIEPFLETH ZürichHugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze eines Sortierraums mit Fächerwand, blauer Stoppuhr auf dem Tisch, drei blau gefüllten Fächern und einem Briefstapel
Handgezeichnete Skizze eines Sortierraums mit Fächerwand, blauer Stoppuhr auf dem Tisch, drei blau gefüllten Fächern und einem Briefstapel
NEUE MODELLE·11. OKTOBER 2026

Microsoft Decision-1: Entscheiden statt schreiben

Microsoft startet Decision-1, ein Modell, das für Antwortoptionen Wahrscheinlichkeiten liefert statt Text. Laut Microsoft ist es 35-mal schneller als GPT-6 Sol und kostet 0,042 Dollar pro Million Input-Tokens. Alle Zahlen sind Herstellerangaben.

Handgezeichnete Skizze einer grossen Holzkiste mit blauer Seilschleife, die an einem Flaschenzug in einer Lagerhalle hängt, daneben Wandkalender und Stroh
Handgezeichnete Skizze einer grossen Holzkiste mit blauer Seilschleife, die an einem Flaschenzug in einer Lagerhalle hängt, daneben Wandkalender und Stroh
NEUE MODELLE·8. OKTOBER 2026

Mistral Large 4: Eine Billion Parameter aus Europa

Mistral stellt Large 4 als öffentliche Vorschau vor: rund eine Billion Parameter, in Europa trainiert, offene Gewichte bis Ende Oktober. Die Benchmarks sind Herstellerangaben, die Lizenz ist noch offen. Wir ordnen ein, was das für Schweizer Firmen heisst.

Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
NEUE MODELLE·6. OKTOBER 2026

Reflection AI zeigt Beam, offenes Modell gegen China

Das US-Start-up Reflection AI stellt Beam vor, ein Modell mit offenen Gewichten und 501 Milliarden Parametern. Es soll chinesischen Modellen mit deutlich weniger Rechenaufwand Konkurrenz machen. Alle Zahlen sind Herstellerangaben, die Gewichte folgen im Oktober.

Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt; die Maske ist leuchtend blau.
Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt
NEUE MODELLE·3. OKTOBER 2026

Tavus: Fast jeder Zweite hält KI-Avatar Griffin für echt

Das US-Startup Tavus meldet, dass 48 Prozent der Testpersonen seinen KI-Videoavatar Griffin nach einer Minute für einen Menschen hielten. Die Zahl stammt vom Hersteller, die Stichprobe war mit 54 Personen klein. Für die Schweiz ist sie trotzdem ein Warnsignal, weil Betrüger Video-Fälschungen bisher selten, Stimmklone dafür umso öfter einsetzen.

Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
NEUE MODELLE·1. OKTOBER 2026

Gemini 4 Argon: Google startet bei den Cyber-Verteidigern

Google stellt Gemini 4 Argon vor, zunächst nur für ausgewählte Cybersecurity-Organisationen im Fairwind-Programm. Laut Google findet und patcht das Modell kritische Schwachstellen selbstständig. Wir ordnen Zahlen, Bloomberg-Zweifel und den Schweiz-Bezug ein.

Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
NEUE MODELLE·30. SEPTEMBER 2026

GPT-6.1 Sol: fast Astra-Niveau zu einem Fünftel des Preises

OpenAI hat am DevDay GPT-6.1 Sol vorgestellt: laut Hersteller fast auf Astra-Niveau, aber für 2 statt 10 Dollar pro Million Eingabe-Tokens. Die Fehlerrate sinkt gegenüber GPT-6 Sol von 11,4 auf 7,7 Prozent. Verfügbar in ChatGPT Work, Codex und API, nicht im normalen Chat.

Mehr aus Neue Modelle →