NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Muse Glimmer: Meta öffnet 30-Milliarden-Modell unter Apache 2.0

Meta Superintelligence Labs hat am 10. August Muse Glimmer veröffentlicht – ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter Apache 2.0 frei verfügbar sind. Quantisiert läuft es auf einer einzelnen Consumer-Grafikkarte. Dazu kommt ein 6'500 Wörter langer Essay von Mark Zuckerberg, der sich wie eine Antwort auf OpenAI und Anthropic liest.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
11. AUGUST 2026
4 MIN. LESEZEIT
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
INHALT
01Die Lizenz, die Llama nie bekam0255 Gigabyte, geschrumpft auf unter 2003Vorn bei Agenten, hinten am Desktop046'500 Wörter gegen die geschlossene Konkurrenz05Warum das für Schweizer Firmen zählt
INHALT
01Die Lizenz, die Llama nie bekam0255 Gigabyte, geschrumpft auf unter 2003Vorn bei Agenten, hinten am Desktop046'500 Wörter gegen die geschlossene Konkurrenz05Warum das für Schweizer Firmen zählt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Die Nachricht ist nicht die Modellgrösse, sondern die Lizenz: Apache 2.0 macht Muse Glimmer für Unternehmen ohne juristische Sonderprüfung lokal einsetzbar – genau das, was Llama nie erlaubte.

Meta Superintelligence Labs hat am 10. August 2026 Muse Glimmer veröffentlicht: ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter der Apache-2.0-Lizenz auf Hugging Face frei heruntergeladen werden können. Es ist das erste offene Modell der neuen Meta-Einheit und Metas erstes seit Llama 4 im Frühjahr 2025. Der eigentliche Bruch steckt aber nicht in der Modellgrösse – sondern in dieser Lizenz.

Die Lizenz, die Llama nie bekam

Llama war nie wirklich Open Source. Die Llama Community License band eine Acceptable Use Policy per Verweis ein, verbot ganze Produktklassen und zog eine Schwelle bei 700 Millionen monatlich aktiven Nutzern – wer darüber lag, brauchte eine gesonderte Lizenz von Meta. Für Juristinnen in Unternehmen war das jedes Mal eine Einzelfallprüfung.

Apache 2.0 kennt nichts davon: kein Nutzungsanhang, keine Nutzerschwelle, keine Wettbewerbsklausel. Und laut der Model Card auf Hugging Face gilt sie für alle ausgelieferten Bausteine – die vollen BF16-Gewichte, beide 4-Bit-Varianten, den Perception-Encoder und den Beschleuniger-Baustein "DFlash".

Der Unterschied ist nicht kosmetisch: Apache 2.0 verlegt die Entscheidung über die Nutzung vom Anbieter zum Anwender.

55 Gigabyte, geschrumpft auf unter 20

In voller Rechengenauigkeit bräuchte ein 30-Milliarden-Modell laut Meta über 55 Gigabyte Speicher – mehr als jede Consumer-Grafikkarte hergibt. Per Quantisierung (die Gewichte werden gröber gespeichert, hier auf etwa 4 Bit) schrumpft das Sprachmodell auf unter 20 Gigabyte. Damit bleibt Platz für Arbeitsspeicher, Bildverarbeitung und Beschleuniger innerhalb eines 24- oder 32-Gigabyte-Budgets. Konkret: eine gängige 24-GB-Karte oder ein MacBook mit genug Unified Memory reicht.

Dazu kommt spekulatives Dekodieren: Ein kleines Begleitmodell namens DFlash schlägt gleich ganze Blöcke von 16 Token vor, das Hauptmodell prüft sie parallel. Metas eigene Messung auf einer RTX 5090: 74,9 Token pro Sekunde ohne, 233,4 mit dem Drafter – ein Faktor 3,1. Auf einem MacBook M4 Max sind es 1,5×, auf dem M5 Max 1,8×.

Der Rest der Ausstattung passt zum Anspruch "immer laufender Agent auf dem eigenen Gerät": 131'072 Token Kontext, mehr als 100 Sprachen, Bild- und Textverarbeitung in einem Modell. Ausgeliefert wird als BF16, als GGUF-k-Quants und als ExecuTorch-Build; Ollama, LM Studio und llama.cpp unterstützen das Modell bereits.

Vorn bei Agenten, hinten am Desktop

Meta vergleicht Glimmer mit Gemma4-31B von Google und Qwen3.6-27B von Alibaba – den beiden führenden offenen Modellen dieser Grössenklasse. Bei Agenten-Aufgaben liegt Glimmer deutlich vorn: 75,5 Punkte auf MCP Atlas gegen 54,2 (Gemma) und 62,5 (Qwen), 51,2 auf SWE-Bench Pro gegen 36,9 und 50,2.

Ehrlicherweise gehört die andere Hälfte dazu: Beim Steuern eines Computer-Desktops (OSWorld-Verified: 65,9 gegen Qwens 75,6) und im Terminal (51,7 gegen 60,7) liegt das chinesische Modell klar vorn, multimodal sind alle drei praktisch gleichauf. Und es sind Metas eigene Zahlen – im Methodik-Report räumt das Unternehmen ein, dass das Test-Setup nicht auf die Konkurrenzmodelle abgestimmt war.

6'500 Wörter gegen die geschlossene Konkurrenz

Zeitgleich veröffentlichte Mark Zuckerberg den Essay "The Future is for Everyone". Seine Kernthese: Superintelligenz dürfe nicht bei wenigen Institutionen liegen, Sicherheit entstehe aus einem Machtgleichgewicht, nicht aus Kontrolle.

"Es gibt keine einzelne wohlwollende Superintelligenz." – Mark Zuckerberg im Essay vom 10. August 2026

Das gefährlichste Szenario sei, schreibt er, wenn führende Labs starke Modelle trainieren und für sich behalten. Besonders offensiv verteidigt er die Destillation – das Trainieren eines kleineren Modells auf den Ausgaben eines grösseren, genau die Methode, mit der Glimmer aus Metas grösserem Muse Spark entstand. Manche versuchten, Destillation als schädlich darzustellen, so Zuckerberg; wichtig sei aber der Grundsatz, "dass man von allem lernen kann, was man beobachten kann". Wie die Nachrichtenagentur AP schreibt, nennt er dabei keine Konkurrenten beim Namen – gemeint sind unverkennbar OpenAI und Anthropic, die chinesischen Labs seit Monaten genau das vorwerfen.

Ein Nebensatz verrät das Geschäftsmodell: Wer mehr Rechenleistung wolle, zahle künftig über einen "dynamischen Auktionsmechanismus" – dieselbe Logik, mit der Meta seit Jahren Werbeplätze verkauft. Der Druck dahinter ist real: Laut Berichten von Wall Street Journal und Implicator.ai plant Meta bis zu 145 Milliarden Dollar Investitionen allein 2026 und 600 Milliarden bis 2028. Offene Gewichte für das stärkere Muse Spark 1.2 sollen in den kommenden Wochen folgen.

Warum das für Schweizer Firmen zählt

Für Schweizer KMU ist die Kombination interessant: Ein Modell, das auf eigener Hardware läuft, schickt keine Kundendaten in eine US-Cloud – relevant überall dort, wo revidiertes Datenschutzgesetz, Berufsgeheimnisse oder Kundenverträge das ohnehin verbieten. Neu ist, dass die Lizenz dem nicht mehr im Weg steht: Apache 2.0 heisst kommerziell nutzbar, anpassbar, weitergebbar – ohne Rückfrage in Menlo Park.

Damit bekommt das offene Schweizer Modell Apertus von ETH und EPFL Gesellschaft in einer Klasse, die vor einem Jahr praktisch chinesischen Anbietern gehörte.

Ein Vorbehalt bleibt: Glimmer ist ein Destillat, kein Spitzenmodell – für Aufgaben an der Leistungsgrenze führt der Weg weiter in die Cloud. Für einen Agenten, der Kalender, Dateien und Mails sortiert, ohne dass sie das Gerät verlassen, ist es aber genau richtig dimensioniert.

Quellen

Meta AI Research: Introducing Muse Glimmer↗ EXTERNER LINKMark Zuckerberg: The Future is for Everyone (Essay)↗ EXTERNER LINKHugging Face: meta-models/Muse-Glimmer-30B (Model Card)↗ EXTERNER LINKMeta: Muse Glimmer Methodology Report↗ EXTERNER LINKThe Decoder: Meta returns to open models with Zuckerberg's plan↗ EXTERNER LINKVentureBeat: Meta returns to open source with Muse Glimmer↗ EXTERNER LINKAP via ABC News: Zuckerberg manifesto pushes open-source approach on AI↗ EXTERNER LINKPhoronix: Meta Publishes Muse Glimmer As 30B Open Agentic Model↗ EXTERNER LINKImplicator.ai: Meta Opens Muse Glimmer in Zuckerberg AI Policy Push↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
MetaOpenAIAnthropicHugging FaceGoogle
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
Illustration eines Tonmodells eines Hauses auf einem Drehteller, umringt von drei kleinen Stativkameras auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Fei-Fei Lis Atlas baut 3D-Welten aus wenigen Fotos

World Labs hat Atlas vorgestellt: ein Weltmodell, das aus einer Handvoll Fotos begehbare 3D-Szenen erzeugt, rekonstruiert und simuliert — bis zu eine Minute Video in 1440p mit frei gewählter Kameraführung, wahlweise als echte 3D-Geometrie. Verfügbar ist es bisher nur im Early Access, und alle Vergleichszahlen stammen von World Labs selbst.

Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Werkstattwaage mit Gewichtsscheiben, Messschieber und Notizzettel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Muse Spark 1.3: Meta setzt auf sparsam statt Spitzenplatz

Meta hat Muse Spark 1.3 veröffentlicht: 62 Punkte im Artificial Analysis Intelligence Index, einen hinter Claude Opus 5 – aber zum Achtel des Preises von Claude Fable 5.1. Die beworbene Sparsamkeit stammt allerdings aus Metas eigener Messung, und die Open-Weights-Frage ist offener denn je.

Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
Illustration einer Schlüsselwerkstatt mit Schlüsselfräse, Rohlingen an der Wand und offenem Vorhängeschloss, kinewsletter.ch Stil
NEUE MODELLE·3. SEPTEMBER 2026

Googles dritter Flash in sechs Wochen – plus ein Cyber-Modell

Gemini 3.8 Flash kostet gleich viel wie der Vorgänger – die Cyber-Variante gibt es nur für geprüfte Verteidiger. Das Frontier-Modell fehlt weiter.

Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
Illustration einer mechanischen Rechenmaschine mit Papierstreifen und Lochkartenstapel auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·2. SEPTEMBER 2026

Claude Fable 5.1: stärker beim Coden, günstiger im Betrieb

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht: deutlich bessere Werte bei agentischem Coding und Recherche, dazu ein um 75 Prozent gesenkter Cache-Preis – doch bei voller Effort-Stufe rechnet Artificial Analysis vor, dass die Rechnung höher ausfällt als bei Opus 5.

Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Speichenrad vor hohen Archivregalen, kinewsletter.ch Stil
NEUE MODELLE·31. AUGUST 2026

Tencent öffnet 770-Milliarden-Modell – Apache 2.0, 1 Million Token

Tencent hat Hy4 preview veröffentlicht: 770 Milliarden Parameter, 1 Million Token Kontext, Gewichte frei unter Apache 2.0. Das bisher grösste offene Modell des Konzerns – und der Lizenztext hat diesmal wirklich kein Kleingedrucktes.

Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
Skizze einer offenen Tresortür mit hängendem Vorhängeschloss vor einer Steinwand, kinewsletter.ch Stil
NEUE MODELLE·30. AUGUST 2026

GLM-5.3 ist offen – aber die MIT-Lizenz ist weg

Z.ai hat die Gewichte seines 753-Milliarden-Parameter-Flaggschiffs GLM-5.3 freigegeben – zwei Wochen verspätet und erstmals nicht unter MIT. Die neue Hauslizenz verpflichtet Model-as-a-Service-Anbieter ab 10 Milliarden Dollar Umsatz zu einer Sicherheitsprüfung durch Z.ai. Für alle anderen bleibt das Modell frei – die eigentliche Hürde sind die 810 Gigabyte Speicher, die es braucht.

Mehr aus Neue Modelle →