NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Muse Glimmer: Meta öffnet 30-Milliarden-Modell unter Apache 2.0

Meta Superintelligence Labs hat am 10. August Muse Glimmer veröffentlicht – ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter Apache 2.0 frei verfügbar sind. Quantisiert läuft es auf einer einzelnen Consumer-Grafikkarte. Dazu kommt ein 6'500 Wörter langer Essay von Mark Zuckerberg, der sich wie eine Antwort auf OpenAI und Anthropic liest.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
11. AUGUST 2026
4 MIN. LESEZEIT
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
Illustration eines offenen Vorhängeschlosses vor einem offenen PC-Gehäuse mit Grafikkarte, kinewsletter.ch Stil
INHALT
01Die Lizenz, die Llama nie bekam0255 Gigabyte, geschrumpft auf unter 2003Vorn bei Agenten, hinten am Desktop046'500 Wörter gegen die geschlossene Konkurrenz05Warum das für Schweizer Firmen zählt
INHALT
01Die Lizenz, die Llama nie bekam0255 Gigabyte, geschrumpft auf unter 2003Vorn bei Agenten, hinten am Desktop046'500 Wörter gegen die geschlossene Konkurrenz05Warum das für Schweizer Firmen zählt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Die Nachricht ist nicht die Modellgrösse, sondern die Lizenz: Apache 2.0 macht Muse Glimmer für Unternehmen ohne juristische Sonderprüfung lokal einsetzbar – genau das, was Llama nie erlaubte.

Meta Superintelligence Labs hat am 10. August 2026 Muse Glimmer veröffentlicht: ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter der Apache-2.0-Lizenz auf Hugging Face frei heruntergeladen werden können. Es ist das erste offene Modell der neuen Meta-Einheit und Metas erstes seit Llama 4 im Frühjahr 2025. Der eigentliche Bruch steckt aber nicht in der Modellgrösse – sondern in dieser Lizenz.

Die Lizenz, die Llama nie bekam

Llama war nie wirklich Open Source. Die Llama Community License band eine Acceptable Use Policy per Verweis ein, verbot ganze Produktklassen und zog eine Schwelle bei 700 Millionen monatlich aktiven Nutzern – wer darüber lag, brauchte eine gesonderte Lizenz von Meta. Für Juristinnen in Unternehmen war das jedes Mal eine Einzelfallprüfung.

Apache 2.0 kennt nichts davon: kein Nutzungsanhang, keine Nutzerschwelle, keine Wettbewerbsklausel. Und laut der Model Card auf Hugging Face gilt sie für alle ausgelieferten Bausteine – die vollen BF16-Gewichte, beide 4-Bit-Varianten, den Perception-Encoder und den Beschleuniger-Baustein "DFlash".

Der Unterschied ist nicht kosmetisch: Apache 2.0 verlegt die Entscheidung über die Nutzung vom Anbieter zum Anwender.

55 Gigabyte, geschrumpft auf unter 20

In voller Rechengenauigkeit bräuchte ein 30-Milliarden-Modell laut Meta über 55 Gigabyte Speicher – mehr als jede Consumer-Grafikkarte hergibt. Per Quantisierung (die Gewichte werden gröber gespeichert, hier auf etwa 4 Bit) schrumpft das Sprachmodell auf . Damit bleibt Platz für Arbeitsspeicher, Bildverarbeitung und Beschleuniger innerhalb eines . Konkret: eine gängige 24-GB-Karte oder ein MacBook mit genug Unified Memory reicht.

WEITERLESENDas könnte dich auch interessieren.

Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
unter 20 Gigabyte
24- oder 32-Gigabyte-Budgets

Dazu kommt spekulatives Dekodieren: Ein kleines Begleitmodell namens DFlash schlägt gleich ganze Blöcke von 16 Token vor, das Hauptmodell prüft sie parallel. Metas eigene Messung auf einer RTX 5090: 74,9 Token pro Sekunde ohne, 233,4 mit dem Drafter – ein Faktor 3,1. Auf einem MacBook M4 Max sind es 1,5×, auf dem M5 Max 1,8×.

Der Rest der Ausstattung passt zum Anspruch "immer laufender Agent auf dem eigenen Gerät": 131'072 Token Kontext, mehr als 100 Sprachen, Bild- und Textverarbeitung in einem Modell. Ausgeliefert wird als BF16, als GGUF-k-Quants und als ExecuTorch-Build; Ollama, LM Studio und llama.cpp unterstützen das Modell bereits.

Vorn bei Agenten, hinten am Desktop

Meta vergleicht Glimmer mit Gemma4-31B von Google und Qwen3.6-27B von Alibaba – den beiden führenden offenen Modellen dieser Grössenklasse. Bei Agenten-Aufgaben liegt Glimmer deutlich vorn: 75,5 Punkte auf MCP Atlas gegen 54,2 (Gemma) und 62,5 (Qwen), 51,2 auf SWE-Bench Pro gegen 36,9 und 50,2.

Ehrlicherweise gehört die andere Hälfte dazu: Beim Steuern eines Computer-Desktops (OSWorld-Verified: 65,9 gegen Qwens 75,6) und im Terminal (51,7 gegen 60,7) liegt das chinesische Modell klar vorn, multimodal sind alle drei praktisch gleichauf. Und es sind Metas eigene Zahlen – im Methodik-Report räumt das Unternehmen ein, dass das Test-Setup nicht auf die Konkurrenzmodelle abgestimmt war.

6'500 Wörter gegen die geschlossene Konkurrenz

Zeitgleich veröffentlichte Mark Zuckerberg den Essay "The Future is for Everyone". Seine Kernthese: Superintelligenz dürfe nicht bei wenigen Institutionen liegen, Sicherheit entstehe aus einem Machtgleichgewicht, nicht aus Kontrolle.

"Es gibt keine einzelne wohlwollende Superintelligenz." – Mark Zuckerberg im Essay vom 10. August 2026

Das gefährlichste Szenario sei, schreibt er, wenn führende Labs starke Modelle trainieren und für sich behalten. Besonders offensiv verteidigt er die Destillation – das Trainieren eines kleineren Modells auf den Ausgaben eines grösseren, genau die Methode, mit der Glimmer aus Metas grösserem Muse Spark entstand. Manche versuchten, Destillation als schädlich darzustellen, so Zuckerberg; wichtig sei aber der Grundsatz, "dass man von allem lernen kann, was man beobachten kann". Wie die Nachrichtenagentur AP schreibt, nennt er dabei keine Konkurrenten beim Namen – gemeint sind unverkennbar OpenAI und Anthropic, die chinesischen Labs seit Monaten genau das vorwerfen.

Ein Nebensatz verrät das Geschäftsmodell: Wer mehr Rechenleistung wolle, zahle künftig über einen "dynamischen Auktionsmechanismus" – dieselbe Logik, mit der Meta seit Jahren Werbeplätze verkauft. Der Druck dahinter ist real: Laut Berichten von Wall Street Journal und Implicator.ai plant Meta bis zu 145 Milliarden Dollar Investitionen allein 2026 und 600 Milliarden bis 2028. Offene Gewichte für das stärkere Muse Spark 1.2 sollen in den kommenden Wochen folgen.

Warum das für Schweizer Firmen zählt

Für Schweizer KMU ist die Kombination interessant: Ein Modell, das auf eigener Hardware läuft, schickt keine Kundendaten in eine US-Cloud – relevant überall dort, wo revidiertes Datenschutzgesetz, Berufsgeheimnisse oder Kundenverträge das ohnehin verbieten. Neu ist, dass die Lizenz dem nicht mehr im Weg steht: Apache 2.0 heisst kommerziell nutzbar, anpassbar, weitergebbar – ohne Rückfrage in Menlo Park.

Damit bekommt das offene Schweizer Modell Apertus von ETH und EPFL Gesellschaft in einer Klasse, die vor einem Jahr praktisch chinesischen Anbietern gehörte.

Ein Vorbehalt bleibt: Glimmer ist ein Destillat, kein Spitzenmodell – für Aufgaben an der Leistungsgrenze führt der Weg weiter in die Cloud. Für einen Agenten, der Kalender, Dateien und Mails sortiert, ohne dass sie das Gerät verlassen, ist es aber genau richtig dimensioniert.

Quellen

Meta AI Research: Introducing Muse Glimmer↗ EXTERNER LINKMark Zuckerberg: The Future is for Everyone (Essay)↗ EXTERNER LINKHugging Face: meta-models/Muse-Glimmer-30B (Model Card)↗ EXTERNER LINKMeta: Muse Glimmer Methodology Report↗ EXTERNER LINKThe Decoder: Meta returns to open models with Zuckerberg's plan↗ EXTERNER LINKVentureBeat: Meta returns to open source with Muse Glimmer↗ EXTERNER LINKAP via ABC News: Zuckerberg manifesto pushes open-source approach on AI↗ EXTERNER LINKPhoronix: Meta Publishes Muse Glimmer As 30B Open Agentic Model↗ EXTERNER LINKImplicator.ai: Meta Opens Muse Glimmer in Zuckerberg AI Policy Push↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?
NEUE MODELLE·11. AUGUST 2026

OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger

OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.

Illustration einer Wandtafel auf Staffelei mit blauer senkrechter Linie und Punkten, kinewsletter.ch Stil
Illustration einer Wandtafel auf Staffelei mit blauer senkrechter Linie und Punkten, kinewsletter.ch Stil
KI-FORSCHUNG·11. AUGUST 2026

Claude hebt Riemann-Schranke von 41,6 auf 67,2 Prozent

Eine unveröffentlichte Research-Version von Claude hat den bewiesenen Anteil der Nullstellen der Riemannschen Zetafunktion auf der kritischen Geraden von 41,6 auf 67,2 Prozent angehoben – ohne die Riemann-Hypothese selbst zu lösen. Angestossen hat das ein Anthropic-Mitarbeiter ohne Mathematik-Ausbildung, die Arbeit erledigten rund 60 Claude-Subagenten, und der Beweis liegt maschinenprüfbar im Beweisassistenten Lean auf GitHub.

Illustration einer offenen Tresortür in einem Serverraum, kinewsletter.ch Stil
Illustration einer offenen Tresortür in einem Serverraum, kinewsletter.ch Stil
REGULIERUNG & ETHIK·9. AUGUST 2026

OpenAI stoppt Teile von Astra – erstmals Cyber-Stufe «Critical»

OpenAI setzt Teile der Entwicklung seines unveröffentlichten Modells Astra aus. Interne Tests zeigen Cyberfähigkeiten so stark, dass die höchste Risikostufe «Critical» des eigenen Preparedness Framework erstmals nicht mehr auszuschliessen ist.

Illustration einer Filmklappe mit elektroblauen Balken neben Tonangel-Mikrofon und Scheinwerfer, im Hintergrund ein Fenster mit Schwarzwald-Tannen, kinewsletter.ch Stil
Illustration einer Filmklappe mit elektroblauen Balken neben Tonangel-Mikrofon und Scheinwerfer, im Hintergrund ein Fenster mit Schwarzwald-Tannen, kinewsletter.ch Stil
NEUE MODELLE·6. AUGUST 2026

FLUX 3 Video: KI-Clips mit Ton – jetzt für alle verfügbar

Black Forest Labs macht sein Videomodell FLUX 3 Video über die API allgemein verfügbar: bis zu 20 Sekunden Video mit nativ mitgeneriertem Ton, Lippensynchronisation auf Deutsch und einem günstigen Draft-Modus. In internen Tests sieht sich das Freiburger KI-Studio an der Spitze.

Illustration einer Balkenwaage mit elektroblauem Ständer, auf der einen Schale Münzen, auf der anderen gerollte Dokumente, kinewsletter.ch Stil
Illustration einer Balkenwaage mit elektroblauem Ständer, auf der einen Schale Münzen, auf der anderen gerollte Dokumente, kinewsletter.ch Stil
KI-TOOLS & APPS·6. AUGUST 2026

Meta greift Claude Code an: 92 Prozent Rabatt fürs Datenteilen

Meta Superintelligence Labs lanciert mit Muse Code einen Terminal-Coding-Agenten als direkte Konkurrenz zu Claude Code und Codex – angetrieben vom neuen Modell Muse Spark 1.2. Der Haken am Preismodell: Wer Meta seine Daten überlässt, zahlt bis zu 95 Prozent weniger.

Illustration eines Wachhäuschens mit Schranke und elektroblauem Rundschild, kinewsletter.ch Stil
Illustration eines Wachhäuschens mit Schranke und elektroblauem Rundschild, kinewsletter.ch Stil
KI-TOOLS & APPS·5. AUGUST 2026

Mistral Shieldstral: Offenes 3B-Sicherheitsmodell schlägt siebenmal grössere Guard-Modelle

Mistral hat Shieldstral veröffentlicht: einen offenen Sicherheits-Classifier mit nur 3 Milliarden Parametern, der Texte und Bilder moderiert. Die Regeln bekommt das Modell als Klartext-Frage zur Laufzeit — laut Mistral erreicht oder übertrifft es damit Guard-Modelle bis zu siebenfacher Grösse und läuft auf einer einzigen 16-GB-Grafikkarte.

Mehr aus Neue Modelle →