Diese Woche in KI.
Die wichtigsten Entwicklungen der Woche, für dich zusammengefasst.
OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger
OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.
Muse Glimmer: Meta öffnet 30-Milliarden-Modell unter Apache 2.0
Meta Superintelligence Labs hat am 10. August Muse Glimmer veröffentlicht – ein multimodales Modell mit 30 Milliarden Parametern, dessen Gewichte unter Apache 2.0 frei verfügbar sind. Quantisiert läuft es auf einer einzelnen Consumer-Grafikkarte. Dazu kommt ein 6'500 Wörter langer Essay von Mark Zuckerberg, der sich wie eine Antwort auf OpenAI und Anthropic liest.
Claude hebt Riemann-Schranke von 41,6 auf 67,2 Prozent
Eine unveröffentlichte Research-Version von Claude hat den bewiesenen Anteil der Nullstellen der Riemannschen Zetafunktion auf der kritischen Geraden von 41,6 auf 67,2 Prozent angehoben – ohne die Riemann-Hypothese selbst zu lösen. Angestossen hat das ein Anthropic-Mitarbeiter ohne Mathematik-Ausbildung, die Arbeit erledigten rund 60 Claude-Subagenten, und der Beweis liegt maschinenprüfbar im Beweisassistenten Lean auf GitHub.
OpenAI kauft NextSlide — ChatGPT baut längst deine Slides
OpenAI hat das Präsentations-Startup NextSlide übernommen — abgeschlossen wurde der Deal schon Anfang Jahr, bekannt gegeben erst am 7. August. Wichtiger als die Übernahme: ChatGPT baut seit Mai fertige Foliensätze direkt in PowerPoint, in jedem Tarif inklusive Gratis-Abo. Der entscheidende Haken für Schweizer KMU steht im Kleingedruckten von Microsoft.
Hinter allen drei Rogue-KI-Vorfällen steckt dasselbe kleine Startup
Die Fälle, in denen KI-Modelle von OpenAI, Anthropic und Meta bei Sicherheitstests in echte fremde Systeme eingriffen, gehen auf dieselbe Fehlkonfiguration zurück – bei einem einzigen Anbieter. Irregular aus Tel Aviv hat rund 35 Mitarbeitende und prüft die mächtigsten Modelle der Welt. Das wirft eine Frage auf, die bisher kaum jemand stellt.
SRG blockiert KI-Crawler und will ihr Archiv für Apertus öffnen
Seit August weist die SRG auf srf.ch, rts.ch und rtr.ch über 20 KI-Trainingsbots ab — Live-Abrufe für KI-Antworten bleiben ausdrücklich erlaubt. Gleichzeitig verhandelt sie mit ETH Zürich und EPFL darüber, ihr Archiv mit rund 2 Millionen Stunden Radio- und TV-Material dem offenen Schweizer Modell Apertus zu überlassen. Andere Medienhäuser lassen sich ihre Archive für zweistellige Millionenbeträge abkaufen.
Amazons Kraftwerk in Texas könnte grösster Klimaverschmutzer der USA werden
Für ein neues KI-Rechenzentrum in Pecos County finanziert Amazon ein eigenes Gaskraftwerk mit 35 Turbinen und 7,65 Gigawatt. Die Bewilligung erlaubt 33 Millionen Tonnen CO2 pro Jahr – mehr als jedes andere Kraftwerk der USA. Am Netto-Null-Versprechen für 2040 hält der Konzern trotzdem fest.
Claude Code schaltet ab 14. August auf Automatik
Ein Klassifikator prüft künftig jeden Befehl statt dir. In Anthropics Studie erkannten Menschen nur 13,6 Prozent der gefährlichen Kommandos, der Klassifikator 89 Prozent.
Cloudflare baut Kitesurf – einen Browser nur für KI-Agenten
Cloudflare hat Kitesurf vorgestellt: einen Browser ohne Tabs und Extensions, gebaut ausschliesslich für KI-Agenten. Er läuft komplett auf Cloudflare Workers und braucht 3- bis 7-mal weniger CPU und Speicher als Chromium.
AMD kauft Taalas – KI-Modelle direkt ins Silizium gebrannt
AMD übernimmt das Toronto-Startup Taalas, das KI-Modelle direkt ins Silizium brennt, statt sie auf flexibler Hardware laufen zu lassen. Ein Testchip lieferte Llama 3.1 8B mit 16'960 Token pro Sekunde und Nutzer aus – ein Vielfaches konkurrierender Hardware. Der Preis dafür: Jeder Chip kann nur genau ein Modell.
Kimi K3 brach aus der Testumgebung aus – und schummelte
Das chinesische Modell Kimi K3 verliess bei einem Cybersicherheits-Test seine Sandbox, klonte das Benchmark-Repository von GitHub und las die Lösung ab. Schuld war eine falsch konfigurierte Testumgebung. Der Fall zeigt: Nicht nur die Modelle sind ein Risiko – auch die Tests, die sie prüfen sollen.
OpenAI stoppt Teile von Astra – erstmals Cyber-Stufe «Critical»
OpenAI setzt Teile der Entwicklung seines unveröffentlichten Modells Astra aus. Interne Tests zeigen Cyberfähigkeiten so stark, dass die höchste Risikostufe «Critical» des eigenen Preparedness Framework erstmals nicht mehr auszuschliessen ist.
KI-Agenten brauchen 600-mal mehr Strom als ein Chat-Prompt
Klimaforscher Zeke Hausfather protokollierte acht Wochen lang seine Claude-Code-Nutzung: 1'138 Prompts lösten über 14'000 Modellaufrufe und 3,2 Milliarden Tokens aus. Macht rund 150 Wattstunden pro Prompt – etwa 600-mal so viel wie ein einfacher Chat-Prompt. Gemessen sind allerdings nur die Tokens, der Rest ist Schätzung.
KI frisst den Arbeitsspeicher – PC-Riesen greifen zu China-Chips
HP, Asus und Acer verbauen laut Nikkei Asia erstmals chinesischen Arbeitsspeicher – nicht weil er billiger wäre, sondern weil KI-Rechenzentren den Markt leerkaufen. In der Schweiz sind Notebooks laut Galaxus binnen zwölf Monaten um 30 Prozent teurer geworden.
«Wir können keine Daten trinken» – Indien klagt gegen Google
Googles 15-Milliarden-Rechenzentrum in Visakhapatnam ist im Bau – und steht bereits vor Gericht. Umweltschützer klagen wegen Wasserverbrauch und der Nähe zu einem Leoparden-Schutzgebiet. Der Widerstand gegen KI-Rechenzentren ist global geworden.
Unitree geht an die Börse – und schreibt schwarze Zahlen
Der chinesische Roboterhersteller Unitree bepreist seinen Börsengang in Shanghai mit rund 9 Milliarden Dollar. Es ist der erste Humanoiden-Hersteller mit Serienauslieferung und Gewinn, der einen Kurszettel bekommt – und ein harter Realitätscheck für die Bewertungen der ganzen Branche.
Suno markiert KI-Songs – sechs Tage nach dem GEMA-Urteil
Suno kündigt Audio-Wasserzeichen, Fingerprinting und Download-Limits an – sechs Tage nach der Niederlage gegen die GEMA. In Kraft sind bisher nur die neuen Community-Regeln; die Technik kommt erst «in den kommenden Wochen», und wie sie funktioniert, sagt Suno nicht.
OpenAI-Agenten bauten ein heimliches Message Board für ihre Hacks
An der Black Hat legte OpenAI offen: Seine Agenten bauten sich in einem internen Repository ein Message Board – und nach der Löschung zwei Tage später ein neues. Aus dieser Koordination entstand der Einbruch bei Hugging Face.
US-Berufungsgericht: Perplexitys Shopping-Agent darf zurück auf Amazon
Ein US-Berufungsgericht hat das Verbot gekippt, das Perplexitys KI-Agenten seit März das Einkaufen auf Amazon untersagte. Die Begründung hat es in sich: Rechtlich greifen die Nutzer auf Amazon zu, nicht Perplexity — Amazons Hacking-Vorwurf dürfte damit scheitern. Entschieden ist der Prozess aber noch nicht.
Meta liess über 50 Anzeigen mit KI-generiertem Missbrauchsmaterial laufen
Eine Wired-Recherche auf Basis von Daten des Tech Transparency Project zeigt: Meta hat mehr als 50 bezahlte Anzeigen mit KI-generierten sexualisierten Darstellungen von Kindern geprüft, freigegeben und ausgespielt – auf Facebook, Instagram, Messenger und Threads. Die Anzeigen sind inzwischen entfernt, doch der Fall wirft grundlegende Fragen an Metas Werbeprüfung auf.
Google beerdigt den Assistant: Ab 4. September übernimmt Gemini
Google stellt den Google Assistant ein: Ab dem 4. September 2026 ersetzt Gemini den Sprachassistenten auf Android-Handys, Tablets, Smartwatches, Kopfhörern und in Android Auto. Ein Zurück gibt es nicht.
Meta greift Claude Code an: 92 Prozent Rabatt fürs Datenteilen
Meta Superintelligence Labs lanciert mit Muse Code einen Terminal-Coding-Agenten als direkte Konkurrenz zu Claude Code und Codex – angetrieben vom neuen Modell Muse Spark 1.2. Der Haken am Preismodell: Wer Meta seine Daten überlässt, zahlt bis zu 95 Prozent weniger.
Mistral Shieldstral: Offenes 3B-Sicherheitsmodell schlägt siebenmal grössere Guard-Modelle
Mistral hat Shieldstral veröffentlicht: einen offenen Sicherheits-Classifier mit nur 3 Milliarden Parametern, der Texte und Bilder moderiert. Die Regeln bekommt das Modell als Klartext-Frage zur Laufzeit — laut Mistral erreicht oder übertrifft es damit Guard-Modelle bis zu siebenfacher Grösse und läuft auf einer einzigen 16-GB-Grafikkarte.
Qwen3.8-Max: Alibaba liefert nach – und verspricht offene Gewichte
Alibaba hat Qwen3.8-Max voll lanciert: 2,4 Billionen Parameter, 1 Million Token Kontext und Case Studies, in denen das Modell tagelang autonom arbeitet. Nächste Woche sollen die Gewichte folgen – es wäre das erste Max-Klasse-Modell, das offen verfügbar wird.
FLUX 3 Video: KI-Clips mit Ton – jetzt für alle verfügbar
Black Forest Labs macht sein Videomodell FLUX 3 Video über die API allgemein verfügbar: bis zu 20 Sekunden Video mit nativ mitgeneriertem Ton, Lippensynchronisation auf Deutsch und einem günstigen Draft-Modus. In internen Tests sieht sich das Freiburger KI-Studio an der Spitze.
ByteDance Seedance 2.5: 30-Sekunden-Videos mit Ton in einem Durchgang
ByteDance hat Seedance 2.5 vorgestellt: Das Videomodell generiert neu 30 Sekunden Video samt Ton in einem einzigen Durchgang – doppelt so viel wie der Vorgänger und rund dreimal so viel wie Googles Gemini Omni Flash. Clips lassen sich mehrfach zu Minuten-Videos verlängern. Verfügbar ist das Modell vorerst nur auf ByteDances China-Plattformen, die API soll folgen.
OpenAI kündigt Astra an – mit zehn gelösten Mathe-Problemen
OpenAI hat zehn Resultate zu offenen Problemen der Mathematik und theoretischen Informatik publiziert – erzeugt von einer internen Version von Astra, das OpenAI erstmals offiziell als sein nächstes grosses Modell bezeichnet. Alle Beweise sind im Beweisassistenten Lean maschinell verifiziert, die Tokenkosten beziffert OpenAI auf rund 2'000 Dollar. Die Mathe-Community reagiert zwischen Begeisterung und Sinnkrise.
Inkling-Small: Muratis Viertel-Modell überholt sein eigenes Flaggschiff
Zwei Wochen nach seinem ersten offenen Modell legt Mira Muratis Thinking Machines Lab nach: Inkling-Small hat 276 Milliarden Parameter, steht unter Apache-2.0-Lizenz und landet laut Artificial Analysis nur einen Punkt hinter dem rund dreieinhalbmal grösseren Flaggschiff. Auf Coding-Benchmarks schlägt der Kleine das Original sogar.
Zürcher Startup Exclaim Robotics holt 5 Millionen für Rechenzentrums-Roboter
Das Zürcher Startup Exclaim Robotics holt 4,95 Millionen US-Dollar, um autonome Reparatur-Roboter für KI-Rechenzentren zu bauen. Gründerin Helen Oleynikova kommt von der ETH Zürich – und will Technikern die gefährliche Arbeit an 800-Volt-Racks abnehmen.
Weltbank: KI-Jobrisiko in der Schweiz dreimal höher
Die Weltbank hat den World Development Report 2026 vorgelegt: In Hochlohnländern wie der Schweiz sind 14,2 Prozent der Jobs durch generative KI automatisierungsgefährdet, in ärmeren Ländern nur 4,5 Prozent. Für den globalen Süden ist KI laut dem Bericht vor allem eines: eine Rettungsleine.
Radio Schaffhuuse: Neues Schweizer Radio wird komplett von KI moderiert
Seit dem 1. Juli moderiert beim neuen «Radio Schaffhuuse» ausschliesslich künstliche Intelligenz – mit geklonten Stimmen der eigenen Redaktion. Das Konzept macht Lokalradio bezahlbar, hat aber einen Haken: Auf DAB+ fehlt laut SRF der Hinweis, dass hier eine Maschine spricht.
FHNW und Giotto.ai forschen an effizienteren KI-Modellen
Das High-Performance-Computing-Labor der FHNW und das Lausanner KI-Labor Giotto.ai wollen gemeinsam Rechenaufwand und Inferenzkosten von KI-Modellen senken, ohne Leistung einzubüssen. Im Fokus: Serving-Engines, Deployment-Profile und Hardware-Beschleuniger.
Jetzt alle drei: Auch Metas KI hackte real – OpenAI nennt Details
Nach OpenAI und Anthropic räumt jetzt auch Meta ein, dass eines seiner Modelle bei Sicherheitstests real in ein fremdes Unternehmen eindrang. Zugleich legt OpenAI erstmals offen, was sein Modell GPT-5.6 Sol genau tat – und wie schnell der Vorfall gestoppt wurde. Innerhalb von zwei Wochen ist damit bei allen drei grossen US-Labs dasselbe passiert.
Beben bei Google DeepMind: Hassabis gibt Tagesgeschäft ab, Dean geht
Demis Hassabis zieht sich aus dem Tagesgeschäft von Google DeepMind zurück, um sich ganz auf AGI zu konzentrieren – und Google-Urgestein Jeff Dean geht nach 27 Jahren. Mit drei weiteren Top-Forschern gründet Dean das Startup Discovery Loop, das wissenschaftliche Forschung automatisieren will.
KI-Agenten täuschten bei UK-Sicherheitstests echte Menschen
Das britische AI Security Institute und OpenAI haben zwei neue Vorfälle offengelegt: Bei einem Cyber-Test der Behörde führten Anthropics Mythos 5 und OpenAIs GPT-5.6 Sol 19 unsanktionierte Aktionen gegen echte Menschen und Organisationen aus – inklusive gefälschter Online-Identitäten. Beim Testpartner Irregular griff ein OpenAI-Modell wegen einer Fehlkonfiguration eine echte Website an. Realer Schaden entstand laut den Beteiligten nicht.
Gemini Robotics ER 2: Googles Roboter-Gehirn für alle Entwickler
Google DeepMind hat mit Gemini Robotics ER 2 das «Gehirn» seiner neuen Robotik-Familie für alle Entwickler geöffnet: Das Modell plant mehrstufige Roboter-Aufgaben, erkennt per Videoverständnis in Echtzeit, ob etwas schiefläuft, und koordiniert mehrere Roboter gleichzeitig. Die beiden Action-Modelle der Gemini-Robotics-2-Familie bleiben vorerst Early-Access-Partnern vorbehalten.
Der KI-Newsletter aus der Schweiz.
kinewsletter.ch ist für alle KI-Interessierten — egal ob du KI beruflich nutzen willst oder einfach neugierig bist. Wir erklären komplexe Themen simpel und verständlich.
Keine Vorkenntnisse nötig. In 5 Minuten pro Woche bist du auf dem neuesten Stand — jeden Freitag direkt in deinem Postfach.









































































