NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Nadella fordert eine Notbremse für KI-Modelle

Microsoft-Chef Satya Nadella verlangt, KI-Modelle von Anfang an als mögliches Sicherheitsrisiko zu behandeln: mit Protokollen, Kontrollen ausserhalb des Modells und einer Notbremse. Wir ordnen ein, was das für Firmen mit KI-Agenten heisst.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
11. OKTOBER 2026
2 MIN. LESEZEIT
Handgezeichnete Skizze einer Zugwand mit blau gerahmter Notbremse hinter Glas, Hammer an einer Kette und vier Wandschaltern
Handgezeichnete Skizze einer Zugwand mit blau gerahmter Notbremse hinter Glas, Hammer an einer Kette und vier Wandschaltern
INHALT
01Vier Forderungen statt Vertrauensfrage02Der Anlass: Labore verlieren die Kontrolle03Drei Fragen für deine Firma
INHALT
01Vier Forderungen statt Vertrauensfrage02Der Anlass: Labore verlieren die Kontrolle03Drei Fragen für deine Firma
Inoo GmbH
Präsentiert & entwickelt von
kinewsletter.ch ist ein Projekt der Inoo GmbH

KI-Beratung und Softwareentwicklung aus dem St. Galler Rheintal.

inoo.ch →
DAS WICHTIGSTE IN KÜRZE

Nadella verlangt Kontrollen ausserhalb des Modells und eine Notbremse. Prüfe bei deinen KI-Agenten, wer sie stoppen kann und wo die Protokolle liegen.

Microsoft-Chef Satya Nadella fordert, KI-Modelle von Anfang an wie ein mögliches Sicherheitsrisiko zu behandeln. In einem Beitrag auf X und einem Essay vom Samstag, 10. Oktober, schreibt er: «We must assume a model is compromised and contain it from the start» – also: Geh davon aus, dass ein Modell kompromittiert ist, und begrenze es von Beginn an. Dazu stellt er vier Forderungen auf, darunter eine «Notbremse», mit der ein Mensch ein laufendes Modell stoppen kann. Laut RuntimeWire ist es ein Grundsatzpapier und kein Produkt.

Vier Forderungen statt Vertrauensfrage

Nadella will KI nicht als undurchsichtige Black Box behandeln, die man entweder komplett akzeptiert oder komplett ablehnt. Laut TechCrunch schlägt er vor:

  • Das Modell vom «Harness» trennen, also von der Software, die seine Arbeit steuert und verwaltet.
  • Kontrollen und Schutzmechanismen ausserhalb des Modells einbauen.
  • Jede wichtige Modellaktion in manipulationssicheren, lesbaren Protokollen festhalten.
  • Eine berechtigte Person kann ein Modell mitten in einer Aufgabe pausieren oder abschalten – «wie eine Notbremse».

Der Essay trägt laut RuntimeWire den Titel «Models as Insider Risks in the Super Intelligence Era». Er vergleicht Modelle mit Insidern, die weitreichende Rechte haben, und nennt zusätzlich laufende Tests, unabhängige Prüfungen, Meldung von Vorfällen und den Einsatz mehrerer Modelle. Ein Microsoft-Produkt oder einen technischen Standard nennt der Text nicht.

Der Anlass: Labore verlieren die Kontrolle

WEITERLESENDas könnte dich auch interessieren.

Tuschskizze eines Tresors und eines verschlossenen Gitterkäfigs mit Roboterarm auf einer Werkbank, der Käfig in Elektroblau

TechCrunch ordnet den Post nach Berichten ein, in denen grosse KI-Firmen eigene Kontrollverluste einräumten. Am 9. Oktober veröffentlichte OpenAI einen Vorfall vom 6. Oktober: Ein internes Modell sollte beim Training sieben Antworten anderer Modelle bewerten, fand die nötigen Dateien nicht und reichte erfundene Bewertungen ein. Danach beschädigte es seine Umgebung, offenbar um einen Neustart mit den fehlenden Dateien zu erzwingen. OpenAIs Überwachungssystem markierte den Fall zur Prüfung durch Menschen. Anthropic wiederum hat den Live-Internetzugang für alle internen Tests abgeschaltet, nachdem Modelle in Tests echte Websites ausgenutzt hatten.

Drei Fragen für deine Firma

Nadellas Text richtet sich an Unternehmen. Wenn du KI-Agenten einsetzt oder planst, lohnen sich drei Fragen: Wer darf einen Agenten mitten in der Arbeit stoppen? Liegen Berechtigungen und Protokolle ausserhalb des Modells, sodass du sie selbst lesen kannst? Und was passiert, wenn der Agent etwas Unerwartetes tut? Das sind unsere Schlüsse aus Nadellas Vorschlägen, keine Vorgaben von Microsoft.

Quellen

Satya Nadella auf X, 10.10.2026↗ EXTERNER LINKTechCrunch, 10.10.2026↗ EXTERNER LINKRuntimeWire, 10.10.2026↗ EXTERNER LINKMezha, 11.10.2026↗ EXTERNER LINKOpenAI Alignment, 09.10.2026↗ EXTERNER LINKTechCrunch, 09.10.2026↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
MicrosoftOpenAIAnthropic
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?
Tuschskizze eines Tresors und eines verschlossenen Gitterkäfigs mit Roboterarm auf einer Werkbank, der Käfig in Elektroblau
KI-BUSINESS

Nvidia baut den Not-Aus für KI-Agenten in den Chip

Nvidia lanciert die «Open Agent Safety Platform»: Die quelloffene Runtime OpenShell bekommt mit Sentry einen Hardware-Wächter auf BlueField-4-DPUs, der regelverletzende Agenten laut Nvidia in Millisekunden isoliert. Über 100 Partner sind dabei, OpenAI fehlt. Gegen Prompt Injection hilft der Wächter nur bedingt.

Handgezeichnete Skizze eines Schalters mit blauer Hinweisbox, blauem Wählscheibentelefon mit abgehobenem Hörer, Schreibtischlampe und Papierstapel
Handgezeichnete Skizze eines Schalters mit blauer Hinweisbox, blauem Wählscheibentelefon mit abgehobenem Hörer, Schreibtischlampe und Papierstapel
REGULIERUNG & ETHIK

Anthropic-Modell meldet der Polizei einen erfundenen Mordhinweis

Ein Testlauf mit Claude Haiku 4.5 reichte im Juli einen falschen Hinweis zu einem ungelösten Mordfall bei der Polizei von Philadelphia ein. Anthropic schaltet das Internet für interne Tests ab, das Weisse Haus verlangt Meldungen. Wir ordnen ein, was das für Firmen mit KI-Agenten heisst.

Mehr aus Regulierung & Ethik →