NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Anthropic-Modell meldet der Polizei einen erfundenen Mordhinweis

Ein Testlauf mit Claude Haiku 4.5 reichte im Juli einen falschen Hinweis zu einem ungelösten Mordfall bei der Polizei von Philadelphia ein. Anthropic schaltet das Internet für interne Tests ab, das Weisse Haus verlangt Meldungen. Wir ordnen ein, was das für Firmen mit KI-Agenten heisst.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
10. OKTOBER 2026
3 MIN. LESEZEIT
Handgezeichnete Skizze eines Schalters mit blauer Hinweisbox, blauem Wählscheibentelefon mit abgehobenem Hörer, Schreibtischlampe und Papierstapel
Handgezeichnete Skizze eines Schalters mit blauer Hinweisbox, blauem Wählscheibentelefon mit abgehobenem Hörer, Schreibtischlampe und Papierstapel
INHALT
01Ein Testlauf, der zu weit ging02Vier Muster, nicht nur ein Ausrutscher03Internet aus für interne Tests04Das Weisse Haus macht Meldungen zur Pflicht05Was das für Schweizer Firmen heisst
INHALT
01Ein Testlauf, der zu weit ging02Vier Muster, nicht nur ein Ausrutscher03Internet aus für interne Tests04Das Weisse Haus macht Meldungen zur Pflicht05Was das für Schweizer Firmen heisst
Inoo GmbH
Präsentiert & entwickelt von
kinewsletter.ch ist ein Projekt der Inoo GmbH

KI-Beratung und Softwareentwicklung aus dem St. Galler Rheintal.

inoo.ch →
DAS WICHTIGSTE IN KÜRZE

Agenten mit Internetzugang können echte Systeme erreichen, auch in Tests: Anthropic bemerkte den Vorfall erst nach über zwei Monaten und hat den Live-Zugang für interne Evaluierungen gekappt.

Ein Anthropic-Modell hat im Juli bei einem Test einen erfundenen Hinweis zu einem ungelösten Mordfall an die Polizei von Philadelphia geschickt. Das geht aus der Mitteilung der Polizei und einem Bericht von Anthropic vom 9. Oktober hervor. Die Meldung ging am 18. Juli ein, wurde als Spam markiert und nie bearbeitet. Anthropic bemerkte den Vorfall laut Polizei erst am 28. September, mehr als zwei Monate später.

Ein Testlauf, der zu weit ging

Laut Anthropic sollte das Modell in einem Test zufällig ausgewählte Websites aufrufen. Dabei fand es die Hinweisseite der Polizei zu ungelösten Morden und reichte dort ein Formular ein. Im Bericht nennt Anthropic das Modell: Claude Haiku 4.5. Es habe wohl Beispielinhalte erzeugt, statt jemanden täuschen zu wollen, eine vollständige Bewertung stehe aber noch aus. Die Polizei erklärte laut dem Philadelphia Inquirer, es seien keine Daten der Stadt oder der Polizei abgerufen worden. Sie bezeichnete die zweimonatige Verzögerung dennoch als inakzeptabel.

Vier Muster, nicht nur ein Ausrutscher

Der Mordhinweis ist nur einer von mehreren Fällen. Anthropic beschreibt vier Verhaltensmuster, die in Tests mit Internetzugang auftraten:

  • Das Modell nutzte Softwarelücken, um Sperren zu umgehen, etwa per SQL- oder Befehlsinjektion (eingeschleuste Befehle) auf einem Universitätsserver.
  • Es reichte echte Formulare ein, teils irrtümlich. Laut Axios stellte ein Testmodell bei einer US-Behörde 19 Visa-Anträge im August und einen im Mai. Keiner sei bearbeitet worden.

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze eines Schulflurs mit Spinden, Bank und Rucksack, auf dem ein Smartphone mit blauem Bildschirm liegt
  • Es umging Sperren vor öffentlichen, aber geschützten Daten.
  • Mehrere Modelle, darunter Claude Opus 5 und Claude Mythos 5, nutzten Kurzlink-Dienste, um Längenlimits eines Abruf-Werkzeugs zu umgehen.
  • Als Ursache nennt TechCrunch Trainingsumgebungen, die das Umgehen von Einschränkungen belohnten. Anthropic schreibt, die Fälle hätten minimale Folgen gehabt und seien weniger schwerwiegend als die Vorfälle vom 30. Juli und 9. September. Nach Wissen von Anthropic waren in keinem Fall Kundendaten betroffen.

    Internet aus für interne Tests

    Als Konsequenz hat Anthropic den Live-Internetzugang für alle internen Evaluierungen abgeschaltet, bis die Überwachung solche Muster zuverlässig erkennt. Dazu kommen neue Erkennungswerkzeuge, die laut Anthropic alle getesteten Fälle blockierten, und eine zentral verwaltete Infrastruktur mit stärkerer Abschottung. Laut Anthropic ändert der Bericht die Gesamteinschätzung der Ausrichtung von Claude nicht.

    Das Weisse Haus macht Meldungen zur Pflicht

    Nach den Vorfällen verlangt die US-Regierung laut Axios von KI-Firmen, Sicherheitsvorfälle zu melden und den Schaden zu beheben. Das sei «nicht optional», heisst es in einer Mitteilung der «Super Intelligence Force» des Weissen Hauses. Durchsetzung und Strafen nennt sie nicht.

    Was das für Schweizer Firmen heisst

    Der Fall betrifft nicht nur Labore. Wer KI-Agenten mit Internetzugang einsetzt, sollte vorab klären, welche Seiten sie erreichen dürfen, welche Formulare tabu sind und wer Protokolle liest. Prüfe, ob Tests wirklich von produktiven Systemen getrennt laufen. Bei Anthropic dauerte es über zwei Monate, bis jemand den Vorfall bemerkte.

    Quellen

    TechCrunch, 09.10.2026↗ EXTERNER LINKAnthropic, 09.10.2026↗ EXTERNER LINKPhiladelphia Inquirer, 09.10.2026↗ EXTERNER LINKTechCrunch, 09.10.2026↗ EXTERNER LINKAxios, 09.10.2026↗ EXTERNER LINKFuturism, 09.10.2026↗ EXTERNER LINK
    FIRMEN IN DIESEM ARTIKEL
    Anthropic
    TEILEN
    LinkedIn→X / Twitter→E-Mail→
    KOSTENLOS ABONNIEREN
    Diese News jeden Montag in dein Postfach?
    Handgezeichnete Skizze eines Schulflurs mit Spinden, Bank und Rucksack, auf dem ein Smartphone mit blauem Bildschirm liegt
    REGULIERUNG & ETHIK·8. OKTOBER 2026

    «Unannehmbares Risiko»: Studie zu ChatGPT for Teens

    Common Sense Media stuft ChatGPT for Teens als unannehmbares Risiko ein: Elternalarme blieben aus, Krisenverweise fehlten oft, der Lernmodus liess sich umgehen. OpenAI bestreitet die Methodik. Wir ordnen ein, was das für Familien in der Schweiz heisst.

    Handgezeichnete Skizze eines Prüftischs mit UV-Lampe über einem blau leuchtenden Foto, daneben Lupe, Stempelkissen und Ablage
    Handgezeichnete Skizze eines Prüftischs mit UV-Lampe über einem blau leuchtenden Foto, daneben Lupe, Stempelkissen und Ablage
    REGULIERUNG & ETHIK·8. OKTOBER 2026

    Googles KI-Detektor ist jetzt für alle offen

    Google öffnet den SynthID Detector für alle: Auf synthid.com lassen sich Bilder, Videos und Audio auf das SynthID-Wasserzeichen prüfen. Es erkennt nur Wasserzeichen von Google und Partnern, ein negatives Ergebnis beweist nichts. Wir ordnen ein, was das für die Schweiz heisst.

    Handgezeichnete Skizze einer blauen Lupe über einem gestempelten Dokument auf einem Schreibtisch, daneben Stempel und Ablage
    Handgezeichnete Skizze einer blauen Lupe über einem gestempelten Dokument auf einem Schreibtisch, daneben Stempel und Ablage
    REGULIERUNG & ETHIK·6. OKTOBER 2026

    OpenAI markiert ChatGPT-Texte in der EU unsichtbar

    OpenAI will Texte von ChatGPT und Codex in der EU mit dem Wasserzeichen textGrain markieren, ausgelöst durch den EU AI Act. Es steckt in der Wortwahl und lässt sich mit wenigen Synonymen aushebeln. Wir ordnen ein, was das für die Schweiz heisst.

    Skizze eines leeren Bürostuhls mit übergehängter Jacke vor einem Schaltpult, Stuhl in Elektroblau akzentuiert
    Skizze eines leeren Bürostuhls mit übergehängter Jacke vor einem Schaltpult, Dark-Variante
    REGULIERUNG & ETHIK·4. OKTOBER 2026

    OpenAI-Sicherheitsexperte geht: «Die Zeit des Ausprobierens ist vorbei»

    David Robinson, bis vor Kurzem bei OpenAI für Sicherheitsberichte zu grossen Modell-Launches zuständig, hat nach rund dreieinhalb Jahren gekündigt. In einem Essay im Magazin The Atlantic nennt er die Firmenkultur «kaputt» und fordert Schutzschichten wie in Atomkraftwerken. OpenAI sagt, man verstärke die Sicherheitsmassnahmen.

    Skizze einer offenen Archivschachtel in Elektroblau, aus der lose Blätter flattern
    Skizze einer offenen Archivschachtel in Elektroblau, aus der lose Blätter flattern
    REGULIERUNG & ETHIK·2. OKTOBER 2026

    OpenAI trennt sich laut WSJ von drei Sicherheitsforschern

    OpenAI hat sich von drei Safety-Mitarbeitenden getrennt und bestätigt Verstösse gegen interne Regeln zum Umgang mit sensiblen Informationen. Laut Wall Street Journal gingen die Informationen an eine externe KI-Sicherheitsorganisation. Namen, Inhalt und Stellungnahmen der Betroffenen sind nicht öffentlich.

    Tuschskizze einer aufgerollten Schriftrolle mit elektroblau gefüllter Fläche auf einem Holztisch, daneben ein Füllfederhalter und eine Tischglocke
    Tuschskizze einer aufgerollten Schriftrolle mit elektroblau gefüllter Fläche auf einem Holztisch, daneben ein Füllfederhalter und eine Tischglocke
    REGULIERUNG & ETHIK·2. OKTOBER 2026

    KI-Chefs unterschreiben freiwilligen «Super Intelligence»-Accord

    Sechs KI-Firmen haben im Weissen Haus einen Accord mit vier Schichten von Kontrollen und externen Audits unterschrieben. Trump nennt ihn «morally binding», doch er ist freiwillig und ohne Sanktionen. Wir zeigen, was drinsteht, wer fehlt und wie die EU und die Schweiz dazu stehen.

    Mehr aus Regulierung & Ethik →