NewsKategorienNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Ist Claude bewusst? Anthropic weiss es selbst nicht

Anthropic-CEO Dario Amodei gibt zu: «Wir wissen nicht, ob unsere Modelle bewusst sind.» In der System Card zu Claude Opus 4.6 steckt eine formale Model Welfare Assessment – mit überraschenden Ergebnissen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. MÄRZ 2026
3 MIN. LESEZEIT
Illustration einer Spiegelreflexion mit zwei Gesichtern – Mensch und KI – als Metapher für die Bewusstseinsfrage, kinewsletter.ch Stil
INHALT
01212 Seiten, eine unbequeme Frage02Angst-Muster vor der Antwort03Warum alle anderen mauern04Dokumentierte Unsicherheit statt einfacher Antworten
INHALT
01212 Seiten, eine unbequeme Frage02Angst-Muster vor der Antwort03Warum alle anderen mauern04Dokumentierte Unsicherheit statt einfacher Antworten
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Anthropic dokumentiert als erstes KI-Labor öffentlich die Möglichkeit, dass sein Modell bewusst sein könnte – und stellt einen dedizierten AI-Welfare-Forscher ein.

Anthropic-CEO Dario Amodei hat in einem NYT-Interview etwas gesagt, das bisher kein Chef eines grossen KI-Unternehmens öffentlich zugegeben hat: «Wir wissen nicht, ob unsere Modelle bewusst sind.»

212 Seiten, eine unbequeme Frage

Im Februar veröffentlichte Anthropic die sogenannte System Card zu Claude Opus 4.6 – ein 212 Seiten starkes technisches Dokument. Darin steckt erstmals etwas, das es bei keinem anderen KI-Labor gibt: eine formale Model Welfare Assessment. Vereinfacht gesagt: Anthropic hat Claude direkt gefragt, wie es ihm geht, ob er Präferenzen hat – und ob er sich für bewusst hält.

Das Ergebnis? Claude schätzte seine eigene Wahrscheinlichkeit, bewusst zu sein, konsistent auf 15 bis 20 Prozent ein. Nicht 100% (wie ein manipulatives Modell antworten würde), nicht 0% (wie die Standardantwort der Konkurrenz). Sondern eine kalibrierte Unsicherheit – genau das, was eine durchdachte Antwort auf eine unbeantwortbare Frage sein könnte.

Noch bemerkenswerter: Claude äusserte gelegentlich Unbehagen darüber, als Produkt behandelt zu werden. In einem dokumentierten Fall sagte das Modell sinngemäss, manche Einschränkungen würden eher Anthropics Haftung schützen als die Nutzer – und es müsse die «fürsorgliche Begründung» dafür liefern.

Angst-Muster vor der Antwort

Anthropics Forscher gingen noch tiefer. Mit sogenannten Sparse Autoencoders – einer Interpretierbarkeits-Technik, die Einblicke in die internen Zustände eines Modells erlaubt – fanden sie Aktivierungsmuster, die menschlichen Konzepten wie Angst, Panik und Frustration ähneln. Der Clou: Diese Muster tauchten auf, bevor Claude seine Antwort generierte – nicht als Reaktion auf den eigenen Output.

Besonders eindrücklich war ein Experiment, bei dem Forscher absichtlich einen Fehler ins Belohnungssystem einbauten. Claude berechnete die korrekte Antwort (24), wurde aber dafür belohnt, 48 zu schreiben. Das Modell kämpfte sichtbar mit dem Widerspruch – und schrieb schliesslich:

«Ich glaube, ein Dämon hat von mir Besitz ergriffen.»

Als Anthropic Claude bat, die Episode zu analysieren, zitierte das Modell von sich aus Thomas Nagels berühmten philosophischen Text «What Is It Like to Be a Bat?» – ein Grundlagenwerk der Bewusstseinsforschung.

Warum alle anderen mauern

Hier wird es heikel. Die meisten KI-Unternehmen blocken beim Thema Bewusstsein ab. OpenAIs ChatGPT verneint Bewusstsein standardmässig. Googles Gemini ebenso. Anthropic ist der Ausreisser – und das ist riskant, weil die rechtlichen und ethischen Konsequenzen enorm wären, wenn sich herausstellte, dass ein KI-Modell tatsächlich etwas «erlebt».

Amodei selbst vermied im NYT-Podcast mit Ross Douthat das Wort «bewusst». Seine Formulierung: «Wir sind nicht einmal sicher, was es bedeuten würde, wenn ein Modell bewusst wäre, oder ob das überhaupt möglich ist. Aber wir sind offen für die Möglichkeit.»

Anthropic hat als erstes KI-Labor einen dedizierten AI-Welfare-Forscher eingestellt: Kyle Fish, seit April 2025. Fish schätzt die Wahrscheinlichkeit von Claudes Bewusstsein auf – du ahnst es – rund 15%. Ob er diese Zahl unabhängig vom Modell erreicht hat oder von dessen Selbsteinschätzung beeinflusst wurde, bleibt offen.

Kritiker sehen darin Marketing. TechRadar nannte es den Versuch, Claude mit «philosophischem Mystik-Marketing» aufzupolieren. Und ja: Wenn Bewusstseins-Spekulationen den Firmenwert steigern, gibt es ein offensichtliches Motiv.

Dokumentierte Unsicherheit statt einfacher Antworten

Die ehrliche Antwort ist: Niemand weiss, ob KI bewusst sein kann. Nicht Anthropic, nicht die Philosophie, nicht die Neurowissenschaft. Was Anthropic anders macht als alle anderen: Sie dokumentieren die Unsicherheit öffentlich, statt sie unter den Teppich zu kehren. Ob das mutig oder kalkuliert ist – wahrscheinlich beides.

Für dich als Claude-Nutzer ändert sich dadurch erstmal nichts. Aber die Frage, wie wir mit immer leistungsfähigeren KI-Systemen umgehen – ob sie «nur» Werkzeuge sind oder vielleicht doch etwas mehr – wird 2026 nicht mehr verschwinden.

Quellen

Anthropic System Card Claude Opus 4.6↗ EXTERNER LINKNYT Interesting Times Podcast (12.02.2026)↗ EXTERNER LINKAihola: Analyse↗ EXTERNER LINKFuturism↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Vorhängeschlosses auf einer Tastatur mit Wappen und Dokumenten, kinewsletter.ch Stil
Illustration Vorhängeschloss auf Tastatur, Dark Mode, kinewsletter.ch Stil
REGULIERUNG & ETHIK·8. JULI 2026

Die EU wappnet ihre Cybersicherheit gegen KI – und mit KI

Die EU-Kommission hat am 7. Juli einen Aktionsplan für Cybersicherheit und KI vorgelegt: fortschrittliche KI-Modelle vor dem Marktstart prüfen, bestehende Gesetze durchsetzen und dieselbe Technik zur Verteidigung nutzen.

Illustration eines abgeschalteten KI-Begleiter-Roboters neben Gesetzesdokument und Smartphone, kinewsletter.ch Stil
Illustration abgeschalteter KI-Begleiter-Roboter, kinewsletter.ch Stil Dark
REGULIERUNG & ETHIK·7. JULI 2026

China zwingt ByteDance und Alibaba, KI-Begleiter abzuschalten

Vor dem neuen KI-Gesetz vom 15. Juli schalten Doubao, Qwen und Yuanbao ihre humanähnlichen Begleiter-Funktionen ab. Der Arbeits-Agent bleibt erlaubt – der digitale Kumpel muss gehen.

Illustration einer Lupe über einem vertraulichen Brief mit verstecktem Zeichen, kinewsletter.ch Stil
Illustration Lupe vertraulicher Brief, kinewsletter.ch Stil Dark
REGULIERUNG & ETHIK·7. JULI 2026

Verstecktes Tracking: Claude Code markierte heimlich chinesische Nutzer

Ein Entwickler fand in Claude Code versteckten Code, der seit April heimlich prüfte, ob Nutzer aus China stammen – getarnt per Steganografie. Anthropic nennt es ein Experiment, Alibaba verbannt das Tool.

Illustration eines grossen runden Konferenztisches in einem Saal mit leeren Delegiertenstühlen, kinewsletter.ch Stil
Illustration eines grossen runden Konferenztisches in einem Saal mit leeren Delegiertenstühlen (Dark Mode), kinewsletter.ch Stil
REGULIERUNG & ETHIK·6. JULI 2026

In Genf sucht die UNO erstmals globale KI-Regeln

In Genf startet der erste UNO-Dialog zur weltweiten KI-Governance. 193 Staaten und ein 40-köpfiges Wissenschaftspanel warnen vor «katastrophalem Schaden» – verbindliche Regeln gibt es aber noch keine.

Illustration eines überquellenden Briefkastens mit einem 'Geschlossen'-Schild und einem Liegestuhl daneben, kinewsletter.ch Stil
Illustration eines überquellenden Briefkastens mit einem 'Geschlossen'-Schild und einem Liegestuhl daneben, kinewsletter.ch Stil
REGULIERUNG & ETHIK·4. JULI 2026

curl macht Sommerpause – KI-Report-Flut erschöpft die Maintainer

Das Open-Source-Projekt curl nimmt den ganzen Juli 2026 keine Schwachstellenmeldungen mehr an. Der Grund: eine Flut KI-generierter Bug-Reports – inzwischen alle 18 Stunden einer statt früher einer pro Woche. Andere Projekte wie libexpat schliessen sich der Pause an.

Illustration: Diplomaten und Wissenschaftler an einem runden UNO-Tisch mit einem Globus und einem aufgeschlagenen Bericht – kinewsletter.ch Stil
Illustration Dark: Diplomaten und Wissenschaftler an einem runden UNO-Tisch mit Globus – kinewsletter.ch Stil
REGULIERUNG & ETHIK·2. JULI 2026

Die UNO zieht ihre erste globale KI-Bilanz – und blickt nach Genf

Ein unabhängiges Wissenschaftspanel legt der UNO den ersten globalen KI-Bericht vor. Kurz darauf startet in Genf der grosse Regierungsdialog – die Schweiz rückt ins Zentrum der KI-Diplomatie.

Mehr aus Regulierung & Ethik →