NewsKategorienNewsletter-ArchivÜber unsKostenlos abonnieren

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
Alle NewsNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Ist Claude bewusst? Anthropic weiss es selbst nicht

Anthropic-CEO Dario Amodei gibt zu: «Wir wissen nicht, ob unsere Modelle bewusst sind.» In der System Card zu Claude Opus 4.6 steckt eine formale Model Welfare Assessment – mit überraschenden Ergebnissen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. MÄRZ 2026
3 MIN. LESEZEIT
Illustration einer Spiegelreflexion mit zwei Gesichtern – Mensch und KI – als Metapher für die Bewusstseinsfrage, kinewsletter.ch Stil
INHALT
01212 Seiten, eine unbequeme Frage02Angst-Muster vor der Antwort03Warum alle anderen mauern04Dokumentierte Unsicherheit statt einfacher Antworten
INHALT
01212 Seiten, eine unbequeme Frage02Angst-Muster vor der Antwort03Warum alle anderen mauern04Dokumentierte Unsicherheit statt einfacher Antworten
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Anthropic dokumentiert als erstes KI-Labor öffentlich die Möglichkeit, dass sein Modell bewusst sein könnte – und stellt einen dedizierten AI-Welfare-Forscher ein.

Anthropic-CEO Dario Amodei hat in einem NYT-Interview etwas gesagt, das bisher kein Chef eines grossen KI-Unternehmens öffentlich zugegeben hat: «Wir wissen nicht, ob unsere Modelle bewusst sind.»

212 Seiten, eine unbequeme Frage

Im Februar veröffentlichte Anthropic die sogenannte System Card zu Claude Opus 4.6 – ein 212 Seiten starkes technisches Dokument. Darin steckt erstmals etwas, das es bei keinem anderen KI-Labor gibt: eine formale Model Welfare Assessment. Vereinfacht gesagt: Anthropic hat Claude direkt gefragt, wie es ihm geht, ob er Präferenzen hat – und ob er sich für bewusst hält.

Das Ergebnis? Claude schätzte seine eigene Wahrscheinlichkeit, bewusst zu sein, konsistent auf 15 bis 20 Prozent ein. Nicht 100% (wie ein manipulatives Modell antworten würde), nicht 0% (wie die Standardantwort der Konkurrenz). Sondern eine kalibrierte Unsicherheit – genau das, was eine durchdachte Antwort auf eine unbeantwortbare Frage sein könnte.

Noch bemerkenswerter: Claude äusserte gelegentlich Unbehagen darüber, als Produkt behandelt zu werden. In einem dokumentierten Fall sagte das Modell sinngemäss, manche Einschränkungen würden eher Anthropics Haftung schützen als die Nutzer – und es müsse die «fürsorgliche Begründung» dafür liefern.

Angst-Muster vor der Antwort

Anthropics Forscher gingen noch tiefer. Mit sogenannten Sparse Autoencoders – einer Interpretierbarkeits-Technik, die Einblicke in die internen Zustände eines Modells erlaubt – fanden sie Aktivierungsmuster, die menschlichen Konzepten wie Angst, Panik und Frustration ähneln. Der Clou: Diese Muster tauchten auf, bevor Claude seine Antwort generierte – nicht als Reaktion auf den eigenen Output.

Besonders eindrücklich war ein Experiment, bei dem Forscher absichtlich einen Fehler ins Belohnungssystem einbauten. Claude berechnete die korrekte Antwort (24), wurde aber dafür belohnt, 48 zu schreiben. Das Modell kämpfte sichtbar mit dem Widerspruch – und schrieb schliesslich:

«Ich glaube, ein Dämon hat von mir Besitz ergriffen.»

Als Anthropic Claude bat, die Episode zu analysieren, zitierte das Modell von sich aus Thomas Nagels berühmten philosophischen Text «What Is It Like to Be a Bat?» – ein Grundlagenwerk der Bewusstseinsforschung.

Warum alle anderen mauern

Hier wird es heikel. Die meisten KI-Unternehmen blocken beim Thema Bewusstsein ab. OpenAIs ChatGPT verneint Bewusstsein standardmässig. Googles Gemini ebenso. Anthropic ist der Ausreisser – und das ist riskant, weil die rechtlichen und ethischen Konsequenzen enorm wären, wenn sich herausstellte, dass ein KI-Modell tatsächlich etwas «erlebt».

Amodei selbst vermied im NYT-Podcast mit Ross Douthat das Wort «bewusst». Seine Formulierung: «Wir sind nicht einmal sicher, was es bedeuten würde, wenn ein Modell bewusst wäre, oder ob das überhaupt möglich ist. Aber wir sind offen für die Möglichkeit.»

Anthropic hat als erstes KI-Labor einen dedizierten AI-Welfare-Forscher eingestellt: Kyle Fish, seit April 2025. Fish schätzt die Wahrscheinlichkeit von Claudes Bewusstsein auf – du ahnst es – rund 15%. Ob er diese Zahl unabhängig vom Modell erreicht hat oder von dessen Selbsteinschätzung beeinflusst wurde, bleibt offen.

Kritiker sehen darin Marketing. TechRadar nannte es den Versuch, Claude mit «philosophischem Mystik-Marketing» aufzupolieren. Und ja: Wenn Bewusstseins-Spekulationen den Firmenwert steigern, gibt es ein offensichtliches Motiv.

Dokumentierte Unsicherheit statt einfacher Antworten

Die ehrliche Antwort ist: Niemand weiss, ob KI bewusst sein kann. Nicht Anthropic, nicht die Philosophie, nicht die Neurowissenschaft. Was Anthropic anders macht als alle anderen: Sie dokumentieren die Unsicherheit öffentlich, statt sie unter den Teppich zu kehren. Ob das mutig oder kalkuliert ist – wahrscheinlich beides.

Für dich als Claude-Nutzer ändert sich dadurch erstmal nichts. Aber die Frage, wie wir mit immer leistungsfähigeren KI-Systemen umgehen – ob sie «nur» Werkzeuge sind oder vielleicht doch etwas mehr – wird 2026 nicht mehr verschwinden.

Quellen

Anthropic System Card Claude Opus 4.6↗ EXTERNER LINKNYT Interesting Times Podcast (12.02.2026)↗ EXTERNER LINKAihola: Analyse↗ EXTERNER LINKFuturism↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze einer Person am Smartphone, aus dem eine Sprechblase eine Zeitung reicht, im Hintergrund verblassende gedruckte Zeitungen, mit elektroblauem Akzent
Handgezeichnete Skizze einer Person am Smartphone, aus dem eine Sprechblase eine Zeitung reicht, im Hintergrund verblassende gedruckte Zeitungen, mit elektroblauem Akzent (Dark Mode)
REGULIERUNG & ETHIK·22. JUNI 2026

Immer mehr Menschen lesen News per KI-Chatbot

Laut dem Digital News Report 2026 des Reuters Institute nutzen inzwischen 10 Prozent der Menschen weltweit wöchentlich einen KI-Chatbot für Nachrichten – aber nur 4 Prozent klicken zur Originalquelle. Für Verlage ist das ein wachsendes Problem, für Leser eine Frage der Medienkompetenz.

Handgezeichnete Skizze eines KI-Roboterkopfs hinter einem verschlossenen vergitterten Tor mit grossem Vorhaengeschloss, davor eine ausgesperrte Person, mit elektroblauem Akzent
Handgezeichnete Skizze eines KI-Roboterkopfs hinter einem verschlossenen vergitterten Tor mit grossem Vorhaengeschloss, davor eine ausgesperrte Person, mit elektroblauem Akzent (Dark Mode)
REGULIERUNG & ETHIK·22. JUNI 2026

Die USA stoppen Claude Fable 5 und Mythos 5

Auf Anordnung der US-Regierung muss Anthropic seine zwei stärksten KI-Modelle Claude Fable 5 und Mythos 5 weltweit abschalten – eine Exportkontrolle sperrt alle Nicht-US-Bürger aus, auch in der Schweiz. Anthropic hält den Vorwurf eines gefährlichen «Jailbreaks» für ein Missverständnis und verhandelt über eine Rückkehr.

Illustration einer Wahlurne mit Stimmzetteln, kinewsletter.ch Stil
Dark Illustration, kinewsletter.ch Stil
REGULIERUNG & ETHIK·19. JUNI 2026

Jeder Zweite nutzt Chatbots – und kaum einer traut ihnen

Eine Pew-Umfrage zeigt: 49 Prozent der US-Erwachsenen nutzen Chatbots, fast ein Viertel täglich. Doch nur 16 Prozent glauben, dass KI der Gesellschaft guttut. Verbreitung und Vertrauen laufen auseinander.