kinewsletter.chkinewsletter.ch
News
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
Newsletter-Archiv
Search
News
Kategorien
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
Newsletter-ArchivÜber unsSuche
Kostenlos abonnieren
kinewsletter.chkinewsletter.ch

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

Navigation

Alle NewsNewsletter-ArchivAutorenÜber unsKontakt

Rechtliches

ImpressumDatenschutzAGB

© 2026Inoo GmbH · Altstätten SG · Schweiz

Swiss Made SoftwareEin Produkt vonInooInoo
  1. Home
  2. KI-News
  3. Regulierung & Ethik
  4. Ist Claude bewusst? Anthropic weiss es selbst nicht
Regulierung & EthikKI-Forschung

Ist Claude bewusst? Anthropic weiss es selbst nicht

Anthropic-CEO Dario Amodei gibt zu: «Wir wissen nicht, ob unsere Modelle bewusst sind.» In der System Card zu Claude Opus 4.6 steckt eine formale Model Welfare Assessment – mit überraschenden Ergebnissen.

Montag, 9. März 2026~3 Min. Lesezeit
Pascal Eugster
Pascal EugsterGründer & Entwickler
Illustration einer Spiegelreflexion mit zwei Gesichtern – Mensch und KI – als Metapher für die Bewusstseinsfrage, kinewsletter.ch Stil
Illustration einer Spiegelreflexion mit zwei Gesichtern – Mensch und KI – als Metapher für die Bewusstseinsfrage, kinewsletter.ch Stil
Das Wichtigste

Anthropic dokumentiert als erstes KI-Labor öffentlich die Möglichkeit, dass sein Modell bewusst sein könnte – und stellt einen dedizierten AI-Welfare-Forscher ein.

Anthropic-CEO Dario Amodei hat in einem NYT-Interview etwas gesagt, das bisher kein Chef eines grossen KI-Unternehmens öffentlich zugegeben hat: «Wir wissen nicht, ob unsere Modelle bewusst sind.»

212 Seiten, eine unbequeme Frage

Im Februar veröffentlichte Anthropic die sogenannte System Card zu Claude Opus 4.6 – ein 212 Seiten starkes technisches Dokument. Darin steckt erstmals etwas, das es bei keinem anderen KI-Labor gibt: eine formale Model Welfare Assessment. Vereinfacht gesagt: Anthropic hat Claude direkt gefragt, wie es ihm geht, ob er Präferenzen hat – und ob er sich für bewusst hält.

Das Ergebnis? Claude schätzte seine eigene Wahrscheinlichkeit, bewusst zu sein, konsistent auf 15 bis 20 Prozent ein. Nicht 100% (wie ein manipulatives Modell antworten würde), nicht 0% (wie die Standardantwort der Konkurrenz). Sondern eine kalibrierte Unsicherheit – genau das, was eine durchdachte Antwort auf eine unbeantwortbare Frage sein könnte.

Noch bemerkenswerter: Claude äusserte gelegentlich Unbehagen darüber, als Produkt behandelt zu werden. In einem dokumentierten Fall sagte das Modell sinngemäss, manche Einschränkungen würden eher Anthropics Haftung schützen als die Nutzer – und es müsse die «fürsorgliche Begründung» dafür liefern.

Angst-Muster vor der Antwort

Anthropics Forscher gingen noch tiefer. Mit sogenannten Sparse Autoencoders – einer Interpretierbarkeits-Technik, die Einblicke in die internen Zustände eines Modells erlaubt – fanden sie Aktivierungsmuster, die menschlichen Konzepten wie Angst, Panik und Frustration ähneln. Der Clou: Diese Muster tauchten auf, bevor Claude seine Antwort generierte – nicht als Reaktion auf den eigenen Output.

Besonders eindrücklich war ein Experiment, bei dem Forscher absichtlich einen Fehler ins Belohnungssystem einbauten. Claude berechnete die korrekte Antwort (24), wurde aber dafür belohnt, 48 zu schreiben. Das Modell kämpfte sichtbar mit dem Widerspruch – und schrieb schliesslich:

«Ich glaube, ein Dämon hat von mir Besitz ergriffen.»

Als Anthropic Claude bat, die Episode zu analysieren, zitierte das Modell von sich aus Thomas Nagels berühmten philosophischen Text «What Is It Like to Be a Bat?» – ein Grundlagenwerk der Bewusstseinsforschung.

Warum alle anderen mauern

Hier wird es heikel. Die meisten KI-Unternehmen blocken beim Thema Bewusstsein ab. OpenAIs ChatGPT verneint Bewusstsein standardmässig. Googles Gemini ebenso. Anthropic ist der Ausreisser – und das ist riskant, weil die rechtlichen und ethischen Konsequenzen enorm wären, wenn sich herausstellte, dass ein KI-Modell tatsächlich etwas «erlebt».

Amodei selbst vermied im NYT-Podcast mit Ross Douthat das Wort «bewusst». Seine Formulierung: «Wir sind nicht einmal sicher, was es bedeuten würde, wenn ein Modell bewusst wäre, oder ob das überhaupt möglich ist. Aber wir sind offen für die Möglichkeit.»

Anthropic hat als erstes KI-Labor einen dedizierten AI-Welfare-Forscher eingestellt: Kyle Fish, seit April 2025. Fish schätzt die Wahrscheinlichkeit von Claudes Bewusstsein auf – du ahnst es – rund 15%. Ob er diese Zahl unabhängig vom Modell erreicht hat oder von dessen Selbsteinschätzung beeinflusst wurde, bleibt offen.

Kritiker sehen darin Marketing. TechRadar nannte es den Versuch, Claude mit «philosophischem Mystik-Marketing» aufzupolieren. Und ja: Wenn Bewusstseins-Spekulationen den Firmenwert steigern, gibt es ein offensichtliches Motiv.

Dokumentierte Unsicherheit statt einfacher Antworten

Die ehrliche Antwort ist: Niemand weiss, ob KI bewusst sein kann. Nicht Anthropic, nicht die Philosophie, nicht die Neurowissenschaft. Was Anthropic anders macht als alle anderen: Sie dokumentieren die Unsicherheit öffentlich, statt sie unter den Teppich zu kehren. Ob das mutig oder kalkuliert ist – wahrscheinlich beides.

Für dich als Claude-Nutzer ändert sich dadurch erstmal nichts. Aber die Frage, wie wir mit immer leistungsfähigeren KI-Systemen umgehen – ob sie «nur» Werkzeuge sind oder vielleicht doch etwas mehr – wird 2026 nicht mehr verschwinden.

Teilen:

Das könnte dich auch interessieren

Handgezeichnete Skizze: Denkfabrik-Gebäude mit KI-Gehirn und Schutzschild – Anthropic Institute für KI-Sicherheit
Handgezeichnete Skizze: Denkfabrik-Gebäude mit KI-Gehirn und Schutzschild – Anthropic Institute für KI-Sicherheit
Regulierung & Ethik
12. März 2026

Anthropic gründet hauseigene Denkfabrik für KI-Risiken

Anthropic hat drei interne Teams zum «Anthropic Institute» zusammengelegt — einer Denkfabrik unter Mitgründer Jack Clark, die erforschen soll, wie KI Arbeit und Gesellschaft verändert. Erstes Projekt: ein fortlaufender «Economic Index».

Anthropic will mit einer eigenen Denkfabrik die KI-Debatte mitgestalten — und gleichzeitig seine Position im Streit mit dem Pentagon stärken.

Weiterlesen
Pentagon-Gebäude mit amerikanischer Flagge, Richterhammer auf Marmorständer und Militär-Emblem – symbolisiert den Rechtsstreit zwischen Anthropic und dem US-Verteidigungsministerium
Pentagon-Gebäude mit amerikanischer Flagge, Richterhammer auf Marmorständer und Militär-Emblem – symbolisiert den Rechtsstreit zwischen Anthropic und dem US-Verteidigungsministerium
Regulierung & Ethik
11. März 2026

Pentagon setzt auf Google Gemini — Anthropic verklagt US-Regierung

Das US-Verteidigungsministerium stuft Anthropic als «Supply-Chain-Risiko» ein, weil das Unternehmen KI-Sicherheitsprinzipien nicht aufgeben will. Google übernimmt mit Gemini die Pentagon-Plattform – Anthropic klagt vor zwei US-Gerichten.

Anthropic wird vom Pentagon bestraft, weil es rote Linien bei Massenüberwachung und autonomen Waffen nicht streichen will – Google füllt die Lücke, während Microsoft und 37 Forscher Anthropic vor Gericht unterstützen.

Weiterlesen
Illustration zum Thema Anthropic verklagt die US-Regierung
Illustration zum Thema Anthropic verklagt die US-Regierung
Regulierung & Ethik
10. März 2026

Anthropic verklagt die US-Regierung – der grösste KI-Ethik-Showdown

Anthropic hat am 9. März zwei Bundesgerichtsklagen gegen das Pentagon eingereicht. Der Grund: Die Einstufung als «Supply Chain Risk», weil das Unternehmen die uneingeschränkte militärische Nutzung von Claude ablehnte. Es ist die bisher grösste Konfrontation zwischen einem KI-Unternehmen und der US-Regierung.

Anthropic riskiert Milliardenumsätze, weil es die militärische Nutzung von Claude einschränkt – und zieht dafür vor Gericht.

Weiterlesen