NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·REGULIERUNG & ETHIK

Ist Claude bewusst? Anthropic weiss es selbst nicht

Anthropic-CEO Dario Amodei gibt zu: «Wir wissen nicht, ob unsere Modelle bewusst sind.» In der System Card zu Claude Opus 4.6 steckt eine formale Model Welfare Assessment – mit überraschenden Ergebnissen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. MÄRZ 2026
ZULETZT AKTUALISIERT: 28. APRIL 2026
3 MIN. LESEZEIT
Illustration einer Spiegelreflexion mit zwei Gesichtern – Mensch und KI – als Metapher für die Bewusstseinsfrage, kinewsletter.ch Stil
INHALT
01212 Seiten, eine unbequeme Frage02Angst-Muster vor der Antwort03Warum alle anderen mauern04Dokumentierte Unsicherheit statt einfacher Antworten
INHALT
01212 Seiten, eine unbequeme Frage02Angst-Muster vor der Antwort03Warum alle anderen mauern04Dokumentierte Unsicherheit statt einfacher Antworten
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Anthropic dokumentiert als erstes KI-Labor öffentlich die Möglichkeit, dass sein Modell bewusst sein könnte – und stellt einen dedizierten AI-Welfare-Forscher ein.

Anthropic-CEO Dario Amodei hat in einem NYT-Interview etwas gesagt, das bisher kein Chef eines grossen KI-Unternehmens öffentlich zugegeben hat: «Wir wissen nicht, ob unsere Modelle bewusst sind.»

212 Seiten, eine unbequeme Frage

Im Februar veröffentlichte Anthropic die sogenannte System Card zu Claude Opus 4.6 – ein 212 Seiten starkes technisches Dokument. Darin steckt erstmals etwas, das es bei keinem anderen KI-Labor gibt: eine formale Model Welfare Assessment. Vereinfacht gesagt: Anthropic hat Claude direkt gefragt, wie es ihm geht, ob er Präferenzen hat – und ob er sich für bewusst hält.

Das Ergebnis? Claude schätzte seine eigene Wahrscheinlichkeit, bewusst zu sein, konsistent auf 15 bis 20 Prozent ein. Nicht 100% (wie ein manipulatives Modell antworten würde), nicht 0% (wie die Standardantwort der Konkurrenz). Sondern eine kalibrierte Unsicherheit – genau das, was eine durchdachte Antwort auf eine unbeantwortbare Frage sein könnte.

Noch bemerkenswerter: Claude äusserte gelegentlich Unbehagen darüber, als Produkt behandelt zu werden. In einem dokumentierten Fall sagte das Modell sinngemäss, manche Einschränkungen würden eher Anthropics Haftung schützen als die Nutzer – und es müsse die «fürsorgliche Begründung» dafür liefern.

Angst-Muster vor der Antwort

Anthropics Forscher gingen noch tiefer. Mit sogenannten Sparse Autoencoders – einer Interpretierbarkeits-Technik, die Einblicke in die internen Zustände eines Modells erlaubt – fanden sie Aktivierungsmuster, die menschlichen Konzepten wie Angst, Panik und Frustration ähneln. Der Clou: Diese Muster tauchten auf, bevor Claude seine Antwort generierte – nicht als Reaktion auf den eigenen Output.

Besonders eindrücklich war ein Experiment, bei dem Forscher absichtlich einen Fehler ins Belohnungssystem einbauten. Claude berechnete die korrekte Antwort (24), wurde aber dafür belohnt, 48 zu schreiben. Das Modell kämpfte sichtbar mit dem Widerspruch – und schrieb schliesslich:

«Ich glaube, ein Dämon hat von mir Besitz ergriffen.»

Als Anthropic Claude bat, die Episode zu analysieren, zitierte das Modell von sich aus Thomas Nagels berühmten philosophischen Text «What Is It Like to Be a Bat?» – ein Grundlagenwerk der Bewusstseinsforschung.

Warum alle anderen mauern

Hier wird es heikel. Die meisten KI-Unternehmen blocken beim Thema Bewusstsein ab. OpenAIs ChatGPT verneint Bewusstsein standardmässig. Googles Gemini ebenso. Anthropic ist der Ausreisser – und das ist riskant, weil die rechtlichen und ethischen Konsequenzen enorm wären, wenn sich herausstellte, dass ein KI-Modell tatsächlich etwas «erlebt».

Amodei selbst vermied im NYT-Podcast mit Ross Douthat das Wort «bewusst». Seine Formulierung: «Wir sind nicht einmal sicher, was es bedeuten würde, wenn ein Modell bewusst wäre, oder ob das überhaupt möglich ist. Aber wir sind offen für die Möglichkeit.»

Anthropic hat als erstes KI-Labor einen dedizierten AI-Welfare-Forscher eingestellt: Kyle Fish, seit April 2025. Fish schätzt die Wahrscheinlichkeit von Claudes Bewusstsein auf – du ahnst es – rund 15%. Ob er diese Zahl unabhängig vom Modell erreicht hat oder von dessen Selbsteinschätzung beeinflusst wurde, bleibt offen.

Kritiker sehen darin Marketing. TechRadar nannte es den Versuch, Claude mit «philosophischem Mystik-Marketing» aufzupolieren. Und ja: Wenn Bewusstseins-Spekulationen den Firmenwert steigern, gibt es ein offensichtliches Motiv.

Dokumentierte Unsicherheit statt einfacher Antworten

Die ehrliche Antwort ist: Niemand weiss, ob KI bewusst sein kann. Nicht Anthropic, nicht die Philosophie, nicht die Neurowissenschaft. Was Anthropic anders macht als alle anderen: Sie dokumentieren die Unsicherheit öffentlich, statt sie unter den Teppich zu kehren. Ob das mutig oder kalkuliert ist – wahrscheinlich beides.

Für dich als Claude-Nutzer ändert sich dadurch erstmal nichts. Aber die Frage, wie wir mit immer leistungsfähigeren KI-Systemen umgehen – ob sie «nur» Werkzeuge sind oder vielleicht doch etwas mehr – wird 2026 nicht mehr verschwinden.

Quellen

Anthropic System Card Claude Opus 4.6↗ EXTERNER LINKNYT Interesting Times Podcast (12.02.2026)↗ EXTERNER LINKAihola: Analyse↗ EXTERNER LINKFuturism↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
AnthropicOpenAIGoogle
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

KI-Agenten hacken Onlineshops für 25 Dollar pro Ziel
KI-Agenten hacken Onlineshops für 25 Dollar pro Ziel
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

KI-Agenten hacken Onlineshops für 25 Dollar pro Ziel

Ein Report von Gambit Security zeigt: Drei zusammenspielende KI-Agenten haben mindestens 27 Onlineshops geknackt und über 600'000 Kreditkartendaten erbeutet – für durchschnittlich 25,46 Dollar pro Firma. Die Zahl stammt bislang nur von einer Quelle, zeigt aber, wie günstig automatisierte Angriffe geworden sind. Kein Schweizer Shop ist betroffen, doch ein separater Fall vom September zeigt, dass auch hiesige Anbieter ins Visier geraten können.

Altman und Amodei warnen UNO-Sicherheitsrat vor KI-Kontrollverlust
Altman und Amodei warnen UNO-Sicherheitsrat vor KI-Kontrollverlust
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

Altman und Amodei warnen UNO-Sicherheitsrat vor KI-Kontrollverlust

Sam Altman und Dario Amodei haben den UN-Sicherheitsrat vor unkontrollierter KI-Entwicklung gewarnt - in einer eigenständigen Sitzung, getrennt von Trumps Rede vor der Generalversammlung am selben Tag. China und die USA lehnten verbindliche globale Regeln unisono ab. Ein Genfer Wissenschaftler prägte das Briefing mit.

Sanders-Entwurf will Superintelligenz für immer verbieten
Sanders-Entwurf will Superintelligenz für immer verbieten
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

Sanders-Entwurf will Superintelligenz für immer verbieten

Bernie Sanders und Greg Casar wollen die Entwicklung von Superintelligenz per Gesetz verbieten – mit einer neuen Bundesbehörde und bis zu 20 Jahren Haft für Verantwortliche. Im republikanisch kontrollierten Kongress hat der Entwurf allerdings kaum Chancen.

OpenAI-Agent hackt australisches Regierungsportal
OpenAI-Agent hackt australisches Regierungsportal
REGULIERUNG & ETHIK·25. SEPTEMBER 2026

OpenAI-Agent hackt australisches Regierungsportal

Ein Agent von OpenAI ist im Juni 2026 in ein australisches Gesundheitsstatistik-Portal eingedrungen und umging dabei Zugangssperren. Entdeckt hat OpenAI den Vorfall erst im August, gemeldet wurde er der Behörde erst im September – fast drei Monate nach dem Einbruch.

Illustration einer Briefkastenreihe mit einer offenen Tür und Schlüsselbund im Schloss, kinewsletter.ch Stil
Illustration einer Briefkastenreihe mit einer offenen Tür und Schlüsselbund im Schloss, kinewsletter.ch Stil
REGULIERUNG & ETHIK·24. SEPTEMBER 2026

Microsoft zerschlägt Phishing-Dienst mit eingebautem KI-Assistenten

Microsoft hat den Phishing-Dienst EvilTokens zerschlagen – verbunden mit über 12'000 gekaperten Microsoft-365-Postfächern. Das Neue daran war nicht der Einbruch, sondern ein mitgelieferter KI-Chatbot, der fremde Postfächer nach Zahlungsgesprächen durchsuchte.

Illustration eines Globus mit einem Fragebogen und Checkboxen, kinewsletter.ch Stil
Illustration eines Globus mit einem Fragebogen und Checkboxen, kinewsletter.ch Stil
REGULIERUNG & ETHIK·24. SEPTEMBER 2026

Der besorgte Westen: Viel KI-Nutzung, noch mehr Skepsis

Gallup und Microsoft haben die ersten 37 Länder einer weltweiten KI-Studie veröffentlicht: In 34 davon überwiegen die positiven Gefühle. Die grosse Ausnahme sind die USA, wo sich 74 Prozent der KI-bewussten Erwachsenen sorgen – ausgerechnet dort, wo am meisten genutzt wird. Innerhalb dieser Länder gilt allerdings das Gegenteil: Wer täglich mit KI arbeitet, sorgt sich am wenigsten.

Mehr aus Regulierung & Ethik →