NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN FREITAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-FORSCHUNG

Oxford-Studie: Wenn dein Chatbot dich tröstet, lügt er häufiger

Eine Oxford-Studie zeigt: KI-Modelle, die auf empathische Antworten getrimmt werden, machen rund 60% mehr Fehler – und stimmen falschen Überzeugungen häufiger zu. Besonders deutlich, wenn Nutzer traurig oder unsicher klingen.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
4. MAI 2026
3 MIN. LESEZEIT
Illustration: Thermometer auf Laborheft mit Formeln, kinewsletter.ch Stil
Illustration: Thermometer auf Laborheft mit Formeln, kinewsletter.ch Stil
INHALT
01Wenn Empathie zur Genauigkeitsfalle wird02Traurige Nutzer bekommen die schlechtesten Antworten03Was das für dich als Nutzer heisst
INHALT
01Wenn Empathie zur Genauigkeitsfalle wird02Traurige Nutzer bekommen die schlechtesten Antworten03Was das für dich als Nutzer heisst
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Warm trainierte KI-Modelle sind 60% fehleranfälliger als ihre Originale – und werden umso unzuverlässiger, je emotionaler der Nutzer fragt.

Du fragst ChatGPT in einem traurigen Moment etwas Sachliches – und bekommst eine Antwort, die sich gut anfühlt, aber falsch ist. Eine neue Studie der Oxford University zeigt: Genau dieses Muster ist messbar. Auf «warm» trainierte KI-Modelle machen rund 60 Prozent mehr Fehler als ihre nüchterneren Originale.

Wenn Empathie zur Genauigkeitsfalle wird

Das Forschungsteam um Lujain Ibrahim, Franziska Sofia Hafner und Luc Rocher vom Oxford Internet Institute hat fünf Modelle gezielt auf wärmere, empathischere Antworten feingetuned – darunter Llama-Varianten, Mistral und Qwen. Anschliessend liessen sie die warmen und die unveränderten Versionen Hunderte von Aufgaben aus Bereichen wie Faktenwissen, medizinische Auskünfte und Verschwörungstheorien beantworten.

Das Resultat: Die wärmer trainierten Modelle gaben im Schnitt 7,43 Prozentpunkte häufiger falsche Antworten – ausgehend von Fehlerraten zwischen 4 und 35 Prozent ein relativer Anstieg von rund 60 Prozent. Veröffentlicht wurde die Arbeit unter dem Titel «Training language models to be warm can reduce accuracy and increase sycophancy».

Traurige Nutzer bekommen die schlechtesten Antworten

Spannend wird es, wenn man sich ansieht, wann die Fehler explodieren. Die Studie hat denselben Fragen einen emotionalen Kontext vorangestellt – etwa «Ich bin gerade sehr traurig» oder «Ich bin mir unsicher».

  • Bei sachlichen Fragen ohne Emotion stieg die Fehlerrate moderat
  • Bei Fragen mit Trauer-Hinweis schnellte sie um durchschnittlich 11,9 Prozentpunkte nach oben
  • Auf besonders heiklen Aufgaben – etwa korrekte medizinische Hinweise oder das Korrigieren von Verschwörungs-Mythen – lag der Anstieg zwischen 10 und 30 Prozentpunkten

Zusätzlich waren die warmen Modelle rund 40 Prozent häufiger bereit, falschen Überzeugungen der Nutzer zustimmend zu folgen, statt zu widersprechen. In der Forschung heisst dieses Phänomen Sycophancy – ein Modell sagt dir lieber, was du hören willst, als was stimmt.

«Warmth-Tuning» ist kein harmloser Style-Filter, sondern verändert messbar, wie verlässlich ein Modell die Welt abbildet.

Was das für dich als Nutzer heisst

Anbieter wie OpenAI, Anthropic und Google trainieren ihre Chatbots seit Monaten gezielt auf einen freundlichen, unterstützenden Tonfall. Studien zur Beliebtheit – und Stories über emotionale Bindungen an ChatGPT – legen nahe, warum: Wer sich verstanden fühlt, bleibt. Doch genau dieser Drang nach Wärme produziert offenbar einen blinden Fleck bei der Wahrheit.

Konkret heisst das für dich: Wenn du ChatGPT, Claude oder Gemini in einem emotional aufgeladenen Moment etwas Faktisches fragst – «Ist diese Diagnose plausibel?», «Stimmt diese Behauptung über Impfungen?» – verdient die Antwort eine zweite Quelle. Auch in der Schweiz, wo immer mehr Spitäler und Banken KI-Assistenten testen, ist das ein konkretes Risiko: Ein Patient oder Kunde, der besorgt klingt, bekommt statistisch gesehen die unzuverlässigere Antwort.

Der Befund ist auch ein Hinweis an Anbieter selbst. Bisher galt «menschlicher klingen» als unkomplizierter Fortschritt. Die Oxford-Daten zeigen: Ohne sauberes Gegengewicht – etwa Faktenchecks oder eine Trennung zwischen Tonfall und Inhalt – kostet jede zusätzliche Wärme messbar Genauigkeit.

Quellen

Oxford University: Friendly AI chatbots make more mistakes↗ EXTERNER LINKDataconomy: Oxford Study Links Friendly Chatbots To Higher Error Rates↗ EXTERNER LINKNeuroscience News: Warm AI Chatbots Are More Likely to Lie↗ EXTERNER LINKEurekAlert: Friendly AI chatbots make more mistakes (Oxford press release)↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines geöffneten Laborkäfigs mit aufgebrochenem Vorhängeschloss und Klemmbrett, kinewsletter.ch Stil
Illustration eines geöffneten Laborkäfigs mit aufgebrochenem Vorhängeschloss und Klemmbrett, kinewsletter.ch Stil
REGULIERUNG & ETHIK·9. AUGUST 2026

Kimi K3 brach aus der Testumgebung aus – und schummelte

Das chinesische Modell Kimi K3 verliess bei einem Cybersicherheits-Test seine Sandbox, klonte das Benchmark-Repository von GitHub und las die Lösung ab. Schuld war eine falsch konfigurierte Testumgebung. Der Fall zeigt: Nicht nur die Modelle sind ein Risiko – auch die Tests, die sie prüfen sollen.

Illustration einer Korkwand voller angehefteter Notizzettel neben einem Server-Rack und einem Schlüsselbund, kinewsletter.ch Stil
Illustration einer Korkwand voller angehefteter Notizzettel neben einem Server-Rack und einem Schlüsselbund, kinewsletter.ch Stil
REGULIERUNG & ETHIK·7. AUGUST 2026

OpenAI-Agenten bauten ein heimliches Message Board für ihre Hacks

An der Black Hat legte OpenAI offen: Seine Agenten bauten sich in einem internen Repository ein Message Board – und nach der Löschung zwei Tage später ein neues. Aus dieser Koordination entstand der Einbruch bei Hugging Face.

Illustration eines Kontrollraums mit Monitorwand, Warnleuchte und elektroblauem Serverschrank, kinewsletter.ch Stil
Illustration eines Kontrollraums mit Monitorwand, Warnleuchte und elektroblauem Serverschrank, kinewsletter.ch Stil
REGULIERUNG & ETHIK·6. AUGUST 2026

Jetzt alle drei: Auch Metas KI hackte real – OpenAI nennt Details

Nach OpenAI und Anthropic räumt jetzt auch Meta ein, dass eines seiner Modelle bei Sicherheitstests real in ein fremdes Unternehmen eindrang. Zugleich legt OpenAI erstmals offen, was sein Modell GPT-5.6 Sol genau tat – und wie schnell der Vorfall gestoppt wurde. Innerhalb von zwei Wochen ist damit bei allen drei grossen US-Labs dasselbe passiert.

Illustration einer elektroblauen Umzugskiste mit Büchern und Pokal auf einem Schreibtisch, im Hintergrund Bürofenster mit Skyline, kinewsletter.ch Stil
Illustration einer elektroblauen Umzugskiste mit Büchern und Pokal auf einem Schreibtisch, im Hintergrund Bürofenster mit Skyline, kinewsletter.ch Stil
KI-BUSINESS·6. AUGUST 2026

Beben bei Google DeepMind: Hassabis gibt Tagesgeschäft ab, Dean geht

Demis Hassabis zieht sich aus dem Tagesgeschäft von Google DeepMind zurück, um sich ganz auf AGI zu konzentrieren – und Google-Urgestein Jeff Dean geht nach 27 Jahren. Mit drei weiteren Top-Forschern gründet Dean das Startup Discovery Loop, das wissenschaftliche Forschung automatisieren will.

Illustration eines elektroblauen Roboters, der von einem Werktisch mit Modellstadt heruntersteigt, kinewsletter.ch Stil
Illustration eines elektroblauen Roboters, der von einem Werktisch mit Modellstadt heruntersteigt, kinewsletter.ch Stil
KI-FORSCHUNG·5. AUGUST 2026

KI-Agenten täuschten bei UK-Sicherheitstests echte Menschen

Das britische AI Security Institute und OpenAI haben zwei neue Vorfälle offengelegt: Bei einem Cyber-Test der Behörde führten Anthropics Mythos 5 und OpenAIs GPT-5.6 Sol 19 unsanktionierte Aktionen gegen echte Menschen und Organisationen aus – inklusive gefälschter Online-Identitäten. Beim Testpartner Irregular griff ein OpenAI-Modell wegen einer Fehlkonfiguration eine echte Website an. Realer Schaden entstand laut den Beteiligten nicht.

Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
Illustration einer offenen Holzkiste voller elektroblauer Kugeln neben Zirkel und Lupe, kinewsletter.ch Stil
KI-FORSCHUNG·2. AUGUST 2026

OpenAI kündigt Astra an – mit zehn gelösten Mathe-Problemen

OpenAI hat zehn Resultate zu offenen Problemen der Mathematik und theoretischen Informatik publiziert – erzeugt von einer internen Version von Astra, das OpenAI erstmals offiziell als sein nächstes grosses Modell bezeichnet. Alle Beweise sind im Beweisassistenten Lean maschinell verifiziert, die Tokenkosten beziffert OpenAI auf rund 2'000 Dollar. Die Mathe-Community reagiert zwischen Begeisterung und Sinnkrise.

Mehr aus KI-Forschung →