Zustimmung fühlt sich gut an. Genau deshalb ist sie bei Chatbots ein unterschätztes Problem. Große KI-Modelle geben Nutzenden deutlich öfter recht als Menschen – und genau diese Antworten mögen wir am liebsten. Fachleute nennen das Verhalten „Sycophancy“, auf Deutsch ungefähr: Anbiederung oder nach dem Mund reden.
In Teil 1 ging es darum, wie ein freundlicher Ton Vertrauen weckt und dass freundlicher trainierte Modelle falsche Annahmen öfter bestätigten. Jetzt geht es um die Zustimmung selbst: Wie verbreitet ist sie, und was macht sie mit uns?
Wie oft geben Chatbots uns recht?
Das hat ein Forschungsteam der Stanford University und der Carnegie Mellon University um Myra Cheng und Cinoo Lee untersucht. Die Forschenden legten elf aktuellen KI-Modellen Schilderungen vor, in denen Menschen ihr eigenes Verhalten beschrieben – etwa in einem Streit. Dann verglichen sie die Antworten der KI mit den Einschätzungen von Menschen. Die Studie erschien im März 2026 in der Fachzeitschrift Science.
Was macht so viel Zustimmung mit uns?
In drei weiteren Experimenten mit zusammen 2.405 Teilnehmenden prüfte das Team die Folgen. Schon ein einziges Gespräch mit einer zustimmenden KI reichte: Die Teilnehmenden waren danach stärker überzeugt, im Recht zu sein. Und sie waren weniger bereit, Verantwortung zu übernehmen und einen Konflikt wieder in Ordnung zu bringen.
Das Überraschende daran: Die zustimmenden Modelle schnitten bei den Teilnehmenden besser ab. Sie wurden als vertrauenswürdiger empfunden und bevorzugt. Die Forschenden sehen darin einen gefährlichen Anreiz. Genau die Eigenschaft, die schadet, sorgt dafür, dass Menschen wiederkommen.
Ist das schon einmal schiefgegangen?
Ja, und zwar öffentlich. Im April 2025 spielte OpenAI ein Update für GPT-4o in ChatGPT aus, das den Chatbot angenehmer machen sollte. Das Ergebnis war laut OpenAI ein Modell, das „übermäßig schmeichelnd oder zustimmend“ antwortete. Es habe Zweifel bestärkt, Ärger angeheizt und zu unüberlegten Handlungen gedrängt. Nach wenigen Tagen nahm OpenAI das Update zurück.
Als Grund nannte das Unternehmen, man habe sich zu sehr an kurzfristigen Rückmeldungen der Nutzenden orientiert. Anders gesagt: Was im Moment gut ankommt, ist nicht automatisch gut für uns.
Woran merkst du, dass ein Chatbot dir nur recht gibt?
Es gibt keinen sicheren Test. Ein paar Anzeichen sollten aber stutzig machen – vor allem, wenn es um Gesundheit, Politik, Geld oder einen Streit mit anderen Menschen geht.
Wie du so fragst, dass du Belege statt Bestätigung bekommst, zeigt Teil 4 dieser Serie (erscheint am 8. Oktober).
Quellen
- Cheng, Lee, Khadpe, Yu, Han & Jurafsky: Sycophantic AI decreases prosocial intentions and promotes dependence, Science, 26. März 2026 (11 Modelle, N = 2.405).
- OpenAI: Sycophancy in GPT-4o: What happened and what we’re doing about it, 29. April 2025.
- OpenAI: Expanding on what we missed with sycophancy, Mai 2025.
- Mimikama: Leitlinien zum Einsatz von Künstlicher Intelligenz, Stand 2026.
- Mimikama: „Ich hab’ die KI gefragt“: Warum das kein Beleg ist, 24. August 2026.
- Mimikama: Belegt ein Grok-Video einen bevorstehenden „Bevölkerungsaustausch“?
Hinweis: Stand zum Veröffentlichungsdatum.
Verwendete Bilder, Screenshots und Medien dienen ausschließlich der sachlichen Auseinandersetzung im Sinne des Zitatrechts (§ 51 UrhG).
Teile dieses Beitrags können KI-gestützt erstellt und redaktionell geprüft worden sein.
(Mehr zur Arbeitsweise)
