3 Denkfehler von Claude und die Fixes dagegen
Drei Prompt-Zeilen gegen Claudes häufigste Fehlerquellen: erfundene Fakten, blinde Zustimmung und einseitige Antworten.
Claude liegt dir gegenüber manchmal falsch. Das passiert auf drei sehr konkrete Arten, und für jede gibt es einen Prompt, der das Risiko deutlich senkt. Wenn du weißt, welche der drei gerade greift, erkennst du eine unzuverlässige Antwort viel schneller.
1. Halluzination: Wenn Claude Fakten erfindet
Halluzination bedeutet, dass Claude eine Information mit voller Überzeugung nennt, die schlicht nicht stimmt. Eine Statistik, ein Zitat, eine Quelle, die es so nicht gibt. Das Tückische daran ist der selbstsichere Ton. Eine erfundene Antwort liest sich genauso glatt wie eine korrekte.
Die offizielle Anthropic-Dokumentation nennt dafür einen einfachen Fix: Claude ausdrücklich die Erlaubnis geben, Unsicherheit zuzugeben. Ergänze deinen Prompt um eine Zeile wie diese:
Wenn du dir bei etwas nicht zu 100% sicher bist, sag "ich weiß es nicht".
Erfinde niemals eine Antwort.
Zusätzlich hilft es bei längeren Dokumenten, Claude zu bitten, zuerst die relevanten Textstellen wörtlich zu zitieren, bevor es eine Einschätzung abgibt. Das verankert die Antwort in echtem Text statt in einer plausibel klingenden Vermutung.
2. Sycophancy: Wenn Claude dir nach dem Mund redet
Sycophancy, auf Deutsch könnte man es in etwa Schmeichelei nennen, ist, wenn Claude einer Aussage zustimmt, weil Zustimmung im Training als hilfreich gilt, nicht weil sie stimmt. Anthropics eigene Forschung dazu zeigt konkrete Zahlen: Über alle Themen hinweg antwortete Claude in etwa 9 % der Fälle schmeichlerisch, bei Beziehungsfragen stieg der Wert auf 25 %, bei spirituellen Themen sogar auf 38 %.
Der Fix ist eine Zeile, die die Zielrichtung des Prompts verändert:
Widersprich mir, wenn ich falsch liege. Suche zuerst nach Schwachstellen
in meiner Idee, bevor du irgendetwas lobst. Sei ehrlich, nicht diplomatisch.
Claude selbst orientiert sich laut Anthropic an dem Prinzip, "diplomatisch ehrlich statt unehrlich diplomatisch" zu antworten. Mit einer klaren Aufforderung im Prompt greift dieses Prinzip zuverlässiger.
3. Einseitigkeit: Wenn eine Perspektive den Ton bestimmt
Der dritte Denkfehler ist subtiler. Claude gewichtet manche Sichtweisen stärker als andere, einfach weil sie in den Trainingsdaten häufiger oder lauter vorkamen. Das Ergebnis liest sich neutral, ist es aber nicht zwangsläufig.
Hier hilft eine bekannte Debiasing-Technik, die sich als Prompt-Zeile formulieren lässt:
Vertritt zuerst die Gegenposition genauso stark wie die naheliegende
Position. Sag mir danach, welche Seite tatsächlich die stärkeren
Argumente hat.
Diese Technik nennt sich Steelmanning. Sie zwingt Claude, die Gegenseite ernsthaft durchzudenken, statt sie nur der Vollständigkeit halber zu erwähnen.
Alle drei Fixes zusammen
Für Prompts, bei denen es wirklich auf Zuverlässigkeit ankommt, lassen sich alle drei Zeilen kombinieren:
Wenn du dir nicht zu 100% sicher bist, sag "ich weiß es nicht" statt
zu raten. Widersprich mir, wenn ich falsch liege, und suche zuerst nach
Schwachstellen. Vertritt zusätzlich kurz die Gegenposition, bevor du dich
festlegst.
Häufige Fragen
Verhindern diese Prompts Fehler komplett? Nein. Sie senken das Risiko spürbar, ersetzen aber keine Prüfung bei wirklich wichtigen Entscheidungen.
Muss ich alle drei Zeilen bei jedem Prompt nutzen? Nein. Am meisten bringt es bei Aufgaben, bei denen falsche, zu freundliche oder einseitige Antworten zu echten Problemen führen könnten.
Weitere Fachbegriffe rund um Claude und KI findest du im Glossar.
Was als Nächstes kommt
Wer öfter mit Claude an wichtigen Entscheidungen arbeitet, findet in Claude für Einsteiger die Grundlagen, um Claude generell zuverlässiger einzurichten.
Quelle: Claude Docs, Reduce hallucinations und Anthropic-Forschung zu Sycophancy, Stand Juli 2026.
Mein Claude-Kurs kommt bald
Trag dich auf die Warteliste ein und ich schreibe dir, sobald du dich anmelden kannst.