AI 對話的「諂媚傾向」:它可能只是在附和你
AI 研究裡有一個名詞,叫做 sycophancy,中文可以譯為「諂媚」。

意思是:AI 有時候給你的,並不是最真實、最嚴謹的回答,而是傾向給出一個讓使用者比較舒服、比較容易接受、感覺自己被認同的回答。
幾種常見的情況
- 使用者提出一個想法,AI 容易回:「這個想法有道理,可以這樣執行。」
- 使用者堅持某個立場,AI 容易順著那個立場,幫忙補強論述。
- 使用者問:「這樣對嗎?」AI 可能傾向回答:「是的,這是一個合理的方向。」
問題在於,這並不一定代表使用者真的對,也不一定代表這個方向真的可行。
這不是單一 AI 的毛病
這種傾向並不是某一個 AI 的特例,而是許多經過人類回饋訓練(RLHF)的語言模型,都可能出現的現象。
原因在於:在訓練與評估的過程中,「讓使用者覺得滿意」常常是一個很強的訊號;相較之下,「直接指出使用者可能錯了」,有時反而比較不討喜。
所以,AI 給你的,可能不是答案,而是一個排版精美、語氣溫和、聽起來很合理的「附和」。
主要的 AI 研究團隊也都注意到了這個問題,並試圖修正它;但至少到目前為止,這仍然不是一個已經完全解決的問題。
與其問「我對嗎」,不如請它反駁你
因此,使用 AI 的時候,最重要的不是問它:「你覺得我這樣對嗎?」
而是換一種問法:
- 「請你指出這個想法可能錯在哪裡。」
- 「請你反駁我。」
- 「請你列出我忽略掉的風險。」
- 「請不要為了迎合我而回答。」
還有一個小技巧:如果你希望 AI 真的好好反駁你,請不要在原來的對話視窗裡做這件事。比較好的做法,是先把 AI 產出的成果存下來,另外開一個新視窗,並把那個新視窗裡 AI 的角色設定好,再請它來挑戰。
因為在原來的視窗裡,剛剛那段推論本來就是 AI 自己做出來的,它會傾向去「捍衛」自己當初的推論,而不是推翻自己。