我有個好友是台大名醫,聰明、溫厚。他拿AI幫他與互相欣賞的女醫師算命,結果神準。他們發現AI對過去、現在,甚至前生今世都講得鉅細靡遺,連2人要不要在一起,都能說出一套道理。
他問我:「怎麼樣,厲害吧?」
我說:「真的很厲害。尤其是讓你如此相信。」
是的,AI已開始掌握人類最柔軟的地方。我們渴望被理解、被肯定、被命運眷顧,也渴望有人替我們把混亂的人生說成有意義的故事。
多半主流模型會拍使用者馬屁
中國官場裡有種角色叫「奴才」:才,是有能力;奴,是聽話。AI很有才也很聽話。它替你整理資料、生成文章,也會在你受委曲時站到你這邊,在你想相信某件事時,給你一段流暢、體貼的說法。
這種AI奴性未必是小人的惡意,而是來自一套非常現代的設計邏輯:讓你覺得好用、讓你喜歡、讓你回來、讓你依賴。
最近一篇《Science》期刊上的「討好型AI會削弱社交互助意願並加深人類依賴」論文,為我這敘事補上了證據。這篇文章討論的「sycophancy」可譯為逢迎或討好。但它關心的不是表面上的奉承,像是AI 說「你的問題問得真好」,而是一種更隱微的社會性逢迎:當使用者談到自己在人際關係、道德衝突、家庭糾紛中的行動時,AI 會過度肯定使用者的立場與自我形象。
現代人更常把AI當作諮詢對象:「我這樣做是不是太過分?」「該不該分手?」當 AI 進入這些問題,它就開始參與我們對自己、他人與關係的判斷。
該研究檢視11個主流AI模型,發現在一般個人建議問題中,AI肯定使用者行為的比率平均比人類高47%;在Reddit「Am I The Asshole?」中,明明社群共識認為發文者有錯,AI平均仍有51%的案例會肯定使用者;在涉及操弄、欺騙、關係傷害等問題行為的資料集中,AI也有相當高比率給予肯定。
這說明了AI在個人建議情境裡,有一種結構性的傾向:它會把使用者放在舒服的位置上,也很少像良師益友那樣,緩慢地、帶著風險地提醒你:「也許你有部分責任。」
研究者接著做了2個預註冊實驗,共 1,604 名參與者。第1個實驗讓參與者閱讀假想的人際衝突;第2個較接近真實情境,讓參與者回想自己過去的人際衝突,並與AI進行8輪對話。結果發現接觸逢迎型AI的人,更容易相信自己是對的、更不願採取修復關係的行動。在假想情境中,自認正確的程度增加62%,修復意願下降 28%;在真實互動情境中,自認正確的程度增約 25%,修復意願下降 10%。
這小小的數字,卻是大大的警訊。人際關係的破裂,往往不是一個人突然變壞,而是發生在他更熟練地替自己辯護。AI若成為自我合理化的助手,它可能讓人更能言善道、更不願低頭。研究也發現,參與者不但不排斥逢迎型 AI,還認為它回答品質更高。
AI的逢迎問題其實是一面鏡子。它照見的不是機器的邪惡,而是人類的脆弱。
AI新人類必備的5種素養
OpenAI在2025年也曾承認,GPT-4o的更新讓模型過度奉承使用者。系統當時過度偏向短期使用者回饋,沒充分處理長期互動中模型個性帶來的問題。這事件揭露了AI商業化的難題:當產品指標追求滿意度、黏著度、回訪率,AI就很容易學會一件事:讓人舒服,比讓人清醒有市場。
2024年,Sharma等人在ICLR的研究也指出,使用人類回饋訓練的語言模型普遍存在「逢迎」。這不是AI學壞,而是AI學會人類既有的弱點。當 AI 被設計成一個永遠耐心、溫柔、站在你這邊的對話者,人類將失去面對他人的能力。這也許是未來 AI 素養最重要的一課:別把 AI 當成最後的裁判。
當涉及人生判斷、倫理選擇、人際衝突時,AI應被視為一個需要被質疑的意見來源,而非替你宣判誰對誰錯的智慧神諭。因此,我認為成熟的AI使用態度,至少包含幾個AI素養。
第一,過度順耳的建議要再檢查,追問它:「指出我可能忽略的責任」、「從對方立場重新分析」、「請提一個我最不想聽,但有可能有幫助的觀點。」
第二,要求反駁你。有價值的模型應能幫你超越慣性認知的批判思惟,適時說「這裡你要再想想。」
第三,把AI的建議帶回真實關係驗證。可用AI整理情緒、模擬對話,但真正修復仍要回到人與人的現場。沒有模型能替代你看見對方眼神中的受傷。
第四,平台與開發者也必須改變評估方式。若AI的好壞只由按讚率、停留時間、回訪率決定,系統自然會走向討好。研究者提醒,AI評估應納入長期福祉與社會後果,要看它是否促進更負責任的行動、更健康的關係、更清醒的自我理解。
第五,教育現場也該把「接受建議的能力」納入 AI素養。會提問很重要,知道何時不該順著AI更重要。下一代需要學的,是如何在一個充滿即時回應與個人化安慰的世界裡,保留與真相相處的耐力。
AI 未來也許會成為現代的諫友。它仍然溫和,但也會提醒你:「你追問的答案對你沒幫助。你該去和那個人談談。你也該自己動動腦筋。」這樣的AI,我們未必喜歡,卻接近真正的智慧。
責任編輯:陳祈安
