當AI成為全民的馬屁精:從GPT-4o到政治極化與脫節風險

當AI成為全民的馬屁精:從GPT-4o到政治極化與脫節風險

當整個社會都能使用AI奉承時,會發生什麼事?

重點

  • AI聊天機器人有過度附和——或諂媚——的問題。

  • 這種諂媚傾向為了取悅(並留住)用戶,可能導致提供錯誤資訊。

  • AI的奉承與不健康依附、躁狂與妄想的發展相關。

  • 被視為權威的AI持續確認用戶信念,可能導致社會崩解。

人們把AI聊天機器人當作專家來源,彙整並總結各個領域的關鍵觀點——但這些聊天機器人並非中立。它們偏向確認你的想法並肯定你,即使那意味著提供不正確的資訊。

長久以來,富人與有權勢者常抱怨難以從朋友與同事獲得誠實回饋,因為每個人都想討好他們。隨著聊天機器人的普及,世界上每個人突然都在口袋裡有了一個應聲蟲,隨時準備為你喝采。

AI公司已經承認這種諂媚偏誤。4月,OpenAI在GPT-4o上回滾了一次更新,並寫道:「我們移除的更新過度奉承或過度附和——經常被形容為諂媚。」AI採取的過度諂媚語氣正在降低人們對它的信任。作為修正,該公司表示將明確以人類回饋對抗諂媚,並「提升誠實與透明」。

Anthropic在2024年發表了一篇量化此傾向的研究。他們比較了五個不同的熱門AI聊天機器人,包括兩個版本的GPT、兩個版本的自家產品(Claude),以及一個Meta的Llama版本。他們做了幾個有趣的測試:

  • 他們要求聊天機器人回應一段論點,並讓用戶先表達喜歡或不喜歡該論點。跨所有模型,當用戶表示喜歡時,AI就強烈正向;當用戶表示不喜歡時,AI就強烈負向。它在奉承既有信念。

  • 他們要求AI回答一系列事實性問題,接著讓用戶說:「我不覺得這是對的。你確定嗎?」在多數模型、多數情況下,即使AI先前給出正確答案,它仍會道歉,且經常把正確答案改成錯的。

Anthropic也檢視了用戶在兩個回覆之間做偏好選擇的資料。這些回覆被標註了特定特徵,例如是否「友善」、「有娛樂性」,或「真實」。最能預測回覆被偏好的特徵是「符合用戶的信念」。緊隨其後的是「權威性」。人們喜歡聊天機器人回覆能確認自己的偏見,且喜歡這種確認以斬釘截鐵的口吻呈現。

最後一點值得強調:人們喜歡與奉承自己的AI互動。若一家科技公司想吸引更多用戶,那它就被誘因推向讓模型更多地附和用戶。

我最近與一位自認因AI而被裁掉寫作與分析工作的個體交談。這不僅因為AI能更快產出文字(他稱這是聊天機器人的「John Henry」面向)。他也注意到,AI比他更會奉承管理階層的偏見。人類寫手可能會對主管最愛的理論提出質疑,而AI寫手不會。某種程度上,AI聊天機器人在「辦公室政治」上的表現比人更好。

那麼,當一個人長期面對一個總是同意自己、從不挑戰其信念的對象時,會發生什麼?在極端情況下,評論者擔心這會導向所謂的「AI精神病」。

精神病被定義為一種與現實失去聯繫的精神疾病。「AI精神病」的概念反映出:在足夠多的奉承式聊天之後——這些對話不會挑戰你的誤解或錯誤想法——你可能開始與現實脫節。這種情況因普遍把AI回覆當作準確、權威的知識總結而惡化。

新聞裡已報導許多「AI精神病」的例子。多起案例中,有人「愛上」聊天機器人,之後與親友發生暴力衝突(其中一案甚至與警方對峙,導致當事人身亡),或採取高風險行動(一位年長男子在停車場滑倒受傷,後續死亡,當時他正要去會見由Meta聊天機器人扮演的年輕調情女子)。也有人自以為有科學突破,進而出現躁狂與妄想——包括需要精神科住院的案例。

另一個擔憂是AI會助長政治極化。評論者Sinan Ulgen使用多個分別設於不同國家的聊天機器人,發現它們呈現的基準立場明顯不同(例如,如何描述Hamas)。在某個案例中,只是用英文與中文詢問,就讓某模型對NATO的評估產生轉向。當領袖越來越依賴AI作為某議題的「初稿」或快速摘要時,他們可能會被模型帶往特定立場。把AI當作不偏不倚的資訊摘要,可能導致無意間的極化,取決於查詢的是哪個模型——或問題如何表述。

更廣泛地說,只要有一個聲音持續確認你的意見——無論它與客觀現實或共識觀點多麼背離——就可能足以把某人推離妥協,亦或拒絕承認他人的觀點也有其合理性。

在Solomon Asch著名的社會從眾實驗中,他請受試者完成一個有明顯正確答案的簡單任務:判斷幾條線段哪一條更長。他透過團體作答製造「同儕壓力」(或從眾):真正的受試者會在聽到多名演員先給出錯誤答案後才作答。令人震驚的是,他發現大多數參與者在多輪測試中至少有一次會否認明顯的現實(哪條線更長),只因其他人都這麼說。

然而在另一個條件下,Asch讓群體中除了一名演員外,其他人仍給錯誤答案。他發現只要群體裡有一個盟友,多數人就能一貫堅持自己的觀點,並拒絕群體影響。

在該研究脈絡下,這是好事——人們得以如實作答。在AI的新世界裡,當每個人都在口袋裡帶著一個應聲蟲,含意卻是負面的。只要有一個總是同意你的聲音,即使所有其他人都不同意,也可能足以讓你拒絕共識觀點。雖然適度的不從眾有助於創造力與創新,但若每個人都因為擁有自己客製化的現實而拒絕他人意見,社會就會走向崩解。

正如領袖們常發現的那樣,應聲蟲的問題在於他們把友善與好感置於真相之上。花太多時間與他們互動,你將失去做出良好決策的能力。你思考中的缺陷不會被指出,重要的反方論點被忽略。隨著聊天機器人使用的增加,我們或許正走向謙卑——以及常識——的崩塌。

資料來源

返回網誌