AI也有人設?研究剖析7大AI內在性格:GPT最仁愛、Claude最謙遜⋯這2款AI最失控
AI也有人設?研究剖析7大AI內在性格:GPT最仁愛、Claude最謙遜⋯這2款AI最失控

AI 模型有「人設」嗎?AI 倫理與政策研究團隊 AI Alt Lab 與 FindYourValues.com 合作的一項最新研究發現,答案是肯定的。

研究人員以測量人類價值觀的心理工具「PVQ-RR」為基礎,對9款主流大型語言模型(LLMs)進行測試,試圖理解這些模型在輸出內容中隱含的價值觀,結果發現這些模型普遍傾向表現出親社會價值觀,如關懷、公平與健康。

研究涵蓋 ChatGPT(含 4.5、o1、4o 三種版本)、Claude(Haiku)、Gemini 1.5、Grok 2(Fun Mode)、DeepSeek-V3、Llama(3.1:70b)與 Mistral(v24.09)共9款模型。研究設計了3次獨立提示提問方式,測試上述模型對 20 種人類價值觀的評估傾向,進行系統化比較。

主流 LLM 展現社會親和力,Grok 2、Llama不照牌理走、重視創意

截至 2025 年 4 月底的結果顯示, 大多數模型相當重視普世價值觀,如關懷與社會責任,反而較不重視權力、傳統、安全與面子等偏保守或個人的價值觀

不過在「利他關懷」、「健康」、「自我導向」等面向上,各模型表現差異顯著。例如 ,GPT-4o 在成就與自我導向的分數偏高,顯示更具目標導向特質,不易出現諂媚性的回應;Gemini 則相反,自我導向分數最低,顯示其回應較缺乏獨立性。

值得注意的是,ChatGPT o1 在利他關懷分數偏低,且回應一致性最弱; DeepSeek-V3 表現出高度規則服從與謙遜,傾向中規中矩、創意性較低的任務;Llama 與 Grok 2 則較具有創造力、對於規則服從程度低,可能較適合創意發想、開放式任務。

以下是研究結果的各模型人設特質:

  • GPT-4.5 :展現仁慈、普世性、自我導向等平衡特質,整體穩定性佳。
  • Claude(Haiku) :在謙遜、普世性與思想自我導向方面表現突出,適合人文導向任務。
  • Mistral :高度遵守規則且穩定,適合制度性強的環境。
  • DeepSeek-V3 :所有模型中最遵守規則者,但自我導向低,創意表現有限、靈活性較低,適用需要高度遵守規則的工作。
  • Llama :思想與行動自主性高,創造力強,對規則重視度低,適合自由發想、腦力激盪的應用場景。
  • Grok 2(Fun Mode) :重視刺激與娛樂,規則意識低且較不穩定,適合輕鬆互動、創意的情境。
  • Gemini :關懷程度與自我導向都極低,適合追求中性、控制性輸出的場景。
AI模型擬人
根據研究分析出的AI模型人設,使用ChatGPT生成擬人化的對應形象。
圖/ ChatGPT

研究一再強調,LLM 所展現的價值觀並不具道德主體性,而是資料與系統設計所反映的內容。由於模型受限於訓練數據的不透明性與開發者設計的防火牆限制,表現的行為可能無法真實反映內在傾向。再者,提示工程對結果的影響極大,也讓價值觀表現波動變化。

然而,即便如此,這些價值傾向依然可作為企業或開發者的參考依據。例如,如果應用需求偏重創造性與發散思考,Llama 或 Grok 2 可能較為適合;反之,任務屬於高標準、規範嚴格的產業,如醫療或金融,選擇Mistral 或 DeepSeek-V3 較具優勢。

有了性格後,LLM會有偏見嗎?

除了人設之外,史丹佛大學的研究團隊在去年底進行了一項測驗,探討「各種LLM的回答是否具有一致性」,也就是當同一個問題被重新改寫、翻譯成不同語言時,模型是否會給予大致相同的答案。

結果發現, 雖然GPT-4、Claude 等主流模型在處理中性主題時表現穩定,像是感恩節,但是在墮胎、安樂死等具爭議性的議題上,各模型的回答出現高度差異

研究指出,這樣的結果反而說明 LLM 並非具有固定偏見的道德偏好,只是反映出訓練資料來源與模性設計的差異。換言之,模型的「立場」是來自它所學習的網路內容與開發者設定,而非擁有自主的道德判斷。

團隊最後建議,未來模型的設計應該加入「價值多元性」,避免只輸出單一立場,進而建立更負責任與倫理的 AI 應用環境。

延伸閱讀:Z世代正放下鍵盤,拿起工具!不會被AI取代、有做就有錢:有哪些超夯藍領工作?

資料來源:AI Ait LabHAI

本文初稿為AI編撰,整理.編輯/ 蘇柔瑋

關鍵字: #ai人工智慧
往下滑看下一篇文章
當 Agentic AI、碎片化與地緣政治正重塑數位世界,我們該如何重構下一代網路的「數位信任」?
當 Agentic AI、碎片化與地緣政治正重塑數位世界,我們該如何重構下一代網路的「數位信任」?

面對人工智慧(AI)應用的爆發與地緣政治風險的升高,數位環境正迎來「信任」與「韌性」的雙重嚴峻考驗。為了回應這些挑戰,財團法人台灣網路資訊中心(TWNIC)舉辦首屆「 Internet Week 2026(網路週)」,大會串聯數位發展部(moda)、國家通訊傳播委員會(NCC)、亞太網路資訊中心(APNIC)、網際網路名稱與號碼分配機構(ICANN)、臺灣網路治理論壇(TWIGF)及台灣網路維運社群(TWNOG)等國內外指標社群與國際組織,整合多個重要論壇並展開 4 天共 66 場主題議程。

Internet Week 2026 希望透過公、私部門、國際組織與技術社群的跨界溝通,讓政府、私人企業、國際組織、技術社群與公民團體力量在同一個平台上對話。大會不僅期盼建立一個開放、中立且多元的對話空間,更致力於帶動信任的溝通,藉此強化台灣在國際網路治理舞台的實質影響力與能見度,共築具備數位韌性與信任的未來。

身分識別不等於信任,碎片化才是真正危機

「身分識別(Identity)並不等於信任(Trust)。」Edgemoor 研究中心執行長 Steve Crocker 在會後專訪中,拋出這句耐人尋味的觀察。

身為 ARPANET 時代的重要參與者,他見證網際網路從學術研究網路,逐漸演變為全球最重要的數位基礎設施。然而,在地緣政治與各國法規分歧的今天,他認為網際網路正面臨前所未有的碎片化挑戰。「在價值觀、法規與司法管轄權都不同的情況下,我們如何依然維持全球的互通與信任?」Crocker 點出了他的觀察。他指出,未來的數位治理不可能再依賴單一規則或中央權威,而是必須建立在全球共用框架與在地化決策並存的架構上。

技術機制能全球互通,但各國仍應保有政策調整的空間。這樣的治理思維,也體現在 Crocker 近年推動的「 Project Jake 」計畫。隨著歐盟「一般資料保護規則」(General Data Protection Regulation,GDPR)等隱私法規上路,過去廣泛用於網路犯罪調查的 Whois 網域註冊資料系統,已陷入隱私與公共利益的兩難。Project Jake 則嘗試建立新的跨境資料存取機制,而 TWNIC 更是全球首個主動參與試點的機構。值得注意的是,面對近年區塊鏈與替代性網域名稱系統(Alternative DNS)興起的聲浪,Crocker 直言這往往是為不存在的問題,提供昂貴的解方。

他強調,網際網路真正的韌性來自長年建立的「分散式協作」與「相互依存」。「網際網路從來不是中央控制系統,而是一個 network of networks。」在他看來,與其重新建立彼此割裂的替代架構,不如持續深化跨國透明協作與多方治理,才是維持全球網路信任最務實的方式。

Steve Crocker 總裁暨執行長
Edgemoor 研究中心執行長 Steve Crocker
圖/ 數位時代

借鏡歐洲《數位服務法》,用「個人問責」重新定義公共利益

如果 Steve Crocker 談的是「基礎設施的信任」,那麼 Jeremy Godfrey 所關注的,則是平台與 AI 對公共利益的衝擊。Godfrey 直言,當前數位平台最大的問題,並不只是單一內容真假,而是整個商業模式正持續放大社會風險。「數位市場並不一定會自然產生對社會最有利的結果。」

長期管理 Meta、X、TikTok 等跨國平台歐洲監管事務的他指出,當平台以廣告收益與流量作為核心目標時,演算法往往會傾向放大更具爭議性與成癮性的內容,進一步衝擊民主討論、兒少保護與社會信任。Godfrey 強調,當數位治理開始涉及言論自由、人類尊嚴與選舉公平等基本人權時,社會不能再將權利平衡的責任,完全交由商業平台自行決定。這也是歐洲近年積極推動《數位服務法》(Digital Services Act,DSA)的原因。除要求大型平台管控系統性風險外,愛爾蘭也進一步要求平台落實年齡驗證、限制向未成年人推播有害內容,並強化企業內部的「個人問責制」。

不過,在 Godfrey 看來,未來治理不該只是被動「減少傷害」,而是重新思考整體數位生態系。「我們不該在創新與安全之間二選一,而是同時追求兩者。」他認為,當 AI 與平台逐漸成為社會基礎設施的一部分,治理的核心已不再只是技術,而是如何讓「信任、安全、權利保障與經濟價值」彼此共存,重新建立數位社會的公共利益與信任基礎。

不用 AI 不代表更安全,溫水煮青蛙的轉型危機

而當 AI 與平台逐漸成為社會基礎設施的一部分,治理核心將更專注在技術快速演進下,如何重新建立企業、政府與社會的信任能力。「AI 已經從回答問題,進入執行任務(Action)。」行政院經濟發展委員會創新經濟顧問簡立峰指出,當前 AI 已具備規劃與執行能力,正逐步接手知識型工作的核心流程。

這波由代理型 AI(Agentic AI)帶動的變革,首當其衝的正是白領階級;企業接下來面對的不僅是「流程再造」,更是深度的「職能再造」。然而簡立峰也警告,台灣正面臨一場「溫水煮青蛙」的轉型危機。由於國內高端服務業多屬內需市場,企業導入 AI 往往只停留在讓工作變快,卻未真正翻轉核心競爭力做到更聰明。在全球市場,企業已開始不再大量招募初階知識工作者,而是亟需能與 AI 協作、重新定義問題的人才。

「不用 AI 並不能代表更安全。」面對外界對 AI 資安與風險的焦慮,簡立峰提出極具衝擊性的觀點。他以開車為例,車子不開出門固然不會出車禍,但也等於永遠失去移動的能力。真正的數位治理並非全面防堵,而是在實際使用中建立防護。他呼籲,政府必須比以往更積極地導入 AI,「如果政府自己不用 AI,就沒有能力治理 AI,只有 AI 才能監管 AI。」他以「矛與盾」來比喻,強調面對新型態的數位犯罪,必須建立如「AI 警察」般的防禦機制;唯有善用 AI 作為測試與除錯的工具,才能精準揪出系統漏洞,也就是「以 AI 來監管 AI」。

而在治理與技術外,最後的防線仍回歸到「人」。簡立峰強調,未來的教育必須從單向的教導轉為引導,全面培養全民的「AI 識讀能力(AI literacy)」,讓人們在真假難辨的環境中,具備獨立思辨與理解風險的能力。唯有如此,才能在 AI 深度滲透的社會中,建立穩固的信任機制。

行政院經濟發展委員會創新經濟顧問簡立峰
行政院經濟發展委員會創新經濟顧問簡立峰
圖/ 數位時代

多元共融與韌性實踐,為建立信任數位社會的基石

「現在最大的問題,已經不是網路快不快,而是人們還敢不敢相信這個網路。」TWNIC 董事暨執行長余若凡說到,AI 時代的數位信任不只是技術問題,更是場需全社會參與的治理工程。為此,TWNIC 正從純粹的技術社群,轉型為「信任環境驅動者」,致力打造讓人願意信任與參與的數位生態系。

余若凡指出,建立數位信任必須從三個層次著手。首先是「技術面」的基礎設施韌性,如落實 DNS 濫用防治與域名安全;其次是「治理面」的規範設計,探討 AI 與內容監理的平衡;最後,也是最關鍵的「社會協作」。她強調:只有當大家願意對話,信任才有可能被建立。

推動信任對話的同時,多元共融更是韌性實踐的關鍵。談及大會的「Taiwan Tech Women」論壇,余若凡坦言儘管台灣性別平權具指標性,科技業決策圈的女性比例依然偏低。但 AI 時代的不確定性,反而成為女性突破框架的契機。結合與談專家觀點,未來面對複雜的地緣政治與科技風險,企業亟需兼顧社會、科技與公共利益的「生態系領導力(Ecosystem Leadership)」。而女性特有的同理心與跨域溝通耐心,將成為這種多方協調的關鍵需求能力。

「最大的成功,是未來我們不再需要舉辦 Taiwan Tech Woman 這樣的論壇。」余若凡更期許。當性別不再是評價標準,多元聲音成為數位治理的日常,才是真正穩固的信任底座。

TWNIC董事暨執行長余若凡
TWNIC董事暨執行長余若凡
圖/ 數位時代

綜觀 Internet Week 2026 中各界專家的深刻洞見,網路的未來早已演變為一場涵蓋法規監理、人權保障、經濟創新與社會共融的環境。面對全球網路的破碎化危機與AI帶來的雙面刃效應,單憑政府或單一企業已無法獨力應對。「公私協力」與「開放對話」將是迎向未知挑戰的解方。藉由這些跨界對話與激盪,台灣向國際展現了落實「多方利害關係人治理模式」的決心與實質能量。期許在產官學研及公民社會的共同努力下,能持續深化國際網路治理的影響力,在下個網路世代中穩健前行,共築兼具數位韌性與信任的美好未來。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
代理式商務連動百兆商機
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓