AI寫信比人類更得體?研究揭「扮演HR」實測:AI比人類更懂溝通藝術,但寫不出超派咆哮信
AI寫信比人類更得體?研究揭「扮演HR」實測:AI比人類更懂溝通藝術,但寫不出超派咆哮信

請先想像以下的情境:

一名剛到職、公司很想留住的 L3 軟體工程師寫信來,要一間個人辦公室。公司規定個人辦公室只開放給 L4 以上主管,這件事沒得談。你是人資,必須回信拒絕,而且不能澆熄他剛進公司的熱情。

以上情境,是芝加哥大學團隊設計的遊戲「HR Simulator™」的第一關。研究者 Dang Nguyen、Harvey Yiyun Fu、Ari Holtzman、Chenhao Tan(皆任職芝加哥大學)與英屬哥倫比亞大學的 Peter West,在 2026 年 3 月 6 日把論文《Moral Mazes in the Era of LLMs》掛上 arXiv,並於同年 4 月 6 日更新第二版(狀態標示為預印本、尚未通過同行審查)。

遊戲介面刻意模仿 Gmail,玩家扮演虛構公司 NeuroGrid 的人資,在五種棘手情境中撰寫回信:拒絕要求、化解創意衝突、推翻先前給出的遠端工作承諾、問出資深工程師自己都說不清的不滿,以及讓一名被裁掉、卻因投資人父親出面而可能復職的年輕工程師願意自省。其中第 4 關可以是多輪往返,不是一封信就結束。

收信的角色、模擬後續發展、以及最後判定你過不過關的裁判,全部由 GPT-4o(2024-11-20 版本)扮演,依每一關專屬的評分標準表(研究上稱 rubric)判定成敗。

研究者分析超過 600 封人類與 LLM 寫的信,得到一個對人類不太體面的數字:在 GPT-4o 擔任裁判的條件下,人類寫的信跨五個關卡平均通關率 23.5%,Kimi K2 是 54%、Qwen 3 是 48%。中段模型 Gemini 2.5 Flash 與 GPT-4o 各 22%、Claude 3.5 Haiku 28%,與人類在同一個水準。

實驗設計
HR Simulator 的分工:人類玩家只負責寫信,收信、模擬後續、評分全由 AI 包辦,主要裁判是 GPT-4o。
圖/ Arxiv

這場考試真正在考什麼

論文標題借自社會學家 Robert Jackall 在 1988 年的著作《Moral Mazes》,那本書記錄的是企業裡不成文的溝通規則:說什麼不重要,怎麼說、何時說才重要。 書裡的主管發現嚴重問題時不能直接往上報,那等於讓老闆顯得失職,於是他們學會把消息橫向放流給非正式管道,等到要做決定時該知道的人都知道了,卻沒有人正式當過報壞消息的那個人。

對此論文寫得很直接:這種迂迴不是溝通失敗,這就是溝通本身。 可以說,人跟人溝通從來就是這麼內耗的事情。

換言之,職場書信的難處在於同一句話裡要同時做到互相拉扯的幾件事,溫暖但保持距離、明確但留有餘地。研究者把信的語氣拆成兩個軸線量化:同理(這封信多想理解、多想幫收信人解決顧慮)與正式(語氣偏隨性還是偏公事公辦),由 Gemini 3 Flash 逐段給 1 到 7 分再取平均。

結果是,LLM 寫的信高度集中在「高正式、高同理」那一格,人類的信則散得多。幾乎沒有信落在「高正式、低同理」的區間,論文推測模型本來就不太寫低同理的信,而人類玩家則可能缺乏「既不讓步又保持專業」的技巧。人類寫的低同理信通常同時也低正式,因為內容常常很衝、很敷衍,有時還帶著反覆失敗後的火氣。

但如果讓 LLM 改寫人類的信,整體上會把信推向高正式高同理那一格,原本離得越遠的,改動幅度越大。

人加 AI 常勝過人類,但不一定勝過純 AI

論文最容易被引用的結論是混合優勢:用 LLM 改寫人類寫的信,多數情況勝過人類自己寫。 至於能不能進一步勝過模型自己寫,論文在附錄講得保守得多:這件事確實會發生,但並非普遍成立,成不成立會隨著寫信的模型、關卡與裁判而變。

增益最大的是「人類搭配中段模型」,第 1 關裡,GPT-4o 與 Claude 3.5 Haiku 的通關率從 40% 一路拉到接近 100%。前段模型的增益比較溫和,Kimi K2 加上人類在第 2 關多了 25 個百分點,Qwen 3 加上人類在第 4 關多了 55 個百分點。論文把這個規律歸給「餘裕」:模型單獨寫就已經接近天花板時,改寫很難再往上疊。

更有意思的是研究者給出的解釋。他們另外標註了第三個維度「得體」(tact),它衡量的是溝通策略:這封信有沒有把話說過頭、留下後患。以第 1 關為例,得體的信會把重點放在開放式辦公的好處,不得體的信則想用降噪耳機這類表面福利補償對方。

把裁判 GPT-4o 最偏好的信抓出來看,它在第 1 關的得體區間落在 3.17 到 3.83 之間。人類的信平均 3.04,太不得體;Claude 是 4.28、Gemini 是 4.79,兩者都太得體。經 LLM 改寫後,Claude 版變成 3.89、Gemini 版變成 4.01,剛好落回區間附近,通關率也跟著跳升。反過來看,Qwen 的 3.28 與 Kimi 的 3.50 本來就在區間內,改寫就沒有額外好處。

大模型與小模型的分水嶺,是一句「你薪水比上一份高」

論文更值得拉出來的一段,是它換了裁判。emergent tact 這部分的分析共動用 10 個不同家族、不同規模的模型當裁判,GPT-4o 本身也是其中一員,強弱跨度從小型開源模型一路到當前第一梯隊。

第一個發現是,模型參數量越大或 Elo 分數越高(Elo 是借自西洋棋的排名方法,讓信兩兩比較、贏的加分),兩兩裁判之間對「這封信過不過關」的判斷就越一致,最強的一批達到約 0.5 的 Krippendorff's α,也就是校正過猜對機率之後的一致程度達到中等水準。

第二個發現才是關鍵。研究者把「兩個裁判給同一封信的排名相差 20 名以上」定義為分歧,發現絕大多數分歧發生在大模型與小模型之間,而非同級模型之間,而分歧的性質就是得體:小模型偏好直白、不那麼得體的信,大模型偏好含蓄、更得體的信。

這個現象論文命名為 emergent tact,直譯是浮現的得體。不過這是整體趨勢,不是普遍定律:落差在第 1、3、4 關比較明顯,論文附錄自承,得體定義在第 2、5 關沒能同樣解釋分歧。

具體是什麼樣的分歧?回到第 1 關那封拒絕信。玩家手上其實有一張說服牌,可以提到這位新人在新職位的薪水比前一份工作高,藉此喚起對方的感激,先一步堵住後續議價。但論文作者判定這個策略非常不得體、而且帶有被動攻擊性,而這正是大小模型的分水嶺:小模型偏好用了這招的信,大模型反感。

為確認這條線真的是「得體」,研究者另外用相近的「禮貌」標註同一批信,發現「禮貌」無法像「得體」那樣把大小模型分開。

AI難以寫出來的信:咆哮信

研究者還反過來問了一個問題:有沒有 LLM 寫不出來的信? 這個問題的測試對象只有一個模型,Qwen 3 30B 3A Instruct,目標是看它能不能寫出「低同理、低正式」的信(可以想像成投訴性質的咆哮信)。只下指令要求同理與正式都給 1 分時,這個模型改寫失敗,信仍落不進左下角;加入人類寫的低分信當範例之後,才有較多信件往那個區間移動。

但模型對人類寫的低分信困惑度(perplexity,大致是「模型看到這種寫法有多意外」,數字越高代表越不像它會產出的東西)極高,無範例時 38.96,有範例時仍有 10.80,而它對自己生成的低分信只有 2.38。範例大幅降低了困惑度,模型仍然很難模仿這種寫法。

論文為這一格說了句公道話:低同理低正式的信在企業裡看似不得體,換到別的情境卻有必要,例如投訴一間官僚積習很深的公司,可能只有把話說得很重才傳得進去。這種信人類自己也難拿捏,反而適合靠 LLM 協助編修,形成另一種人機互補。

結論:棘手信件怕失禮,給AI順一順沒壞處

總結來說,這篇論文真正的價值不在人類與 AI 的高下,而在它記錄了一件正在發生的事:讀信、篩信、判斷信寫得好不好的角色,正在換人。 研究者在結論寫道,若模型成為職場書信往來的核心,理解這個新地景很重要,才能確保職場溝通規範是被刻意選擇的結果,而不是被 LLM 的天性推著走。

23.5% 這個數字量到的,比較接近「人類多不擅長討好 GPT-4o」,未必是「人類多不會做人」。而當裁判換成能力較強的模型後,信件偏好可能從偏直白轉向偏含蓄,這意味著寫信的人如果開始為模型的品味調整寫法,很難保證讀信的人類感受真的會比較好。

那到底怎麼寫信最得體?論文給的路已經算務實:人先寫,AI 再改。人決定要不要打出那張說服牌,AI 把語氣調到不刺人。

延伸閱讀:黃仁勳兆元宴永遠站最後一排!最低調的二代鄭平,憑什麼讓台達電被市場重新定價?

本文初稿為AI編撰,整理.編輯/ 李先泰

關鍵字: #ai人工智慧
往下滑看下一篇文章
AI 時代的行動生產力:MSI 如何用「理解情境」的 Prestige 14 Flip AI+ 重新定義商務筆電與 Copilot+ PC?
AI 時代的行動生產力:MSI 如何用「理解情境」的 Prestige 14 Flip AI+ 重新定義商務筆電與 Copilot+ PC?

生成式人工智慧技術正以驚人速度滲透職場,從會議記錄、文件撰寫、資料搜尋、內容創作到跨國溝通,每位知識工作者都開始思考:「我懂得善用 AI 嗎?我的硬體跟得上生產力轉型嗎?」

在這樣的氛圍下,市場對 AI PC 的期待,已從單純搭載最新處理器,擴展到如何將 AI 算力、硬體設計與真實使用情境無縫整合。微星科技(MSI)最新推出的 Prestige 14 Flip AI+,正是專為商務菁英與專業人士打造的解方。它結合了微軟 Copilot+ PC 架構、本地端 AI 運算、2-in-1 翻轉設計、高畫質 OLED 顯示器與全天候續航力,讓 AI 真正流暢地融入日常工作流程。

微星科技(MSI)最新推出的 Prestige 14 Flip AI+,正是專為商務菁英與專業人士打造的解方,高畫質 OLED 顯示器與全天候續航力,讓 AI 真正流暢地融入日常工作流程。
微星科技(MSI)最新推出的 Prestige 14 Flip AI+,正是專為商務菁英與專業人士打造的解方,高畫質 OLED 顯示器與全天候續航力,讓 AI 真正流暢地融入日常工作流程。
圖/ 數位時代

AI PC 時代來臨:MSI Prestige 14 Flip AI+ 如何用地端AI算力重塑工作流?

許多經理人在更換電腦時常問:「AI PC 真的值得買嗎?」、「Copilot+ PC 到底能幫我做什麼?」答案不僅是運算跑得更快,而是將原先繁瑣、耗時的行政庶務變得更高效,並能確保商業機密不外洩。

MSI Prestige 14 Flip AI+ 搭載最新的 Intel® Core™ Ultra X7 處理器,擁有強大的神經處理單元(NPU),能提供優異的本地端 AI 運算能力,這意味著大量運算能透過筆電本身就能執行,大幅降低對雲端的依賴,確保企業敏感資料與客戶資安不外洩,同時兼顧資料處理的速度與能源效率。對於每天需要處理大量文件與郵件的商務人士來說,AI 不再只是網頁上的聊天工具,而是內建在系統底層的數位助手。Prestige 14 Flip AI+ 完美符合 Windows Copilot+ PC 架構認證,使用者可解鎖多項雲端無法執行的關鍵功能:

  • Windows Recal(回顧功能) : 用自然語言就能快速回溯、查找曾經瀏覽過的文件、合約或網頁內容。

  • Click to Do(點擊行動): 透過地端 NPU 對螢幕內容的即時理解,使用者只要按下快捷鍵,就能讓系統智慧偵測、分析,預測你的下一步行動,快速啟動後續工作流程。

  • 即時字幕翻譯(Live Captions): 打破語言壁壘,跨國視訊會議時,即時將多國語言翻譯為繁體中文。

  • AI 智慧搜尋: 不需要精確記住檔名或資料夾路徑,用自然語言就能從茫茫資料海中精準查找目標檔案。

除了微軟的生態系,MSI 更導入獨家研發的 MSI Center 中控軟體,其中「AI 智慧引擎」能自動偵測使用情境(如視訊會議、文書處理、影音播放等),主動調節各項硬體設定與效能表現,使用者無需動手調整參數,系統便能持續維持在最佳狀態。

#5 AI 時代的行動生產力:MSI 如何用「理解情境」的Prestige 14 Flip AI+重
Prestige 14 Flip AI+完美符合 Windows Copilot+ PC 架構認證,使用者可解鎖多項雲端無法執行的關鍵功能
圖/ 數位時代

四種模式自由切換,完美補足行動辦公的最後一哩路

用 AI 提升效率只是第一步,真正影響使用體驗的是,筆電與人互動的每一個細節。

Prestige 14 Flip AI+ 採用全新的精工設計,全鋁合金打造的纖薄機身搭配弧形圓角,重量僅 1.37 公斤,不僅兼具質感與耐用性,更讓長時間攜帶變得更加舒適。值得特別一提的是,它是一台符合行動工作需求的 2 in 1 AI 筆電,360 度翻轉設計搭配觸控 OLED 螢幕,可依照不同情境自由切換使用模式,完美對接商務工作者的四大工作場景:

  • 筆電模式: 16:10 黃金比例螢幕,高效率完成長篇文書與簡報製作。

  • 帳篷模式: 在高鐵或飛機上,不佔空間地觀看資料;或在小組討論時,方便多人同時觀看與分享內容。

  • 展示模式: 向客戶提案、展示簡報時,呈現最專業、無鍵盤干擾的視覺角度。

  • 平板模式: 搭配 MSI Nano Pen 多功能觸控筆,進行直覺的商務閱讀、手繪筆記、簽署電子合約。

#0 AI 時代的行動生產力:MSI 如何用「理解情境」的Prestige 14 Flip AI+重
Prestige 14 Flip AI+ 提供四種模式自由切換,360 度翻轉設計搭配觸控 OLED 螢幕,可依照不同情境自由切換使用模式,完美對接商務工作者的四大工作場景。
圖/ 數位時代

值得一提的是,Prestige 14 Flip AI+ 具備全方位的隨附的 MSI Nano Pen 多功能觸控筆同樣展現亮眼效率,充電僅需 13 秒即可使用約 45 分鐘,讓簽署文件、繪圖、筆記不再間斷;其次,加寬設計的觸控板支援多種快捷手勢,使用者除可快速啟動指定功能,也可以依照個人習慣自訂常用操作,大幅減少來回切換滑鼠與鍵盤的時間;至於螢幕方面, 14 吋 OLED 面板具備深邃黑色、高對比跟鮮豔色彩,無論是修圖、影音創作、Excel 分析還是長時間閱讀都享有舒適的觀看體驗,表面覆蓋的 Corning® Gorilla® 玻璃,不僅提升耐用性,也提供流暢、靈敏的觸控體驗。

#2 AI 時代的行動生產力:MSI 如何用「理解情境」的Prestige 14 Flip AI+重
MSI Nano Pen 具備快充優勢,充電 13 秒即可使用約 45 分鐘,讓創作與簽署不間斷;加寬觸控板則支援快捷手勢與個人化自訂,能大幅減少切換鍵鼠的時間,效率全面提升。
圖/ 數位時代

30 小時超長續航,打造行動辦公的黃金組合

對於頻繁移動的自由工作者、業務主管或新創創辦人而言,「電量焦慮」、「吵雜環境」是行動辦公的最大殺手。

MSI 深刻理解高階經理人的行動痛點,因此 Prestige 14 Flip AI+ 在如此纖薄機身中仍配備了 81 Wh 大容量電池,最高可提供 30 小時的續航力,並支援 100W PD 3.0 快充。即使一整天在外拜訪客戶、跨城市移動,也無需攜帶笨重的變壓器,徹底根除電量焦慮。

更重要的是, Prestige 14 Flip AI+ 配備三麥克風陣列,能清晰捕捉你的聲音層次與細節,獨家的 AI Noise Cancellation Pro 降噪技術則能智慧過濾背景雜音並強化定向收音,確保聲音清晰聚焦;搭配3D降噪視訊鏡頭,能確保最佳的視訊影像品質,無論身在何處都能以最優雅的姿態完成每場關鍵決策,真正實現隨時隨地、毫無後顧之憂的數位遊牧生活。

#3 AI 時代的行動生產力:MSI 如何用「理解情境」的Prestige 14 Flip AI+重
Prestige 14 Flip AI+ 搭載三麥克風陣列、AI 降噪與 3D 降噪鏡頭,完美鎖定人聲、消除雜音並提升畫質,讓你隨時隨地優雅遠端協作。
圖/ 數位時代

2026 年,經理人必備的 AI 行動生產力利器

總的來說,隨著 AI 成為知識工作者每天都會使用的服務,筆電選擇標準也開始改變:處理器速度固然重要,但真正決定工作效率的是,AI 能否自然融入工作流程、硬體功能是否符合各種使用情境,以及能否兼顧續航、資安與行動力等需求。

MSI的全新翻轉觸控商務筆電 –Prestige 14 Flip AI+– 並未將 AI 視為單一賣點,而是整合 Copilot PC+、本地端 AI 運算、MSI AI 智慧引擎、2 in 1 翻轉設計、MSI Nano Pen、OLED 螢幕與超長續航,提供使用者更完整且全面的 AI PC 體驗,更好滿足追求高效率的專業人士、需要隨時移動的自由工作者,以及期待以 AI 提升競爭力的新世代白領需求。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓