AI助理新聞摘要錯誤率達45%!BBC研究:Gemini引用品質最差、年輕世代盲信恐釀媒體信任危機
AI助理新聞摘要錯誤率達45%!BBC研究:Gemini引用品質最差、年輕世代盲信恐釀媒體信任危機
##### AI助理新聞摘要錯誤率達45%! > **重點一:** 跨國大規模研究顯示,AI助理對新聞內容的表述有高達 45% 的錯誤,此系統性問題無關語言或平台,恐危及大眾信任。 > **重點二:** 4大主流 AI 平台中,Gemini 的表現最差,有 76% 的回覆存在重大問題,主因是其引用來源的品質不佳。 > **重點三:** 儘管錯誤率高,但仍有許多閱聽人(尤其年輕族群)信任 AI 助理提供的新聞摘要,且AI發生錯誤時認為新聞機構責無旁貸。

歐洲廣播聯盟(EBU)、英國廣播公司(BBC)近期公布一項大型跨國研究《AI 助理在新聞中的使用與認知》,揭發AI助理在處理新聞內容時,存在嚴重的系統性錯誤。

這項橫跨 18個國家、涵蓋 14 種語言的調查顯示,無論使用哪種語言、地區或平台, ChatGPT、Copilot、Gemini 或 Perplexity等AI 助理在回覆新聞相關問題時,高達 45% 的內容至少存在一個重大錯誤,其中,31%的內容在辨識、引用或連結所使用的原始資訊來源時出現錯誤,而20%的內容含有「重大準確性問題」,包括AI幻覺或引用過時資訊

如今有愈來愈多人使用AI 助理作為獲取資訊的主要入口, 特別是 25 歲以下族群中有 15% 就使用 AI 助理看新聞 。高錯誤率不僅威脅到新聞內容的準確性,更可能動搖民眾對新聞媒體乃至民主參與的信任。

EBU 媒體總監暨副總幹事德・騰德(Jean Philip De Tender)強調,這些錯誤並非單一事件,而是「跨越國界和多語言的系統性問題」,大眾若無法信任資訊來源,最終將「什麼都不信」。

觀察一:4大平台表現評比,Gemini 來源引用最棘手

這項研究評估了 ChatGPT、Copilot、Gemini 和 Perplexity 4大主流 AI 助理平台共 3,000 多個回覆,根據準確性、來源引用、事實與觀點的區分,以及提供背景資訊等關鍵標準進行評估。

結果顯示,錯誤的分布在不同平台間存在顯著差異, 其中 Gemini 的表現最為不佳,有 76% 的回覆被判定存在重大問題,這個比率是其他 AI 助理的2倍以上 。主要症結在於 Gemini 糟糕的「來源引用」表現,整體調查中,有 31% 的回覆存在嚴重來源問題,包括引用來源遺失、具誤導性或根本錯誤。

BBC 生成式 AI 專案總監亞契(Peter Archer)表示,雖然樂見 AI 帶來的價值,但大眾必須能夠信任他們所閱讀、觀看和聽到的內容,並願意與 AI 公司合作,共同解決這些明顯存在的重大問題。

觀察二:4大AI錯誤類型,「事實錯誤」最損信任感

為了深入了解錯誤對大眾信任的實際影響,研究測試了4種常見的 AI 錯誤類型,包括事實錯誤(Factual Errors)、觀點作為事實呈現(Opinion as Fact)、來源與歸屬錯誤(Sourcing Errors)和自行加入觀點(Introduction of Opinions)。 結果表明,所有錯誤都會嚴重損害用戶的信心,其中事實錯誤最具破壞力。

高達 84% 的英國成年人表示,事實錯誤(如日期、數字不準確)將對他們對 AI 摘要的信任產生重大影響,因為準確性是用戶對新聞內容最基本的底線。

觀點作為事實呈現類型中,有 81% 的人認為這會嚴重損害信任,因其破壞了公正性讓用戶感覺 AI 系統在選邊站或有隱藏偏見。

即使是更為技術性的來源與歸屬錯誤(如錯誤引用新聞機構),也有 76% 的人表示會破壞信任,讓人質疑內容真實性。

當 AI 助理自行加入原始報導中沒有的觀點時,模糊了報導與評論的界線,有 73% 的人會因此對其信任大打折扣。

報告強調,在大家習慣快速瀏覽資訊的時代,任何一個小錯誤,都會在用戶心中留下負面印象。

觀察三:AI 錯誤回應闖禍,媒體恐背連坐黑鍋

這項研究還揭露了一個對新聞媒體來說很頭痛的問題:當AI發生錯誤時,閱聽人不僅會責怪 AI 服務提供商,也會將矛頭指向新聞提供者。

許多人錯誤地假定 AI 助理提供的新聞摘要是準確的。在英國成年人中,超過三分之一新信AI 能產生準確的摘要,而在 35 歲以下的年輕族群中,這個比例更攀升至近一半。

而當AI內容出現錯誤時,大多數英國成年人認為 AI 服務提供商 (36%) 和政府/監管機構 (31%) 應負責確保 AI 回覆的準確性。

即使錯誤是由 AI 摘要生成所致,仍有 23% 的人認為「新聞提供商」應該為與他們名稱相關聯的內容負責,有 35% 的人本能地同意新聞來源就該為 AI 摘要中的錯誤負責。 這些都表明 AI 助理的失誤,可能連帶對新聞媒體的信譽造成負面影響,即使錯誤並非新聞機構所致。

報告也指出,若想恢復民眾的信任,AI 平台必須提供清楚的來源、時間和連結,並且一旦修正錯誤,要確保在所有地方都能同步更新,避免讓新聞媒體成為 AI 錯誤的替罪羔羊。

AI新聞摘要仍是演算法,動搖新聞品牌信任度

這份報告警告 AI 摘要中立的可靠表象創造了用戶的盲點。由演算法帶來的虛假確定性,導致用戶在接收資訊時鬆懈了查證的本能。

如果這種情況持續,AI 的系統性錯誤不僅會讓用戶失去對技術本身的信任,還可能悄悄侵蝕用戶對整體新聞品牌的可信度與信任感,最終對整個新聞環境造成負面衝擊。

延伸閱讀:好險,AI文章還沒有占據你的世界!AI文章數量與人寫文章曾出現「黃金交叉」,現在呈55波
「只懂古典物理的LLM,無法提出相對論!」學者解密AI思維鏈:為何光寫提示詞,配不上「工程」兩字?

資料來源:BBC

本文初稿為AI編撰,整理.編輯/ 蘇柔瑋

往下滑看下一篇文章
核保、理賠、客服全面AI化:富邦人壽導入「三大智能助理」升級保險服務鏈
核保、理賠、客服全面AI化:富邦人壽導入「三大智能助理」升級保險服務鏈

近年談 AI 轉型的金融業者不少,多半從技術切入,闡述架構藍圖與導入策略。富邦人壽則選擇從行政端著手,先問哪個場景最攸關保戶,再決定 AI 該往哪裡導入。「關鍵在於回歸以人為本的核心,專注於客戶體驗。」保單行政處處主管蔡佳蓉副總經理指出,核保、理賠與客服,是服務價值鏈中與保戶互動最直接的三大關鍵,自然成為富邦人壽 AI 布局的起點。

以 AI 賦能核保,審查時間省六成

開始一張保單的旅程,核保是第一步,攸關保戶是否能儘速取得保障。投保過程中,若涉及既有病史或體況,核保便須介入評估,綜合審視商品條款、投保規則與法律規範,以決定是否承保,可說是一項高度專業的決策工程。

「以一份新契約為例,客戶的病歷資料可能厚達百頁。核保員得逐頁翻找診斷紀錄、用藥史與手術紀錄,判斷其對承保的影響。但大多數核保人員並不具備醫護背景,這方面的專業判斷力全靠長期經驗積累,導致傳統作業十分耗時。」蔡佳蓉解釋。

為此,富邦人壽建構「核保智能助理」,運用生成式 AI 摘要病歷,解決過往判讀大量專業英文病歷的痛點。這可不是把資料丟進 AI 資料庫就好——蔡佳蓉分享,導入過程中的挑戰之一,是為特種個資去識別化,需先透過個資遮罩工具處理病歷;此外,針對 AI 常見的「幻覺」風險,團隊也反覆調校提示詞,讓摘要報告力求精準正確。

她強調, AI 定位為「初篩與重點整理」的助手,最終決策權仍歸於核保員。透過 AI 摘要、核保員決策的人機協作模式,體況審查平均作業時間成功從 40 分鐘縮短至 15 分鐘,核保效率提升六成,讓核保同仁能將心力集中於高風險案件與例外處理。

以 AI 輔助判讀,加速理賠條款今昔對照

同樣面對大量資料判讀挑戰的,還有理賠。理賠是保險公司實踐承諾、展現服務價值的重要時刻,但隨著醫療技術不斷進步,許多保單條款當年訂定的手術項目,到了今天可能已發展出全新的治療方式。理賠人員需要從大量醫療資料中,判斷新技術是否符合條款約定,過程相當耗時,也需要高度的醫療專業知識。

對此,富邦人壽導入「理賠智能助理」,整合醫療資訊與內部顧問醫師的專業意見,協助理賠人員快速比對保單條款與客戶所接受治療的對應關係。例如,當醫療科技演進產生新的手術方式時,AI 可協助理賠人員快速了解該疾病與手術的進行方式,並檢索相關條款與內部規則,提供理賠判斷建議,縮短過去需逐一查找資料的時間。此外,系統亦能協助摘錄擷取診斷書、病理報告及醫療費用單據等理賠文件審核重點,大幅縮短人工判讀比對時間,讓理賠人員更專注於專業判斷與保戶溝通,加速理賠服務效率與一致性。

客戶服務處處主管張婉茹指出:「AI 除了加速理賠作業,也能將資深理賠人員的專業經驗與判斷邏輯濃縮為高效吸收的知識庫,協助新進同仁快速掌握案件重點與判斷依據,縮短學習曲線,並提升理賠判斷的一致性與品質。」透過 AI 助理減輕資料整理的負擔,理賠人員得以將精力回歸專業決策與客戶溝通。

以 AI 客服加速分流,前線服務更到位

在核保與理賠之外,最大量的服務場景是客服。張婉茹表示,隨著數位原生世代逐漸成為保戶主力,客戶傾向先自主操作解決問題,不會直接撥打電話;一旦選擇撥打電話,就代表問題已超出自助服務能處理的範圍。

對此,AI 客服的導入,不只是回答問題,更是協助客戶找到最適合服務管道的「智慧導航員」。「我們是第一線面對客戶,因此 AI 客服最重要的不是回答得多,而是回答得正確。」張婉茹表示,富邦人壽在設計上特別重視回答來源的可信度,透過既有知識庫與 FAQ 資料治理機制,讓 AI 優先扮演「理解需求、引導服務」的角色,確保保戶獲得正確且一致的資訊。

事實上,富邦人壽的文字客服早於大型語言模型盛行前便已上線,目前文字客服平均每月處理超過六萬則訊息,智能助理能即時理解客戶需求,將保單查詢、資料變更等簡易服務導引至 App 或線上平台快速完成;面對理賠、保單變更或保障內容等較複雜的需求,則由真人客服接手提供專業協助。讓簡單問題快速解決、複雜問題由專人服務,將有限的人力資源投入最需要專業與溫度的服務情境,讓分流機制發揮實際成效。

從核保員手中的病歷、理賠人員桌上的單據,到線上客服的迅速回應,富邦人壽的 AI 布局,始終緊貼第一線作業現場。張婉茹表示,科技發展不一定要一次 end to end 全到位,應該是不停小步快跑,慢慢把應用場景擴大。去年底推出的全新富邦人壽 App,將「簡單、貼心、隨行」的理念落實在使用者介面體驗上,就是一次階段性集大成的成果。

但無論 AI 如何加速資料判讀、優化流程,專業判斷與服務溫度仍是機器無法取代的核心。「要有專業,才能判斷 AI 的產出品質。」富邦人壽兩位主管也強調,科技迅速發展下,富邦人壽導入 AI,不是要取代核保員、理賠人員或客服人員,而是希望讓每一位同仁把時間花在最有價值的地方。當AI承接了流程中繁瑣的資料負荷,人員就能更專注在判斷、溝通與服務,讓同仁的專業與心力回歸到最需要判斷力與人情味的溝通之上,這才是真正以客戶為中心的 AI 轉型。也是富邦人壽實現「AI Everywhere」的旅途上不忘的目標。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓