AI助理新聞摘要錯誤率達45%!BBC研究:Gemini引用品質最差、年輕世代盲信恐釀媒體信任危機
AI助理新聞摘要錯誤率達45%!BBC研究:Gemini引用品質最差、年輕世代盲信恐釀媒體信任危機
##### AI助理新聞摘要錯誤率達45%! > **重點一:** 跨國大規模研究顯示,AI助理對新聞內容的表述有高達 45% 的錯誤,此系統性問題無關語言或平台,恐危及大眾信任。 > **重點二:** 4大主流 AI 平台中,Gemini 的表現最差,有 76% 的回覆存在重大問題,主因是其引用來源的品質不佳。 > **重點三:** 儘管錯誤率高,但仍有許多閱聽人(尤其年輕族群)信任 AI 助理提供的新聞摘要,且AI發生錯誤時認為新聞機構責無旁貸。

歐洲廣播聯盟(EBU)、英國廣播公司(BBC)近期公布一項大型跨國研究《AI 助理在新聞中的使用與認知》,揭發AI助理在處理新聞內容時,存在嚴重的系統性錯誤。

這項橫跨 18個國家、涵蓋 14 種語言的調查顯示,無論使用哪種語言、地區或平台, ChatGPT、Copilot、Gemini 或 Perplexity等AI 助理在回覆新聞相關問題時,高達 45% 的內容至少存在一個重大錯誤,其中,31%的內容在辨識、引用或連結所使用的原始資訊來源時出現錯誤,而20%的內容含有「重大準確性問題」,包括AI幻覺或引用過時資訊

如今有愈來愈多人使用AI 助理作為獲取資訊的主要入口, 特別是 25 歲以下族群中有 15% 就使用 AI 助理看新聞 。高錯誤率不僅威脅到新聞內容的準確性,更可能動搖民眾對新聞媒體乃至民主參與的信任。

EBU 媒體總監暨副總幹事德・騰德(Jean Philip De Tender)強調,這些錯誤並非單一事件,而是「跨越國界和多語言的系統性問題」,大眾若無法信任資訊來源,最終將「什麼都不信」。

觀察一:4大平台表現評比,Gemini 來源引用最棘手

這項研究評估了 ChatGPT、Copilot、Gemini 和 Perplexity 4大主流 AI 助理平台共 3,000 多個回覆,根據準確性、來源引用、事實與觀點的區分,以及提供背景資訊等關鍵標準進行評估。

結果顯示,錯誤的分布在不同平台間存在顯著差異, 其中 Gemini 的表現最為不佳,有 76% 的回覆被判定存在重大問題,這個比率是其他 AI 助理的2倍以上 。主要症結在於 Gemini 糟糕的「來源引用」表現,整體調查中,有 31% 的回覆存在嚴重來源問題,包括引用來源遺失、具誤導性或根本錯誤。

BBC 生成式 AI 專案總監亞契(Peter Archer)表示,雖然樂見 AI 帶來的價值,但大眾必須能夠信任他們所閱讀、觀看和聽到的內容,並願意與 AI 公司合作,共同解決這些明顯存在的重大問題。

觀察二:4大AI錯誤類型,「事實錯誤」最損信任感

為了深入了解錯誤對大眾信任的實際影響,研究測試了4種常見的 AI 錯誤類型,包括事實錯誤(Factual Errors)、觀點作為事實呈現(Opinion as Fact)、來源與歸屬錯誤(Sourcing Errors)和自行加入觀點(Introduction of Opinions)。 結果表明,所有錯誤都會嚴重損害用戶的信心,其中事實錯誤最具破壞力。

高達 84% 的英國成年人表示,事實錯誤(如日期、數字不準確)將對他們對 AI 摘要的信任產生重大影響,因為準確性是用戶對新聞內容最基本的底線。

觀點作為事實呈現類型中,有 81% 的人認為這會嚴重損害信任,因其破壞了公正性讓用戶感覺 AI 系統在選邊站或有隱藏偏見。

即使是更為技術性的來源與歸屬錯誤(如錯誤引用新聞機構),也有 76% 的人表示會破壞信任,讓人質疑內容真實性。

當 AI 助理自行加入原始報導中沒有的觀點時,模糊了報導與評論的界線,有 73% 的人會因此對其信任大打折扣。

報告強調,在大家習慣快速瀏覽資訊的時代,任何一個小錯誤,都會在用戶心中留下負面印象。

觀察三:AI 錯誤回應闖禍,媒體恐背連坐黑鍋

這項研究還揭露了一個對新聞媒體來說很頭痛的問題:當AI發生錯誤時,閱聽人不僅會責怪 AI 服務提供商,也會將矛頭指向新聞提供者。

許多人錯誤地假定 AI 助理提供的新聞摘要是準確的。在英國成年人中,超過三分之一新信AI 能產生準確的摘要,而在 35 歲以下的年輕族群中,這個比例更攀升至近一半。

而當AI內容出現錯誤時,大多數英國成年人認為 AI 服務提供商 (36%) 和政府/監管機構 (31%) 應負責確保 AI 回覆的準確性。

即使錯誤是由 AI 摘要生成所致,仍有 23% 的人認為「新聞提供商」應該為與他們名稱相關聯的內容負責,有 35% 的人本能地同意新聞來源就該為 AI 摘要中的錯誤負責。 這些都表明 AI 助理的失誤,可能連帶對新聞媒體的信譽造成負面影響,即使錯誤並非新聞機構所致。

報告也指出,若想恢復民眾的信任,AI 平台必須提供清楚的來源、時間和連結,並且一旦修正錯誤,要確保在所有地方都能同步更新,避免讓新聞媒體成為 AI 錯誤的替罪羔羊。

AI新聞摘要仍是演算法,動搖新聞品牌信任度

這份報告警告 AI 摘要中立的可靠表象創造了用戶的盲點。由演算法帶來的虛假確定性,導致用戶在接收資訊時鬆懈了查證的本能。

如果這種情況持續,AI 的系統性錯誤不僅會讓用戶失去對技術本身的信任,還可能悄悄侵蝕用戶對整體新聞品牌的可信度與信任感,最終對整個新聞環境造成負面衝擊。

延伸閱讀:好險,AI文章還沒有占據你的世界!AI文章數量與人寫文章曾出現「黃金交叉」,現在呈55波
「只懂古典物理的LLM,無法提出相對論!」學者解密AI思維鏈:為何光寫提示詞,配不上「工程」兩字?

資料來源:BBC

本文初稿為AI編撰,整理.編輯/ 蘇柔瑋

往下滑看下一篇文章
人人用 AI,訊息更分散?普羅品牌顧問「Process 2.0」助企業建品牌 AI 助理、精準溝通驅動成長
人人用 AI,訊息更分散?普羅品牌顧問「Process 2.0」助企業建品牌 AI 助理、精準溝通驅動成長

自 2022 年底 ChatGPT 引爆生成式 AI 浪潮以來,企業競相導入 AI 加速內容產出,效率看似提升,品牌訊息破碎化與品質失控的風險卻也隨之浮現。行銷、客服、業務各自運用 AI 工具產出文案,語氣與規範逐漸失去統一標準,消費者接收到的品牌形象因此愈趨模糊。

「一旦 AI 成為人人可及的工具,它本身幾乎不再是差異化的因素。真正的差異,不在於技術本身,而在於企業如何運用它。」Process 普羅品牌顧問創辦人 Martin Kessler 指出,長期來看,勝出的不會是使用最強大 AI 的企業,而是那些將品牌定位得足夠清晰、即使在技術趨於同質化的情況下依然與眾不同的企業。「AI 正成為常態,但唯有強大的品牌,才具備真正的競爭優勢。」

普羅品牌顧問-2.JPG
Process 普羅品牌顧問創辦人 Martin Kessler。
圖/ 數位時代

如何運用 AI 加快內容產出速度,並同時兼顧品牌信任所需要的一致水準,這是 1995 年創立於瑞士蘇黎世的普羅品牌顧問,近年積極思考的問題。為此,普羅提出「Process 2.0」服務,將顧問角色從建立品牌策略,延伸到協助企業建立可持續運作的品牌溝通系統。

「Process 2.0」服務:提升企業品牌溝通力

Process 普羅品牌顧問台北分公司總經理洪翠霞觀察,品牌訊息之所以失焦,關鍵在於策略完成後,仍缺乏一套持續運作的溝通系統銜接執行。她將這種落差歸納為五種斷層:

首先,一旦策略完成後未能落實到日常工作,便形成策略斷層。同時,當品牌理解過度仰賴少數主管,一旦人員異動,傳承便隨之中斷,造成轉譯斷層。

在執行面上,各部門對外溝通的語氣逐漸分散不一致,也會有語氣斷層的問題;內容產出雖多,卻缺乏共同標準判斷是否符合品牌,則是驗證斷層。最後,所有品牌知識散落各處、未被系統化管理,導致治理斷層,也讓最初的策略價值難以發揮效果。

這五個斷層背後,指涉的是同一個關鍵。也就是品牌策略與實際執行之間,少了一套能夠持續運作的品牌溝通系統。

普羅品牌顧問-3.jpg
Process 普羅品牌顧問台北分公司總經理 洪翠霞。
圖/ 數位時代

為此,普羅開發出「Process 2.0」解方,從三個階段解決落差。首先,從「Brand Strategy」出發,先釐清品牌的定位與價值主張;接著才是「Brand Communication System」,將策略轉化為跨部門可依循的語言規則;最後則是「AI Brand Communication」,把品牌知識整合進安全可控的 AI 工作環境,讓行銷、業務、客服、人資,乃至海外代理商,都能基於統一的品牌基準產出內容,並持續進行審核與知識更新。

「AI 內容產出速度已遠遠超過品牌治理速度,品牌基礎若模糊不清,AI 只會更快放大既有的問題。」洪翠霞強調,AI 時代讓斷層問題更加明顯,因此她也期待透過「Process 2.0」品牌專屬 AI 助理,延伸顧問影響力,幫助品牌長期把關、一同成長。

品牌力 + AI:打造品牌專屬 AI Agent

為實現「Process 2.0」,普羅攜手愛酷智能科技(AccuHit)將品牌策略、知識與 AI 技術整合,協助企業建立專屬品牌 AI 助理。

愛酷智能科技(AccuHit)執行長林庭箴指出,「Process 2.0」鎖定的是品牌再造:AI 除了應用在企業內部流程,還能如何用在品牌溝通面。他分析,當電商進入超微利的時代,零售產業正走向三個不可逆的趨勢,包括:到 2030 年,將有五成消費行為由 AI 協助完成,商品資料必須完整到能讓 AI 讀懂;其次是超個人化,信任愈稀缺,推薦卻必須愈貼近個人需求這件事將更挑戰;第三,則是預測型消費將持續增加。

普羅品牌顧問-4.JPG
AccuHit 執行長 林庭箴。
圖/ 數位時代

尤其,在非零售場域,品牌溢價更為關鍵,因為品牌價值與品牌溝通內容不只要讓消費者理解,也要讓 AI 讀懂,才能持續發揮影響力。不過,當企業想要運用 AI 做行銷卻沒想像中容易。林庭箴強調,企業 AI 最大的挑戰,多半集中在機敏資料的存取與管理層面。

因此在「Process 2.0」的開發協作上,普羅負責定義場景,AccuHit 則提供技術與產品面支援,將品牌規範與知識納入 Gen AI 系統,讓所有輸出都能經過品質控管,如同 AI 版本的品牌指南,確保每一次輸出都建立在信任與安全之上。

目前品元實業、昇昇膠業等品牌已導入試用這項服務工具,無論是行銷內容撰寫、客服回覆、產品諮詢或內部教育訓練,皆能依據統一的品牌規範,輸出兼具效率與品質的內容。

Brand-to-Revenue:探索成長新引擎

根據台經院發布的《2026 台灣企業品牌力大調查》,過去五年(2021 至 2025 年)收集的 1,167 家企業數據顯示,台灣企業普遍呈現「內強外弱」的品牌結構。也就是品牌定位與內部管理已具基礎,但對外溝通與價值主張,如品牌好感度與互動性,卻相對薄弱,導致多數企業雖有高重複購買率,卻缺乏品牌溢價能力與市場認同。

對此,台灣品牌耀飛計畫小組副主任朱俐穎指出,「Process 2.0」的目標,是協助企業建構可落地的溝通能力,最終讓品牌策略實質驅動營收成長。

她以多年輔導近千家品牌企業的經驗為例,企業經過品牌輔導後,形象全面升級、設計語言更聚焦,市場識別度也隨之提升。她觀察,品牌塑造的成果平均在一至兩年後開始發酵,客戶能明顯感受到不同:「以往客戶只是單純買產品,但有了品牌之後,就多了願景與合作想像,能吸引其他企業一起創新共榮。」

普羅品牌顧問-5.jpg
台灣品牌耀飛計畫小組副主任 朱俐穎。
圖/ 數位時代

AI 的本質就像一面放大鏡:品牌定位清楚,AI 能加速轉譯、提升溝通效率;定位模糊甚至混亂,AI 也會同步放大這份混亂,後果難以收拾。品牌梳理是否到位,決定了 AI 是阻力還是助力。

為協助企業及早驗證成效,普羅已推出「60 天品牌成長試用計畫」,讓企業在正式導入「Process 2.0」前展開深度合作,鎖定成長機會。從 Made in Taiwan 到 Trusted Taiwan Brand,信任,才是品牌溢價的關鍵。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓