哪一款AI最會讀書?冠軍「不是ChatGPT」:5款主流AI大PK,只有「它」沒出現幻覺
哪一款AI最會讀書?冠軍「不是ChatGPT」:5款主流AI大PK,只有「它」沒出現幻覺

重點一:AI閱讀實測中,Claude以無「幻覺」的穩定表現奪冠,ChatGPT緊追在後,但整體AI得分偏低。

重點二:各家AI在文學、法律、科學及政治等不同領域的理解能力參差不齊,表現不一。

重點三:專家認為AI目前尚無法取代人類閱讀,尤其在重要文件處理上,僅能作為輔助工具。

時間來到2025年,生成式AI出現許多主打資料整合的功能,例如Google旗下的Notebook LM,抑或是各家推出的Deep Research功能皆然,其仰賴的都是AI模型的「閱讀能力」,以及輸入資料後的推理能力。

針對當前五款主流AI模型的閱讀能力 ,《華盛頓郵報》的實測結果顯示,由Anthropic公司開發的Claude表現最出色,在總體評分中奪冠,也是唯一未出現「幻覺」(hallucination,指AI捏造資訊)的AI,第二名則是OpenAI旗下的ChatGPT。

先說結論,撇除分數評級的高低,《華盛頓郵報》測試結果顯示,當前AI在深度理解與分析上仍有顯著不足,整體平均得分僅約70%,相當於學術評級中的D+,顯示AI的閱讀理解能力仍有極大進步空間。

AI閱讀各有所長:Claude擅長法律、ChatGPT較懂文學

《華盛頓郵報》本次評估了包含Claude、ChatGPT、Copilot、Meta AI,以及Google的Gemini五款AI。測試範圍涵蓋文學小說、法律合約、醫學研究及政治演說四大領域,並由各領域專家對AI的回答進行盲評,其結果如下:

文學領域:ChatGPT 7.8;Claude 7.3;Meta AI 4.3;Copilot 3.5;Gemini 2.3。
法律領域:Claude 6.9;Gemini 6.1;Copilot 5.4;ChatGPT 5.3;Meta AI 2.6。
健康科學領域:Claude 7.7;ChatGPT 7.2;Copilot 7;Gemini 6.5;Meta AI 6。
政治領域:ChatGPT 7.2;Claude 6.2;Meta AI 5.2;Gemini 5;Copilot 3.7。

總體得分而言:

Claude:69.9
ChatGPT:68.4
Gemini:49.7
Copilot:49
Meta AI:45

總結來說,Claude以些微分差勝過ChatGPT,至於Gemini、Copilot、Meta AI,則落於50分以下評級。值得一提的是,Claude為唯一未產生幻覺的AI。

本次測試的文件,在文學方面為小說《The Jackal’s Mistress》、在醫學方面為COVID-19、帕金森氏症的醫學論文、在法律方面為租賃協議及建築承包合約,在政治領域則為川普的演講文件。

結果顯示,AI在不同專業領域的表現差異甚大。例如,ChatGPT在文學和政治類別中表現較佳,但在法律文件的理解上則落後;Claude則在法律和健康科學領域取得最高分。

然而,即使是表現最好的Claude,其在文學領域的評分也非頂尖,而Gemini在文學理解方面,甚至出現了被評審形容為「不準確、誤導且草率」的解讀,甚至有種企圖矇混過關的感覺。

值得注意的是,除了Claude,其餘四款AI均在測試中出現了程度不一的資訊捏造情況。這證實了AI閱讀長文的能力仍有限,故生成摘要常有遺漏重要資訊,或過度強調正面內容而忽略負面細節的問題。

註1:原文測試時間為2025年4月至5月,所使用的AI版本為:ChatGPT-4o、Gemini 2.0 Flash、Claude 3 Sonnet、Llama 4、Copilot for Microsoft 365。

註2:評審對每個AI答案進行10分制評分,每個學科領域的得分是所有評分的平均值。總分為四個學科領域賦予同等權重,並以100分制呈現。

專家總結:AI難取代真人閱讀

儘管部分AI在特定分析性問題上展現出令人驚豔的能力,例如ChatGPT總結小說的摘要及書評,或是Claude對修訂法律文件提出的建議、協助產出醫學論文的洞察等。但整體而言,專家們對當前AI的閱讀理解能力仍持謹慎態度。

例如參與評審的企業律師Sterling Miller指出,AI在法律文件處理上的表現不夠穩定,尚不能替代專業律師;小說家Chris Bohjalian則表示,AI的回答有時像是「戴著人類面具的機器人」,假裝理解實則不然。

至於主持測試的記者則建議,若要使用AI協助閱讀,最好同時使用至少兩款工具進行比較,並且對於攸關個人權益的重要文件,仍應親自仔細閱讀。

總地來說,AI目前可作為一種輔助工具,例如協助快速掌握新主題、解讀專業術語,但不應完全依賴其結果。

延伸閱讀:中華電信不配被信任?一文解析「Google撤銷憑證」關鍵點:背後隱藏3大管理缺失
補強電商物流的關鍵拼圖:第三方物流是什麼?4大超商取貨戰力、業績一次看

責任編輯:李先泰

本文初稿為AI編撰,整理.編輯/ 李先泰

資料來源:華盛頓郵報

關鍵字: #Google #meta #openai
往下滑看下一篇文章
從缺工到食安:古吉系統科技如何推動餐飲業數位化的下一波浪潮?
從缺工到食安:古吉系統科技如何推動餐飲業數位化的下一波浪潮?

Computex 2026 圓滿落幕,除了 AI 與機器人應用之外,服務業數位化也成為展場上的另一項焦點。其中,自助服務設備品牌古吉系統科技展出的多款新品,以「雙機整合」概念吸引不少參觀者目光。無論是雙面自助點餐機、POS 與自助點餐二合一雙系統機,或桌上型 1 托 2 點餐機,皆為台灣首創、自主研發的創新設計,不僅展現古吉深厚的產品研發與系統整合能力,放眼國際市場也具有高度差異化。

古吉系統科技總經理吳三奇表示,古吉長期聚焦於如何用更高效率、更低成本的方式協助業者解決營運痛點,希望透過持續創新,滿足不同場域與業態的需求,進一步推動服務業數位轉型。

#3 從缺工到食安:古吉系統如何推動餐飲業數位化的下一波浪潮?
圖/ 數位時代

從連鎖品牌走向街邊小店,自助設備迎來新一波普及潮

事實上,相較於連鎖餐廳、速食店或手搖飲品牌,自助設備在傳統市場、市集攤販、街邊小吃等中式餐飲場域的普及率一直不高。古吉系統科技總經理吳三奇分析,背後原因主要來自資訊落差、經營習慣與成本考量三大因素。

不過,隨著食藥署修正《食品良好衛生規範準則》,明定餐飲從業人員在調理即食食品時,手部不得接觸現金,這樣的市場現況正逐漸出現改變。關鍵在於,傳統餐飲業者的人力本就有限,「老闆一人負責點餐、備餐兼找零」的作業模式已成常態,即便有意增聘人力,也往往受限於缺工問題而不易實現。

在此背景下,自助點餐機/售票機、自助付款機等自助設備成了最佳解答。吳三奇形容,業者導入自助設備就像多聘請一位櫃檯人員,不僅能協助處理點餐、收款等重複性工作,符合法規要求及降低第一線人力負擔,也能減少找錯錢、收到假鈔,以及尖峰時段來不及應對顧客需求等問題,讓業者能將更多心力投入餐點製作與服務品質提升。

從早餐店到主題樂園,自助設備如何解決不同產業的營運痛點?

而從古吉服務的客戶案例來看,自助設備所解決的問題,不只是作業效率而已,而是涵蓋人流分散、收款管理與消費體驗等不同面向,且應用場景橫跨餐飲業、觀光休閒等各種服務場域。

像連鎖早餐品牌晨間廚房便透過自助設備解決尖峰時段的人流問題。由於早午餐產業的顧客高度集中在特定尖峰時段,且普遍不願久候,因此,點餐與出餐效率往往直接影響門市營運表現。為此,晨間廚房在原有的 POS 與手機點餐系統外,再導入古吉自助點餐機進行分流顧客,不僅提供更多元的點餐選擇,也有效降低櫃檯壓力並提升整體點餐與出餐效率。

而手搖飲品牌茶之魔手則透過自助收款設備改善門市收銀流程,其將自助收款機整合既有 POS 系統,店員只需負責點餐即可,由消費者自行完成付款流程,不僅減少收款、找零所耗費的時間,也能降低錯誤風險,進而快速消化排隊人流。

值得注意的是,自助設備的應用也早已跨出餐飲產業。例如主題樂園遠雄海洋公園便導入自動售票機並整合園區消費系統,遊客在購票的同時,還可取得折價卷,折抵在園區內的消費,不僅降低售票窗口的人力需求,也讓遊客從購票到入園的流程更加順暢。

#1 從缺工到食安:古吉系統如何推動餐飲業數位化的下一波浪潮?
圖/ 數位時代

從店家痛點出發,打造跨產業的一站式解決方案

從餐飲到觀光,不同產業面臨的營運挑戰雖然各不相同,卻都能在古吉的解決方案中找到對應答案,關鍵在於,古吉從市場需求角度出發,建立起涵蓋點餐、收款、叫號、廚房作業及營運管理的一站式解決方案,並透過多元產品組合滿足不同場域需求。

吳三奇進一步說明,古吉系統科技早在 2014 年便投入研發自助點餐系統,長期與第一線店家合作的過程中,發現許多業者面臨相似的經營難題,例如:人力不足、店面空間有限等。因此,古吉的產品開發始終圍繞著「省空間、更有效率、降低成本」三大目標,希望透過科技協助店家減輕人力負擔,同時優化營運流程。

正因如此,古吉系統科技不斷研發新產品,目前市場上多數品牌僅能提供 3 至 5 種機型,古吉卻已發展出 12 至 15 種不同尺寸與安裝形式的設備,讓業者能依照自身業態與空間條件選擇最適合的配置。

這樣的研發思維,也體現在古吉 2026 年推出的多款新產品上。例如:雙面自助點餐機採用兩個螢幕共用一台主機的設計,可同時服務兩位顧客;桌上型 1 托 2 點餐機則讓兩台點餐機共用一台付款設備,在有限空間中提升服務量能;而 POS 與自助點餐二合一雙系統機,則兼具店員服務與顧客自助操作兩種模式,可依現場需求靈活調整,無論是店員點餐、顧客自助結帳,或由顧客自行完成點餐與付款,都能有效提升整體營運效率。

「我們不是為了追求產品數量而開發新產品,而是從店家真正遇到的問題出發。」吳三奇表示,正因為持續思考如何解決店家在人力與空間上的限制,古吉才能持續創新產品,並成為台灣商家導入數量最高的自助點餐機品牌。

展望未來,吳三奇認為,隨著食安規範逐步落實,加上缺工問題短期內難以緩解,自助設備在服務業中的角色也將持續轉變,從過去提升效率的選配工具,逐漸成為維持營運、兼顧合規與優化顧客體驗的基本配備,並進一步推動餐飲業展開新一波數位轉型。

#0 從缺工到食安:古吉系統如何推動餐飲業數位化的下一波浪潮?
圖/ 數位時代

面對市場需求持續升溫,古吉系統科技也將持續投入產品創新,包括導入 AI 應用、縮減設備體積,以及開發更多符合不同場域需求的解決方案。同時,古吉也正積極布局日本、香港、越南等海外市場,希望將台灣自主研發的自助服務技術推向國際,讓更多企業透過科技提升營運效率與服務品質。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
代理式商務連動百兆商機
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓