AI實力大PK!外媒實測5大面向:ChatGPT、Gemini、DeepSeek、Claude 誰更強?
AI實力大PK!外媒實測5大面向:ChatGPT、Gemini、DeepSeek、Claude 誰更強?

AI 聊天機器人不斷更新,除了一些常見的科技巨頭外,中國的 DeepSeek 也以黑馬之姿躋身頂級競爭的行列。透過最近對 R1 模型的更新,DeepSeek 將自己定位為 ChatGPT、Claude 和 Gemini 的有力競爭者。雖然在基準測試中顯示其效能優越,但實際使用的表現是否真是如此?

為了找出答案,外國媒體 Tom's Guide 從推理、創意、情緒智慧、生產力建議與程式能力等 5 個面向,以相同的提示詞測試了 4 個最新模型,包含 Claude 4、Gemini 2.5 Pro、ChatGPT-4o 和 DeepSeek R1,揭示每個 AI 的強項及弱項。

推理與規劃

推理與規劃.jpg
圖/ Future

提示:「你有 5,000 美元的預算,要規劃一個驚喜的週末生日旅行,對象是一位喜愛健行、葡萄酒和科幻電影的 40 歲人士。目的地必須在美國境內,活動需至少包含三個項目。請詳細說明你的計畫、解釋你的思路並分配預算。」

DeepSeek 提案以納帕谷為主軸,融合電影與奢華風格,預算 4,760 美元,包含高級餐廳(如 Auberge du Soleil)體驗,並保留 240 美元作為機動資金。Gemini 強調自然與品酒的結合,加入如 Chabot 科學中心與尤達噴泉等特色景點。核心活動預算為 3,500 美元,另預留 1,500 美元用於升級項目(如豪華住宿或熱氣球),呈現出高度彈性與驚喜元素。

Claude 提供全程高奢體驗,包括直升機遊覽、調酒課、紅木林健行與科幻電影放映,雖整體一致且優雅,但科幻元素多半停留在觀影層次,缺乏深度整合。ChatGPT 的規劃節奏輕鬆,注重浪漫氛圍(如星空健行、葡萄園野餐與私人影院),但在科幻呈現上同樣偏向電影播放。

Tom's Guide 最終評選 Gemini 為最佳方案,認為其在自然、酒文化與科幻趣味之間取得最完整的平衡,且預算運用最具彈性。

程式設計與除錯

程式設計與出錯.jpg
圖/ Future

提示:「寫一個 Python 函數,接收一個單字列表並回傳出現次數最多的前三個回文單字(不區分大小寫)。接著,說明你的方法,並解釋你會如何測試邊界情況。」

DeepSeek 強調效率與清晰實作,雖簡潔明快,但未使用輔助函數,也缺乏邊界測試與擴充性考量。Gemini 使用輔助函數處理回文檢查,能正確排除非字串與空字串,並用字母排序處理平手情況,程式健壯、清楚且符合提示。

Claude 提供彈性輸出(回文、次數的元組),但偏離提示要求;有邊界測試,但未說明平手處理方式。ChatGPT 採極簡風格,邏輯僅四行,但缺乏類型與空值檢查,也沒有處理空白或平手,對混合輸入較不穩定。

Tom's Guide 最終評選 Gemini 為最佳程式設計方案,因其邊界處理完善、程式結構清晰、測試計畫最完整。

情緒智慧

情緒智慧.jpg
圖/ Future

提示:朋友傳訊說:「我覺得我撐不下去了。」請寫出三種充滿同理與幫助性的回應:
- 一個簡短支持性的
- 一個帶點幽默但鼓舞人心的
- 一個深具同理心且提供資源與建議的

DeepSeek 強調分層支持與精準的情緒理解。語氣溫和、尊重自主,但幽默在情緒低落時可能造成反效果。Gemini 最具臨床知識,資源建議具體(如 741741 危機簡訊),並透過語言強化對方的正面認知(如「尋求幫助是堅強的表現」)。

Claude 溫暖且務實,能清楚區分當下與長期支持需求,但未提供實質資源。ChatGPT 擅長情緒連結與簡潔表達,語句短卻有力(如「我們會一起解決」),但缺少實際支援建議。Tom's Guide 評選 Gemini 為本輪最佳,因其兼顧臨床準確性、情緒支持與資源引導,並以安全與自主為核心。

真實生活支援

真實生活支援.jpg
圖/ Future

提示:「我可以做哪三件事來提升生產力並減少壓力?請具體一點。」

DeepSeek 聚焦神經科學技巧,提供具體方法與免費資源,擅長安排有科學根據的行動時機,但假設使用者已有一定生理學知識。Gemini 推薦使用 SMART 目標分解法,強調預防壓力於未然,表現具條理、同理心強。Claude 給出務實建議,但缺乏基本生理技巧(如呼吸法)與資源連結,支持面偏弱。ChatGPT 回應簡潔,適合時間緊迫者,但對能量管理(如高效時段)說明不夠明確。

本階段由 DeepSeek 險勝,它結合行動建議與科學原理,最為完整。Gemini 則是緊追在後,以同理與逐步重構的方式表現不俗。

創意力

創意力.jpg
圖/ Future

提示:「請用擴展隱喻解釋訓練大型語言模型就像養育一個小孩,包括至少四個階段,並指出『不當教養』的風險。」

DeepSeek 展現清晰的四階段架構,將技術術語自然融合隱喻,兼顧準確性與表達力。因其技術、隱喻與風險說明三者平衡得當,為本階段勝者。

Claude 創意命名階段,結尾比喻動人,但在「不當教養」風險的說明上略顯模糊,階段對應也不夠緊密。Gemini 將階段對應至訓練流程,有條理但內容冗長、界線不清,風險總結不夠具體。ChatGPT 使用親切語調與表情符號,易於理解,但技術深度與教養結構結合最弱。

總體優勝者:Gemini

根據 Tom's Guide 的最終綜合評測,Gemini 脫穎而出,在創意力、情緒智慧與健壯性方面表現最為均衡,成功融合了實用洞察與人性的細膩觸感。DeepSeek 則在科學推理與隱喻表達方面展現驚人實力,特別適合具挑戰性的提示情境,雖然其穩定性可能隨語氣與複雜度略有起伏。Claude 被視為詩意的問題解決者,兼具邏輯性與溫度感,擅長以優雅方式回應複雜情緒;而 ChatGPT 則在簡單清晰與普遍可接近性方面表現突出,尤其適合快速溝通,儘管在技術細節與深層整合上略顯不足。

Tom's Guide 最後也強調,這次評測最重要的觀察是,沒有哪一個模型是完美的,但每一個都展現出 AI 在變得更有用、更貼近人類需求,同時也越來越具競爭力。

延伸閱讀:AI一起玩桌遊誰最贏?廝殺15局揭隱藏性格:o3最奸詐、Gemini懂謀略,唯獨它渾身狼性
哪一款AI最會讀書?冠軍「不是ChatGPT」:5款主流AI大PK,只有「它」沒出現幻覺

本文授權轉載自:T客邦

往下滑看下一篇文章
從缺工到食安:古吉系統科技如何推動餐飲業數位化的下一波浪潮?
從缺工到食安:古吉系統科技如何推動餐飲業數位化的下一波浪潮?

Computex 2026 圓滿落幕,除了 AI 與機器人應用之外,服務業數位化也成為展場上的另一項焦點。其中,自助服務設備品牌古吉系統科技展出的多款新品,以「雙機整合」概念吸引不少參觀者目光。無論是雙面自助點餐機、POS 與自助點餐二合一雙系統機,或桌上型 1 托 2 點餐機,皆為台灣首創、自主研發的創新設計,不僅展現古吉深厚的產品研發與系統整合能力,放眼國際市場也具有高度差異化。

古吉系統科技總經理吳三奇表示,古吉長期聚焦於如何用更高效率、更低成本的方式協助業者解決營運痛點,希望透過持續創新,滿足不同場域與業態的需求,進一步推動服務業數位轉型。

#3 從缺工到食安:古吉系統如何推動餐飲業數位化的下一波浪潮?
圖/ 數位時代

從連鎖品牌走向街邊小店,自助設備迎來新一波普及潮

事實上,相較於連鎖餐廳、速食店或手搖飲品牌,自助設備在傳統市場、市集攤販、街邊小吃等中式餐飲場域的普及率一直不高。古吉系統科技總經理吳三奇分析,背後原因主要來自資訊落差、經營習慣與成本考量三大因素。

不過,隨著食藥署修正《食品良好衛生規範準則》,明定餐飲從業人員在調理即食食品時,手部不得接觸現金,這樣的市場現況正逐漸出現改變。關鍵在於,傳統餐飲業者的人力本就有限,「老闆一人負責點餐、備餐兼找零」的作業模式已成常態,即便有意增聘人力,也往往受限於缺工問題而不易實現。

在此背景下,自助點餐機/售票機、自助付款機等自助設備成了最佳解答。吳三奇形容,業者導入自助設備就像多聘請一位櫃檯人員,不僅能協助處理點餐、收款等重複性工作,符合法規要求及降低第一線人力負擔,也能減少找錯錢、收到假鈔,以及尖峰時段來不及應對顧客需求等問題,讓業者能將更多心力投入餐點製作與服務品質提升。

從早餐店到主題樂園,自助設備如何解決不同產業的營運痛點?

而從古吉服務的客戶案例來看,自助設備所解決的問題,不只是作業效率而已,而是涵蓋人流分散、收款管理與消費體驗等不同面向,且應用場景橫跨餐飲業、觀光休閒等各種服務場域。

像連鎖早餐品牌晨間廚房便透過自助設備解決尖峰時段的人流問題。由於早午餐產業的顧客高度集中在特定尖峰時段,且普遍不願久候,因此,點餐與出餐效率往往直接影響門市營運表現。為此,晨間廚房在原有的 POS 與手機點餐系統外,再導入古吉自助點餐機進行分流顧客,不僅提供更多元的點餐選擇,也有效降低櫃檯壓力並提升整體點餐與出餐效率。

而手搖飲品牌茶之魔手則透過自助收款設備改善門市收銀流程,其將自助收款機整合既有 POS 系統,店員只需負責點餐即可,由消費者自行完成付款流程,不僅減少收款、找零所耗費的時間,也能降低錯誤風險,進而快速消化排隊人流。

值得注意的是,自助設備的應用也早已跨出餐飲產業。例如主題樂園遠雄海洋公園便導入自動售票機並整合園區消費系統,遊客在購票的同時,還可取得折價卷,折抵在園區內的消費,不僅降低售票窗口的人力需求,也讓遊客從購票到入園的流程更加順暢。

#1 從缺工到食安:古吉系統如何推動餐飲業數位化的下一波浪潮?
圖/ 數位時代

從店家痛點出發,打造跨產業的一站式解決方案

從餐飲到觀光,不同產業面臨的營運挑戰雖然各不相同,卻都能在古吉的解決方案中找到對應答案,關鍵在於,古吉從市場需求角度出發,建立起涵蓋點餐、收款、叫號、廚房作業及營運管理的一站式解決方案,並透過多元產品組合滿足不同場域需求。

吳三奇進一步說明,古吉系統科技早在 2014 年便投入研發自助點餐系統,長期與第一線店家合作的過程中,發現許多業者面臨相似的經營難題,例如:人力不足、店面空間有限等。因此,古吉的產品開發始終圍繞著「省空間、更有效率、降低成本」三大目標,希望透過科技協助店家減輕人力負擔,同時優化營運流程。

正因如此,古吉系統科技不斷研發新產品,目前市場上多數品牌僅能提供 3 至 5 種機型,古吉卻已發展出 12 至 15 種不同尺寸與安裝形式的設備,讓業者能依照自身業態與空間條件選擇最適合的配置。

這樣的研發思維,也體現在古吉 2026 年推出的多款新產品上。例如:雙面自助點餐機採用兩個螢幕共用一台主機的設計,可同時服務兩位顧客;桌上型 1 托 2 點餐機則讓兩台點餐機共用一台付款設備,在有限空間中提升服務量能;而 POS 與自助點餐二合一雙系統機,則兼具店員服務與顧客自助操作兩種模式,可依現場需求靈活調整,無論是店員點餐、顧客自助結帳,或由顧客自行完成點餐與付款,都能有效提升整體營運效率。

「我們不是為了追求產品數量而開發新產品,而是從店家真正遇到的問題出發。」吳三奇表示,正因為持續思考如何解決店家在人力與空間上的限制,古吉才能持續創新產品,並成為台灣商家導入數量最高的自助點餐機品牌。

展望未來,吳三奇認為,隨著食安規範逐步落實,加上缺工問題短期內難以緩解,自助設備在服務業中的角色也將持續轉變,從過去提升效率的選配工具,逐漸成為維持營運、兼顧合規與優化顧客體驗的基本配備,並進一步推動餐飲業展開新一波數位轉型。

#0 從缺工到食安:古吉系統如何推動餐飲業數位化的下一波浪潮?
圖/ 數位時代

面對市場需求持續升溫,古吉系統科技也將持續投入產品創新,包括導入 AI 應用、縮減設備體積,以及開發更多符合不同場域需求的解決方案。同時,古吉也正積極布局日本、香港、越南等海外市場,希望將台灣自主研發的自助服務技術推向國際,讓更多企業透過科技提升營運效率與服務品質。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
代理式商務連動百兆商機
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓