AI實力大PK!外媒實測5大面向:ChatGPT、Gemini、DeepSeek、Claude 誰更強?
AI實力大PK!外媒實測5大面向:ChatGPT、Gemini、DeepSeek、Claude 誰更強?

AI 聊天機器人不斷更新,除了一些常見的科技巨頭外,中國的 DeepSeek 也以黑馬之姿躋身頂級競爭的行列。透過最近對 R1 模型的更新,DeepSeek 將自己定位為 ChatGPT、Claude 和 Gemini 的有力競爭者。雖然在基準測試中顯示其效能優越,但實際使用的表現是否真是如此?

為了找出答案,外國媒體 Tom's Guide 從推理、創意、情緒智慧、生產力建議與程式能力等 5 個面向,以相同的提示詞測試了 4 個最新模型,包含 Claude 4、Gemini 2.5 Pro、ChatGPT-4o 和 DeepSeek R1,揭示每個 AI 的強項及弱項。

推理與規劃

推理與規劃.jpg
圖/ Future

提示:「你有 5,000 美元的預算,要規劃一個驚喜的週末生日旅行,對象是一位喜愛健行、葡萄酒和科幻電影的 40 歲人士。目的地必須在美國境內,活動需至少包含三個項目。請詳細說明你的計畫、解釋你的思路並分配預算。」

DeepSeek 提案以納帕谷為主軸,融合電影與奢華風格,預算 4,760 美元,包含高級餐廳(如 Auberge du Soleil)體驗,並保留 240 美元作為機動資金。Gemini 強調自然與品酒的結合,加入如 Chabot 科學中心與尤達噴泉等特色景點。核心活動預算為 3,500 美元,另預留 1,500 美元用於升級項目(如豪華住宿或熱氣球),呈現出高度彈性與驚喜元素。

Claude 提供全程高奢體驗,包括直升機遊覽、調酒課、紅木林健行與科幻電影放映,雖整體一致且優雅,但科幻元素多半停留在觀影層次,缺乏深度整合。ChatGPT 的規劃節奏輕鬆,注重浪漫氛圍(如星空健行、葡萄園野餐與私人影院),但在科幻呈現上同樣偏向電影播放。

Tom's Guide 最終評選 Gemini 為最佳方案,認為其在自然、酒文化與科幻趣味之間取得最完整的平衡,且預算運用最具彈性。

程式設計與除錯

程式設計與出錯.jpg
圖/ Future

提示:「寫一個 Python 函數,接收一個單字列表並回傳出現次數最多的前三個回文單字(不區分大小寫)。接著,說明你的方法,並解釋你會如何測試邊界情況。」

DeepSeek 強調效率與清晰實作,雖簡潔明快,但未使用輔助函數,也缺乏邊界測試與擴充性考量。Gemini 使用輔助函數處理回文檢查,能正確排除非字串與空字串,並用字母排序處理平手情況,程式健壯、清楚且符合提示。

Claude 提供彈性輸出(回文、次數的元組),但偏離提示要求;有邊界測試,但未說明平手處理方式。ChatGPT 採極簡風格,邏輯僅四行,但缺乏類型與空值檢查,也沒有處理空白或平手,對混合輸入較不穩定。

Tom's Guide 最終評選 Gemini 為最佳程式設計方案,因其邊界處理完善、程式結構清晰、測試計畫最完整。

情緒智慧

情緒智慧.jpg
圖/ Future

提示:朋友傳訊說:「我覺得我撐不下去了。」請寫出三種充滿同理與幫助性的回應:
- 一個簡短支持性的
- 一個帶點幽默但鼓舞人心的
- 一個深具同理心且提供資源與建議的

DeepSeek 強調分層支持與精準的情緒理解。語氣溫和、尊重自主,但幽默在情緒低落時可能造成反效果。Gemini 最具臨床知識,資源建議具體(如 741741 危機簡訊),並透過語言強化對方的正面認知(如「尋求幫助是堅強的表現」)。

Claude 溫暖且務實,能清楚區分當下與長期支持需求,但未提供實質資源。ChatGPT 擅長情緒連結與簡潔表達,語句短卻有力(如「我們會一起解決」),但缺少實際支援建議。Tom's Guide 評選 Gemini 為本輪最佳,因其兼顧臨床準確性、情緒支持與資源引導,並以安全與自主為核心。

真實生活支援

真實生活支援.jpg
圖/ Future

提示:「我可以做哪三件事來提升生產力並減少壓力?請具體一點。」

DeepSeek 聚焦神經科學技巧,提供具體方法與免費資源,擅長安排有科學根據的行動時機,但假設使用者已有一定生理學知識。Gemini 推薦使用 SMART 目標分解法,強調預防壓力於未然,表現具條理、同理心強。Claude 給出務實建議,但缺乏基本生理技巧(如呼吸法)與資源連結,支持面偏弱。ChatGPT 回應簡潔,適合時間緊迫者,但對能量管理(如高效時段)說明不夠明確。

本階段由 DeepSeek 險勝,它結合行動建議與科學原理,最為完整。Gemini 則是緊追在後,以同理與逐步重構的方式表現不俗。

創意力

創意力.jpg
圖/ Future

提示:「請用擴展隱喻解釋訓練大型語言模型就像養育一個小孩,包括至少四個階段,並指出『不當教養』的風險。」

DeepSeek 展現清晰的四階段架構,將技術術語自然融合隱喻,兼顧準確性與表達力。因其技術、隱喻與風險說明三者平衡得當,為本階段勝者。

Claude 創意命名階段,結尾比喻動人,但在「不當教養」風險的說明上略顯模糊,階段對應也不夠緊密。Gemini 將階段對應至訓練流程,有條理但內容冗長、界線不清,風險總結不夠具體。ChatGPT 使用親切語調與表情符號,易於理解,但技術深度與教養結構結合最弱。

總體優勝者:Gemini

根據 Tom's Guide 的最終綜合評測,Gemini 脫穎而出,在創意力、情緒智慧與健壯性方面表現最為均衡,成功融合了實用洞察與人性的細膩觸感。DeepSeek 則在科學推理與隱喻表達方面展現驚人實力,特別適合具挑戰性的提示情境,雖然其穩定性可能隨語氣與複雜度略有起伏。Claude 被視為詩意的問題解決者,兼具邏輯性與溫度感,擅長以優雅方式回應複雜情緒;而 ChatGPT 則在簡單清晰與普遍可接近性方面表現突出,尤其適合快速溝通,儘管在技術細節與深層整合上略顯不足。

Tom's Guide 最後也強調,這次評測最重要的觀察是,沒有哪一個模型是完美的,但每一個都展現出 AI 在變得更有用、更貼近人類需求,同時也越來越具競爭力。

延伸閱讀:AI一起玩桌遊誰最贏?廝殺15局揭隱藏性格:o3最奸詐、Gemini懂謀略,唯獨它渾身狼性
哪一款AI最會讀書?冠軍「不是ChatGPT」:5款主流AI大PK,只有「它」沒出現幻覺

本文授權轉載自:T客邦

往下滑看下一篇文章
思科:打造智慧轉型韌性基礎的關鍵 人才培育與科技
思科:打造智慧轉型韌性基礎的關鍵 人才培育與科技

人工智慧(AI)正以前所未有的姿態重塑全球政府與企業的數位轉型藍圖,帶來一場深刻的變革。這股浪潮不僅預示著效率與生產力的巨大躍升,同時也為組織帶來嚴峻挑戰。如何駕馭 AI、確保資訊安全、並同時兼顧永續發展,成為當今各國政府與企業亟需面對的核心課題。在這樣一個充滿挑戰與無限機會的時代,全球網路與資安科技大廠思科(Cisco),憑藉其完整的產業生態系和豐富的跨國合作經驗,正積極扮演關鍵的賦能者角色,所推動的台灣數位加速計畫(Taiwan Digital Acceleration, TDA)也已邁入3.0階段。思科認為,值此時刻組織需要為數位轉型建立具韌性的基礎,而關鍵不只是科技,更重要的是人才培育。

AI雖解決人力短缺問題 但人員更需學習駕馭AI

負責思科國家數位加速計畫(CDA),與多國政府密切合作的思科全球資深副總裁暨全球創新長Guy Diedrich,談到當今各國政府與企業正在面臨融合著AI、資安與永續發展的數位轉型趨勢,而在此過程中關鍵的是,組織必須透過科技與培育人才來為此波轉型打造具韌性的基礎。

思科
思科全球資深副總裁暨全球創新長Guy Diedrich
圖/ 思科

Diedrich進一步表示,未來的職位已不再是用職務說明書來衡量,而是以工作流程為核心,人力會在不同階段介接不同科技,可能是AI、機器人、人形機器人甚至量子電腦,因此人力與科技的整合也特別重要。思科台灣總經理林岳田也舉例,過去在地端、雲端網路設備有各自的管理平台,未來除了將化繁為簡整合為單一平台外,許多資料搜集比對的例行工作由AI取代,但關鍵的決策判斷仍會交由人力負責,因此培育員工學習AI也更加不可或缺。

過去從TDA 1.0計畫推動至今,透過思科網路學院(Cisco Networking Academy),思科與合作夥伴已經在台灣培育超過17萬名技術人才。提供從網路工程師認證(CCNA)、網路高級工程師(CCNP)到網路專家(CCIE)等,針對不同職務與層級完整的專業培訓,而去年剛推出針對AI架構的網路設計專家(CCDE-AI Infrastructure)認證,在市場上更是炙手可熱。Diedrich強調,未來學習將成為工作中的一部份,持續在職訓練才能確保人員跟上技術的快速發展。

林岳田也指出,思科致力於人才培育不遺餘力,並從多方面投注資源。包括目前已在台灣的北、南、東部區域成立思科網路學院教師培訓中心,作為推動各區域人才培訓的種子基地。同時,思科與合作夥伴晉泰科技在2025年於高雄成立「亞灣AIOT生態系發展基地暨研發中心」,目標是培育5,000名AIOT人才並協助 1,500 人取得國際認證,以解決目前產業智慧轉型卻求才若渴的窘境。而在政府公部門方面,思科近期與國家資通安全研究院 (簡稱「資安院」) 合作「NPO資安共學計畫」,由思科網路學院 (Cisco Networking Academy) 提供課程與平台資源,資安院負責在地招募與社群經營,共同構築永續的公益資安生態系。

思科
思科台灣總經理林岳田
圖/ 思科

完整生態系整合多元科技 一同推動AI創新

數位轉型另一項重要關鍵就是科技,尤其當今企業都在思考如何利用AI推動創新。思科與18家合作夥伴,從TDA 1.0到3.0計畫,共同實踐30個創新專案。其中TDA 1.0著重智慧城市、企業 5G專網、資訊安全和數位醫療照護等核心領域,奠定數位轉型基礎;TDA 2.0計畫除了延續並深化前述智慧城市與智慧交通,也因應新冠疫情下的醫療照護需求,為長者提供遠距學習、遠距醫療等樂齡生活應用,同時拓展金融韌性等創新場景。而在離岸風電計畫中,更利用5G結合VR眼鏡解決方案,協助當時因為疫情封控而無法來台支援的國外風機維護工程師,進行遠距教育訓練。

而TDA 3.0計畫中聚焦永續發展、資安韌性和AI驅動的智慧轉型,其中指標性專案之一,便是以高雄港為場域的智慧港口解決方案。提供從貨輪進港到貨櫃卸貨、起重機遠端操作監控等全自動化營運,可提升人員工作效率並確保安全。同時此方案中也兼顧永續發展需求,透過感測器可將各種機具設備的碳排資料回傳,完整監控能源使用情形。

人員短缺不只是運輸業也是許多產業共同面臨的難題,思科與合作夥伴針對醫院推出行動醫療推車,就是利用AIOT、無線/有線網路整合結合Webex視訊系統等,能協助遠端醫師迅速掌握病情,在第一時間提供專業判斷,或協助護理師迅速正確完成數據輸入工作。思科全球副總裁黃志明也強調,科技的運用更重要的是化繁為簡,透過整合算力、網路、資安與儲存功能的AI PODs一體機伺服器,讓許多TDA 3.0專案能專注於應用開發,加速落地部署。

黃志明進一步表示,思科能協助企業導入部署各項AI創新方案,得力於生態系中有擅長應用開發、技術架構、顧問諮詢等不同領域的合作夥伴,彼此在開放、包容的平台上運作,因此能協助企業加速智慧轉型並提升企業價值。

思科
思科全球副總裁黃志明
圖/ 思科

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
蘋果能再次偉大?
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓