誰是AI數學解題之王?Gemini、ChatGPT奧林匹克賽都摘金,誰更接近頂尖天才高中生?
誰是AI數學解題之王?Gemini、ChatGPT奧林匹克賽都摘金,誰更接近頂尖天才高中生?

重點一:Google DeepMind 的 Gemini Deep Think AI 模型於 2025 年國際數學奧林匹亞(IMO)以自然語言直接解題,獲得金牌標準,成為首批獲官方認證的 AI 系統之一。

重點二:Google的Gemini大型語言模型透過「深度思考」功能及強化學習,正確解答六題中的五題。而最難的第六題,全體630名參賽學生中僅有5名學生解題成功。

重點三:該AI模型將先由數學家測試,未來預計納入Google AI Ultra訂閱服務,進一步推向市場。

Google母公司Alphabet旗下AI研究部門 Google DeepMind 宣布,其開發的人工智慧模型在國際數學奧林匹亞 (International Mathematical Olympiad, IMO) 競賽中,成功摘下金牌。

國際數學奧林匹亞是一項面向高中生的著名數學競賽,每個參賽國家派出六名選手,必須在4.5小時內解答六題。2025年共有630名參賽者,排名前半的參賽者獲得獎牌,而只有頂尖的前8%選手、共67人獲得金牌。

這項成就的關鍵在於,Gemini Deep Think AI 是在與全球頂尖高中生完全相同的競賽條件與評分標準下完成挑戰,成功在六道題目中解出五道(解題過程請點我),獲得總分35分(滿分42分),證明其已具備世界一流的複雜數學推理能力。去年,GoogleDeepMind的AlphaProof和AlphaGeometry 2系統組合取得了銀牌,解決了六個問題中的四個,獲得了28分。

Google數學模型.jpeg
Google今年採用Gemini Deep Think AI 參與IMO競賽,結果優於去年的AlphaProof和AlphaGeometry 2系統組合。
圖/ Google

有趣的是,OpenAI研究員Alexander Wei日前才在X上發文指出,OpenAI最新的實驗性語言模型在 也在國際數學奧林匹亞正確解答了六題中的五題,達到金牌水準。

執行長Sam Altman 則稱這一成就是 AI 發展十年來的重要里程碑,但強調這種「金牌級」能力的模型短期內不會公開。

因此,Google此番高調宣布金牌,再加上宣布該模型未來將納入Google AI Ultra,與OpenAI隔空較勁的意味十分濃厚。

Gemini能以自然語言理解題目,AI數學家教要來了?

更關鍵的是,雖然Gemini跟OpenAI的實驗模型在數學解題上都達到了IMO金牌水準, 但OpenAI的評鑑方式是由一群前IMO獎牌得主進行獨立評分,而非在官方競賽框架下進行 。相較之下,Google的AI直接面對官方試題,並在4.5小時的時限內完成作答,其結果的公正性與可比性更勝一籌。

此次參賽的AI是以 Gemini 系列大型語言模型為核心,並搭載了今年五月發布的 Deep Think 功能。此技術使其能夠模擬人類思緒,同時生成並評估多種解題路徑,最終整合出最佳答案。

為了訓練AI的數學能力,Google採用了強化學習 (reinforcement learning) 技術,並利用包含高品質數學解題過程、甚至是解題技巧與提示的特製資料庫進行訓練,使其能處理橫跨代數、組合數學、幾何與數論等領域的複雜證明題。

白話來說, Gemini Deep Think AI 能夠直接用自然語言(像人類一樣的英文敘述)理解和解答數學題目,不需要先把題目轉換成專業的電腦語言。而採用「平行推理」技術,意思是同時思考多種解題方法,最後選出最好的答案,而不是只走單一路線。

獲獎模型將納入Google AI Ultra方案

Google DeepMind表示,相較於去年獲得銀牌的AI模型 AlphaGeometry 與 AlphaProof 需要專家將題目翻譯成特定程式語言,耗時數日運算,今年新一代的Gemini模型已能直接以自然語言理解題目並生成證明,且在競賽時限內完成,展現了端到端的卓越能力。

Google計畫將此頂尖AI技術分階段推向市場,初期將提供給特定數學家進行測試與合作,最終將整合至名為「Google AI Ultra」的訂閱服務中,目前該服務的月費為新台幣8,150元,旨在為高階用戶提供更強大的AI助理功能與一系列進階AI服務。

延伸閱讀:年薪上看487萬!10大「AI最難取代」高薪職位出爐:不只工程師,這類非理科也超穩
電費愈貴它愈搶手,虛擬電廠是什麼?為何是AI時代穩定供電關鍵?

本文初稿為AI編撰,整理.編輯/ 李先泰

資料來源:Googlesiliconangle商業內幕

往下滑看下一篇文章
生成式AI來襲、資安成焦點!AWS白皮書揭密金融業上雲契機
生成式AI來襲、資安成焦點!AWS白皮書揭密金融業上雲契機
2025.07.15 |

生成式AI詐欺暴增700%、嵌入式金融快速興起,數位轉型已成金融業不可逆的未來!金融機構正面對前所未有的技術挑戰與信任危機,從資安、AI應用,到用戶體驗與法遵合規,皆須重新部署,對此,AWS推出《金融科技創新與雲端應用白皮書》,結合全球趨勢與在地洞察,為台灣金融業提供明確的上雲行動方針。

金融詐欺事件因AI暴增,資安成雲端平台要務

隨著生成式AI迅速發展,金融詐欺的門檻大幅降低、手法愈加複雜。Deloitte金融服務中心預估,在「激進」採用GenAI的情境下,2027年電子郵件詐欺損失可能高達115億美元;美國的AI詐欺損失更將從2023年的123億美元,飆升至400億美元。

面對此等威脅,金融業無法再以傳統方式應對。AWS成為眾多金融業者信賴的資安後盾,Bowtie執行長Michael Chan表示:「AWS 擁有最多的安全認證,為我們的客戶和我們帶來其他雲端平台無法提供的安心感。」在生成式AI引發的新風險時代,選擇可信的雲端夥伴至關重要。

圖片1.jpg
圖/ aws

金融業大量部署AI,AWS協助企業提升效率與風控力

白皮書指出,40%的金融企業正積極學習如何部署AI,藉由大數據與機器學習,改善風險管理、詐騙偵測與投資策略。根據Gartner調查,34%的企業已部署AI應用,22%計畫在未來12個月內部署;IDC則預估,2026年全球AI支出將達3,000億美元,成長速度為一般IT支出的4.2倍。種種跡象指出,AI正快速融入金融核心流程。

為了跟上這波AI浪潮,越來越多金融業者採用AWS解決方案。以拉丁美洲新創銀行Nubank為例,不僅以AWS技術打造完全手機化的信用卡體驗,還成功管理超過7,000萬名客戶。其基礎設施領導者Renan Capaverde直言:「我們能達成目標,很大程度仰賴AWS提供的技術和架構。」

嵌入式金融正夯,AWS技術助銀行敏捷推新服務

應用內支付與嵌入式金融正逐步改變大眾對銀行的想像,根據Deloitte預測,社交平台上的應用內支付市場將以年複合成長率30%成長,從2024年的191億美元攀升至2030年的945億美元,甚至上看1,971億美元,成為社群商務支付的重要一環。

企業與金融機構要在這場變革中勝出,需倚賴更快速的產品開發與數據分析能力。透過AWS雲端平台與機器學習工具,銀行不但能加速新產品上線、改善用戶體驗,還能即時分析大量交易資料、交叉比對異常行為,強化風險控管能力。

銀行在AWS上營運,年省10兆瓦電力

AWS也能幫助金融業在推動ESG上一臂之力。根據Deloitte與AWS報告,AWS基礎設施的能效比美國企業數據中心高出3.6倍,並計畫於2025年實現100%可再生能源。

美國Capital One銀行在全面遷移至AWS後,關閉了8座資料中心,回收了41噸銅和62噸鋼,並從資料中心拆除了總計1,350萬英尺的電纜,總計每年可節省10兆瓦電力,相當於65萬個LED燈泡。

金融機構雲端轉型3階段:策略、導入、維運

Deloitte也在白皮書中建議,金融機構若真的想使用雲端服務,可採三階段策略推動雲端轉型。準備階段時,可確認雲端策略,進行雲適性評估,規劃長期願景;導入階段,金融業就要選擇合適雲技術,規劃雲原生架構,建立治理與搬遷計畫;最終維運時,強化DevOps與自動化,持續優化成本與效益。

台灣金融業上雲關鍵時機!AWS台北區域即將上線

隨著台灣金融法規逐步鬆綁,加上2025年AWS亞太(台北)區域啟用,現在正是台灣金融業上雲的關鍵時刻!屆時將包含3個可用區,支援資料落地、低延遲與高營運韌性,每個區域都具備獨立的電源、散熱與物理安全性,並透過冗餘的超低延遲網路連接,大幅強化災備能力與業務持續性。

此外,AWS台北區域將提供廣泛的核心雲端服務,包括運算、儲存、資料庫、網路、安全、監控等,讓台灣金融機構能在本地部署高效能的雲端應用,並享有國際級的安全與合規標準。

圖片2.gif
圖/ aws

立即下載《金融科技創新與雲端應用白皮書

掌握產業趨勢、實戰案例與資安關鍵策略,打造下一階段的金融競爭優勢!

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
電商終局戰
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓