誰是AI數學解題之王？Gemini、ChatGPT奧林匹克賽都摘金，誰更接近頂尖天才高中生？|數位時代 BusinessNext

重點一：Google DeepMind 的 Gemini Deep Think AI 模型於 2025 年國際數學奧林匹亞（IMO）以自然語言直接解題，獲得金牌標準，成為首批獲官方認證的 AI 系統之一。

重點二：Google的Gemini大型語言模型透過「深度思考」功能及強化學習，正確解答六題中的五題。而最難的第六題，全體630名參賽學生中僅有5名學生解題成功。

重點三：該AI模型將先由數學家測試，未來預計納入Google AI Ultra訂閱服務，進一步推向市場。

Google母公司Alphabet旗下AI研究部門 Google DeepMind 宣布，其開發的人工智慧模型在國際數學奧林匹亞 (International Mathematical Olympiad, IMO) 競賽中，成功摘下金牌。

國際數學奧林匹亞是一項面向高中生的著名數學競賽，每個參賽國家派出六名選手，必須在4.5小時內解答六題。2025年共有630名參賽者，排名前半的參賽者獲得獎牌，而只有頂尖的前8%選手、共67人獲得金牌。

這項成就的關鍵在於，Gemini Deep Think AI 是在與全球頂尖高中生完全相同的競賽條件與評分標準下完成挑戰，成功在六道題目中解出五道（解題過程請點我），獲得總分35分（滿分42分），證明其已具備世界一流的複雜數學推理能力。去年，GoogleDeepMind的AlphaProof和AlphaGeometry 2系統組合取得了銀牌，解決了六個問題中的四個，獲得了28分。

有趣的是，OpenAI研究員Alexander Wei日前才在X上發文指出，OpenAI最新的實驗性語言模型在也在國際數學奧林匹亞正確解答了六題中的五題，達到金牌水準。

執行長Sam Altman 則稱這一成就是 AI 發展十年來的重要里程碑，但強調這種「金牌級」能力的模型短期內不會公開。

因此，Google此番高調宣布金牌，再加上宣布該模型未來將納入Google AI Ultra，與OpenAI隔空較勁的意味十分濃厚。

Gemini能以自然語言理解題目，AI數學家教要來了？

更關鍵的是，雖然Gemini跟OpenAI的實驗模型在數學解題上都達到了IMO金牌水準， 但OpenAI的評鑑方式是由一群前IMO獎牌得主進行獨立評分，而非在官方競賽框架下進行 。相較之下，Google的AI直接面對官方試題，並在4.5小時的時限內完成作答，其結果的公正性與可比性更勝一籌。

此次參賽的AI是以 Gemini 系列大型語言模型為核心，並搭載了今年五月發布的 Deep Think 功能。此技術使其能夠模擬人類思緒，同時生成並評估多種解題路徑，最終整合出最佳答案。

為了訓練AI的數學能力，Google採用了強化學習 (reinforcement learning) 技術，並利用包含高品質數學解題過程、甚至是解題技巧與提示的特製資料庫進行訓練，使其能處理橫跨代數、組合數學、幾何與數論等領域的複雜證明題。

白話來說， Gemini Deep Think AI 能夠直接用自然語言（像人類一樣的英文敘述）理解和解答數學題目，不需要先把題目轉換成專業的電腦語言。而採用「平行推理」技術，意思是同時思考多種解題方法，最後選出最好的答案，而不是只走單一路線。

獲獎模型將納入Google AI Ultra方案

Google DeepMind表示，相較於去年獲得銀牌的AI模型 AlphaGeometry 與 AlphaProof 需要專家將題目翻譯成特定程式語言，耗時數日運算，今年新一代的Gemini模型已能直接以自然語言理解題目並生成證明，且在競賽時限內完成，展現了端到端的卓越能力。

Google計畫將此頂尖AI技術分階段推向市場，初期將提供給特定數學家進行測試與合作，最終將整合至名為「Google AI Ultra」的訂閱服務中，目前該服務的月費為新台幣8,150元，旨在為高階用戶提供更強大的AI助理功能與一系列進階AI服務。

延伸閱讀：年薪上看487萬！10大「AI最難取代」高薪職位出爐：不只工程師，這類非理科也超穩
 電費愈貴它愈搶手，虛擬電廠是什麼？為何是AI時代穩定供電關鍵？

本文初稿為AI編撰，整理．編輯/ 李先泰

資料來源：Google、siliconangle、商業內幕

生成式AI詐欺暴增700%、嵌入式金融快速興起，數位轉型已成金融業不可逆的未來！金融機構正面對前所未有的技術挑戰與信任危機，從資安、AI應用，到用戶體驗與法遵合規，皆須重新部署，對此，AWS推出《金融科技創新與雲端應用白皮書》，結合全球趨勢與在地洞察，為台灣金融業提供明確的上雲行動方針。

金融詐欺事件因AI暴增，資安成雲端平台要務

隨著生成式AI迅速發展，金融詐欺的門檻大幅降低、手法愈加複雜。Deloitte金融服務中心預估，在「激進」採用GenAI的情境下，2027年電子郵件詐欺損失可能高達115億美元；美國的AI詐欺損失更將從2023年的123億美元，飆升至400億美元。

面對此等威脅，金融業無法再以傳統方式應對。AWS成為眾多金融業者信賴的資安後盾，Bowtie執行長Michael Chan表示：「AWS 擁有最多的安全認證，為我們的客戶和我們帶來其他雲端平台無法提供的安心感。」在生成式AI引發的新風險時代，選擇可信的雲端夥伴至關重要。

金融業大量部署AI，AWS協助企業提升效率與風控力

白皮書指出，40%的金融企業正積極學習如何部署AI，藉由大數據與機器學習，改善風險管理、詐騙偵測與投資策略。根據Gartner調查，34%的企業已部署AI應用，22%計畫在未來12個月內部署；IDC則預估，2026年全球AI支出將達3,000億美元，成長速度為一般IT支出的4.2倍。種種跡象指出，AI正快速融入金融核心流程。

為了跟上這波AI浪潮，越來越多金融業者採用AWS解決方案。以拉丁美洲新創銀行Nubank為例，不僅以AWS技術打造完全手機化的信用卡體驗，還成功管理超過7,000萬名客戶。其基礎設施領導者Renan Capaverde直言：「我們能達成目標，很大程度仰賴AWS提供的技術和架構。」

嵌入式金融正夯，AWS技術助銀行敏捷推新服務

應用內支付與嵌入式金融正逐步改變大眾對銀行的想像，根據Deloitte預測，社交平台上的應用內支付市場將以年複合成長率30%成長，從2024年的191億美元攀升至2030年的945億美元，甚至上看1,971億美元，成為社群商務支付的重要一環。

企業與金融機構要在這場變革中勝出，需倚賴更快速的產品開發與數據分析能力。透過AWS雲端平台與機器學習工具，銀行不但能加速新產品上線、改善用戶體驗，還能即時分析大量交易資料、交叉比對異常行為，強化風險控管能力。

銀行在AWS上營運，年省10兆瓦電力

AWS也能幫助金融業在推動ESG上一臂之力。根據Deloitte與AWS報告，AWS基礎設施的能效比美國企業數據中心高出3.6倍，並計畫於2025年實現100%可再生能源。

美國Capital One銀行在全面遷移至AWS後，關閉了8座資料中心，回收了41噸銅和62噸鋼，並從資料中心拆除了總計1,350萬英尺的電纜，總計每年可節省10兆瓦電力，相當於65萬個LED燈泡。

金融機構雲端轉型3階段：策略、導入、維運

Deloitte也在白皮書中建議，金融機構若真的想使用雲端服務，可採三階段策略推動雲端轉型。準備階段時，可確認雲端策略，進行雲適性評估，規劃長期願景；導入階段，金融業就要選擇合適雲技術，規劃雲原生架構，建立治理與搬遷計畫；最終維運時，強化DevOps與自動化，持續優化成本與效益。

台灣金融業上雲關鍵時機！AWS台北區域即將上線

隨著台灣金融法規逐步鬆綁，加上2025年AWS亞太（台北）區域啟用，現在正是台灣金融業上雲的關鍵時刻！屆時將包含3個可用區，支援資料落地、低延遲與高營運韌性，每個區域都具備獨立的電源、散熱與物理安全性，並透過冗餘的超低延遲網路連接，大幅強化災備能力與業務持續性。

此外，AWS台北區域將提供廣泛的核心雲端服務，包括運算、儲存、資料庫、網路、安全、監控等，讓台灣金融機構能在本地部署高效能的雲端應用，並享有國際級的安全與合規標準。

立即下載《金融科技創新與雲端應用白皮書》

掌握產業趨勢、實戰案例與資安關鍵策略，打造下一階段的金融競爭優勢！

誰是AI數學解題之王？Gemini、ChatGPT奧林匹克賽都摘金，誰更接近頂尖天才高中生？