30年深度學習的孤獨之旅!今年圖靈獎頒給了「AI三巨頭」
30年深度學習的孤獨之旅!今年圖靈獎頒給了「AI三巨頭」

有一個流傳很廣的說法:Steve Jobs把公司取名蘋果,並以咬了一口的蘋果作為logo,是為了紀念服食毒蘋果自殺的電腦科學先驅艾倫·圖靈(Alan Mathison Turing)。

Steve Jobs否認了這個說法,但他說,「很希望自己是那樣構思的。」

從電腦科學到人工智慧,圖靈都做出了奠基性的貢獻,以他的名字命名的「圖靈獎」,被公認為電腦世界的最高榮譽,相當於電腦界的諾貝爾獎。

今年的圖靈獎被授予了深度學習領域的三巨頭:Yoshua Bengio、Yann LeCun和Geoffrey Hinton,以表揚他們對人工智慧發展的推動,三位科學家將平分100萬美元的獎金。

現在,深度學習已經幾乎是人工智慧的代名詞,從AlphaGo、人臉辨識、智慧語音助理到自動駕駛,都得益於深度學習的發展。

但它的進步,是一個孤獨的故事。

過去10年內,ImageNet圖像辨識挑戰賽都是人工智慧領域最權威的比賽之一。

ImageNet有一個超百萬張圖片的超級數據庫,其中的圖片由人手工添加標籤,說明圖片的內容,並分成不同的類別,從動物、汽車等大類,一直到虎鯊、廁所衛生紙這樣的小類。

參賽者要做的就是對圖片中的物體進行辨識和分類,準確度最高者獲勝。

圖靈獎
圖/ 作者提供

2012年,首次參賽的加拿大電腦科學家Geoffrey Hinton領銜的團隊拿到了冠軍,而且,比第二名准確率高出了10%。

這個結果震驚了學術界,因為當時的第二名到第四名都用了相同的研究方法,他們已經做到了極致,每個隊伍準確率的差別不超過1%。

Hinton團隊用的是完全不同的方法——深度學習,具體的算法被稱為卷積神經網路(CNN)。這是一個里程碑式的進步,正是Hinton團隊的突破,讓學術界和工業界用更多人關注、使用深度學習,最終推動了人工智慧行業的大發展。

如果以辨識貓為例,傳統的電腦視覺算法依靠設計者的先驗知識,比如透過貓的集合體推斷出,四條腿,體型較小,會喵喵叫的動物為貓。機器透過人的思維構建的模式來判斷它是否為貓。

深度學習則不同,它從海量的和貓相關的數據中自動學習,並提取出相應特徵,最終可以判定某個未知物體為貓。它和人類的思維方式更為接近,這種算法也被歸於神經網路。

雖然看起來深度學習從根本上就是一個更先進的算法,但在過去相當長的時期內,它並不被看好。

因為過去用於訓練的數據集規模都比較小,這很容易導致過擬合現象,即算法在測試集表現很好,但在實際應用出會出現極大的誤差;同時,電腦性能也無法滿足擁有成千上萬個參數的深度學習模型。

Yoshua Bengio、Yann LeCun和Geoffrey Hinton三位科學家正是在這樣的限制下堅持深度學習研究的。

Hinton已經71歲了,上世紀70年代,還在愛丁堡大學攻讀人工智慧博士學位的他就著迷於神經網路,這和當時的學術主流背道而馳,就連他的博士生導師也反對他的研究。

「我們一周見一次面,有時會以爭吵結束,有時候不會。」Hinton在一次採訪中曾回憶他的博士時光。

Yoshua Bengio和Yann LeCun要年輕一些,三人的研究互有交集。Yann LeCun現年58歲,1987至1988年,他在Hinton的實驗室中有一年的博士後研究經歷,之後加入當時最頂尖的隸屬於AT&T的貝爾實驗室。

在貝爾實驗室中,LeCun利用深度學習研發出了辨識手寫的信件和電話號碼的系統,這個成功取得了不錯的商業成功,它一度辨識了美國10%的手寫支票。

但是,當他將深度學習用於其他領域時,就遇到了重重困難,只有當訓練數據集足夠大時,深度學習才能表現得足夠好,但當時很少有什麼領域滿足這個條件。

LeCun的研究被視為異類,但依然有一些研究員和他一樣堅信深度學習的未來,包括現年55歲的,當時同在貝爾實驗室的Yoshua Bengio。

2004年,在加拿大前沿科學機構的讚助下,Geoffrey Hinton創立了專注於「神經計算和自適應感知」的項目,他也邀請了在深度學習堅持多年的Yoshua Bengio和Yann LeCun加入。

三人聯手後,就是推動深度學習不斷前進的故事。他們在2010年幫助微軟、IBM和Google拓展了語音辨識的邊界,之後在圖像辨識做了相同的工作,一直到2012年,Hinton領銜的團隊在ImageNet圖像辨識挑戰賽一戰成名,掀開了人工智慧的嶄新一頁。

現在,Hinton加入了Google,同時在多倫多大學繼續研究工作;LeCun是Facebook的首席人工智慧科學家,同時也是紐約大學的教授;Bengio拒絕了科技巨頭的邀請,他是蒙特利爾大學的教授,並創立了一家名為ElementAI的AI公司。

如果算上Hinton在博士期間的研究,他們已經默默為深度學習奉獻了30年。

「他們引領了科學典範的轉變,歷史最終選擇了他們,我充滿敬畏。」另一位AI權威,艾倫人工智慧研究所CEO,Oren Etzioni如此評價他們的獲獎。

圖靈獎沒有忘記英雄,我們也應該銘記。

本文授權轉載自愛范兒

往下滑看下一篇文章
AI 成為企業新基礎設施,勤英科技從雲端代理走向 AI Infra 整合
AI 成為企業新基礎設施,勤英科技從雲端代理走向 AI Infra 整合

因應生成式 AI、代理式 AI 與實體 AI 的崛起,模型成為企業資訊基礎設施的一環,企業不僅需要算力、還必須具備同時管理多個 AI 模型、優化營運成本,以及確保 AI 基礎設施的安全與穩定;有鑑於此,服務超過 2,000 家企業客戶上雲的勤英科技(ELITE CLOUD)將業務範疇從雲端代理延伸到 AI 基礎設施整合商,協助企業整合多元模型資源、因應不同應用場景彈性調度算力資源,在 AI 新世代建立可規模化的 AI Infra 能力。

「隨著 AI 從單一聊天機器人進化到多模型、多代理協作,企業的核心競爭力不再僅是擁有 AI,而是建立一套可管理、多模型共存、穩定、安全且可持續擴充的 AI Infra 環境。」勤英科技區域總經理黃士培表示,為協助更多企業推進 AI 創新實務,勤英科技從原本的 AWS、Google Cloud、Azure 雲端代理角色,進一步轉型為 AI 基礎設施整合服務商,透過多語言模型平台 MixRoute、代理式 AI 導入與企業資料治理服務,協助企業建立真正可落地、可管理、可擴展的 AI 應用架構。

從 IT Infra 到 AI Infra,企業最大挑戰不是模型、算力而是管理

過去幾年,許多企業透過生成式 AI 實現「問問題」、「摘要文件」、「生成簡報」,提升員工工作績效,而代理式 AI 的崛起與普及,則讓「內嵌 AI 的企業應用」快速成為新常態,從企業資源規劃(ERP)、顧客關係管理(CRM)、人力資源(HR),到客服、研發甚至製造系統,AI 開始深度嵌入各類企業應用,AI 扮演的角色也從單純的輔助工具,逐漸進化為企業營運與決策流程的重要核心。

也因此,企業保持未來競爭力的關鍵,不再是「有沒有導入 AI」,而是「是否具備管理 AI 的能力」,包括如何讓多模型共存、如何控管 Token 成本、如何確保資料品質與一致性、如何依不同部門需求配置 Agent,以及如何避免 AI 成為新的資訊孤島,都是企業導入 AI 後的新挑戰。

「Gemini、Claude、OpenAI、Mistral 等模型快速迭代,意味著企業若只押注單一模型,未來很可能在成本、效能與彈性上失去優勢。」勤英科技區域總經理黃士培表示,企業接下來更需要以「Models as Infrastructure(模型即基礎建設)」的思維,將大型語言模型視為與運算、儲存、網路同等重要的基礎資源來規劃、治理以及進行成本管理,將資訊系統架構重塑為 AI 基礎建設。

勤英科技_內文1.JPG
圖/ 數位時代

勤英科技服務的客戶數超過 2,000 家,不少客戶已導入 AI 應用服務,正積極建置 AI Infra 與管理環境,因此,勤英科技自 2025 年積極轉型,將 AI Infra 視為企業長期競爭力的基礎建設來經營,業務範疇從傳統雲端代理擴展至 AI Infra 整合服務商,例如與多模型平台 MixRoute 合作,並開發可支援單一登入(SSO)、彈性調度不同大型語言模型 Token 的管理平台,協助企業簡化模型管理與成本控管,將更多資源與心力聚焦於核心業務與創新應用。

從雲端代理走向 AI Infra 整合,勤英科技從三面向協助企業發揮 AI 綜效

有鑑於 AI 應用與雲端環境息息相關,勤英科技除因應企業客戶的多雲策略協助管理多雲環境、優化成本,以及落實資安治理,更因應不同使用情境推出三種 AI 方案助力企業:

第一:提供開箱即用的 AI 服務。

黃士培以 Google Cloud 的產品為例解釋,透過整合 Gemini 的 Google Workspace,企業可直接在 Gmail、Meet、Docs、Sheets、Slides 中使用 AI 功能,包括會議摘要、文件生成、簡報整理等,快速提升員工生產力,同時,增強企業對 AI 應用的信心,為之後的應用深化做準備。

第二:協助企業規劃、打造與導入代理式 AI 應用服務。

「對於擁有豐沛結構化數據資料、知識庫的企業來說,除以生成式 AI 打造企業大腦,還會透過代理式 AI 提升自動化執行能力,重塑工作效率。」黃士培表示,勤英科技可以基於 Google Gemini Enterprise,提供含括底層雲端架構、AI 模型調度、資料治理與 AI Agent 串接等服務,讓企業員工可以自然語言安全調用企業資料,讓 Agent 進一步執行任務與推動流程。

舉例來說,勤英科技協助在台灣成立超過 50 年的製造業品牌商將 Gemini Enterprise 介接 SAP 與 Salesforce 訓練模型、建立可供 AI 調用的企業知識中樞;另在影音內容生成領域,勤英科技亦協助客戶導入 AI 自動化技術,將內容產製成本縮減達 90%。

第三:提供多模型聚合管理平台,滿足企業以 API 串連各種模型的需求。

勤英科技與新加坡 MixRoute 合作,提供企業客戶多模型管理平台,讓企業可以視需求彈性敏捷的調度 Gemini、Claude、OpenAI 等不同模型,並透過單一帳號、單一帳單與 Budget Alert 機制,管理 token 使用量與 AI 成本。

勤英科技_內文2.JPG
圖/ 數位時代

「透過我們提供的多模型管理平台,企業客戶不會被單一模型綁定,可以在模型快速疊代的環境下,更靈活地管理成本與算力資源。」黃士培如是說道。

總的來說,隨著 AI 應用從單點工具走向大規模企業部署,下一波競爭核心將從模型能力延伸至 AI 基礎設施管理能力,而這也是勤英科技從雲端代理走向 AI Infra 整合服務商背後的核心原因:當 AI 開始成為企業營運的一部分,企業需要的,已不只是模型供應商,而是能協助串接雲端、資料、Agent 與應用場景的長期技術夥伴。

有關更多勤英科技相關資訊,請查詢網站:https://www.elite.cloud/zh/

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
代理式商務連動百兆商機
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓