超越人類閱讀能力,阿里巴巴、微軟AI創紀錄,搶攻客服導覽工作
超越人類閱讀能力,阿里巴巴、微軟AI創紀錄,搶攻客服導覽工作
2018.01.16 | 微軟

「這是機器第一次在測試中超越人類。」人工智慧(AI)不僅擊敗圍棋世界冠軍李世乭,如今又在「閱讀理解」項目攻下一城。

阿里巴巴與微軟的AI機器學習模型,參與被認為最具權威性的史丹佛大學閱讀理解測驗,在分析500多篇維基百科文章、通過題目庫10萬條問題的隨機測驗後,最後出爐的成績都紛紛超越人類過去的紀錄。

阿里巴巴AI閱讀能力首度超越人類

由史丹佛大學研究人員所開發的史丹佛大學閱讀理解測試(Stanford Question Answering Dataset,簡稱SQuAD),被業界認為是最具權威與公信力的機器閱讀理解測驗,包括Google、IBM、Facebook、卡內基美隆大學等企業機構都曾參與。

人類過去在SQuAD測驗拿下最高的成績是82.304分,這次中國阿里巴巴所開發的人工智慧(AI)機器學習模型,在回答完一份由10萬條題目所組成的題目庫問題後,以82.44分的分數首度超越人類,接著微軟在相同的測驗中以82.650分同樣超越人類記錄。

Alibaba
阿里巴巴所開發的人工智慧(AI)機器學習模型,在閱讀理解測試中,以82.44分的分數首度超越人類,微軟也在相同的測驗中以82.650分超越人類表現。
圖/ shutterstock

消化大量資訊、模擬人類閱讀理解行為

SQuAD比賽由一個10萬條問題組成的機器閱讀理解題目庫組成,這些題目以500篇維基百科文章為基礎,主要用來測試機器是否能透過自然語言處理模仿人類對單字、句子的理解,在消化大量資訊後,精準地回答出問題。

AI在閱讀完題目庫中的一篇短文後,需要回答關於文章的幾個問題。例如,讓AI閱讀影集《異世奇人》資料,然後問「博士的飛船叫什麼名字?」;或是閱讀成吉思汗的歷史後,問「成吉思汗是哪年去世的?」

阿里巴巴研究團隊提出的「基於分層融合注意力機制」的深度神經網絡模型,是這項技術的重大突破,這款模型可以模擬人類在閱讀理解時的行為,包括串聯不同篇章的內容、帶著問題反覆閱讀文章、在閱讀時標註避免遺忘資訊等。

客服、導覽都派得上用場

阿里巴巴自然語言處理首席科學家司羅(Si Luo)表示,目前AI只能回答有明確答案的問題,如果問題表達的方式太模糊不清、不合語法、沒有預先準備好資料,AI有可能無法正常運作。

不過測驗結果還是相當振奮人心,「2018年有了一個強勁的開始。」SQuAD負責人Pranav Rajpurkar興奮地在Twitter上這麼寫下。

Museum tour
AI閱讀理解的精進,未來可以應用在客服、美術館導覽,甚至是回答病患的醫療問題。
圖/ shutterstock

透過AI閱讀理解的精進,未來將可以幫助人類處理大量資料、更加準確回答問題,「像是『為什麼會下雨?』這類客觀的問題就可以透過機器高度精準的回答。」首席科學家司羅(Si Luo)說:「這項科技可以應用在客服、美術館導覽,甚至是回答病患的醫療問題。」

成為第一家在閱讀理解測驗分數超越人類的科技公司,阿里巴巴近年加入騰訊、百度等公司的行列,積極在AI領域求突破,希望能借助AI發展社群媒體、廣告以及自動駕駛技術,中國也喊出要在2030年成為AI領域的領頭羊。

關鍵字: #人工智慧
往下滑看下一篇文章
健細胞科技攜手中興大學,推出「Cancell Insight」醫療AI 輔助決策平台,消弭醫療數位鴻溝
健細胞科技攜手中興大學,推出「Cancell Insight」醫療AI 輔助決策平台,消弭醫療數位鴻溝

為打破醫療 AI 高昂的算力與人力門檻,健細胞科技與國立中興大學資管系蔡孟勳教授團隊產學合作,正式推出「Cancell Insight 醫療 AI 模型平台」(https://insight.cancell.ai)。該平台以 SaaS(軟體即服務)模式提供一站式託管,讓先進的醫療 AI 資源不再侷限於大型醫學中心,有效消弭基層與城鄉間的醫療數位鴻溝。

軟體硬實力:打通 AI 落地最後一哩路

過去,許多由學術或生技單位開發的優秀模型因缺乏部署工具,往往淪為「實驗室孤兒」;而中小型醫院也常因 IT 建置成本對 AI 望之卻步。

健細胞科技創辦人周子堯Victor憑藉其UIUX規劃、程式開發技術背景,親自領軍AI 模型研發團隊,建構 Cancell Insight 平台。他強調,智慧醫療落地必須具備「無感化部署」、「持續性反覆運算」與「大眾化使用」三大要素。Cancell Insight 包辦了從數據清潔、標註到模型訓練與部署的底層工程,醫療機構僅需提供去識別化數據,繁瑣技術難題全由平台解決,讓 AI 真正回歸醫療「輔助」本質。

專為高壓臨床環境設計,七大核心優勢重新定義臨床運作效率

健細胞科技
Cancell Insight提供涵蓋數據清洗、精準標註、模型訓練至部署託管的一站式解決方案
圖/ 健細胞科技

【行動化與 LINE 整合】 支援 LINE 一鍵登入,醫師可直接透過官方帳號上傳檔案呼叫模型並查閱紀錄,實現真正的醫療行動化。

【隨選模型與高相容性】 提供多元 AI 模型庫供彈性訂閱。每組模型具備獨立 API Key,可無縫串接醫院現有 HIS 系統或 APP。

【團隊協作共享】 首創以「團隊」為服務單位,跨科別成員可同步共享模型權限、數據分析與歷史紀錄,提升研究協調效率。

【自動化數據處理】 支援模板批次上傳,內建自動校準系統,若格式不符將自動轉檔、去識別化與重構,大幅解放 IT 人力。

【雙模態 AI 解析】 深度整合 Dr.Cell AI (Gemini) 多模態能力,不僅輸出預測結果,更提供進階臨床解說與治療準則問答,提升決策參考價值。

堅守醫療嚴謹性,推動醫療平權與永續商業價值

在追求科技創新的同時,Cancell Insight 嚴格把關醫療安全性。平台所有 AI 模型輸出結果均定位為「臨床決策輔助」與「研究檢測輔助」,透過「非直面病患」的機制,確保所有 AI 建議皆由專業醫療人員進行最終判讀。

透過 SaaS 專案訂閱模式,Cancell Insight 成功以合理經費取代了傳統的高額硬體採購,讓中小型醫院與偏鄉診所也能具備同等的診斷實力,落實真正的醫療平權。對研發端而言,平台不僅是加速醫療科技商用化、縮短變現週期的推進器,其高度結合日常工作流的特性,更有效減少了醫護的行政負荷,緩解當前醫療量能短缺的危機。

【進階部署】啟動臨床試驗,Docker 地端部署確保資安與時效

為進一步驗證臨床效益並符合醫療機構對資訊安全的高標準,Cancell Insight 即將與各大醫療機構攜手展開「臨床研究計畫」。針對有高度資安控管需求的醫院,平台提供彈性的 Docker 地端模型部署(On-premise Deployment) 方案。第一線的醫師與護理師可直接在院內本機端快速啟動 AI 模型,安全地注入病患臨床數據後,即可「零時差」取得預測結果。此舉不僅確保了敏感醫療數據「不出院」,完美符合嚴格的醫療法規與病患隱私要求,更能實際驗證 Cancell Insight 在真實高壓的臨床場域中,能即時、有效地提供精準的決策輔助。

健細胞科技
部署輕量化模型於地端,支援離線模式使用模型,完善保護企業敏感資料
圖/ 健細胞科技

展望未來,擴大智慧醫療生態圈

透過 SaaS 模式取代高額硬體採購,Cancell Insight 致力落實醫療平權。未來,健細胞科技將以此平台為樞紐,尋求跨界深度合作:

醫療機構: 提供各級別醫院隨選即用的 AI 助理及地端部署選項。
學術/生技: 協助實驗室模型落地,並優化新藥研發與臨床試驗的數據處理效率。
商業保險: 整合 AI 評估工具,提供更精準的健康管理與風險控管服務。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
AI全球100+台灣20
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓