Google發布Gemini 2.0!AI助手Astra大升級:可聽懂晶晶體、看圖辨位⋯還能兼電玩教練?
Google發布Gemini 2.0!AI助手Astra大升級:可聽懂晶晶體、看圖辨位⋯還能兼電玩教練?

Google的招牌AI模型Gemini,經歷了近一年的1.5版本發展,終於在台灣時間12月11日深夜宣布推出最新的Gemini 2.0 Flash實驗版,為新一代Gemini 2.0系列打頭陣

Google執行長桑德爾.皮蔡(Sundar Pichai)在部落格文章中稱它為「我們所有尖端技術的縮影」。

Gemini 2.0 Flash雖然是輕量版,表現卻超出上一代的最高版本1.5 Pro,產出速度還更快,性能大幅升級,Google也同步分享了智慧助手Project Astra和新的網頁助手Project Mariner的應用,在多模態能力、反應速度、對外蒐集資料能力上,都展現新一代Gemini的力量。

google-deepmind-LuzT78A1g7M-unsplash.jpg
Google推出全新模型Gemini 2.0 Flash,同時展示助手能力升級版的應用。
圖/ Google DeepMind on Unsplash

Gemini 2.0 Flash有多強?

Gemini 2.0 Flash是由非常受開發者歡迎的1.5 Flash模型的升級版產品,延續了Flash反應速度極快的特性,根據Google的測試,2.0 Flash身為「輕量版」,關鍵標準測試的表現,除了長文字處理外,其他所有相簿都贏過上一代的「專業版」1.5 Pro。例如,2.0 Flash寫程式的能力得到92.9的高分,1.5 Pro在這個項目中只得到85.4分,速度還快了一倍。

Google Gemini 2.0 Flash
Google Gemini 2.0 Flash和1.5版本相比,在多方面能力都拿到更高的分數。
圖/ Google

開放時間
Google已於上月先向部分開發者分享了Gemini 2.0的早期實驗版本,即日起開發者可透過Google AI Studio和Vertex AI平台正式選用Gemini 2.0 Flash的實驗模型, 明年一月將全面開放使用,並推出更多不同大小的模型版本。

智慧助手升級:Project Astra

隨著新版本模型的登場,AI助手也跟著升級。Google在今年5月登場的I/O大會中首次公開Google未來的人工智慧助手—— Project Astra,具備「多模態」能力,能解讀文字、語音、動態畫面,因此能夠在看到動態畫面時快速思考和反應,甚至擁有記憶力。

掌握最新AI、半導體、數位趨勢!訂閱《數位時代》日報及社群活動訊息

Google Project Astra Demo

而加入Gemini 2.0後,Project Astra有了四大能力升級。

升級一:多語言對話能力

Astra語言能力升級,現在可支援多語言及混合語言對話,並更能理解口音及少見詞彙。例如,在說話時使用中應大量混雜的「晶晶體」,或者和法國人好友同時對Astra下指令,都能快速理解並完成任務。

升級二:使用更多工具輔助

Astra現在可以上網使用Google搜尋、Lens與地圖,解鎖更多應用場景,例如拍攝路上的裝置藝術,Astra可以知道位置之外,還可以透過網路上的說明資訊,告訴你裝置藝術的涵義。

升級三:記憶力變強了

Astra在初登場時最讓人印象深刻的是記憶力,當時Demo的人員詢問Astra「記不記得我的眼鏡放在哪裡?」Astra馬上分析這幾分鐘內經過的所有畫面,找到眼鏡所在的影格並分析畫面中的資訊,最後得出結論;「放在一顆蘋果旁邊。」

這次Google把Astra的記憶力保留時間拉長到10分鐘,並能想起更多過去的對話內容作為補充資訊,以更個性化地服務使用者,比如可以請Astra幫忙記住一組密碼,離開去泡杯咖啡聊聊天,回來後再請Astra幫忙說出密碼內容。

升級四:降低延遲自然對話

根據Google的說明,新版本Astra的語言理解速度已經接近真人對話,因此當你Astra問問題時,不會讓人感覺「卡卡」,互動更自然。

網頁搜尋幫手:Project Mariner

而這一次Google也揭露全新計畫內容,稱為Project Mariner,可以視為Google打造未來全新網頁使用體驗的決心, Project Mariner就像一個助手,或者擴充功能,幫你瀏覽各種網頁蒐集到需要的資訊,它可以理解並分析瀏覽器畫面中的資訊,包括像素、文字、程式碼、圖片及表單等元素。

比如Google展示了一項應用,打開一個Google試算表文件,表格裡面有好幾家公司的名字, 可以在一旁的Project Mariner視窗中打下「幫我找到這些公司的招牌產品和他們的聯絡方式」,Mariner就會開始自己開始搜尋、尋找資訊,而且這些過程都展示給你看,讓你看見Mariner在滑動這些公司的官網、理解圖片的過程,接著在幾秒鐘後整理好資訊、告訴你答案。

因為可以看到蒐集答案的過程,而不是直接提供結果,把人的監管加入流程中,雖然速度比起直接生成答案更慢,卻也提高了一部分的可信度。

在WebVoyager基準測試中,可以評估AI在真實世界網頁裡工作的表現,Project Mariner達到了83.5分的成績,根據Google的說法,這是業界領先的成果,「雖然Project Mariner目前的執行速度稍慢且偶爾不夠準確,但隨著技術進步,這些問題將迅速改善。」Google Labs產品管理總經理潔克琳.康傑曼(Jaclyn Konzelmann)指出。

遊戲領域「外掛」:Gemini for Games

Gemini 2.0的另一項新應用是在遊戲方面,像是一個師傅,幫助玩家在遊戲的虛擬世界中快速針對規則、角色等內容產生理解,甚至可以邊玩邊詢問「我忘記現在是要完成甚麼任務才能通關,你可以告訴我嗎?」

而Gemini就會告訴玩家「你必須蒐集到200顆寶石,建議你選擇XX角色更快達成任務。」代表可以根據螢幕上的行動進行遊戲推理,並透過即時對話提供下一步建議。

Gaming disorder
未來玩遊戲時,也許可以讓Gemini助手提供策略上的建議。
圖/ shutterstock

總結:Google持續嘗試在謹慎中創新

隨著微軟、OpenAI等公司提出AI代理(AI Agent)新概念和應用,能夠在用戶授權下主動執行任務的代理式AI,成為明年最重要的競爭方向,代表AI從一個口令一個動作,進入下一個階段。

Google這次在Astra和Mariner都展現類似的野心,不過很明顯在產品設計上更加小心翼翼,甚至依舊保留了人類監管或控制的選項,似乎還沒打算讓AI脫離掌控主動工作。

對此,Google DeepMind 產品管理總經理圖席.道許(Tulsee Doshi)在受訪時坦言,Google確實有感受到業界對於放鬆AI行動限制的發展方向,不過這代表著更多的問題可能會隨之發生,因此Google還是抱持的謹慎地態度面對,先從部分授權開始,同時找來一群信任的測試人員,進行試用並提供回饋,確保AI提供的服務不會出問題。

Google似乎將延續「負責任AI」的口號,在衝刺的AI領域中自踩剎車,先求穩再求好的模式,會在明年的AI代理戰中脫穎而出還是落後,值得觀察。

延伸閱讀:Google發布量子晶片Willow!5分鐘搞定「10的25次方年」計算:將解鎖AI、核融合難題

責任編輯:李先泰

關鍵字: #Google #AI
往下滑看下一篇文章
從地下室到演唱會都不卡!台灣大哥大如何解鎖全場景、有感升級的5G體驗?
從地下室到演唱會都不卡!台灣大哥大如何解鎖全場景、有感升級的5G體驗?

5G開台邁入第五年,戰場早已從「誰有5G」轉向「誰的5G好用」。夜市、演唱會、地鐵、商圈——這些人潮洶湧、訊號最容易卡頓的地方,才是檢驗網路品質的真實考場。要打造真正有感的5G體驗,靠的不是技術名詞,關鍵在於能否把網路資源變成看得見、用得到的流暢速度。

台灣大哥大擁有最大5G黃金頻寬,以及高覆蓋率的NRCA載波聚合領先技術,為網路傳輸佈局暢行無阻的地圖,打通每一個收訊死角,再加上OpenSignal權威認證背書,不僅是技術成績站得住腳,更讓用戶日常生活使用有感提升。

全台獨家最大頻寬100MHz,讓5G跑得快又穩

要解析5G效能優劣,關鍵在於「頻寬」配置。頻寬就像道路的寬度,直接決定數據傳輸的承載容量。頻寬越寬,越能支撐大量用戶同時連線,確保下載、串流、直播等應用維持順暢體驗,避免因流量壅塞導致服務中斷。簡言之,頻寬就是撐起網路用戶體感的關鍵。

台灣大哥大目前在全球主流5G黃金頻段3.5GHz上,獨家取得全台最大100MHz頻寬資源,達到頻譜配置的頂規水準。實測結果顯示,在理想條件下,此頻寬配置可擁有高達2Gbps下載速率。

1216001092_53M.jpg
圖/ shutterstock

同時,台灣大哥大也已在全台超過2,000處熱點完成5G黃金頻段基地台升級。因此即使遇到夜市商圈、大型演唱會、跨年活動等高密度人流聚集場景,當用戶數量暴增、頻寬需求激增時,完整的基礎建設布局仍能確保訊號不中斷、網速不卡頓。

打通收訊死角,體驗有感不只是口號

除了速度與流量,5G還有一項棘手難題——涵蓋死角與訊號穿透力。特別是在室內深處、地下室等場域,即使該處已有5G涵蓋,實際使用仍有可能無法完全避免的卡頓或不穩狀況。

原因在於5G高頻段雖速度快,但穿透力弱,容易因手機功率有限而發生不穩定的情況。對此,台灣大哥大結合700MHz低頻段的穩定性優勢,以互補式的高低頻協作架構,強化訊號深度與廣度。換言之,在戶外大場景跑得快,在室內密閉空間也能收得到。

NRCA自動切換最佳頻段,上網不怕訊號塞車

台灣大哥大的核心技術優勢,還有NRCA(New Radio Carrier Aggregation)載波聚合技術;NRCA讓行動裝置能同時使用多個頻段上網,如同多車道高速公路,讓資料流在不同頻段間靈活切換,兼顧高速率與深度覆蓋率。當某一頻段出現壅塞,系統能自動將資料流量轉至其他頻段傳輸,以提升整體承載效率與傳輸穩定性。

自2021年率先佈建高低頻NRCA,目前已有超過六成基地台支援這項技術,有效壓縮延遲、提升連線穩定度、強化訊號覆蓋與穿透。此外,合併台灣之星後,台灣大哥大更將全球主流5G黃金頻段3.5GHz的60MHz與40MHz頻寬合併,打造業界最大100MHz,為全台唯一同時整合5G高高頻與高低頻NRCA的電信業者,在5G網路體驗與穩定度領先同業,達到頻譜配置的頂規水準。

隨著短影音、直播、雲端工作等即時傳輸需求爆炸成長,用戶對「穩定滑順」的網路依賴不斷提高。台灣大哥大領先的NRCA載波聚合技術,正好回應用戶需求,無論是在捷運上滑臉書,還是在人聲鼎沸的夜市直播吃美食,都能享受多場景流暢切換的優質5G體驗。

2334636029_63M (1).jpg
圖/ shutterstock

優質有感體驗,經國際權威OpenSignal認證

根據國際第三方認證機構OpenSignal於2025年6月公布的行動網路體驗報告,台灣大哥大在「可用率」、「5G影音體驗」與「整體影音體驗」三項用戶有感的指標上獲得第一名。所謂可用率,意指用戶隨時隨地都能連上網路,關鍵時刻訊號不缺席,不論身處室內或移動場景,都能穩定連線不中斷;同時,良好的影音體驗指標,則代表用戶在觀看影片、雲端會議或滑短影音時,能享有畫質流暢、連線穩定、不易中斷的完整體驗。OpenSignal向來以實測數據為依據,其認證結果可視為對 5G 體驗品質的權威背書。

今年第一季,OpenSignal也針對合併電信後的網路表現進行評比。自2023年底台灣大哥大與台灣之星完成合併後,其在涵蓋體驗的評分顯著提升,並在品質一致性指標上維持82~84%的穩定水準。相較其他合併案例,台灣大哥大是體驗提升幅度最大、整體穩定性維持最佳的合併業者,顯見其網路品質、營運韌性與整合效率。

5G技術是否能成為使用者真正信賴的基礎,關鍵在於能否在生活場景中「被感受到」。台灣大哥大以完整的頻寬資源、彈性技術架構與佈建策略,從速度到穩定、從戶外到室內,打造順暢5G體驗,可期待在這場長期5G競賽中,成為用戶最仰賴的行動網路選擇。

有關更多相關資訊,請查詢網站:https://www.taiwanmobile.com/content/event/nrca/index.html

追蹤我們
電商終局戰
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓