Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能
Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能

科技巨頭公司在生成式AI領域打得難分難捨,現在Google又出招了。Google於台灣時間6號晚間宣布推出全新大型語言模型「Gemini」,號稱目前市面上最強大的通用模型,Google執行長皮蔡(Sundar Pichai)更在部落格文章中劍指OpenAI的最強模型GPT-4,指出最高階的Gemini Ultra在32項AI測試中,有30項的評分贏過GPT-4的測試分數,宣示意味濃厚。

google gemini.jpg
Google全新多模態大型語言模型Gemini登場。
圖/ Google

Gemini厲害在哪?Gemini Ultra、Gemini Pro、Gemini Nano差別是什麼?

Gemini強大之處在於「多模態」能力,能夠針對文字、圖片、聲音、影片、程式碼等多種型態的內容進行理解並推理,同時推出三種大小的版本,可以靈活部署在不同場景,最大可到雲端大型資料中心,最小可以塞進手機裡,Pixel 8 Pro手機將可以支援Gemini應用。

Gemini三種規模:
Gemini Ultra(最大):適用高度複雜任務,在2024年初會推出給企業和開發者使用。

Gemini Pro(中等):最靈活通用的模型,12/13會讓開發者和企業客戶在Vertex AI和AI Studio等平台中使用。

Gemini Nano(最小):最有效率且可以部署在手機等終端裝置的模型,12/6起可以提供給安卓開發者申請使用,建立Gemini為基礎的裝置用應用程式。

google Gemini_FlexibleModel.jpg
Gemini推出三種大小,讓不同規模的場景可以彈性應用。
圖/ Google

Gemini號稱大勝GPT-4!一支影片感受Gemini有多驚人

Google並未公開Gemini的訓練參數量,但是Gemini Ultra在32項基準測試中,有30項都打贏OpenAI用1.8兆參數訓練出的GPT-4模型,參數量可能達到相近規模。Google特別加強訓練Gemini的理解力、總結能力、程式能力、計畫能力等面向,更擁有多模態能力,無論是文字、圖片、語音、影片、程式等內容都能理解,並且隨時轉換交互生成

Google在媒體說明會中秀出幾支示範影片,展現Gemini的力量,為了感受Gemini的反應速度,測試人員是讓Gemini實時看著自己的動作回答問題:

Google Gemini測試影片

第一步: 測試人員一邊畫圖,一邊詢問Gemini畫的內容,Gemini輕鬆回答這是一隻鴨子,並形容它的筆觸、色彩和身上的特徵,展現基礎的影像辨識能力。

第二步: 測試人員突然從畫面外拿出一隻實體的鴨子洗澡玩具,問它「你確定嗎?」Gemini馬上回答:「噢,我現在看到你拿著一隻實體的藍色鴨子。」展現辨識材質、物體的能力和反應速度。

第三步: 測試人員詢問Gemini,這個鴨子玩具是否可以浮在水上,Gemini回答:「我不太確定他的材質,所以難以判斷,但它看起來確實很像是塑膠做的。」接著測試人員讓Gemini看到擠壓玩具並發出聲音的樣子,Gemini立刻改口說:「如果它會發出聲音,那我確定他一定會浮起來。」證明Gemini能夠透過聲音和畫面判斷鴨子裡面有空氣,以及含有空氣的玩具能夠浮在水面上的原理。

Gemini採用Google自研晶片TPU訓練,同時也宣布推出全新的TPU v5p,是專門為AI訓練所設計,v5p的算力是上一代的2倍,訓練大型語言模型的速度是過去的2.8倍,除了Google自己發展更加速,未來也能幫助客戶用最低延遲訓練AI模型。

延伸閱讀:「一個詞」讓ChatGPT吐出原始資料!AI模型為何能在無形間出賣你?

Bard也跟著「升等」了,兩種版本依序上線

Google用來和ChatGPT、Copilot等競爭對手對抗的聊天機器人Bard,也將跟著Gemini一起「升等」。

1.即日起推出Gemini Pro調校版本Bard,提升理解力、計畫力、邏輯力
2.2024年初會推出「Bard Advance」進階版,用最強大的Gemini Ultra調校。

bard.jpg
Google 聊天機器人 Bard 將推出Gemini訓練版本,功能更強大。
圖/ Google

Gemini Pro版本Bard

即日起升級的Bard是由Gemini Pro調校,將先推出英文版,在超過170個國家地區上線,未來會逐步解鎖其他語言的版本。

Gemini Pro是中等且最應用場景最廣泛的模型,和GPT-3.5對標,Google指出Gemini Pro在8項基準中有6項都打贏GPT-3.5,其中包含多模態理解力和數學邏輯推理能力等測試。

Google和知名科學YouTuber Mark Rober合作測試Bard能力。

Bard測試

1.計畫能力:先折了三個不同材質的紙飛機,並拍下紙飛機的照片給Bard看,請Bard幫忙計畫如何測試紙飛機的飛行能力。Bard提議進行瞄準靶心的測試、紙面穿透力測試等多種方法,分別測試材質的硬度和風阻程度。

2.邏輯推理能力:下一步請Bard協助精進這架紙飛機的能力,Bard馬上列出幾項待改善的清單,包括翅膀太小、紙張太薄、尾翼太短等,並寫出原理。

3.創造力:詢問Bard該怎麼用最吸睛的方式測試紙飛機能力,讓YouTube影片變得更精彩,Bard提議一連串的現場設備,更建議可以「讓紙飛機飛越火圈」,讓Mark Rober成功完成影片片尾的精彩畫面。

Gemini Ultra版本的「Bard Advanced」

Google將於明年初上線火力全開的「Bard Advanced」,用最強大的多模態模型Gemini Ultra調校。這個版本原定會在年底上線,不過Google指出正在做更多安全性功能測試,將等到完善的階段開放使用。

Gemini Nano將登陸手機

另外,規模最小的Gemini Nano讓Pixel手機能解鎖更強大的AI模型應用,搭載最高階自研處理器Tensor G3的Pixel 8 Pro將成為第一款支援的手機,同樣搭載Tensor G3的Pixel 8會是下一波加入的機型,未來也會開放更多安卓手機加入支援Gemini Nano的應用程式,時程表未定。

Pixel 8 Pro第一波將上線兩大AI功能:

AI功能一:錄音工具摘要
可增強錄音功能的準確度,並且一鍵完成會議、訪談等錄音工具內容的摘要,不錯過細節,並且這些功能都是內建在手機,即便在離線的情況也能使用。

AI功能二:Gboard智慧回覆
開發人員預覽版的Gboard可啟動智慧回覆功能。AI根據收到的訊息給予回覆建議,節省使用者打字時間,目前率先支援Whatsapp,計畫於明年支援更多App。

在雲端龍頭亞馬遜AWS發出「世界上沒有最強模型」的宣言後,Google端出號稱「世界最強模型」應戰,並透過模型大小的彈性,卡位手機等終端應用開發市場,同時強調通用型能力,力求在生成式AI領域進入最多使用場景。

延伸閱讀:Gemini其實不是要幹掉ChatGPT!Google兵分三路想做什麼?

責任編輯:林美欣

往下滑看下一篇文章
漸強實驗室推「AI-First Communication Cloud」戰略,三大 AI 平台完整佈局、終結數據孤島
漸強實驗室推「AI-First Communication Cloud」戰略,三大 AI 平台完整佈局、終結數據孤島

一個殘酷的現實是:MIT 研究報告顯示,全球高達 95% 的生成式 AI 專案無法創造實際商業價值。問題出在哪裡?不是技術不足,是多數企業僅將 AI 視為「工具」,而非「戰略」,結果往往購買了許多應用卻難以串聯,數據彼此割裂,遂形成新的「數位路障」。

台灣市場也有相同矛盾。《2025 台灣 AI+MarTech 白皮書》指出,近五年軟體工具數量暴增 264%,但企業卻普遍面臨「工具越多、整合越難」的困境。對此,漸強實驗室於 9 月 16 日正式發布「AI-First Communication Cloud」戰略藍圖,提出一站式平台,將行銷、銷售與客服的資料流整合,縮短企業從洞察到行動的距離,實踐「重塑商業溝通」的使命。

為什麼必須 AI-First?

2025 漸強年度產品發表會除了展示產品之外,更同步舉辦了「漸強實驗室 x 企業領袖共創圓桌:以AI 重構企業成長引擎」。活動由《數位時代》創新長 James Huang 主持,邀請 Google Cloud 大中華區企業雲端技術副總經理 KJ WU、國泰健康管理顧問資深協理郭怡賢,分享全球 AI 趨勢與導入挑戰。現場超過 50 位 C-level 高層齊聚,包括屈臣氏、kkday、雅詩蘭黛、全國電子等領導品牌,共同聚焦 AI 對企業未來的影響,展現漸強在 AI 轉型議題上的產業影響力。

在這場活動中,漸強實驗室共同創辦人暨執行長薛覲曾在產品發佈會表示,AI 已成為國家、產業與企業的分水嶺,如:美國人均 GDP 已達 9 萬美元,但增速放緩至 1~3%,因此政府選擇 All-in AI,以重燃生產力引擎;另一方面,中國、印度、巴西等新興經濟體則將 AI 視為「彎道超車」的契機——AI 競爭,儼然成為國家實力再洗牌的契機。

回到企業層面,AI 不只加速工作流,也創造結構性的效率差異。薛覲表示,兩家同樣維持 20% YOY的公司,若其中一家具備 AI 能力,效率差距將被迅速放大。

漸強實驗室
圖/ 漸強實驗室

不過,更根本的挑戰是當 AI 接手重複任務後,員工時間如何被重新定義?如果 AI 僅僅讓回覆更即時、報表更漂亮,價值仍然淺薄;真正的關鍵是讓相同人力創造雙倍產出,或用一半資源達成既定目標。

因此,漸強實驗室提出「AI First、AI Driven、AI Built」的核心觀。對國家,AI 是戰略武器;對產業,是效率槓桿;對企業,則是生存門票。此刻若還選擇觀望 AI,代價恐怕是被淘汰,唯有主動擁抱 AI,才有機會獲得指數級成長。

漸強實驗室三大平台串聯,AI戰略再下一城

為了讓 AI 發揮戰略價值,漸強採取內外並進的策略。一方面重塑內部流程,包括目前約 90% 的程式碼透過 AI 協作完成,開發速度提升近五成;或透過導入 Google AgentSpace 將內部訓練效率提升 40%、業務提案時間縮短 80%。

同時,漸強也將AI經驗沉澱為產品,端出三大平台形成完整的 AI 生態。包括:

MAAC(企業專屬的行銷成長架構師),不再只是發送工具,而能在對的時間將對的內容送給對的人。如保健品牌 Vitabox 使用分眾功能,訊息點擊率提升六倍、廣告投資報酬率成長 3.7 倍;電商 Coupang 則將文案產出時間縮短 70%,團隊效率明顯提升。

CAAC(讓客服與銷售成為 Super Agents),則透過多角色 AI Agent 即時回覆,自動解決八成常見問題,以餐飲品牌為例,導入後對話處理量提升 233%,首次回覆時間縮短至原先的三分之一,成功優化客服團隊效率與工作量能。

DAAC(24 小時挖掘洞察、可自動行動的 AI 數據顧問),作為漸強實驗室的全新產品,定位為全自動 AI 數據分析平台,能將分散於行銷、客服、會員標籤的資訊整合,把以往3~5天的跨部門數據彙整加速到 3 分鐘內完成,並一鍵開啟執行建議,幫助企業立即把握機會、採取行動、解決問題。

漸強實驗室發布「AI-First Communication Cloud」戰略藍圖。為終結工具、數據
圖/ 漸強實驗室

漸強整合三大平台構成「AI All-in-one Solution」,形成一個不停轉動的生態系。從 MAAC 完整剖析全通路數據、一鍵觸發自動化行銷,到 CAAC 即時 360° 洞察顧客需求、一鍵啟動專屬對話,再到 DAAC 即時數據分析轉化為行動,一步步幫助企業決策不再依靠經驗直覺,而是由數據與 AI 驅動的最佳智慧。

AI 落地的最後一哩路

從產品戰略可見,漸強將 AI 的運作理解為一個不斷循環的系統:AI Agents 執行任務-結果沉澱為決策依據-經由大模型判斷方向-再驅動新一輪行動。唯有所有環節緊密相扣,AI 才能真正驅動價值;一旦斷裂,就會退化成孤立的單點工具。

因此在產品工具之後,漸強也提出 AI 顧問服務,將多年實戰經驗濃縮打磨,帶領品牌一步步界定痛點、快速試錯、人機分工、持續優化,協助品牌建立能長期演化的系統,讓技術在導入之後,還能持續成長。

薛覲比喻,漸強作為創新歷程就像是「蓋教堂」,目標使命始終如一,唯隨著時代演進,一次次聚焦解決某個挑戰,逐步將藍圖逐步堆疊實踐。走到 AI 時代的分水嶺,漸強不只給出解方,也盼能拋出更大的思考格局,帶動企業讓 AI 成為決策的核心,讓產品與顧問形成互補生態,陪伴企業從工具導入走向結構轉型;當多數企業仍在試水階段,那些率先建構 AI 驅動的組織,將更快抵達未來。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
一次搞懂Vibe Coding
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓