Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能
Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能

科技巨頭公司在生成式AI領域打得難分難捨,現在Google又出招了。Google於台灣時間6號晚間宣布推出全新大型語言模型「Gemini」,號稱目前市面上最強大的通用模型,Google執行長皮蔡(Sundar Pichai)更在部落格文章中劍指OpenAI的最強模型GPT-4,指出最高階的Gemini Ultra在32項AI測試中,有30項的評分贏過GPT-4的測試分數,宣示意味濃厚。

google gemini.jpg
Google全新多模態大型語言模型Gemini登場。
圖/ Google

Gemini厲害在哪?Gemini Ultra、Gemini Pro、Gemini Nano差別是什麼?

Gemini強大之處在於「多模態」能力,能夠針對文字、圖片、聲音、影片、程式碼等多種型態的內容進行理解並推理,同時推出三種大小的版本,可以靈活部署在不同場景,最大可到雲端大型資料中心,最小可以塞進手機裡,Pixel 8 Pro手機將可以支援Gemini應用。

Gemini三種規模:
Gemini Ultra(最大):適用高度複雜任務,在2024年初會推出給企業和開發者使用。

Gemini Pro(中等):最靈活通用的模型,12/13會讓開發者和企業客戶在Vertex AI和AI Studio等平台中使用。

Gemini Nano(最小):最有效率且可以部署在手機等終端裝置的模型,12/6起可以提供給安卓開發者申請使用,建立Gemini為基礎的裝置用應用程式。

google Gemini_FlexibleModel.jpg
Gemini推出三種大小,讓不同規模的場景可以彈性應用。
圖/ Google

Gemini號稱大勝GPT-4!一支影片感受Gemini有多驚人

Google並未公開Gemini的訓練參數量,但是Gemini Ultra在32項基準測試中,有30項都打贏OpenAI用1.8兆參數訓練出的GPT-4模型,參數量可能達到相近規模。Google特別加強訓練Gemini的理解力、總結能力、程式能力、計畫能力等面向,更擁有多模態能力,無論是文字、圖片、語音、影片、程式等內容都能理解,並且隨時轉換交互生成

Google在媒體說明會中秀出幾支示範影片,展現Gemini的力量,為了感受Gemini的反應速度,測試人員是讓Gemini實時看著自己的動作回答問題:

Google Gemini測試影片

第一步: 測試人員一邊畫圖,一邊詢問Gemini畫的內容,Gemini輕鬆回答這是一隻鴨子,並形容它的筆觸、色彩和身上的特徵,展現基礎的影像辨識能力。

第二步: 測試人員突然從畫面外拿出一隻實體的鴨子洗澡玩具,問它「你確定嗎?」Gemini馬上回答:「噢,我現在看到你拿著一隻實體的藍色鴨子。」展現辨識材質、物體的能力和反應速度。

第三步: 測試人員詢問Gemini,這個鴨子玩具是否可以浮在水上,Gemini回答:「我不太確定他的材質,所以難以判斷,但它看起來確實很像是塑膠做的。」接著測試人員讓Gemini看到擠壓玩具並發出聲音的樣子,Gemini立刻改口說:「如果它會發出聲音,那我確定他一定會浮起來。」證明Gemini能夠透過聲音和畫面判斷鴨子裡面有空氣,以及含有空氣的玩具能夠浮在水面上的原理。

Gemini採用Google自研晶片TPU訓練,同時也宣布推出全新的TPU v5p,是專門為AI訓練所設計,v5p的算力是上一代的2倍,訓練大型語言模型的速度是過去的2.8倍,除了Google自己發展更加速,未來也能幫助客戶用最低延遲訓練AI模型。

延伸閱讀:「一個詞」讓ChatGPT吐出原始資料!AI模型為何能在無形間出賣你?

Bard也跟著「升等」了,兩種版本依序上線

Google用來和ChatGPT、Copilot等競爭對手對抗的聊天機器人Bard,也將跟著Gemini一起「升等」。

1.即日起推出Gemini Pro調校版本Bard,提升理解力、計畫力、邏輯力
2.2024年初會推出「Bard Advance」進階版,用最強大的Gemini Ultra調校。

bard.jpg
Google 聊天機器人 Bard 將推出Gemini訓練版本,功能更強大。
圖/ Google

Gemini Pro版本Bard

即日起升級的Bard是由Gemini Pro調校,將先推出英文版,在超過170個國家地區上線,未來會逐步解鎖其他語言的版本。

Gemini Pro是中等且最應用場景最廣泛的模型,和GPT-3.5對標,Google指出Gemini Pro在8項基準中有6項都打贏GPT-3.5,其中包含多模態理解力和數學邏輯推理能力等測試。

Google和知名科學YouTuber Mark Rober合作測試Bard能力。

Bard測試

1.計畫能力:先折了三個不同材質的紙飛機,並拍下紙飛機的照片給Bard看,請Bard幫忙計畫如何測試紙飛機的飛行能力。Bard提議進行瞄準靶心的測試、紙面穿透力測試等多種方法,分別測試材質的硬度和風阻程度。

2.邏輯推理能力:下一步請Bard協助精進這架紙飛機的能力,Bard馬上列出幾項待改善的清單,包括翅膀太小、紙張太薄、尾翼太短等,並寫出原理。

3.創造力:詢問Bard該怎麼用最吸睛的方式測試紙飛機能力,讓YouTube影片變得更精彩,Bard提議一連串的現場設備,更建議可以「讓紙飛機飛越火圈」,讓Mark Rober成功完成影片片尾的精彩畫面。

Gemini Ultra版本的「Bard Advanced」

Google將於明年初上線火力全開的「Bard Advanced」,用最強大的多模態模型Gemini Ultra調校。這個版本原定會在年底上線,不過Google指出正在做更多安全性功能測試,將等到完善的階段開放使用。

Gemini Nano將登陸手機

另外,規模最小的Gemini Nano讓Pixel手機能解鎖更強大的AI模型應用,搭載最高階自研處理器Tensor G3的Pixel 8 Pro將成為第一款支援的手機,同樣搭載Tensor G3的Pixel 8會是下一波加入的機型,未來也會開放更多安卓手機加入支援Gemini Nano的應用程式,時程表未定。

Pixel 8 Pro第一波將上線兩大AI功能:

AI功能一:錄音工具摘要
可增強錄音功能的準確度,並且一鍵完成會議、訪談等錄音工具內容的摘要,不錯過細節,並且這些功能都是內建在手機,即便在離線的情況也能使用。

AI功能二:Gboard智慧回覆
開發人員預覽版的Gboard可啟動智慧回覆功能。AI根據收到的訊息給予回覆建議,節省使用者打字時間,目前率先支援Whatsapp,計畫於明年支援更多App。

在雲端龍頭亞馬遜AWS發出「世界上沒有最強模型」的宣言後,Google端出號稱「世界最強模型」應戰,並透過模型大小的彈性,卡位手機等終端應用開發市場,同時強調通用型能力,力求在生成式AI領域進入最多使用場景。

延伸閱讀:Gemini其實不是要幹掉ChatGPT!Google兵分三路想做什麼?

責任編輯:林美欣

往下滑看下一篇文章
人人用 AI,訊息更分散?普羅品牌顧問「Process 2.0」助企業建品牌 AI 助理、精準溝通驅動成長
人人用 AI,訊息更分散?普羅品牌顧問「Process 2.0」助企業建品牌 AI 助理、精準溝通驅動成長

自 2022 年底 ChatGPT 引爆生成式 AI 浪潮以來,企業競相導入 AI 加速內容產出,效率看似提升,品牌訊息破碎化與品質失控的風險卻也隨之浮現。行銷、客服、業務各自運用 AI 工具產出文案,語氣與規範逐漸失去統一標準,消費者接收到的品牌形象因此愈趨模糊。

「一旦 AI 成為人人可及的工具,它本身幾乎不再是差異化的因素。真正的差異,不在於技術本身,而在於企業如何運用它。」Process 普羅品牌顧問創辦人 Martin Kessler 指出,長期來看,勝出的不會是使用最強大 AI 的企業,而是那些將品牌定位得足夠清晰、即使在技術趨於同質化的情況下依然與眾不同的企業。「AI 正成為常態,但唯有強大的品牌,才具備真正的競爭優勢。」

普羅品牌顧問-2.JPG
Process 普羅品牌顧問創辦人 Martin Kessler。
圖/ 數位時代

如何運用 AI 加快內容產出速度,並同時兼顧品牌信任所需要的一致水準,這是 1995 年創立於瑞士蘇黎世的普羅品牌顧問,近年積極思考的問題。為此,普羅提出「Process 2.0」服務,將顧問角色從建立品牌策略,延伸到協助企業建立可持續運作的品牌溝通系統。

「Process 2.0」服務:提升企業品牌溝通力

Process 普羅品牌顧問台北分公司總經理洪翠霞觀察,品牌訊息之所以失焦,關鍵在於策略完成後,仍缺乏一套持續運作的溝通系統銜接執行。她將這種落差歸納為五種斷層:

首先,一旦策略完成後未能落實到日常工作,便形成策略斷層。同時,當品牌理解過度仰賴少數主管,一旦人員異動,傳承便隨之中斷,造成轉譯斷層。

在執行面上,各部門對外溝通的語氣逐漸分散不一致,也會有語氣斷層的問題;內容產出雖多,卻缺乏共同標準判斷是否符合品牌,則是驗證斷層。最後,所有品牌知識散落各處、未被系統化管理,導致治理斷層,也讓最初的策略價值難以發揮效果。

這五個斷層背後,指涉的是同一個關鍵。也就是品牌策略與實際執行之間,少了一套能夠持續運作的品牌溝通系統。

普羅品牌顧問-3.jpg
Process 普羅品牌顧問台北分公司總經理 洪翠霞。
圖/ 數位時代

為此,普羅開發出「Process 2.0」解方,從三個階段解決落差。首先,從「Brand Strategy」出發,先釐清品牌的定位與價值主張;接著才是「Brand Communication System」,將策略轉化為跨部門可依循的語言規則;最後則是「AI Brand Communication」,把品牌知識整合進安全可控的 AI 工作環境,讓行銷、業務、客服、人資,乃至海外代理商,都能基於統一的品牌基準產出內容,並持續進行審核與知識更新。

「AI 內容產出速度已遠遠超過品牌治理速度,品牌基礎若模糊不清,AI 只會更快放大既有的問題。」洪翠霞強調,AI 時代讓斷層問題更加明顯,因此她也期待透過「Process 2.0」品牌專屬 AI 助理,延伸顧問影響力,幫助品牌長期把關、一同成長。

品牌力 + AI:打造品牌專屬 AI Agent

為實現「Process 2.0」,普羅攜手愛酷智能科技(AccuHit)將品牌策略、知識與 AI 技術整合,協助企業建立專屬品牌 AI 助理。

愛酷智能科技(AccuHit)執行長林庭箴指出,「Process 2.0」鎖定的是品牌再造:AI 除了應用在企業內部流程,還能如何用在品牌溝通面。他分析,當電商進入超微利的時代,零售產業正走向三個不可逆的趨勢,包括:到 2030 年,將有五成消費行為由 AI 協助完成,商品資料必須完整到能讓 AI 讀懂;其次是超個人化,信任愈稀缺,推薦卻必須愈貼近個人需求這件事將更挑戰;第三,則是預測型消費將持續增加。

普羅品牌顧問-4.JPG
AccuHit 執行長 林庭箴。
圖/ 數位時代

尤其,在非零售場域,品牌溢價更為關鍵,因為品牌價值與品牌溝通內容不只要讓消費者理解,也要讓 AI 讀懂,才能持續發揮影響力。不過,當企業想要運用 AI 做行銷卻沒想像中容易。林庭箴強調,企業 AI 最大的挑戰,多半集中在機敏資料的存取與管理層面。

因此在「Process 2.0」的開發協作上,普羅負責定義場景,AccuHit 則提供技術與產品面支援,將品牌規範與知識納入 Gen AI 系統,讓所有輸出都能經過品質控管,如同 AI 版本的品牌指南,確保每一次輸出都建立在信任與安全之上。

目前品元實業、昇昇膠業等品牌已導入試用這項服務工具,無論是行銷內容撰寫、客服回覆、產品諮詢或內部教育訓練,皆能依據統一的品牌規範,輸出兼具效率與品質的內容。

Brand-to-Revenue:探索成長新引擎

根據台經院發布的《2026 台灣企業品牌力大調查》,過去五年(2021 至 2025 年)收集的 1,167 家企業數據顯示,台灣企業普遍呈現「內強外弱」的品牌結構。也就是品牌定位與內部管理已具基礎,但對外溝通與價值主張,如品牌好感度與互動性,卻相對薄弱,導致多數企業雖有高重複購買率,卻缺乏品牌溢價能力與市場認同。

對此,台灣品牌耀飛計畫小組副主任朱俐穎指出,「Process 2.0」的目標,是協助企業建構可落地的溝通能力,最終讓品牌策略實質驅動營收成長。

她以多年輔導近千家品牌企業的經驗為例,企業經過品牌輔導後,形象全面升級、設計語言更聚焦,市場識別度也隨之提升。她觀察,品牌塑造的成果平均在一至兩年後開始發酵,客戶能明顯感受到不同:「以往客戶只是單純買產品,但有了品牌之後,就多了願景與合作想像,能吸引其他企業一起創新共榮。」

普羅品牌顧問-5.jpg
台灣品牌耀飛計畫小組副主任 朱俐穎。
圖/ 數位時代

AI 的本質就像一面放大鏡:品牌定位清楚,AI 能加速轉譯、提升溝通效率;定位模糊甚至混亂,AI 也會同步放大這份混亂,後果難以收拾。品牌梳理是否到位,決定了 AI 是阻力還是助力。

為協助企業及早驗證成效,普羅已推出「60 天品牌成長試用計畫」,讓企業在正式導入「Process 2.0」前展開深度合作,鎖定成長機會。從 Made in Taiwan 到 Trusted Taiwan Brand,信任,才是品牌溢價的關鍵。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓