Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能
Google最強模型Gemini,30項測試打贏GPT-4!Pixel 8 Pro搶先解鎖2大AI功能

科技巨頭公司在生成式AI領域打得難分難捨,現在Google又出招了。Google於台灣時間6號晚間宣布推出全新大型語言模型「Gemini」,號稱目前市面上最強大的通用模型,Google執行長皮蔡(Sundar Pichai)更在部落格文章中劍指OpenAI的最強模型GPT-4,指出最高階的Gemini Ultra在32項AI測試中,有30項的評分贏過GPT-4的測試分數,宣示意味濃厚。

google gemini.jpg
Google全新多模態大型語言模型Gemini登場。
圖/ Google

Gemini厲害在哪?Gemini Ultra、Gemini Pro、Gemini Nano差別是什麼?

Gemini強大之處在於「多模態」能力,能夠針對文字、圖片、聲音、影片、程式碼等多種型態的內容進行理解並推理,同時推出三種大小的版本,可以靈活部署在不同場景,最大可到雲端大型資料中心,最小可以塞進手機裡,Pixel 8 Pro手機將可以支援Gemini應用。

Gemini三種規模:
Gemini Ultra(最大):適用高度複雜任務,在2024年初會推出給企業和開發者使用。

Gemini Pro(中等):最靈活通用的模型,12/13會讓開發者和企業客戶在Vertex AI和AI Studio等平台中使用。

Gemini Nano(最小):最有效率且可以部署在手機等終端裝置的模型,12/6起可以提供給安卓開發者申請使用,建立Gemini為基礎的裝置用應用程式。

google Gemini_FlexibleModel.jpg
Gemini推出三種大小,讓不同規模的場景可以彈性應用。
圖/ Google

Gemini號稱大勝GPT-4!一支影片感受Gemini有多驚人

Google並未公開Gemini的訓練參數量,但是Gemini Ultra在32項基準測試中,有30項都打贏OpenAI用1.8兆參數訓練出的GPT-4模型,參數量可能達到相近規模。Google特別加強訓練Gemini的理解力、總結能力、程式能力、計畫能力等面向,更擁有多模態能力,無論是文字、圖片、語音、影片、程式等內容都能理解,並且隨時轉換交互生成

Google在媒體說明會中秀出幾支示範影片,展現Gemini的力量,為了感受Gemini的反應速度,測試人員是讓Gemini實時看著自己的動作回答問題:

Google Gemini測試影片

第一步: 測試人員一邊畫圖,一邊詢問Gemini畫的內容,Gemini輕鬆回答這是一隻鴨子,並形容它的筆觸、色彩和身上的特徵,展現基礎的影像辨識能力。

第二步: 測試人員突然從畫面外拿出一隻實體的鴨子洗澡玩具,問它「你確定嗎?」Gemini馬上回答:「噢,我現在看到你拿著一隻實體的藍色鴨子。」展現辨識材質、物體的能力和反應速度。

第三步: 測試人員詢問Gemini,這個鴨子玩具是否可以浮在水上,Gemini回答:「我不太確定他的材質,所以難以判斷,但它看起來確實很像是塑膠做的。」接著測試人員讓Gemini看到擠壓玩具並發出聲音的樣子,Gemini立刻改口說:「如果它會發出聲音,那我確定他一定會浮起來。」證明Gemini能夠透過聲音和畫面判斷鴨子裡面有空氣,以及含有空氣的玩具能夠浮在水面上的原理。

Gemini採用Google自研晶片TPU訓練,同時也宣布推出全新的TPU v5p,是專門為AI訓練所設計,v5p的算力是上一代的2倍,訓練大型語言模型的速度是過去的2.8倍,除了Google自己發展更加速,未來也能幫助客戶用最低延遲訓練AI模型。

延伸閱讀:「一個詞」讓ChatGPT吐出原始資料!AI模型為何能在無形間出賣你?

Bard也跟著「升等」了,兩種版本依序上線

Google用來和ChatGPT、Copilot等競爭對手對抗的聊天機器人Bard,也將跟著Gemini一起「升等」。

1.即日起推出Gemini Pro調校版本Bard,提升理解力、計畫力、邏輯力
2.2024年初會推出「Bard Advance」進階版,用最強大的Gemini Ultra調校。

bard.jpg
Google 聊天機器人 Bard 將推出Gemini訓練版本,功能更強大。
圖/ Google

Gemini Pro版本Bard

即日起升級的Bard是由Gemini Pro調校,將先推出英文版,在超過170個國家地區上線,未來會逐步解鎖其他語言的版本。

Gemini Pro是中等且最應用場景最廣泛的模型,和GPT-3.5對標,Google指出Gemini Pro在8項基準中有6項都打贏GPT-3.5,其中包含多模態理解力和數學邏輯推理能力等測試。

Google和知名科學YouTuber Mark Rober合作測試Bard能力。

Bard測試

1.計畫能力:先折了三個不同材質的紙飛機,並拍下紙飛機的照片給Bard看,請Bard幫忙計畫如何測試紙飛機的飛行能力。Bard提議進行瞄準靶心的測試、紙面穿透力測試等多種方法,分別測試材質的硬度和風阻程度。

2.邏輯推理能力:下一步請Bard協助精進這架紙飛機的能力,Bard馬上列出幾項待改善的清單,包括翅膀太小、紙張太薄、尾翼太短等,並寫出原理。

3.創造力:詢問Bard該怎麼用最吸睛的方式測試紙飛機能力,讓YouTube影片變得更精彩,Bard提議一連串的現場設備,更建議可以「讓紙飛機飛越火圈」,讓Mark Rober成功完成影片片尾的精彩畫面。

Gemini Ultra版本的「Bard Advanced」

Google將於明年初上線火力全開的「Bard Advanced」,用最強大的多模態模型Gemini Ultra調校。這個版本原定會在年底上線,不過Google指出正在做更多安全性功能測試,將等到完善的階段開放使用。

Gemini Nano將登陸手機

另外,規模最小的Gemini Nano讓Pixel手機能解鎖更強大的AI模型應用,搭載最高階自研處理器Tensor G3的Pixel 8 Pro將成為第一款支援的手機,同樣搭載Tensor G3的Pixel 8會是下一波加入的機型,未來也會開放更多安卓手機加入支援Gemini Nano的應用程式,時程表未定。

Pixel 8 Pro第一波將上線兩大AI功能:

AI功能一:錄音工具摘要
可增強錄音功能的準確度,並且一鍵完成會議、訪談等錄音工具內容的摘要,不錯過細節,並且這些功能都是內建在手機,即便在離線的情況也能使用。

AI功能二:Gboard智慧回覆
開發人員預覽版的Gboard可啟動智慧回覆功能。AI根據收到的訊息給予回覆建議,節省使用者打字時間,目前率先支援Whatsapp,計畫於明年支援更多App。

在雲端龍頭亞馬遜AWS發出「世界上沒有最強模型」的宣言後,Google端出號稱「世界最強模型」應戰,並透過模型大小的彈性,卡位手機等終端應用開發市場,同時強調通用型能力,力求在生成式AI領域進入最多使用場景。

延伸閱讀:Gemini其實不是要幹掉ChatGPT!Google兵分三路想做什麼?

責任編輯:林美欣

往下滑看下一篇文章
全台首創對話式金融服務iWish 永豐銀讓GAI真正走進金融交易現場
全台首創對話式金融服務iWish 永豐銀讓GAI真正走進金融交易現場

你還在手寫填單、逐格Key-in資料嗎?在生成式AI浪潮席捲各行各業之際,永豐銀行推出全台首創「說話就能完成交易」的智能對話式金融服務iWish,讓繁瑣的填單流程成為過去式,使用者可以透過文字輸入、口說敍述或上傳照片等方式,向AI傳達自身需求,無論哪一種方式,AI都可以即時理解使用者意圖,並根據與使用者的對話內容,自動填寫存款、提款、轉帳、匯款等相關表單,顛覆使用者對金融服務的想像。

生成式AI再進化,開啟AI代理人時代

隨著生成式AI的進步,LLM大型語言模型已具備多輪對話和上下文理解的能力,甚至正邁向可以獨立完成任務、不需要人類涉入的AI代理人(AI Agent)的新階段,這項技術突破讓企業既有服務得以展現全新樣貌。

以國際證券經紀商FBS為例,其推出的FBS AI Assistant服務,跳脫傳統單向建議模式,不直接提供評論或建議,而是讓用戶先選擇一至多項技術指標,再交由生成式AI模型解讀並生成專屬分析與操作建議,打造更具互動性與參與感的使用體驗。

永豐金控數位科技長張天豪認為,這種以生成式AI為核心的互動式服務模式,將大幅優化客戶的使用體驗,成為金融服務新常態。未來,客戶不必學習如何操作App,也不用記得交易程序,只要用對話、上傳照片或螢幕截圖等自己習慣的方式表達需求,AI就會理解並協助完成後續動作。「未來的金融服務將像生活中人與人之間的對話一樣,簡單而自然,」張天豪強調。

永豐銀行
前排由左至右:永豐金控數位科技長 張天豪、永豐銀行資訊、數位及作業督導張升寶、永豐銀行綜合企劃處處長 王筱嵐 後排由左至右:永豐金控數位科技處專案經理 林維婕、永豐金控數位科技處專案工程師 廖庭暘
圖/ 永豐銀行

從填單到對話,iWish重塑分行服務體驗

瞄準此未來趨勢,永豐銀行進一步盤點金融服務場景,決定從最貼近客戶的分行場域出發,打造互動式服務新體驗。

張天豪說明,臨櫃交易往往需要填寫各式各樣的表單,這些表單格式通常很制式、欄位繁複,對不熟悉流程的客戶而言,常常填到一半才發現格式錯誤、填錯位置,甚至必須整張重來,徒增挫折與作業時間。

「iWish服務的推出,就是為了讓這段流程可以變得更自然、直覺且輕鬆,」永豐銀行資訊、數位及作業督導張升寶說,客戶不再需要手寫填單,只要開口說、輸入文字或是上傳圖片,告訴iWish想要使用哪些金融服務,就可以完成交易,將原本繁瑣、仰賴經驗的填單作業,轉化成只需一句話或一張圖就能搞定,大幅提升臨櫃交易的服務體驗與作業效率。

以轉帳交易為例,客戶可以口說轉帳帳戶及金額,或是上傳網購訂單的轉帳頁面截圖、團媽在Line上提醒轉帳付款的對話截圖等,iWish會從中辨識表單所需資訊並精準填入銀行系統中對應的欄位,待客戶確認資訊無誤之後,系統就會生成一個二維條碼,只要將二維條碼交由臨櫃人員完成最後核對,就能輕鬆完成金融交易。

AI減輕行員負擔,專注更高價值服務

除了顛覆客戶的使用體驗,iWish服務也為內部作業流程帶來優化和改變,「對永豐銀行而言,iWish服務不是引進AI技術的炫技展示,而是與現有服務模式的無縫融合,讓創新落地、貼近人性」,永豐銀行綜合企劃處王筱嵐處長說。

王筱嵐進一步表示,最開始,金融交易需要經歷「客戶填單+櫃員輸入」的雙重程序,不僅耗時,也容易出錯。之後,永豐銀行推出免填單服務,客戶可以口述或將交易資訊抄寫在紙上,交由櫃員輸入至系統中、列印單據,待客戶簽名確認即可完成交易。

永豐銀行
圖/ 永豐銀行

而iWish則是免填單服務的再進化,藉由生成式AI(GAI)的語意理解與圖像辨識能力,取代櫃員的手動輸入作業,不僅提高效率與準確度,也大幅降低櫃員的作業負擔,可以將心力投注在更有價值的服務與溝通上。

GAI不只是客服輔助工具,更是金融轉型的推進引擎

相較於目前金融業的生成式AI應用,多數仍停留在客服階段,iWish是全台首創直接導入金融交易場景的GAI服務,堪稱跨出關鍵一步。

然而,在實際開發過程中,永豐銀行團隊也面臨諸多挑戰,其中壓力最大的,便是如何降低LLM可能出現的「幻覺」與辨識錯誤風險。尤其在金融交易場景中,AI的辨識精準度不僅關係到客戶權益,更直接影響其對金融服務的信任感,必須以更審慎的態度來看待。

為此,永豐銀行從多個面向著手提升模型準確度,包括優化Prompt設計與模型邏輯、與前線單位密切協作,共同討論介面呈現、使用流程與應用情境、在UI/UX介面加入提醒文字與引導機制,避免造成誤解。此外,團隊也分階段進行大規模封閉測試,邀請全行數百位同仁參與測試,並根據測試結果持續微調優化,確保最終推出的服務穩定度。

iWish的智慧來自於訓練與學習,「越用越聰明」的特性需要使用者參與激發

iWish是一款全新上市的智能服務,專為提升臨櫃交易體驗而設計。現階段iWish服務聚焦於台幣存款、提款、轉帳及匯款4大交易類型,並以「分行」為主要場景,未來則計劃將iWish服務擴展至更多金融交易類型,甚至走出分行場景,與iBranch等線上服務結合。

永豐銀行
永豐iWish以「智讀」、「智說」、「智寫」人性化操作,讓金融交易更方便快速
圖/ 永豐銀行

iWish的成功落地不僅是技術突破,更宣示意味著,生成式AI正式從客服輔助工具,搖身一變成為可以理解意圖、自然回應、主動引導的智慧助理,讓用戶在熟悉的對話情境中完成交易,實現真正以人為本的金融體驗。而AI模型的成長需要訓練,iWish在初期也需要客戶的參與來變得更聰明,透過接觸到更多元的使用情境,進一步完善服務,讓每一次互動都更懂客戶的需求。

「iWish服務只是第一步,」張升寶認為,這項服務不僅重新定義人與銀行的互動方式,也為生成式AI在金融業的應用看見新的可能。他期許未來能進一步擴大AI Agent應用範圍,讓AI不再只是輔助工具,而是驅動金融轉型的核心力量。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
蘋果能再次偉大?
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓