Google推出Gemini 2.5 Flash Image!AI修圖不再「走鐘」,還支援多圖融合:5大亮點一次看
Google推出Gemini 2.5 Flash Image!AI修圖不再「走鐘」,還支援多圖融合:5大亮點一次看

重點一:Google推出Gemini 2.5 Flash Image模型,支援多圖融合、角色一致性及自然語言影像編輯。

重點二:目前開發者可即時透過Gemini API與Google AI Studio使用該模型。生圖一張約耗費 1290 個輸出代幣,換算下來單張圖片定價約新台幣1.2元。

重點三:Google強調,所有生成或編輯的圖片均嵌入SynthID隱形浮水印,確保AI創作可被識別。

Google於台灣時間8月27日推出全新一代AI影像生成與編輯模型Gemini 2.5 Flash Image(又稱nano-banana),主打多圖融合、角色一致性和自然語言精準編輯等功能,期望以更強大的技術能力,打破過往生成式AI在細節、語意理解上的瓶頸。

該模型目前已開放開發者透過Gemini API及Google AI Studio試用(經測試仍未在Gemini網頁版開放)。Google指出,單張圖片定價約為新台幣1.2元(以美元$0.039計),並全面導入SynthID隱形浮水印技術,保障AI生成內容可追溯來源。

生圖技術大突破!支援多圖融合與角色一致性

Gemini 2.5 Flash Image標榜可同時處理多張輸入圖片,融合成全新場景或物件,並維持主角或產品在多次生成、不同環境下的視覺一致性。白話來說,就是解決過以往AI難以跨場景重現同一角色外觀的痛點(例如下Prompt修改後,原本的角色長相就變了)。官方強調,而也讓品牌、商品型錄、教育互動等商業生圖應用更具可行性。

Google亦釋出多款範例App,包括角色一致性、房地產卡片、員工識別證等模板,開發者可直接在Google AI Studio以「vibe coding」方式,自行混搭、客製化功能,降低技術門檻。總結來說,本次的生圖新模型具備以下特色:

  1. 角色一致性
    能在多個場景或不同角度下,維持同一角色或物件的外觀一致。適合用於故事敘述、品牌資產設計、產品多角度展示等。

    1. 提示式影像編輯
      透過自然語言指令,精確地對影像進行局部或整體修改例如:模糊背景、去除污漬、移除人物、改變姿勢、為黑白照片上色等。
  2. 多圖融合
    能理解並合併多張輸入圖片,像是將物件放入新場景、重新設計房間色調、快速生成產品情境照等。
  3. 互動式教學與世界知識應用
    利用 Gemini 的世界知識,能理解手繪圖、協助解答現實問題,並依據複雜指令進行影像處理,適合互動式教學應用。
  4. 視覺模板應用
    可依據既有設計模板,批量生成如房地產卡片、員工證件、產品型錄等統一風格的影像。
炭治郎掃地
經《數位時代》測試,同時上傳背景(夜市)、人物(炭治郎)、物件(掃把),Gemini確實可以依照指令合成圖片。
圖/ Gemini生成

慎防DeepFake!生圖將嵌入SynthID隱形浮水印

Google強調,所有經該模型生成或編輯的圖片,皆會嵌入SynthID隱形浮水印,確保AI創作可追溯、辨識,回應日益嚴峻的數位內容真實性與版權管理議題。

SynthID 是 Google DeepMind 推出的隱形浮水印技術,專為 AI 生成內容設計,會在 AI 生成的內容中嵌入人眼無法察覺的數位浮水印,其可被專用演算法偵測。即使內容經過裁切、壓縮、濾鏡等常見編輯,浮水印仍能被辨識。當媒體、平台或用戶懷疑某內容為 DeepFake,就可利用 SynthID 檢測工具判斷其是否為 AI 生成。

Google強調,未來將持續優化長篇文本渲染、角色一致性及細節表現,並邀請開發者社群參與回饋。

延伸閱讀:GPT-4o生圖全網擠爆,免費版要等等了!如何生成「吉卜力風」?比Grok更厲害嗎?

使用AI有多耗能?Google官方給解答:詢問Gemini一次耗電約「運轉微波爐1分鐘」, 並耗費5滴水

資料來源:GoogleTechChurch

本文初稿為AI編撰,整理.編輯/ 李先泰

關鍵字: #Google #AI
往下滑看下一篇文章
AI代理時代已至!國泰金控以GAIA 2.0框架加速AI應用百花齊放
AI代理時代已至!國泰金控以GAIA 2.0框架加速AI應用百花齊放

AI正以驚人速度重塑世界樣貌,金融產業也不例外。國泰金控作為台灣最大的金融控股公司之一,不僅積極擁抱創新變革,更透過開放分享促進產業共好:在「2025國泰金控技術年會」中分享「GAIA 2.0技術框架」,揭示多代理(Multi-Agent)雲端協作架構,讓AI從知識問答助理進化成可以自主推論、規劃與協作的夥伴,拉開以人為中心的金融科技新世代序幕。

以GAIA 2.0技術框架為基礎,加速集團應用百花齊放

GAIA是國泰金控為實現AI即服務(AI as a Service)提出的關鍵技術框架,歷經一年的發展,不僅成功建立超過200種資料類別的知識庫、彙整50多種生成式AI模型的Model Hub、設有70道安全防護檢查點的AI護欄。

國泰金控
國泰金控副總暨國泰世華銀行數據長梁明喬分享GAIA 2.0技術框架與集團GenAI應用案例
圖/ 數位時代

國泰金控副總經理暨國泰世華銀行數據長梁明喬指出:「隨著代理式AI技術崛起,我們在今年提出GAIA 2.0技術框架,目標是讓AI助理(Assistant)進化成AI Agent,可以跨單位整合工具、數據與分工,實現真正的智慧協作。」

舉例來說,為深化集團員工運用AI提升工作效率,我們打造員工AI助手—Agia,協助同仁進行知識查詢、資料摘要等任務,提升效率與生產力;另外,透過AI自助開發平台—GAIA Studio,讓員工以No Code工具,連結內部知識庫,並以視覺化介面或Prompt快速自主開發,打造業務場景所需的生成式AI服務與工具。GAIA Studio 上線三個月已有28個部門自助開發超過40支內部應用AI服務(包含行銷文案、各類產品知識、趨勢摘要等)。

在技術面,具體作法是透過GAIA 2.0框架下的四個模組,包含負責統籌AI Agent任務分配與協作流程的「Agent Core核心框架」、提供安全自主運作環境的「Agent Workspace可控環境」、連結Agent間共通語言的「Agent Protocol串接協定」,以及集中管理AI工具與元件的「Agent Marketplace整合市集」,以加速AI Agent應用研發與部署。

梁明喬表示:「接下來,我們將以GAIA為引擎,打造通用型、業務型、IT型與服務型AI應用,如Vibe Coding、CUBE Intelligence等服務,一步一腳印擴展集團的AI Agent生態圈,型塑智慧金融新格局。」

舉例來說,隨著生成式AI普及,客戶對於數位(助理)服務的期待更高,國泰世華銀行數位品牌CUBE推出「CUBE Intelligence」兩項新服務,包含「升級版」智能助理–阿發,滿足客戶詢問複雜問題的需求,無論客戶提出什麼問題,都可以完整步驟與適當的情緒價值強化與客戶的連結,讓服務更智慧、貼心且符合期待。

國泰金控
國泰金控副總暨國泰世華銀行數位長陳冠學展示「CUBE Intelligence」兩項新服務
圖/ 數位時代

國泰金控副總經理暨國泰世華銀行數位長陳冠學表示:「除了升級版阿發,另一新服務是我們也在CUBE App新增『對話式功能搜尋(CUBE Search)』,就像把行員放到CUBE App一樣,讓客戶可以用自然語言輕鬆找到想要的服務,讓服務體驗變得更聰明、更人性也更懂你。」兩項CUBE Intelligence新服務即將在年底正式上線。

跨界合作推動台灣大型語言模型落地,加速生成式AI發展

大型語言模型具備強大的語意理解與內容生成能力,是生成式AI快速發展的關鍵推力。國立政治大學金融科技研究中心主任王儷玲指出:「金融產業因為有獨特的金融語境、法規語意以及在地化的繁體中文知識,國際通用模型並不適用,必須建構本土知識庫、標準化模型機制、AI 法規沙盒及在地算力平台,發展台灣企業共同主導與管理的大型語言模型,方能讓更多金融業者透過微調打造適用模型、加速可信賴的AI Agent服務落地。」

國泰金控數數發中心數據暨人工智慧發展部副總經理劉浩翔進一步補充:「本地大型語言模型的成功關鍵,不僅是掌握充足且高品質的數據,還要透過後訓練微調與人類回饋強化學習的訓練方式去微調出適用的AI模型,藉此提升答案的精準度,尤其是需要跨法規、多層邏輯的嚴謹金融專業知識。」

AI要成功,除了應用場景、模型,算力也扮演至關緊要角色,對此,鴻海科技集團亞灣超算執行長姚延宗表示:「本土算力是支持本土大型語言模型落地的關鍵。」不過,他也強調,AI算力快速迭代且進入門檻高,不是每一間企業都可以自建算力,因此,亞灣超算與NVIDIA合作啟用超算中心,讓金融等台灣企業可以按需租賃所需算力,解決資料共享等敏感問題,加速金融AI應用的多元發展。

國泰金控
產業與學界專家於國泰金控技術年會交流生成式AI如何在台落地應用,左起為:國泰金控副總經理施君蘭、政治大學金融科技研究中心主任王儷玲、國泰金控數數發中心副總經理劉浩翔、鴻海科技集團亞灣超算執行長姚延宗
圖/ 數位時代

總的來說,從GAIA 2.0技術框架的推出、生成式AI的落地應用、到積極參與本土大型語言模型建置等行動,可以清楚看到,國泰金控正由內而外推動全面AI創新:強化內部流程效率與治理能力、以智慧化服務提升客戶體驗,並透過技術開放與跨域合作,為金融產業的數位與AI智慧轉型注入新動能。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
進擊的機器人
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓