OpenAI於美國時間9月8日推出新一代圖像模型ChatGPT Images 2.5,主打三件事:細節更清晰、修圖更精準、生成速度更快,生成延遲較前一代Images 2.0最多降低50%。
新模型自當天起陸續對所有ChatGPT、ChatGPT Work與Codex用戶開放,涵蓋各方案,桌機、手機與網頁版都能用。OpenAI指出,每周有超過30億張圖片透過ChatGPT Images與API的GPT-Image系列模型產生。
ChatGPT Images 2.5是什麼?生圖快50%、修圖更精準
所謂細節更清晰,OpenAI指的是保真度:從參考照片出發時更能保留人物辨識度,光線與材質更接近真實。理解力也有提升,複雜的視覺指令消化得更好,透明背景這類版面需求也能處理。速度方面,延遲降低讓使用者能更快反覆修改。《9to5Mac》報導指出,這次更新距Images 2推出約五個月。
AI生圖常見的挫折之一是「改一個地方,其他地方跟著變」。OpenAI稱Images 2.5只修改使用者要求的部分,其餘細節維持不變;在較長的對話中連續修改時,先前的改動不會被吃掉,畫質不會愈改愈差。
## ChatGPT Images 2.5有哪些新功能?Sketch、模板等4大工具一次看
ChatGPT介面配合推出四項工具:
- Sketch:在ChatGPT裡手繪草圖當作視覺參考,輸入「@Sketch」即可啟用。
- 模板:海報、商品周邊等常見格式提供起手模板,填入資訊與風格即可。
- 圖上留言:直接在圖片上標註要改的位置。
- 分享提示詞:分享圖片時一併附上提示詞,他人可換上自己的照片重跑。
ChatGPT Images 2.5 API同步上線:Flare、Sunburst有什麼不同?
API端同步上架兩款模型。GPT-Image-2.5 Flare是多數應用的預設選擇,官方稱其畫質高於GPT-Image-2、延遲低50%,適合社群內容與大量生成;GPT-Image-2.5 Sunburst鎖定高階視覺工作流,多輪編輯的控制更緊密,生成時間較長,適用於可直接上線的廣告素材。早期客戶包括Higgsfield AI、Adobe、Manus與Runway。
安全機制方面,Images 2.5繼續使用C2PA內容來源標記與隱形水印,協助辨識由OpenAI工具產生的圖片。官方定價頁對兩款模型採每百萬token計價,未提供單張價格。
ChatGPT Images 2.5 Sketch怎麼用?實測手繪草圖生成圖片
《數位時代》在ChatGPT手機版實測Sketch,隨手畫了房子、火柴人、地平線與兩叢草的草圖,指令只給「風景畫、野獸派風格、油畫」,約20秒出圖。
成品的四個元素位置與草圖完全一致,回字形窗戶被畫成三層同心方框,火柴人也被原樣畫成黃色線條人,沒有自動變成真人,反倒是沒畫的太陽與山脈被補了上去。換句話說,Sketch對構圖忠實到近乎照抄,要它「看懂」草圖背後的意思,得用文字明講。
這次實測也反映出Sketch比較適合拿來「指定構圖」,而不是讓AI自行理解草圖意圖。如果你已經知道人物、物件要放在哪裡,可以先用簡單線條決定位置,再透過文字提示補上風格、材質與細節;但如果希望AI把火柴人理解成真人、把簡單方框變成特定物件,仍需要在提示詞中明確說明。
對一般使用者來說,Images 2.5真正有感的升級,不只是單次生成的畫質,而是從草圖、生成到反覆修改都能留在同一個工作流程裡。尤其當「只改指定區域、其他地方不要動」變得更可靠,ChatGPT Images也就更接近一套可以反覆溝通、修改的圖像工具。
資料來源:OpenAI官方公告、《9to5Mac》、OpenAI API定價
本文初稿為AI編撰,整理.編輯/ 李先泰
