Sora實測|用文字生成的「魔幻MV」出爐,準確度拚過Runway、Pika?
Sora實測|用文字生成的「魔幻MV」出爐,準確度拚過Runway、Pika?

OpenAI今年2月發布影片生成工具Sora,宣稱可透過文字生成影音內容,由於應用範疇廣泛,引起全球相關產業人士關注。據外媒《Financial Times》報導,在人類一定的提示之下,Sora已經可以應用在廣告、音樂MV的實作過程,以加快創意領域工作者的溝通過程。

從事廣告業的品牌顧問班揚(Charlotte Bunyan)指出,她在為知名超市製作廣告影片時透過Sora實作,並同時比對同為文字生成影音內容的AI模型Runway和Pika的功能,這兩家公司都聲稱只需幾個詞彙提示,就能生成AI影片內容。

班揚指出,無論是Sora、Runway或Pika,都能透過「將想法可視化」來加快交流創意想法的效率,但Sora對提示內容的呈現更加準確。但她也強調,現階段無論使用何種AI模型,生成內容都需要人類進一步處理。

報導中也指出,獨立藝術家Washed Out的新歌《The Hardest Part》MV,是透過Sora製作的最長作品。據悉,MV中的影片,是由Sora依據詳細的文字提示所生成的55個片段拼接而成。但這些片段的連貫性仍有瑕疵。例如同一名角色在不同的影片秒數中長相不一。

對此,特里洛在推文中指出,這些差異反而增強了影片的奇幻性。他認為Sora能夠強化生成內容的創意元素,「但不應成為主導工具。」

《數位時代》曾報導過Sora亮點,以下是原報導:

從和人無礙對談、寫程式到通過Google的工程師面試,OpenAI的生成式AI已經展露過眾多能力,現在他們又掌握了一項新技能:拍影片。新亮相的AI模型「Sora」讓用戶能夠用短短一句話,生成長達1分鐘的擬真影片。

「為您介紹Sora,我們的文字轉視訊模型。Sora可以在保證畫面品質及遵守用戶提示詞的前提下,生成長達1分鐘的影片,」OpenAI在官網中表示。

生成影片極具真實感,OpenAI揭露最新影像生成技術

生成影片的AI其實並不新鮮,從Google、Meta等科技巨頭到成立不滿一年的新創Pika Labs等公司,都發表過生成影片的AI技術。而Sora最大的特點在於極其逼真,外媒《Wired》聲稱,這是沒有在其他影片生成AI模型中看見過的真實感,並且生成的影片長於其他模型。

根據OpenAI在官網上的介紹,Sora能夠生成包含多名角色、特定動作類型以及大量細節的複雜場景,而且AI不僅了解用戶在提示詞所說的各種物體,還知道這些物體是如何存在於現實世界,進而營造出讓人驚豔的逼真感受。

另外,Sora也對語言有著深入理解,可以準確的呈現提示詞所說內容,生成吸引目光的飽滿角色,且可以在一段影片中建立多種不同的鏡頭,並精準保留角色及視覺的風格。

OpenAI也在官網上揭露了大量演示影片,例如一名女子走在東京街頭的短片,其提示詞為:

「一名穿著時尚的女子走在充滿溫暖霓虹燈及招牌的東京街頭。她身著黑色皮夾克、紅色長裙及黑色靴子,拎著一個黑色包包,戴著太陽眼鏡,擦著紅色口紅,走起路來自信又隨性。潮濕的街道反射出七彩燈光,行人熙來攘往。」

(A stylish woman walks down a Tokyo street filled with warm glowing neon and animated city signage. She wears a black leather jacket, a long red dress, and black boots, and carries a black purse. She wears sunglasses and red lipstick. She walks confidently and casually. The street is damp and reflective, creating a mirror effect of the colorful lights. Many pedestrians walk about.)

這段1分鐘的短片裡,雖然從招牌文字、道路布局到路人過於平滑的移動等等存在不少破綻,但乍看之下仍然極為逼真,若是焦點放在時尚女子身上的話,或許一時半會沒辦法注意到這是全然由AI生成的影片。

且不光是具有現實感的現代影片,在提示詞:「淘金熱時的加州歷史鏡頭。」(Historical footage of California during the gold rush)裡,Sora就為影片打上了充滿年代感的濾鏡,不過包含建築布局等仍有一些仔細看便能發現的不合理之處。

OpenAI指出,目前的模型存在弱點,難以精準模擬複雜場景裡的物理原理,並且不太能理解因果關係,假如要求Sora生成一個人吃餅乾的影片,可能畫面中咬了一口餅乾後,餅乾仍然完好無缺。同時Sora還有些左右不分、難以精確呈現隨時間變化的事件等問題。

至於生成這樣一部充滿真實感的影片需要花上多長時間?OpenAI沒有公佈具體用時,僅向媒體透露所費時間大約是「出門吃一餐墨西哥捲餅」,

Sora還有些功能沒有對外展示,例如從一幅圖像生成短片,或者替既有影片填補上缺少的幀數,甚至延伸內容。OpenAI研究人員比爾.皮布斯(Bill Peebles)表示,「這是一種提高講故事能力非常酷的方式。你可以畫出想法,然後使其成為現實。」

目前Sora還無法撼動電影產業,因為每次生成的內容多少有所差異,不可能將120部1分鐘影片串成電影,但對於TikTok等短影音平台來說,將是顛覆性的新工具,即使是普通民眾也能利用AI技術生成高品質的短片。

一般民眾使用Sora還要再等等!OpenAI正與各界合作防範安全問題

不過如此逼真的影像生成能力,若被有心人士用來生成假消息,該怎麼辦?這也是為何OpenAI還沒有公開發布Sora的原因之一,目前該模型僅提供攻擊模擬團隊(red team)和少數藝術家、設計師及電影製作人使用。

OpenAI強調,目前他們正在開發能夠檢測假消息的工具,並計畫嵌入C2PA的後設資料(metadata),例如先前在Dall-E 3中,生成的圖像檔案資料上就會顯示該圖片是使用Dall E打造。除此之外,OpenAI聲稱也將一併包含Dall-E 3既有的使用規範,拒絕生成名人,以及暴力、性或仇恨內容。

OpenAI聲稱,他們正在與各國政府、教育人士及藝術家合作,以了解各界的擔憂及如何正向使用。「就如我們無法預測所有正向的使用方式,我們也無法預先知道所有惡意使用方式。」他們在官網上表示,「這也是為什麼我們認為從在現實世界的使用中學習,打造及發布更安全AI系統的關鍵。」

資料來源:OpenAIWiredThe Verge

關鍵字: #openai
往下滑看下一篇文章
溝通時間砍半、成交率衝 3 成!創造智能以完整 AI解方讓行銷事半功倍
溝通時間砍半、成交率衝 3 成!創造智能以完整 AI解方讓行銷事半功倍

隨著生成式 AI 工具快速普及,使用 AI 生成圖片、文案與影音素材,早已不再稀奇;真正困難的是,如何讓 AI 內容不只具備媲美真人拍攝的質感,還能精準貼合品牌語氣、商品賣點與社群傳播節奏,進一步帶動流量、轉換率與會員經營。

不過,有一家成立不到 5 年的團隊,卻憑藉著這項能力,吸引百年家電品牌、大型連鎖零售品牌、化妝品代工龍頭到政府機關等不同類型客戶合作。近期更與以創意出名的電商平台 蝦皮購物共同合作。

這家隱身在眾多一線大廠背後的 AI 操盤手,正是三立集團旗下的 MarTech 公司「創造智能」。相較於單純提供 AI 工具或單點行銷服務,創造智能更像是企業的 AI 行銷整合夥伴,不只是生成 AI 影音內容,而是從行銷目標出發,運用 AI 串起從內容生成、社群導流、顧客互動到會員經營的完整行銷旅程,突破過往內容與數據各自為政的盲點,這才是它真正讓企業買單的關鍵。

#1 創造智能
除了預算大幅減少、製作效率提升外,林慧珍指出,現在很多人都可以利用 AI 工具生成圖片或影片,但真正拉開差距的,不是 AI 應用能力,而是內容本身。創造智能刻意打造一支由行銷人才與工程師組成的「混血團隊」,兼顧 AI 影音內容的製作效率與品質。
圖/ 創造智能

串起行銷斷點,打造 AI 一條龍整合服務

對台灣企業行銷現場的長期觀察,是創造智能跳脫單一工具走向「AI 行銷整合」模式的起點。

創造智能執行長林慧珍指出,企業行銷工作往往交由不同廠商負責,從影音內容製作、廣告投放、社群經營到會員管理,各自使用不同工具與平台,導致資料散落在各處,形成一個個看不見的行銷斷點,一旦成效不如預期,很難釐清問題究竟出在哪一個環節,是素材無法打動消費者、投放策略失準,還是會員經營沒有發揮效益。

「很多 AI 或軟體業者的想法是,用自家產品去解決客戶的問題,但我們想的不只是解決問題,而是如何讓客戶用最方便、最完整的一條龍方式達成商業目標,」林慧珍強調,也因此,創造智能成立初期便鎖定AIGC 商業影音、AI客服/虛擬人及LINE CRM三大領域,希望從內容、互動到會員經營,串起完整的行銷流程。

在行銷旅程的前端,創造智能透過自家研發的系統與深厚的行銷經驗,快速產製出 AI 影音內容,協助品牌放大聲量、吸引目標受眾;接著透過 AI 客服與 AI 虛擬人即時回應顧客需求,不受時間、地點與語言限制,提高互動與成交機率;最後再藉由 LINE CRM 將流量收斂為品牌的第一方會員資產,透過會員貼標、分群分眾、自動化推播、再行銷等機制,持續深化顧客關係,將一次性的流量轉化為持續回購的忠誠會員。

用 AI 加速內容測試,快速找到市場答案

除了串起完整的行銷流程外,創造智能還能為企業創造兩大價值,第一個是協助企業更快找到真正打動消費者的內容。

「現在很多人都可以利用 AI 工具生成圖片或影片,但真正拉開差距的,不是 AI 應用能力,而是內容本身。」林慧珍指出,創造智能刻意打造一支由行銷人才與工程師組成的「混血團隊」,兼顧 AI 影音內容的製作效率與品質。

林慧珍進一步說明,團隊許多成員原本就來自專業影音團隊,長期協助企業製作導流影片,因此在劇本企劃、分鏡設計與敘事節奏上,累積大量實戰經驗。以近期協助蝦皮購物製作 AI 短影音為例,團隊並非直接交由 AI 工具生成內容,而是先分析目標受眾的偏好,再於腳本設計時加入企劃巧思。像是刻意運用消費者熟悉的歌曲氛圍,營造「似曾相識」的共感,引發社群討論。這些對品牌語感、社群節奏與內容敘事的掌握,正是創造智能團隊多年累積的內容經驗,也是現階段 AI 難以取代的核心價值。

另一方面,團隊則負責研發系統,以滿足企業多元行銷需求。例如:創造智能自行開發的「AI 導演模板」,不僅能快速生成高度擬真的影音內容,還可以依據品牌的不同需求,快速調整畫面風格、配音語氣與敘事方式,協助品牌進行 A/B Test,找出最能吸引消費者的內容。同時,還能依照不同社群平台需求,自動延伸出不同秒數與尺寸的版本,讓同一支影片快速應用於不同投放渠道。

更重要的是,從企劃發想到完成影片,最快約一週即可完成,不僅大幅縮短製作時程,也較傳統真人拍攝節省約 4 至 6 成的成本

讓 AI 走進工作流程,從客服升級為企業數位夥伴

創造智能為企業帶來的第二個價值是,透過 AI 客服 / AI 虛擬人推動流程自動化。林慧珍認為,AI 的價值不只是回答問題,而是深入既有的工作流程,以自動化服務協助企業降低成本、提升營運效率。

舉例來說,創造智能在與百年家電品牌合作時,先以 LINE 官方帳號與會員經營為核心,透過 LINE CRM 建立會員數據基礎,依據會員的瀏覽行為、產品偏好及互動紀錄,自動完成會員標籤與分群,並透過精準推播提供更符合需求的內容。隨著會員數據逐步累積,再進一步串接 Facebook 等社群平台,讓會員經營從單一通路延伸至跨平台互動,逐步建立完整的品牌數位接觸點。

目前,雙方合作已進入第二階段,將 AI 客服真正導入企業日常營運中。從客服受理、案件分流到售後服務,整個流程皆可透過 AI 與系統自動串接完成,不僅縮短服務時間、提升案件處理效率,也讓 AI 的角色從單純的客服工具,進一步成為串聯客服、門市與售後服務的企業數位夥伴。

同樣的模式,也被延伸到 B2B 外貿場景。創造智能為某知名化妝品代工廠打造 AI Sales(AI 虛擬人),並匯入產品知識與各國出口法規,讓 AI 不僅能以多國語言即時回覆海外買家問題,更可自動完成名片蒐集、預約真人業務及商機派單等流程,不僅溝通時間由 6 個月降至 3 個月,減少 30% 以上真人處理成本,訂單成交率提升 25%-32%,

#0 創造智能
某知名化妝品代工廠打造 AI Sales(AI 虛擬人)為例,AI已經可以回復日常問題的70%,真正優化前端開發的營運效率。
圖/ 創造智能

未來,AI 工具將持續演進,但企業真正需要的,始終是能協助創造商業價值的解決方案。林慧珍相信,唯有整合技術、內容與流程,並站在企業角度思考,AI 才能從工具升級為夥伴。這也是創造智能希望實踐的品牌理念──最人性化的MarTech 公司,創造更有溫度的智能夥伴。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
代理式商務連動百兆商機
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓