讓人工智慧開發遊戲,人類玩家只有被虐的份
讓人工智慧開發遊戲,人類玩家只有被虐的份

日前藉著全球最大的遊戲開發大會GDC17的機會,英偉達宣布推出最新款遊戲用顯示卡GeForce GTX 1080 Ti。新顯示卡採用16納米製程Pascal架構,具備3,584個CUDA核心以及高達11GB的顯存,從紙面參數上新核彈比上一代遊戲/通用運算多用途顯示卡Titan X性能稍強一些,比自己的前輩產品GTX 1080也強了35%。

但在新核彈的喧囂之餘,PingWest關注到了英偉達在遊戲開發方面的更多主張和嘗試。 這家稱自己「All about AI」的運算技術公司,正在快速改變遊戲和AI的關係。

此AI非彼AI。在過去,遊戲AI可以指所有非玩家角色 (NPC),比如劇情中的配角、Boss和商人等,也可以再進一步,泛指所有遊戲的非玩家內容,比如作戰機制和商業系統等等。它是由人設計的。

但英偉達覺得,遊戲產業即將進入一個新的AI時代——用AI來輔助設計和開發遊戲,而且品質並不遜於人工製作。

「簡單來說,過去的AI就是規則和腳本,讓AI照著你的設計行動,再到後來有了決策樹,更先進一些。」英偉達應用深度學習研究部(Applied Deep Learning Research) 副總裁布萊恩·卡坦薩羅稱。但他認為,隨著深度學習技術突飛猛進式發展,AI可以幫助開發者生成音畫素材,甚至劇情、任務等機制性的內容。

過去兩年,英偉達已經帶來了多項基於機器學習和神經網絡的工具,以解決遊戲開發者面臨的棘手難題。舉個例子,大型遊戲的一大特點是畫面精美,但這需要美工畫師和視覺設計師巨大的精力去創作材質。受制於人員和財力,中小開發者往往在視覺質量上打了折扣,更多人選擇了矢量化,甚至更粗糙的視覺風格。

英偉達高級開發技術經理安德魯·艾德斯登展示了一項名叫2Shot的技術,讓開發者更輕鬆地從真實世界中提取材質,應用到遊戲中:只需分別打開和關閉閃光燈,用手機拍攝兩張對象材質的照片,運算機將對它們進行自動處理,幾分鐘後即可生成素材文件。

2shot-nvidia

2Shot極大降低了開發者優化材質的技術門檻,但它仍有很大的提升空間。英偉達在去年又提出了1Shot技術,採用更強大的神經網絡進行運算,只需一張照片就能生成素材,時間也降低到了數秒的時間。2Shot的生成素材質量已經達到了工業級,而1Shot的質量還有待提高,但它們已經證明了機器學習和神經網絡在遊戲開發方面的應用前景。

布萊恩·卡坦薩羅

布萊恩·卡坦薩羅

英偉達還展示了另外兩種技術,分別名為Texture Multiplier和Super-Resolution。

Texture Multiplier(材質複製器)類似於視覺特效人員常用的「材質增生」(texture mutation) 技術,最大的不同是採用了經過了大量訓練的捲積神經網絡(Convolutional Neural Network) 作為生成器,生成的效果高度接近真實,達到了肉眼難以分辨的水平。Texture Multiplier將使得美工人員可以快速製作美觀的大片面積材質,不再給人一種「你這材質複製黏貼的吧!」的感覺……

而Super-Resolution(超分辨率)則聽起來更為科幻。記不記得《神鬼認證5》裡的情節:CIA特工在雅典憲法廣場上尋找伯恩,用模糊的定格畫面,「放大、增強!」(Zoom, enhance),然後就獲得了一張特別清晰的照片,確定了目標?

img_0640

其實過去根本沒有這種高科技……至少在《神鬼認證5》拍攝期間還沒有,直到最近才有類似的出來。前不久Google的大腦團隊實現了將8×8像素分辨率的,極度粗糙和顆粒化頭像,還原成比較清晰的,達到了32×32分辨率的頭像,而英偉達也在做類似的事情。

該公司研究者採用的具體訓練方法(注意:和其他機構方法類似,可作參考),是先把大量的高清晰度照片「縮小」(downscale)到非常低的清晰度,僅保留非常有限的特徵,同時另外把這個降級過程中損失的特徵保存下來。

super-reso-nvidia

採用這種方式處理了大量的高清圖片之後,研究者獲得了海量損失掉的特徵。他們將這些特徵整理合成一個「特徵規律庫」,就像辭典一樣,意圖在於告訴神經網絡:再去「放大」 (upscale) 圖片的時候,按照這個辭典去操作。當然,具體操作起來比這個口頭敘述的流程複雜得多,這個卷積神經網絡模型需要數天的時間才能完成訓練。

在此前的測試中,Google大腦團隊的同類技術能夠成功還原90%被打馬賽克的人臉,算是一個十分驚人的成績。而英偉達則不滿足於低清晰度,希望追求更「感人」的分辨率。艾德斯登告訴 PingWest,該公司已經在實驗室中實現僅花「很快」(數秒)的時間將1K分辨率重組為4K分辨率的高清照片。

這種技術能為遊戲帶來什麼改觀?英偉達期待它能夠在未來,讓遊戲在更小容量的基礎上,顯著提高材質的清晰度和視覺效果。舉個例子:在射擊遊戲中,當玩家舉起狙擊槍,瞄準鏡裡能顯示出更清晰的遠處畫面和材質。

sniper-elite-4-hitler-scope

不光是英偉達,Google旗下的英國人工智慧技術公司DeepMind,也在考慮用神經網絡在遊戲上搞點事情——當然如果你有印象的話,過去曾經傳出人工智慧在《打磚塊》、《星際爭霸》、《毀滅戰士》乃至於圍棋上碾壓人類的消息,大多都是DeepMind搞出來的……

該公司在去年訓練了一個名叫WaveNet的人工智慧,讓運算機生成的語音和人類原聲越來越難以區分。WaveNet和過去的串聯式語音合成、參數式語音合成不同,將語音的原始數據(波性文件)細分到了以1毫秒為單位的區間,在每一個區間之間都採用遞歸神經網絡(Recurrent Neural Network) 和卷積神經網絡進行預測學習。

WaveNet 的結構演示

WaveNet的結構演示

最後, DeepMind用Google自家的TTS語音轉文字(目前世界上得分最高的該類技術)數據集進行測試,比Google TTS的得分高了10個百分點——但將Google TTS與人類原聲之間的距離縮短了一半還多。

mos2.width-1500_qoPRcsw

雖然玩遊戲的時候,基本沒人會特別仔細地聽每一句對白,但不意味著開發者應該在這方便節省。WaveNet將會成為遊戲開發者的福音,「想像一下,當你需要調整劇情的時候,可以用運算機生成配音,不必再花錢請配音演員回來重錄,甚至完全不用配音演員。」卡坦薩羅稱。

你可以到WaveNet的網站上試聽一下效果,跟真人聲音差距真的很小。

好吧,現在AI有了生成聲音、視覺材質等元素的能力,接下來呢?

就在上週,遊戲開發公司Nival宣布了一個振奮人心的消息:他們給2015年發售的在線即時戰略遊戲《閃電戰 3》開發了一個神經網絡決策AI:Boris。

在一則演示影片中,Boris顯示出了「風箏」敵方單位的能力(指吸引敵對目標,帶其到處亂跑以打亂策略的行為);還可以在明顯具有劣勢時消極應戰而非拼死頑抗,以起到保存火力的目的;當戰場中有新的敵人加入,Boris會自動分配部隊火力到不同的目標上,也會根據敵方火力級別,自動指揮士兵坐上砲台,而不是傻站在地上,用步槍拼坦克。

boris-ai

更有趣的是,當雙方對抗佔點時,Boris會選擇性忽視那些擋路的殘血敵軍,優先搶點再等待機會擊殺—— 這一特徵顯示出了Boris AI對不同獎勵(reward)級別的理解,能夠優先追求與全局獲勝關係更大的獎勵。

Nival明確表示Boris沒有使用遊戲內核的任何地方數據,只使用對玩家可見的戰場情況,每幾秒鐘進行一次決策。Boris的更多技術細節暫未公開。

在遊戲開發中應用AI技術,還有很大的想像空間。

去年,OpenAI用《俠盜獵車手5》開發出了一個名叫DeepDrive 的「自動駕駛模擬器」。由於遊戲內部的車輛行駛數據應有盡有,OpenAI發現其實可以用遊戲數據來訓練自動駕駛系統。雖然後來研究者刪除了與該模擬器有關的內容(這裡有一個Twitter上的映片演示,這項技術所屬的專案官網還在),該事件還是令人印象深刻,它賦予了人們審視AI和遊戲之間關係的新視角。

像《俠盜獵車手》這樣的開放世界遊戲,開發公司花費多年時間設計了大量的任務關卡,但最快的玩家不出幾十個小時就能玩完全部的內容,繼而希望獲得更多的內容。然而開發公司要花更多精力在下一款遊戲上,無暇顧及上一代(實際上開發公司R星的做法是用一個相對較小規模的團隊維護遊戲,繼續添加新的在線遊戲模式)——未來,AI會不會獲得生成任務、關卡、劇情的能力,以至於可以獨立完成一個完整的遊戲?

卡坦薩羅認為那樣的未來會很棒,但應該只存在於設想階段,「 **我覺得設計關卡和任務最難的地方在於,你怎樣能讓新關卡和任務足夠有趣,這是目前AI還不能取代設計師的地方。**你可以讓AI生成對白,生成材質,但將對白、視覺、機制和劇情進行有序、有趣的拼接,它還做不到。我想可能有些幽默只有人懂。但我可以想像AI 未來能夠輔助設計師更快推出新的關卡和任務,那很將令人期待。」

聊到這裡,我倒是有點擔心了。

你說,AI設計的遊戲,會不會把玩家虐成狗?沒準AI早就想在模擬環境裡先感受一下,取代和虐殺人類是一種什麼樣的感覺吧……?

本文授權轉載自:PingWest

關鍵字: #Nvidia
往下滑看下一篇文章
從企業到政府,圓剛科技以MIT高資安打造頂級影音防線
從企業到政府,圓剛科技以MIT高資安打造頂級影音防線

從企業、政府的遠距會議,到國境通關與高度精準的手術現場,視訊鏡頭、麥克風影像擷取設備在各行各業中無所不在,一場隱形的資安革命也悄然發生。隨著全球地緣政治升溫,供應鏈去風險化浪潮席捲,加上資安事件頻傳,影音設備已不再是單純的硬體周邊,而是接入企業核心網路的通道,任何漏洞都可能成為企業或國家級的資安破口。

這也讓企業和政府採購思維產生根本性轉變,如今不再一味追求便宜,而是要兼具信任、品質與高資安,台灣影音直播設備龍頭圓剛科技,便以 MIT 研發製造,築起乾淨透明的供應鏈高牆,更以「三個 100%」的高品質承諾,成為企業、政府最安全的影音設備後盾。

不打價格戰,以三個 100% 建立透明供應鏈

這股從「價格」走向「信任」的市場轉變,圓剛科技全球品牌行銷處處長蔡柏輝非常有感。他透露,過去企業與政府採購影音設備時,往往以 CP 值為優先考量,以前第一句話問︰「鏡頭解析度多高?價格多便宜?」,現在卻問︰「這台設備的韌體是哪裡寫的?晶片來源乾淨嗎?會不會有資安後門?」「現在採購完全不一樣了,他們更重視產品的信任感和高資安,還有供應鏈是否絕對穩定。」

外界對圓剛的印象,或許還停留在直播主螢幕後、在台灣搶下超過九成市占的影像擷取設備,但事實上,圓剛深厚的影音技術早已延伸至政府、國防、金融、醫療與高科技等產業中。面對市場上的低價競爭,圓剛不打價格戰,而是以「百分百 MIT 研發製造」、「高品質」與「高資安」為訴求,為無數對安全極度敏感的企業與機構,打造可信賴且極致穩定的影音解決方案。

蔡柏輝表示,圓剛堅守「三個 100%」:100% 研發透明、100% 供應鏈可追溯、100% 嚴格品質把關。市面上九成影音品牌都是貼牌採購,但圓剛成立 36 年來,始終堅持在台灣進行產品研發與製造,從來源就建立更透明、更可控的管理機制,嚴格篩選非紅供應鏈,從源頭杜絕潛在的資安後門風險,成為客戶最安心的「台灣優選」品牌。

圓剛科技全球品牌行銷處處長 蔡柏輝
圓剛科技全球品牌行銷處處長 蔡柏輝
圖/ 數位時代

圓剛不僅擁有自己的研發團隊,也建立自主驗證實驗室,產品出廠前必須經過長時間的散熱與壓力測試、靜電防護、電磁相容性驗證等,以車規與工業級標準打磨每一台設備,消除瞬間黑屏或當機風險,確保設備在會議室、指揮中心、教育場域及政府機關等多種環境中,都能長時間穩定運作。

當市場出現新的資安漏洞或作業系統更新帶來的相容性問題,圓剛也能迅速回應,在最短時間內完成韌體修補、測試並推播更新,把客戶的維護成本降到最低。正因為對產品穩定度有著絕對信心,圓剛針對政府及產業應用相關產品,提供最高五年的品質保固保障,這更是其他貼牌廠商完全無法提供的承諾。

工業級高品質表現,滿足企業多元場景需求

正是這份堅持,讓圓剛的影音設備能在眾多要求高資安、高品質的專業場域落地。以國境安全為例,民眾在邊境通關的臉部辨識系統,就是採用圓剛高畫質 4K 視訊鏡頭(PW515),可精準自動對焦,大幅降低光線干擾,提升臉部辨識成功率與通關效率。在查驗包裹與貨物的 X 光機上,也採用圓剛的影像擷取卡(GC571),以零延遲、無壓縮的高清細節,提供最真實的影像,成為邊境防毒防私的第一線眼睛。

圓剛 PW515 可精準自動對焦,大幅降低光線干擾,提升臉部辨識成功率與通關效率。
圓剛 PW515 可精準自動對焦,大幅降低光線干擾,提升臉部辨識成功率與通關效率。
圖/ 數位時代

在國防單位和國家科研機構中,不論是遠距視訊會議,或是戰情傳遞,不少重要會議導入圓剛的視訊鏡頭和智慧降噪會議揚聲器(AS315),避免因藍牙等無線傳輸,在半路被攔截資訊封包,同時滿足通訊清晰、不中斷的需求。

在高階醫療場域,圓剛展現了對影像細節的極致要求。以微血管超音波為例,由於臨床判讀極度依賴影像還原度,些微的色偏或失真都可能影響醫師診斷。圓剛專業級影像擷取器(GC535)透過 4K 解析度與 RGB24 無損色彩還原技術,能將最原始、無壓縮、不偏色的精細畫面傳輸至系統,協助醫師進行精準判讀。考量到醫療設備需長期高強度運作,全機以金屬工藝打造,可高效散熱,確保在任何嚴苛環境下都能運作穩定。

圓剛的高階擷取盒(GC535)支援 4K 高畫質、RGB24 無損色彩還原,協助醫師進行精準判讀。
圓剛的高階擷取盒(GC535)支援 4K 高畫質、RGB24 無損色彩還原,協助醫師進行精準判讀。
圖/ 數位時代

在金融領域,圓剛的 4K 視訊鏡頭也用於銀行的自動開戶機台,滿足金融業嚴苛的遠端身分驗證與銀行級資安防護。而台灣 IC 設計大廠和車用導航大廠,在研發階段檢測 HDMI 影像訊號時,也採用圓剛的擷取設備,進行無壓縮的影像採集,確保出廠時產品品質毫釐不差。

持續深化影音技術,打造極致安全順暢體驗

從合規晶片、台灣製造到硬體無隱藏連網模組,圓剛一層層打造嚴密的資安屏障,「圓剛不只是賣視訊設備的硬體廠商,更是國家級與垂直產業中,最值得信賴的影音安全防線,」蔡柏輝說。

未來這個防護網也將持續進化,讓設備變聰明,但資料不出門。過去要做到智慧降噪、自動對焦追蹤或多畫面切換,常需依賴外部軟體或雲端運算,這對資安敏感的企業來說是極大隱患。未來圓剛的商用擷取卡與視訊鏡頭,將直接在硬體本機上完成所有影像與音訊的智慧處理,無論是消除會議室外的雜音,或是廠務檢測設備時瞬間抓取細節,所有運算都在設備內一秒搞定,蔡柏輝強調︰「一個封包、一張畫面都不需上雲端,這才是政府、企業、金融與國防真正敢用的智慧影音。」

針對現代企業裡的複雜運作環境,可能同時存在不同的作業系統與各類專用機台,圓剛也將持續以「隨插即用」(Plug-and-Play)與極致相容性為核心,讓設備無縫對接產業既有的會議軟體、醫療儀器、銀行櫃員機或軍警戰情室。客戶不需打掉重練,就能輕鬆獲得國家級的影音傳輸品質與資安防護,成為企業各種設備的萬能影音樞紐。

蔡柏輝堅定地說︰「圓剛未來目標非常明確:『讓商用影音導入變得極致順暢,讓資安防護做得滴水不漏。』」當數位轉型邁入資安至上的全新紀元,圓剛將持續以「MIT 信任」、「高資安」、「高品質」三大防護,做全球企業最值得信賴的影音後盾。

圓剛科技將持續深化影音技術,打造極致安全順暢體驗,讓商用影音導入變得極致順暢,讓資安防護做得滴水不漏
圓剛科技將持續深化影音技術,打造極致安全順暢體驗,讓商用影音導入變得極致順暢,讓資安防護做得滴水不漏。
圖/ 數位時代

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
一次搞懂工業AI
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓