GPT-4為何這麼強?輝達GPU如何助攻?OpenAI發明者解密:人類可以完全信任它
GPT-4為何這麼強?輝達GPU如何助攻?OpenAI發明者解密:人類可以完全信任它
##### 黃仁勳與OpenAI創辦人對談

由人工智慧OpenAI所打造的ChatGPT,風潮延燒全球,當中也用到不少繪圖晶片大廠輝達(NVIDIA)出產的GPU。

執行長黃仁勳21日發表2023年的GTC大會演說時指出:「輝達的第一台DGX超級電腦,就是我親手交給OpenAI的。」

黃仁勳也在本屆GTC的議程中,與OpenAI聯合創始人暨首席科學家伊爾亞・蘇茨克維(Ilya Sutskever)開啟爐邊談話,雙方針對ChatGPT的誕生、訓練過程和未來願景進行對談。內容精華如下。

NVIDIA 創辦人暨執行長黃仁勳於GTC 2023回答媒體提問
NVIDIA 創辦人暨執行長黃仁勳於GTC 2023上,和OpenAI聯合創始人暨首席科學家Ilya Sutskever(伊爾亞‧蘇茨克維)開啟爐邊談話
圖/ 輝達提供

📍邀請您加入Web3+ Line社群,持續關注最重要的網路變革
👉 https://lin.ee/kItnyTh

##### ChatGPT是如何誕生的?

黃仁勳(以下簡稱黃): 你為何知道深度學習未來會發揮作用?你當初為何會接觸呢?

伊爾亞・蘇茨克維(以下簡稱蘇茨克維): 回到2003年,學習是一件人類可以做但電腦不能做的事情,甚至理論上能不能實現都不知道。因此我想,若能在深度學習上做出一些成績,可能會是人工智慧最大的進步。很幸運的是,我遇到Jeff Hinton教授,他是在研究神經網路,因為神經網路是在學習平行處理運算,與大腦運作很相似。雖然還不太清楚如何讓它有作用,不過在當時,這已經是當時最可行的方向。

黃: 你剛開始研究時,運算的規模如何?

蘇茨克維: 其實當時沒人覺得規模很重要,因此人們訓練的只有50到100個神經元,100萬會被認為太龐大。當時我們在CPU上跑我們的數據,我們做了一些實驗,什麼都試看看。Jeff Hinton當時也認為用神經網路解一些數學問題非常有趣,這是生成模型的源頭。但隨後問題就出現:什麼應用才能真正推動技術進步?

OpenAI聯合創始人暨首席科學家IlyaSutskever
OpenAI聯合創始人暨首席科學家IlyaSutskever開始打造神經網路時,幾乎沒人關心這項領域。

黃: 你何時具體知道要建構視覺導向的網路神經運算,並參加電腦視覺競賽?

蘇茨克維: 在發展電腦視覺之前,我首先了解到監督式學習(Supervised learning)是我們的前進的方向。

編按:機器學習大致可分為三個方向,監督式學習、無監督式學習 與增強式學習;監督式學習指的是電腦從標籤化(labeled)的資訊中分析模式後做出預測,像是學習標準答案,可一邊修正去達到更精準的預測)。

這不僅僅是一種直覺,還是無法辯駁的前進方向。如果神經網路很深又強大,可以解決困難任務,關鍵字為「深」和「大」,但那時大家不關注神經網路。

大的神經網路能在面對問題時給予好的答案,但需要大量數據才能做到,不過,很明顯優化是一個瓶頸。當時Jeff Hinton教授的另一個研究生James Martens取得突破,他突出一種不同的優化的做法,讓我們證明神經網路是可訓練的。

所以路徑就很清楚: 你找到一些數據,把它變大,訓練神經網路,然後你就能成功 。但下一個問題是要找什麼數據,答案就是ImageNet(大型視覺資料庫)。當時ImageNet看起來難度很高,但只要你有足夠算力用於ImageNet的數據,就會成功。

延伸閱讀: 靠「打字」下指令就能自建元宇宙!結合ChatGPT的虛擬世界平台Oncyber怎麼玩?

##### 輝達GPU助攻!OpenAI如何茁壯?

黃: 那時候我們就開始攜手合作,你如何發現GPU是很有幫助的,但如何發生的,你沒和我說過?

蘇茨克維: Jeff Hinton教授告訴我們可以試試這個GPU,但一開始我們也沒搞懂要用在哪。接下來我們發現,ImageNet的數據及很適合用GPU來運算,速度很快,訓練規模前所未有。

Nvidia Hopper H100 GPU
輝達(NVIDIA)GPU助攻OpenAI,完成大量圖片運算。
圖/ Nvidia

黃: 你來到矽谷,和一些朋友創辦OpenAI,你對OpenAI最初的想法是什麼?你如何達到現在的成就?

蘇茨克維: 一開始,我們不是百分百知道如何推動,環境也和現在很不同。2015~2016年我們創業時,研究人員很少,只有100人,大部分人是從Google的DeepMind來的。

當時我第一個想法是透過壓縮數據,讓機器進行無監督學習,這個技術拿到現在來看,會覺得很簡單,只要預先訓練就好,但在2016年時根本沒人知道怎麼做。臉書(Meta)首席人工智慧科學家楊立昆(Yann LeCun)當時還到處演講說是巨大挑戰。

編按:機器在面對資料時,依照關聯性去歸類、找出潛在規則與套路等,不需事先以人力處理標籤,也不會判別資訊的正確性。

時至今日,GPT不只可做到壓縮訓練數據,也因為如此,在進一步發展後,我們在亞馬遜(Amazon)上預測下一則評論會出現的字詞,發現它具備預測能力,意味著可以發現數據中的秘密,這就是大家今天看到ChatGPT今天能做到的事:給它一些資訊,它能從中提煉和預測。

編按:GPT將大量的資訊壓縮,並進行歸類、找出潛在的規則);壓縮得好,甚至還能有效提取數據中隱藏的訊息。

GPT-4
GPT-4基本建構在具備更佳預測能力模型之上,因此有更強大的功能。
圖/ shutterstock

黃: OpenAI寫了一篇論文談論訓練規模大小的重要性,哪個東西你預見會先出現?是GPT1、2和3,還是訓練大小的規模擴展?

蘇茨克維: 我有一個很強大的信念就是越大越好。在OpenAI,有個重要任務是:如何正確運用越來越大的訓練規模,以及如何精準運用?另一個目標就是強化學習,但你要拿它做什麼?

第一個在OpenAI完成的大專案,就是我們解決實戰遊戲Data2,我們做了一個強化學習agent,讓它和自己對抗,目標是希望可和世界上最好的玩家競爭。

##### GPT-4為何這麼強?

黃: ChatGPT是最簡單的應用程式,任何人都可以用。GPT-4在很多領域表現都令人驚艷,在很多測試中都領先了人類能做到的水準,GPT-4為何能有如此大的進步?

蘇茨克維: GPT-4在很多維度做了改變,它建立在有更好預測能力的基礎之上,當神經網路越能預測下一個字詞,相對來說也代表更理解文本的內容。

例如偵探小說中有很多難的字、事件、線索,當最後要揭曉誰是犯人時,有很多預測結果,但透過更了解文本,就能更精確的預測字詞(誰是犯人),這就是為什麼GPT-4功能更強大。

黃: ChatGPT會希望問問題的人先給予一些先備知識再給予回答,所以ChatGPT已具備內建的推理能力?

蘇茨克維: 某些程度上是,但現在神經網路的推理結果還不太可靠,有時候這些神經網路會有幻想,或做出人類不太會犯的錯誤,降低他們的用處。但我認為繼續做一些研究,能達到更高的可性度,使模型學會要問得更清楚再回答。

黃: 我之前看到GPT-4在維基百科頁面做檢索,GPT-4是否能在既存的事實資料中做檢索,印證其所推論得結果呢?

蘇茨克維: 目前發布的GPT-4沒有檢索能力,他只是很好的預測字詞工具。雖然GPT-4現在沒有支援檢索,但完全具備這樣的能力,能透過檢索讓答案變得更好。

##### AI將持續震驚人類

黃: 有時候我們說「great(好)」或是「sick(生病、厭倦)」,可能會因誤情況不同產生不同語境,AI可以通過音頻等進行模型學習嗎?

蘇茨克維: 可以,影片很有用。

黃: 未來AI會自己訓練自己嗎?

蘇茨克維: 這個可能性仍有待觀察。

黃: AI未來最讓你興奮的地方在哪?

蘇茨克維: 預測是很難的,尤其對太具體的事。我認為這個領域會持續進步,我們將繼續看到AI持續震驚人類。AI未來絕對會達到可以讓人完全信賴,在它不懂時,將會開口要求更多資訊,這是人工智慧未來進步的一大關鍵。

黃: GPT-4什麼東西讓你驚訝?

蘇茨克維: 他展示很多很酷的東西,令人驚奇。首先,GPT-4可靠的程度令人驚艷。之前問問題,ChatGPT可能會用愚蠢的方式誤解,但GPT-4不會。

其次,GPT-4解決數學問題的能力超強大。很多人也注意到,它可以用一個字母開頭寫詩,很清晰遵循指令。在視覺方面,我喜歡他如何解釋迷因圖等笑話。

📍邀請您加入Web3+ Line社群,持續關注最重要的網路變革
👉 https://lin.ee/kItnyTh

責任編輯:林美欣

往下滑看下一篇文章
人人用 AI,訊息更分散?普羅品牌顧問「Process 2.0」助企業建品牌 AI 助理、精準溝通驅動成長
人人用 AI,訊息更分散?普羅品牌顧問「Process 2.0」助企業建品牌 AI 助理、精準溝通驅動成長

自 2022 年底 ChatGPT 引爆生成式 AI 浪潮以來,企業競相導入 AI 加速內容產出,效率看似提升,品牌訊息破碎化與品質失控的風險卻也隨之浮現。行銷、客服、業務各自運用 AI 工具產出文案,語氣與規範逐漸失去統一標準,消費者接收到的品牌形象因此愈趨模糊。

「一旦 AI 成為人人可及的工具,它本身幾乎不再是差異化的因素。真正的差異,不在於技術本身,而在於企業如何運用它。」Process 普羅品牌顧問創辦人 Martin Kessler 指出,長期來看,勝出的不會是使用最強大 AI 的企業,而是那些將品牌定位得足夠清晰、即使在技術趨於同質化的情況下依然與眾不同的企業。「AI 正成為常態,但唯有強大的品牌,才具備真正的競爭優勢。」

普羅品牌顧問-2.JPG
Process 普羅品牌顧問創辦人 Martin Kessler。
圖/ 數位時代

如何運用 AI 加快內容產出速度,並同時兼顧品牌信任所需要的一致水準,這是 1995 年創立於瑞士蘇黎世的普羅品牌顧問,近年積極思考的問題。為此,普羅提出「Process 2.0」服務,將顧問角色從建立品牌策略,延伸到協助企業建立可持續運作的品牌溝通系統。

「Process 2.0」服務:提升企業品牌溝通力

Process 普羅品牌顧問台北分公司總經理洪翠霞觀察,品牌訊息之所以失焦,關鍵在於策略完成後,仍缺乏一套持續運作的溝通系統銜接執行。她將這種落差歸納為五種斷層:

首先,一旦策略完成後未能落實到日常工作,便形成策略斷層。同時,當品牌理解過度仰賴少數主管,一旦人員異動,傳承便隨之中斷,造成轉譯斷層。

在執行面上,各部門對外溝通的語氣逐漸分散不一致,也會有語氣斷層的問題;內容產出雖多,卻缺乏共同標準判斷是否符合品牌,則是驗證斷層。最後,所有品牌知識散落各處、未被系統化管理,導致治理斷層,也讓最初的策略價值難以發揮效果。

這五個斷層背後,指涉的是同一個關鍵。也就是品牌策略與實際執行之間,少了一套能夠持續運作的品牌溝通系統。

普羅品牌顧問-3.jpg
Process 普羅品牌顧問台北分公司總經理 洪翠霞。
圖/ 數位時代

為此,普羅開發出「Process 2.0」解方,從三個階段解決落差。首先,從「Brand Strategy」出發,先釐清品牌的定位與價值主張;接著才是「Brand Communication System」,將策略轉化為跨部門可依循的語言規則;最後則是「AI Brand Communication」,把品牌知識整合進安全可控的 AI 工作環境,讓行銷、業務、客服、人資,乃至海外代理商,都能基於統一的品牌基準產出內容,並持續進行審核與知識更新。

「AI 內容產出速度已遠遠超過品牌治理速度,品牌基礎若模糊不清,AI 只會更快放大既有的問題。」洪翠霞強調,AI 時代讓斷層問題更加明顯,因此她也期待透過「Process 2.0」品牌專屬 AI 助理,延伸顧問影響力,幫助品牌長期把關、一同成長。

品牌力 + AI:打造品牌專屬 AI Agent

為實現「Process 2.0」,普羅攜手愛酷智能科技(AccuHit)將品牌策略、知識與 AI 技術整合,協助企業建立專屬品牌 AI 助理。

愛酷智能科技(AccuHit)執行長林庭箴指出,「Process 2.0」鎖定的是品牌再造:AI 除了應用在企業內部流程,還能如何用在品牌溝通面。他分析,當電商進入超微利的時代,零售產業正走向三個不可逆的趨勢,包括:到 2030 年,將有五成消費行為由 AI 協助完成,商品資料必須完整到能讓 AI 讀懂;其次是超個人化,信任愈稀缺,推薦卻必須愈貼近個人需求這件事將更挑戰;第三,則是預測型消費將持續增加。

普羅品牌顧問-4.JPG
AccuHit 執行長 林庭箴。
圖/ 數位時代

尤其,在非零售場域,品牌溢價更為關鍵,因為品牌價值與品牌溝通內容不只要讓消費者理解,也要讓 AI 讀懂,才能持續發揮影響力。不過,當企業想要運用 AI 做行銷卻沒想像中容易。林庭箴強調,企業 AI 最大的挑戰,多半集中在機敏資料的存取與管理層面。

因此在「Process 2.0」的開發協作上,普羅負責定義場景,AccuHit 則提供技術與產品面支援,將品牌規範與知識納入 Gen AI 系統,讓所有輸出都能經過品質控管,如同 AI 版本的品牌指南,確保每一次輸出都建立在信任與安全之上。

目前品元實業、昇昇膠業等品牌已導入試用這項服務工具,無論是行銷內容撰寫、客服回覆、產品諮詢或內部教育訓練,皆能依據統一的品牌規範,輸出兼具效率與品質的內容。

Brand-to-Revenue:探索成長新引擎

根據台經院發布的《2026 台灣企業品牌力大調查》,過去五年(2021 至 2025 年)收集的 1,167 家企業數據顯示,台灣企業普遍呈現「內強外弱」的品牌結構。也就是品牌定位與內部管理已具基礎,但對外溝通與價值主張,如品牌好感度與互動性,卻相對薄弱,導致多數企業雖有高重複購買率,卻缺乏品牌溢價能力與市場認同。

對此,台灣品牌耀飛計畫小組副主任朱俐穎指出,「Process 2.0」的目標,是協助企業建構可落地的溝通能力,最終讓品牌策略實質驅動營收成長。

她以多年輔導近千家品牌企業的經驗為例,企業經過品牌輔導後,形象全面升級、設計語言更聚焦,市場識別度也隨之提升。她觀察,品牌塑造的成果平均在一至兩年後開始發酵,客戶能明顯感受到不同:「以往客戶只是單純買產品,但有了品牌之後,就多了願景與合作想像,能吸引其他企業一起創新共榮。」

普羅品牌顧問-5.jpg
台灣品牌耀飛計畫小組副主任 朱俐穎。
圖/ 數位時代

AI 的本質就像一面放大鏡:品牌定位清楚,AI 能加速轉譯、提升溝通效率;定位模糊甚至混亂,AI 也會同步放大這份混亂,後果難以收拾。品牌梳理是否到位,決定了 AI 是阻力還是助力。

為協助企業及早驗證成效,普羅已推出「60 天品牌成長試用計畫」,讓企業在正式導入「Process 2.0」前展開深度合作,鎖定成長機會。從 Made in Taiwan 到 Trusted Taiwan Brand,信任,才是品牌溢價的關鍵。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓