GPT-4超強的「PR90」成績嚇到人類!但OpenAI警告:還是有兩大缺陷
GPT-4超強的「PR90」成績嚇到人類!但OpenAI警告:還是有兩大缺陷

今天凌晨,OpenAI公佈了其大型語言模型的最新版本——GPT-4。該公司表示,GPT-4在許多專業測試中表現出超過絕大多數人類的水平。

具體而言,GPT-4實現了以下幾個方面的飛躍式提升:更聰明,答題水平越來越好;支持圖像輸入,擁有強大的識圖能力,但目前只限內部測試;更長的上下文,文字輸入限制提升至2.5萬字;回答準確性顯著提高;更安全,有害資訊更少。

對於普通人而言,如何理解GPT-4到底有多強多聰明?

據OpenAI透露,GPT-4通過了所有基礎考試而且是高分通過。例如,GPT-4在模擬律師資格考試的成績在考生中排名前10%左右,在SAT閱讀考試中排名前7%左右,在SAT數學考試中排名前11%左右。相比之下,曾經令人震撼的GPT-3.5 ,真實得分在倒數10%左右,GPT-4的強大已經可想而知。

ChatGPT4
圖/ 微軟

有網友評論,「如果真跟報告說的那樣就太可怕了,我感覺能力已經遠超我了。」也有人笑稱,「我躺好了!我生在了適合我的時代!」

最多的聲音則是對未來工作不保的擔憂,「還有哪個行業可以不被替代?」「消除任何幻想,AI時代橫掃全球,先思考下GPT-4不能做但你能做的。」

比以前的版本「更大」,或許也更燒錢

OpenAI稱,GPT-4比以前的版本「更大」,這意味著其已經在更多的數據上進行了訓練,並且在模型文件中有更多的權重,這使得它的運行成本更高。

同時,OpenAI並未公佈這個模型的參數量有多少。

OpenAI表示,它使用的是微Azure訓練模型,微軟已經向這家新創公司投資了數十億美元。 OpenAI沒有公佈具體模型大小的細節,也沒有公佈用來訓練模型的硬件,理由是「競爭情況」。

目前,此領域的許多研究人員認為,人工智能領域的許多最新進展,都來自於在數千台超級計算機上運行越來越大的模型,這些模型的訓練過程可能耗資數千萬美元。

為了不斷提高GPT-4性能,OpenAI還為其研發大搞「基建」。

在過去的兩年裡,OpenAI重建了整個深度學習堆棧,並與Azure一起為其工作負載從頭開始設計了一台超級計算機。一年前,OpenAI 在訓練GPT-3.5時第一次嘗試運行了該超算系統,之後他們又陸續發現並修復了一些錯誤,改進了其理論基礎。這些改進的結果是 GPT-4的訓練運行獲得了前所未有的穩定。

OpenAI聯合創辦人兼總裁格雷格·布羅克曼(Greg Brockman)表示,OpenAI預計,未來將由投資十億美元超級計算機的公司開發尖端模型,一些最先進的工具將帶有風險。 OpenAI希望對他們工作的某些部分保密,以給新創公司「一些喘息的空間,以真正關注安全並做好它。」

延伸閱讀:GPT-4「考大學」成績贏過90%考生!34項考試都名列前茅,人類怎麼辦?

侷限性明顯,GPT-4仍然不完全可靠

儘管功能已經非常強大,但 GPT-4仍與早期的 GPT 模型具有相似的侷限性,其中最重要的一點是它仍然不完全可靠,也就是還有可能胡說八道。

OpenAI也警告稱,GPT-4還不完美,在許多情況下,它的能力不如人類。該公司表示:「GPT-4仍有許多已知的侷限性,我們正在努力解決,比如社會偏見、幻覺和對抗性提示。」

總的來說,GPT-4相對於以前的模型(經過多次迭代和改進)已經顯著減輕了幻覺問題。在 OpenAI 的內部對抗性真實性評估中,GPT-4的得分比最新的 GPT-3.5模型高40%。

同時,GPT-4訓練數據還是截止到2021年9月份。這也意味著,GPT-4對於這個時間點以後的資訊,缺乏足夠的了解,也不會從其經驗中學習。

在GPT-4發布之後,OpenAI創辦人阿爾特曼發推文表示:「它仍然是有缺陷的,仍然是有限的,在你花了更多的時間第一次使用它時,它似乎比實際情況更令人印象深刻。」

中國的ChatGPT們要怎麼追?

最令人震驚的在於,按照 demo 視頻裡 OpenAI 工程師們的說法,GPT-4的訓練在去年8月就已經完成,剩下的時間都在進行微調提升,以及最重要的去除危險內容生成的工作。

這也意味著,OpenAI 內部技術,比大家想像中的領先外界更多年。更可怕的是,OpenAI還一口氣開放了API接口和相關論文!這讓中國的ChatGPT們還怎麼追?

英諾天使基金合夥人王晟曾告訴《態℃》欄目,「中國的ChatGPT們即便奮起直追,靜態來講也許兩三年能追上,我認為已經很樂觀了。」

但隨著更強大的GPT-4發布,OpenAI 的技術能力顯然仍在不斷進步,且進展速度遠比我們追的速度還要快。王晟在之前的採訪中判斷,「除非這件事突然遇到了一個瓶頸,整個科技發展方向到頭了,對方不得不停下來,或許我們還有機會追平,或者我們挖掘到一種新的技術路徑有機會追上,不然可能沒有機會了。」

與此同時,在該模型的落地和應用方面,OpenAI也有了最新進展。

新模型將提供給ChatGPT的付費用戶,也將作為API的一部分提供,允許程序員將AI集成到他們的應用程序中。 OpenAI將對750字左右的指令資訊收費3美分,對750字左右的響應資訊收費6美分。

OpenAI還介紹,摩根士丹利正在使用GPT-4來組織數據,而電子支付公司Stripe正在測試GPT-4是否有助於打擊欺詐。其他客戶還包括語言學習公司Duolingo、Khan Academy和冰島政府。 OpenAI合作夥伴微軟週二表示,新版必應搜尋引擎將使用GPT-4。

GPT-4取得的成績令人興奮,但對於還在起跑線上的中國ChatGPT們,還有大量的工作要去探索和研究,想必感受到了巨大的壓力。風浪越大魚越貴,對於這些迅速進入這個新領域的公司來說,也將會擁有巨大的機會。

GPT-4的強大告誡我們,未來唯一限制的因素,就是你的想像力!

本文授權轉載自:網易科技

責任編輯:傅珮晴、錢玉紘

往下滑看下一篇文章
Fubon+ App 上線即吸引數百萬用戶青睞的訣竅:懂你所需、給你所要
Fubon+ App 上線即吸引數百萬用戶青睞的訣竅:懂你所需、給你所要

隨著政策法規開放與消費者行為改變,金融服務不只是交易平台,更是民眾生活的一部分,加速數位金融服務往個人化、智慧化與互動化靠攏,觀察到這股趨勢,台北富邦銀行不僅積極展開轉型旅程,更於 2023 年中啟動 Fubon+ 行動銀行 App 專案:從使用者需求出發,以「簡單」、「直覺」、「懂我」三大設計理念重塑產品架構、系統介面與使用體驗,打造專屬使用者的智慧生活金融。

北富銀以簡單、直覺、懂我為核心訴求,Fubon+化身專屬智慧生活金融助理

集結跨部門 600 位同仁的力量、歷經一年餘的時間,台北富邦銀行在去(2024)年 11 月正式推出 Fubon+ App,在極短時間內協助高達九成的行動銀行用戶轉移,更因應使用者需求快速迭代功能服務,透過數據分析完善個人化體驗,成為使用者不可或缺的智慧生活金融助理。

台北富邦銀行數位金融業務處副總經理傅奕樵解釋:「Fubon+ App 是以使用者需求為核心、以金融使用行為進行服務分類,並以牌卡介面提供信貸、信用卡、帳戶等服務,讓使用者可以更簡單、直覺的點選與連結所需服務,大幅提升操作效率與優化使用體驗。」

富邦金控
Fubon+ App不僅系統介面翻新,功能服務的深度與廣度也隨之擴充
圖/ 數位時代

根據統計,Fubon+ App 上線之初即整合超過 200 個功能服務,每月平均 以5 到 7 個新增或更新功能向上攀升,滿足不同使用場景。例如,針對偏好夜間使用App的族群推出深色主題介面、考量年長者需求提供五種字級選擇,以及因應使用者需求提供夜間換匯服務等。

在這個過程中,平衡多元功能與使用體驗至關緊要,對此,台北富邦銀行數位金融總處副總處長周郭傑認為:「功能越多元,系統介面與操作流程越需要簡潔直觀,為實現這個目標,必須站在使用者立場,思考、設計每一個互動細節與使用體驗。」以生活繳費為例,使用者只要以Fubon+ App繳交水費或電費,系統就會自動記錄並主動發出繳費提醒,降低遺漏與逾期風險,進一步優化金融服務體驗。

Fubon+ App以數據驅動的個人化服務化身使用者的智慧生活金融助理。具體作法有三:整合銀行、人壽與證券數據資料,讓使用者可以單一平台掌握各種資產數據,如銀行存款明細、人壽保單與投資績效等;其次是在App提供「富邦共學」等免費線上課程資訊,以及專屬的理財建議,協助使用者快速掌握所需的理財資訊,以及透過「我的權益」提供使用者專屬優惠與回饋,加速使用者下達各種金融決策。

最後,同時也是最重要的是蒐集與分析使用者的數位軌跡,例如交易數據與互動行為,讓台北富邦銀行可以在對的時間、以對的方式提供專屬使用者的產品服務與資訊,例如在使用者的信用卡額度將滿時發送調額提醒訊息等,即時滿足使用者在不同金融場景的服務需求。

聚焦五大進化服務,Fubon+ App與時俱進滿足使用者需求

為擴大Fubon+ App設計理念與價值,台北富邦銀行將聚焦「安全」、「財富」、「暖心」、「便利」與「智能」五大面向,持續優化金融服務能量。

傅奕樵表示:「資安風險與詐騙事件頻傳,讓使用者對數位金融抱持戒心,為改變這個狀況,Fubon+ App全面提升系統安全、裝置安全與落實資料保護,針對信用卡戶提供卡片安全鎖服務,內連帳戶安全中心提供多重安全設定,包含裝置綁定跟透過OTP(MOTP)進行身分與交易認證等,更透過Fubon+ App圖像化介面讓使用者掌握安全等級,以及知道如何降低風險,進而提升使用者對數位金融服務的信任。」此外,台北富邦銀行將於下半年度導入FIDO金融行動身分識別標準化機制,讓使用者在線上交易時可以生物辨識的方式快速通過身分認證,更好保護用卡安全。

富邦金控
Fubon+ App圖像化介面讓使用者掌握安全等級,提升使用者對數位金融服務的信任。
圖/ 數位時代

除了防詐安全,Fubon+ App更同步進化財富管理功能,以暖心設計與簡單直覺介面,讓使用者可以輕鬆在線完成資訊查詢與金融交易,如匯率到價通知、視覺化市場燈號,到個人化的消費與投資數據分析,為使用者打造一站式的智慧理財體驗。此外,還可依需求串聯實體分行,由專人提供即時協助。「我們將以使用者視角持續優化Fubon+ App,同時,攜手跨業合作夥伴一同滿足使用者在不同生活場景的金融需求,如旅遊金融等,成為真正『懂你』的智慧生活金融助理。」關於Fubon+ App的未來發展方向,周郭傑如是總結。

了解更多Fubon+ >  https://fubonapp.taipeifubon.com.tw/

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
電商終局戰
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓