GPT-4超強的「PR90」成績嚇到人類！但OpenAI警告：還是有兩大缺陷|數位時代 BusinessNext

GPT-4超強的「PR90」成績嚇到人類！但OpenAI警告：還是有兩大缺陷

OpenAI推出的GPT-4，在許多方面的表現都優於前一代。但OpenAI也警告，GPT-4還不完美，在許多情況下，它的能力不如人類。

今天凌晨，OpenAI公佈了其大型語言模型的最新版本——GPT-4。該公司表示，GPT-4在許多專業測試中表現出超過絕大多數人類的水平。

具體而言，GPT-4實現了以下幾個方面的飛躍式提升：更聰明，答題水平越來越好；支持圖像輸入，擁有強大的識圖能力，但目前只限內部測試；更長的上下文，文字輸入限制提升至2.5萬字；回答準確性顯著提高；更安全，有害資訊更少。

對於普通人而言，如何理解GPT-4到底有多強多聰明？

據OpenAI透露，GPT-4通過了所有基礎考試而且是高分通過。例如，GPT-4在模擬律師資格考試的成績在考生中排名前10%左右，在SAT閱讀考試中排名前7%左右，在SAT數學考試中排名前11%左右。相比之下，曾經令人震撼的GPT-3.5 ，真實得分在倒數10%左右，GPT-4的強大已經可想而知。

有網友評論，「如果真跟報告說的那樣就太可怕了，我感覺能力已經遠超我了。」也有人笑稱，「我躺好了！我生在了適合我的時代！」

最多的聲音則是對未來工作不保的擔憂，「還有哪個行業可以不被替代？」「消除任何幻想，AI時代橫掃全球，先思考下GPT-4不能做但你能做的。」

比以前的版本「更大」，或許也更燒錢

OpenAI稱，GPT-4比以前的版本「更大」，這意味著其已經在更多的數據上進行了訓練，並且在模型文件中有更多的權重，這使得它的運行成本更高。

同時，OpenAI並未公佈這個模型的參數量有多少。

OpenAI表示，它使用的是微Azure訓練模型，微軟已經向這家新創公司投資了數十億美元。 OpenAI沒有公佈具體模型大小的細節，也沒有公佈用來訓練模型的硬件，理由是「競爭情況」。

目前，此領域的許多研究人員認為，人工智能領域的許多最新進展，都來自於在數千台超級計算機上運行越來越大的模型，這些模型的訓練過程可能耗資數千萬美元。

為了不斷提高GPT-4性能，OpenAI還為其研發大搞「基建」。

在過去的兩年裡，OpenAI重建了整個深度學習堆棧，並與Azure一起為其工作負載從頭開始設計了一台超級計算機。一年前，OpenAI 在訓練GPT-3.5時第一次嘗試運行了該超算系統，之後他們又陸續發現並修復了一些錯誤，改進了其理論基礎。這些改進的結果是 GPT-4的訓練運行獲得了前所未有的穩定。

OpenAI聯合創辦人兼總裁格雷格·布羅克曼（Greg Brockman）表示，OpenAI預計，未來將由投資十億美元超級計算機的公司開發尖端模型，一些最先進的工具將帶有風險。 OpenAI希望對他們工作的某些部分保密，以給新創公司「一些喘息的空間，以真正關注安全並做好它。」

延伸閱讀：GPT-4「考大學」成績贏過90％考生！34項考試都名列前茅，人類怎麼辦？

侷限性明顯，GPT-4仍然不完全可靠

儘管功能已經非常強大，但 GPT-4仍與早期的 GPT 模型具有相似的侷限性，其中最重要的一點是它仍然不完全可靠，也就是還有可能胡說八道。

OpenAI也警告稱，GPT-4還不完美，在許多情況下，它的能力不如人類。該公司表示：「GPT-4仍有許多已知的侷限性，我們正在努力解決，比如社會偏見、幻覺和對抗性提示。」

總的來說，GPT-4相對於以前的模型（經過多次迭代和改進）已經顯著減輕了幻覺問題。在 OpenAI 的內部對抗性真實性評估中，GPT-4的得分比最新的 GPT-3.5模型高40%。

同時，GPT-4訓練數據還是截止到2021年9月份。這也意味著，GPT-4對於這個時間點以後的資訊，缺乏足夠的了解，也不會從其經驗中學習。

在GPT-4發布之後，OpenAI創辦人阿爾特曼發推文表示：「它仍然是有缺陷的，仍然是有限的，在你花了更多的時間第一次使用它時，它似乎比實際情況更令人印象深刻。」

中國的ChatGPT們要怎麼追？

最令人震驚的在於，按照 demo 視頻裡 OpenAI 工程師們的說法，GPT-4的訓練在去年8月就已經完成，剩下的時間都在進行微調提升，以及最重要的去除危險內容生成的工作。

這也意味著，OpenAI 內部技術，比大家想像中的領先外界更多年。更可怕的是，OpenAI還一口氣開放了API接口和相關論文！這讓中國的ChatGPT們還怎麼追？

英諾天使基金合夥人王晟曾告訴《態℃》欄目，「中國的ChatGPT們即便奮起直追，靜態來講也許兩三年能追上，我認為已經很樂觀了。」

但隨著更強大的GPT-4發布，OpenAI 的技術能力顯然仍在不斷進步，且進展速度遠比我們追的速度還要快。王晟在之前的採訪中判斷，「除非這件事突然遇到了一個瓶頸，整個科技發展方向到頭了，對方不得不停下來，或許我們還有機會追平，或者我們挖掘到一種新的技術路徑有機會追上，不然可能沒有機會了。」

與此同時，在該模型的落地和應用方面，OpenAI也有了最新進展。

新模型將提供給ChatGPT的付費用戶，也將作為API的一部分提供，允許程序員將AI集成到他們的應用程序中。 OpenAI將對750字左右的指令資訊收費3美分，對750字左右的響應資訊收費6美分。

OpenAI還介紹，摩根士丹利正在使用GPT-4來組織數據，而電子支付公司Stripe正在測試GPT-4是否有助於打擊欺詐。其他客戶還包括語言學習公司Duolingo、Khan Academy和冰島政府。 OpenAI合作夥伴微軟週二表示，新版必應搜尋引擎將使用GPT-4。

GPT-4取得的成績令人興奮，但對於還在起跑線上的中國ChatGPT們，還有大量的工作要去探索和研究，想必感受到了巨大的壓力。風浪越大魚越貴，對於這些迅速進入這個新領域的公司來說，也將會擁有巨大的機會。

GPT-4的強大告誡我們，未來唯一限制的因素，就是你的想像力！

本文授權轉載自：網易科技

責任編輯：傅珮晴、錢玉紘

北富銀以簡單、直覺、懂我為核心訴求，Fubon+化身專屬智慧生活金融助理

集結跨部門 600 位同仁的力量、歷經一年餘的時間，台北富邦銀行在去（2024）年 11 月正式推出 Fubon+ App，在極短時間內協助高達九成的行動銀行用戶轉移，更因應使用者需求快速迭代功能服務，透過數據分析完善個人化體驗，成為使用者不可或缺的智慧生活金融助理。

台北富邦銀行數位金融業務處副總經理傅奕樵解釋：「Fubon+ App 是以使用者需求為核心、以金融使用行為進行服務分類，並以牌卡介面提供信貸、信用卡、帳戶等服務，讓使用者可以更簡單、直覺的點選與連結所需服務，大幅提升操作效率與優化使用體驗。」

根據統計，Fubon+ App 上線之初即整合超過 200 個功能服務，每月平均以5 到 7 個新增或更新功能向上攀升，滿足不同使用場景。例如，針對偏好夜間使用App的族群推出深色主題介面、考量年長者需求提供五種字級選擇，以及因應使用者需求提供夜間換匯服務等。

在這個過程中，平衡多元功能與使用體驗至關緊要，對此，台北富邦銀行數位金融總處副總處長周郭傑認為：「功能越多元，系統介面與操作流程越需要簡潔直觀，為實現這個目標，必須站在使用者立場，思考、設計每一個互動細節與使用體驗。」以生活繳費為例，使用者只要以Fubon+ App繳交水費或電費，系統就會自動記錄並主動發出繳費提醒，降低遺漏與逾期風險，進一步優化金融服務體驗。

Fubon+ App以數據驅動的個人化服務化身使用者的智慧生活金融助理。具體作法有三：整合銀行、人壽與證券數據資料，讓使用者可以單一平台掌握各種資產數據，如銀行存款明細、人壽保單與投資績效等；其次是在App提供「富邦共學」等免費線上課程資訊，以及專屬的理財建議，協助使用者快速掌握所需的理財資訊，以及透過「我的權益」提供使用者專屬優惠與回饋，加速使用者下達各種金融決策。

最後，同時也是最重要的是蒐集與分析使用者的數位軌跡，例如交易數據與互動行為，讓台北富邦銀行可以在對的時間、以對的方式提供專屬使用者的產品服務與資訊，例如在使用者的信用卡額度將滿時發送調額提醒訊息等，即時滿足使用者在不同金融場景的服務需求。

聚焦五大進化服務，Fubon+ App與時俱進滿足使用者需求

為擴大Fubon+ App設計理念與價值，台北富邦銀行將聚焦「安全」、「財富」、「暖心」、「便利」與「智能」五大面向，持續優化金融服務能量。

傅奕樵表示：「資安風險與詐騙事件頻傳，讓使用者對數位金融抱持戒心，為改變這個狀況，Fubon+ App全面提升系統安全、裝置安全與落實資料保護，針對信用卡戶提供卡片安全鎖服務，內連帳戶安全中心提供多重安全設定，包含裝置綁定跟透過OTP（MOTP）進行身分與交易認證等，更透過Fubon+ App圖像化介面讓使用者掌握安全等級，以及知道如何降低風險，進而提升使用者對數位金融服務的信任。」此外，台北富邦銀行將於下半年度導入FIDO金融行動身分識別標準化機制，讓使用者在線上交易時可以生物辨識的方式快速通過身分認證，更好保護用卡安全。

除了防詐安全，Fubon+ App更同步進化財富管理功能，以暖心設計與簡單直覺介面，讓使用者可以輕鬆在線完成資訊查詢與金融交易，如匯率到價通知、視覺化市場燈號，到個人化的消費與投資數據分析，為使用者打造一站式的智慧理財體驗。此外，還可依需求串聯實體分行，由專人提供即時協助。「我們將以使用者視角持續優化Fubon+ App，同時，攜手跨業合作夥伴一同滿足使用者在不同生活場景的金融需求，如旅遊金融等，成為真正『懂你』的智慧生活金融助理。」關於Fubon+ App的未來發展方向，周郭傑如是總結。

GPT-4超強的「PR90」成績嚇到人類！但OpenAI警告：還是有兩大缺陷

比以前的版本「更大」，或許也更燒錢

中國的ChatGPT們要怎麼追？

Fubon+ App 上線即吸引數百萬用戶青睞的訣竅：懂你所需、給你所要

北富銀以簡單、直覺、懂我為核心訴求，Fubon+化身專屬智慧生活金融助理

聚焦五大進化服務，Fubon+ App與時俱進滿足使用者需求