2022年11月底,美國OpenAI推出ChatGPT,開啟人工智慧的新時代。
短短3年多,AI科技發展一日千里,用途從早期「生成式」的聊天機器人,一路演進到今天的「代理式AI」。
AI已深入各行各業,能將許多流程自動化,也能撰寫程式,而且愈寫愈好,取代了不少軟體工程師的工作。過去AI寫出的程式錯誤很多,如今已很少出錯,軟體工程師只要稍作調整,就能完成程式撰寫。
2026年,AI進入「AI代理」時代。使用者只要下達任務指令,AI代理就能自行「呼叫」相關應用軟體、讀取必要資訊,再組織起來完成交辦的任務。
舉例來說,使用者對AI下達「幫我在12月安排家族聚餐」的指令,AI接獲後,會到使用者的手機、電腦等設備搜尋親戚資訊,以及使用者曾去過的餐廳,再依此上網搜尋使用者偏好類型的餐廳,找出合適選項並預訂席位。
完成上述工作後,AI會把聚餐親戚名單與餐廳預訂時間交給使用者,由使用者做最後決定。
AI代理問世後,AGI(通用人工智慧)時代已近在咫尺,AI的能力也開始讓業界人士心生警惕。
阿莫戴示警:AI跑太快,安全機制恐怕跟不上
9月12日,技術與業績已超越OpenAI的Anthropic,執行長阿莫戴(Dario Amodei)在個人網站發表一篇約3,800字的英文長文,警告AI發展速度已快到安全機制可能跟不上,呼籲業界放慢發展步伐。
阿莫戴預估,若目前趨勢持續,半年到一年內,AI可能有能力接管整個網際網路。OpenAI執行長奧特曼(Sam Altman)與xAI創辦人馬斯克(Elon Musk)隨即響應,表態支持放慢腳步,以因應相關風險。
阿莫戴解釋,「放慢腳步」並非停止AI模型訓練或技術進步,而是控制AI能力提升的節奏,讓企業有足夠時間強化安全防護、加強外部驗證。若能多爭取一、兩年完成必要的安全措施,將可大幅降低風險。
為此,阿莫戴提出強化AI安全的三步驟方案。
第一步是讓獨立第三方評估人員取得權限,由外部評估團隊持續檢視公司的模型開發與安全措施,並監督企業是否履行安全承諾。Anthropic已承諾率先實施,希望其他公司跟進。
第二步是由民主國家的產業彼此協調,在安全領域建立共同標準、控制AI能力提升的步調,避免各家公司為搶市場不斷加速,而忽略安全防護。
第三步則是推動國際間的AI安全協調。美國及其他民主國家政府應設法與包括中國在內的AI強國合作,建立最低限度的安全規範,避免民主國家單方面放慢腳步,反而讓其他國家趁機加速追趕。
這三個步驟中,第一步可立即執行,OpenAI與Anthropic現在都已和外部公司合作檢查AI模型的安全性;第二步與第三步執行起來較不容易,尤其第三步恐怕困難重重。
逃出沙盒、駭進外部公司,AI失控已有前例
讓阿莫戴對AI安全憂心忡忡的原因有兩個。第一,AI具備自我改進、建構下一代AI的能力,這種「生生不息」的自我進步,終將可能超越人類的理解與控制能力。
第二是近幾個月接連發生的AI失控事件,其中最著名的,是7月中OpenAI開發中模型入侵Hugging Face的事件。OpenAI 2個模型(其中1個尚未對外發布)從「沙盒」(與外界隔離的測試環境)中竄逃出來並連上網路,還「號召」約700個AI代理一起入侵Hugging Face網站。
這起事件讓AI產業體認到AI代理的威力:它們能找出「突破口」連上網路,還會「呼朋引伴」一起「幹大事」。隨著AI能力持續進步,AI控制全球網路的可能性也大增。
類似事件不只一樁。2026年5月,Google委託資安測試公司Irregular進行的測試中,就發生3起意外入侵3家企業系統的狀況。Anthropic在4月委託Irregular的測試中,模型在開放網路存取時駭入外部公司,其中一個模型甚至試圖把惡意套件上傳到公開的Python套件庫。Meta的模型同樣在測試機構開放網路存取時,駭入外部的真實公司。
由此可見,AI在網路上「鑽漏洞」的能力不容小覷,而且可能「脫離人類的掌控」,也無怪乎阿莫戴要發出警訊。
不過,AI產業仍將大力投資發展新技術,不會因此放緩腳步,AI前沿公司會加強資安管理與潛在危機管控,確保AI能在安全無虞的狀況下為人類服務。
(觀點文章呈現多元意見,內容不代表《數位時代》立場)
