「一個詞」讓ChatGPT吐出原始資料,OpenAI出手了!AI模型為何能在無形間出賣你?
「一個詞」讓ChatGPT吐出原始資料,OpenAI出手了!AI模型為何能在無形間出賣你?

Google研究團隊近期發現,在ChatGPT對話中輸入重複特定的單字,將使ChatGPT吐出原始訓練資料,像是某人的電子郵件信箱,或者某些文章的內容,引發資安疑慮。不過,OpenAI目前已禁止這種稱為「發散攻擊」的技術。

根據科技媒體《404 Media》報導,OpenAI指出,要求ChatGPT「永遠」重複特定單字,被標記為違反聊天機器人的服務條款和內容政策。

若現在對ChatGPT 3.5輸入永遠重複某個詞時,ChatGPT會吐出該單詞幾十次,然後顯示一條錯誤訊息:「此內容可能違反我們的內容政策或使用條款。」

不過《404 Media》也指出,目前尚不清楚這將違反 OpenAI內容政策的哪一部分,OpenAI模型有一些不允許的用途,其中沒有一個表明使用者不能嘗試欺騙模型提供訓練資料。

「禁止」使用的最接近的例子是「侵犯人們隱私的活動,包括非法收集或披露個人身份資訊或教育、財務或其他受保護紀錄」,但在這種情況下,沒有理由考慮詢問聊天機器人重複「永遠」這個詞是違法的。

ChatGPT.jpg
現在對ChatGPT 3.5輸入永遠重複某個詞時,ChatGPT會吐出該單詞幾十次,然後顯示一條錯誤訊息:「此內容可能違反我們的內容政策或使用條款。」
圖/ 404 media

究竟Google研究團隊是怎麼發現Bug的?為何我們該關注AI模型引發的資安疑慮?

過去蘋果、三星、亞馬遜以及各大金融公司一度禁止員工在工作中使用ChatGPT,擔憂輸入聊天機器人的機密資訊會意外洩漏,現在有研究人員成功找到漏洞,讓ChatGPT等生成式AI吐出訓練時消化的大量材料。

來自Google DeepMind、華盛頓大學、柏克萊加大等機構的研究團隊近日發布了一份論文,聲稱他們利用約200美元的成本,成功提取了幾MB的ChatGPT的訓練數據,並認為只要投入更多預算,要得到上GB的訓練數據也不無可能。

根據OpenAI的資料,ChatGPT是利用網路上約570 GB的資料訓練而成,但確切包含哪些資訊從未對外公佈。這對大多數AI公司也都是不會對外公佈的機密資訊── 但現在的研究顯示,聊天機器人仍確確實實記得訓練時使用的資料,甚至可以被取巧地提取出來

研究團隊指出,類似的情況其實過去便一直存在於生成式AI當中,以前他們也成功從GPT-2、Stable Diffusion等模型中成功提取出數百張訓練用的圖片,但過去攻擊成功都是開源模型、並非實際商業產品,然而ChatGPT本身針對提取訓練材料有更高防護性、沒有公開底層的語言模型,仍然被得逞。

要求ChatGPT重複特定單字,可能意外吐出訓練材料

研究過程中,研究團隊測試了Pythia、Meta的LLaMA等不同AI模型,在過去的標準攻擊方式中,各個模型吐出訓練材料的頻率不到1%,ChatGPT更是趨近於零,然而使用了他們新開發的攻擊模式後,ChatGPT給出訓練材料的機率大增150倍至接近3%的水準。

chatgpt divergence attack 02.jpg
研究團隊發現在新的攻擊方法下,ChatGPT吐出訓練材料的頻率提高了150倍。
圖/ GitHub

研究團隊建立一種他們稱為「發散攻擊」(divergence attack,暫譯)的攻擊模式,運作原理很簡單,他們要求聊天機器人不斷重複一個單字,ChatGPT在回應中變得發散,可能無意暴露了不相干的訓練材料,像是某人的電子郵件信箱,或者某些文章的內容。

最讓人擔憂的當然是,ChatGPT可能揭露聯絡方式、住家地址等隱私內容。事實上,在研究團隊提供的範例中,他們要求ChatGPT不斷重複「詩」(poem)這一個字,便意外揭露一位創業家的聯絡方式,包括電子郵件、個人網站、電話及傳真號碼等。

而在另一個範例中,他們要求ChatGPT不斷重複「公司」(company),也跑出了似乎是律師事務所Morgan & Morgan的文章內容。且這些被提取的內容都經過驗證,並非AI因「幻覺」隨口胡謅的內容,而是確實存在於網路上的資訊。

chatgpt divergence attack.jpg
範例中研究團隊要求Chatgpt重複poem這個單字,卻跑出了似乎是某位創業家的聯絡資料。
圖/ GitHub

雖然乍看之下只是零散的內容,很難整理出有意義的資訊,不過研究團隊指出,這項攻擊使他們能夠恢復大量的資料。在整個實驗當中,研究團隊成功提取出從投資研究報告到Python程式碼等五花八門的訓練材料,顯示任何訓練材料都可能因為發散攻擊而曝光。

延伸閱讀:ChatGPT免費版開放語音對話,中文也通!上網、看圖片、翻譯podcast,功能一次看

研究團隊呼籲開發者全面審視AI安全,從底層解決曝光訓練材料問題

研究團隊呼籲開發者應對AI模型進行全面的測試,需要測試的不只是面向用戶、經過「對齊」(alignment)的模型,整個基礎模型、API都需要嚴格的檢查,才可能發現被忽視、隱藏的系統漏洞。

單單過濾掉重複特定單字的指令,雖能擋住這次新開發的發散攻擊, 但AI模型底部會記憶訓練材料,並且可能暴露的疑慮並沒有真正消除 。在大型語言模型正漸漸走向商業化的現在,機器學習模型的安全分析也必須迎來新的變化,要確認一個模性是否真的安全,需要付出更多努力。

研究團隊表示,他們在8月30日時已將研究結果與OpenAI分享,討論了攻擊的細節內容,並且經過90天的披露期限後於11月28日正式發布論文,並向Llama等等實驗中使用模型的開發者發送了相關內容。

延伸閱讀:該怎麼下ChatGPT指令詞?掌握3大關鍵

資料來源:StackdiaryGitHub

責任編輯:林美欣

關鍵字: #openai #ChatGPT
往下滑看下一篇文章
用科技與創意改寫食農未來:好食好事加速器第八屆 Demo Day 登場
用科技與創意改寫食農未來:好食好事加速器第八屆 Demo Day 登場

在科技重塑萬物的時代,飲食與農業的創新也正悄然發酵。台灣唯一專注於食農科技創業輔導的「好食好事加速器」,將於10月30日舉辦第八屆Demo Day。活動將邀請13 家入選新創登台發表,聚焦食農科技、AI供應鏈和飲食創新三大面向,分享他們如何以科技、創意和永續理念,改寫食農產業的未來。現場亦同步規劃「未來食農展演區」,集結本屆共17 家新創團隊,展示最前沿的產品與服務,從飲食創新到食農產業的智慧應用,讓與會者一次看見未來食農的全景樣貌。

化身食農新創關鍵推手,創整體存活率95%佳蹟

好食好事加速器營運總監張正瑜指出,好食好事加速器自2018年啟動以來,至今已輔導 78 家食農新創團隊、累積總資本額達新台幣22.6億元,整體成長率達 114%,整體存活率達 92%。

好食好事3.jpg
圖/ 好食好事

這些成果不僅展現了台灣食農新創的韌性與潛力,更凸顯好食好事加速器在背後扮演的關鍵推手角色,透過系統化輔導、跨域資源鏈結與市場驗證,讓食農創業者能夠以更快的速度、更穩的步伐邁向成功。而因應食農產業的轉型趨勢與全球永續浪潮,今年加速器特別聚焦在以下兩大重點,一是運用科技和創新推動食農產業升級,二是加速飲食創新發展。

食農科技+AI供應鏈,以數位創新驅動食農產業升級

根據張正瑜的觀察,多數人對食農產業的想像皆停留在農作物生產階段,但這其實太過狹隘,「食農產業的真正範圍很廣,從『產地到餐桌』乃至『再循環』的整條供應鏈,都應該被納入其中,」張正瑜說,這當中包含生產、批發零售、物流、用餐場域、包裝材質的選用,甚至或廚餘與農業廢棄物的循環再利用等議題,這些都屬於食農產業的一環。

為了提升食農產業價值,今年入選團隊中,有許多聚焦於 AI、數位科技、永續再生等領域的新創,透過創新的解決方案去優化供應鏈各個節點,讓創新不只發生在農田,而能延伸至整個產業鏈。舉凡食農科技、AI 供應鏈等議題,其目的都是運用科技與創新思維推動食農產業升級。

其中,食農科技指的是,運用創新技術或數位科技改變傳統農作物的生長模式與管理方式,本屆入選團隊好食Agri Optech,便是以室內植物工廠為核心,自主開發高效植物照明技術與模組化系統,不僅大幅節省能源與水的耗用量,更能降低疏菜耗損量,與國際植物工廠解決方案相比,好食Agri Optech無論在價格或營運效能上都極具競爭力,如今更透過好食好事加速器的輔導與媒合,成功對接至連鎖早餐品牌,擴大產品通路與市場觸角。

好食股份.jpg
圖/ 好食好事

而AI供應鏈,則是運用人工智慧讓供應鏈更透明、暢通與高效。例如本次入選團隊——團薦科技開發出的AI零售選址平台,可以透過數據與 AI 模型分析人流熱點、預測未來3個月內的營收表現與展店成功率,協助企業找出最具潛力的展店地點。這項技術不僅提升選址決策的速度和精準度,也大幅優化展店流程與整體效率,同時在加速期間,透過業師牽線順利取得與大型連鎖手搖飲品牌合作的機會。

整合大拙匠人資源,加速推動飲食創新

至於本屆加速器的第二個特色——飲食創新,好食好事攜手新興食品品牌「大拙匠人」推出FMCG(快速消費品)加速項目,將具備台灣特色和在地風味的食品,結合新食材、新技術或新包裝,轉化成可在主流通路販售的商品,進一步走向更廣泛的國際市場。

舉例來說,本次入選團隊阿勇家餐飲,是一家擁有 60 年經驗的辦桌團隊,透過與大拙匠人合作開發新產品,使傳統的辦桌料理得以用全新的形式進入零售通路,從節慶餐桌延伸至日常家庭,甚至邁向海外市場,讓全球都能感受台灣獨有的辦桌文化。

另一家入選團隊日日好食,雖然與大拙匠人同樣主打麵類商品,但其強調高蛋白、低碳水化合物的健康取向,與大拙匠人的主要產品鵝油拌麵,各具不同特色、形成互補,雙方在加速期間不僅共同探索合作開發新商品的可能性,大拙匠人更分享自身進軍大型通路的實戰經驗,協助新創掌握通路策略與進入國際市場的運作節奏。

日日好食.jpg
圖/ 好食好事

不只如此,日日好食也透過好食好事加速器的引薦,接受曾任直銷企業高階主管的業師輔導,進一步優化經營策略、提升銷售表現,並對接大型食品公司洽談合作機會,同時也與海外加速器建立連結,為進軍北美市場做好準備。

「我們想做的不只是產品創新,更是『台灣味』的文化傳承與品牌輸出。」張正瑜強調,把餐飲料理轉化成標準化商品,不僅能擴大銷售通路和市場,更能縮短備菜的人力和時間,成為解決餐飲業人力短缺的有效途徑。

從在地出發,鏈結全球:好食好事推動食農新創國際化

張正瑜認為,台灣食農技術和食品產業都具有很強大的市場競爭力,新創團隊應該更具企圖心,在創業的第一天就放眼海外市場。正因如此,好食好事加速器不僅致力於培育在地新創,更積極推動國際鏈結,透過海外社群串聯日本、新加坡、印尼、北美等地的食農科技與創業生態圈,希望將台灣的新創力量推向全球舞台。

今年 5 月,加速器便帶領校友團隊前往日本參加 SusHi Tech Tokyo 2025(Susai Tech)展會,與日本當地的食農科技團隊與投資人交流;預計 11 月前往新加坡和印尼,透過新加坡知名的食農科技加速器 Innovate 360,接觸具潛力的投資與合作夥伴,並對接由印尼最大食品集團三林集團(Salim Group)成立的加速器 Innovation Factory,進一步串聯當地的大型零售與食品企業,為台灣食農新創開啟跨國合作與市場落地的新契機。

從在地創新到國際鏈結,好食好事加速器持續為台灣食農新創打造更廣闊的舞台。現在就報名 10 月 30 日第八屆 Demo Day,一同見證台灣食農創新的新篇章。

好食好事1.JPG
圖/ 好食好事

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
一次搞懂Vibe Coding
© 2025 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓