Perplexity是資料小偷?Cloudflare揭偽裝Chrome爬蟲,遭反嗆「我看你是不懂AI助理」
Perplexity是資料小偷?Cloudflare揭偽裝Chrome爬蟲,遭反嗆「我看你是不懂AI助理」

(2025.08.05 1700 更新Perplexity聲明)

重點一:雲端防護服務商Cloudflare指出AI搜尋引擎Perplexity以隱形爬蟲繞過robots.txt與WAF規則,仍能擷取受限網頁內容。

重點二:該爬蟲偽裝成Chrome瀏覽器並頻繁更換 IP、ASN,每日仍對全球網站送出約2,000至 2,500萬請求。

重點三:Perplexity強調其「user-driven agent」只在用戶發出請求時才抓取內容,且僅用於當下回答,不會長期保存或訓練模型。

Cloudflare (雲端防護服務商) 4 日發表最新觀測揭露 Perplexity 在遭封鎖後,改以偽裝瀏覽器的未宣告爬蟲繞過 robots.txt 與 WAF 限制,仍成功抓取原本禁止擷取的內容。此舉不僅違背 RFC 9309 所訂網路共識,也衝擊網站對合法爬蟲的基本信任機制。

換句話說,Perplexity 在被網站擋下後,沒有守規矩地停止,而是讓一支假扮成一般 Chrome 瀏覽器 的爬蟲再偷偷抓取資料。

Cloudflare指出,包括PerplexityBot和Perplexity-User兩種爬蟲,會忽視網站寫在 robots.txt 裏面「禁止抓資料」的指令,連 WAF(Web 應用程式防火牆)的封鎖也設法繞開。

結果就是: 網站原本不想被抓走的內容,仍被抓走;而這種故意違反網路約定(見 RFC 9309)的行為,會削弱網站對「守規矩的爬蟲都會自我標示、遵守限制」這套信任機制。

對於上述指控,Perplexity 發言人 Jesse Dwyer 反駁稱相關貼文只是 Cloudflare 的「銷售話術」,並否認爬蟲為自家所有。不過,Perplexity 去年確實因《Wired》等媒體指其未經授權引用全文而陷入「抄襲」爭議,執行長 Aravind Srinivas 也被質疑對「抄襲」定義語焉不詳。

Cloudflare 近月祭出「AI爬蟲按次付費」功能,讓出版社與網站能為資料存取設定明確定價;同時在旗下免費「Bot Fight Mode」新增 AI-bot 專用封鎖規則,網站只需一鍵即可拒絕或限速未付費的爬蟲,藉此把「給錢才給料」的談判主導權拉回內容擁有者。

Cloudflare如何抓包Perplexity?

Cloudflare 先接獲多家客戶反映,指出即便已在「禁止機器抓取」的 robots.txt 檔案與防火牆(WAF)中封鎖 Perplexity 的官方爬蟲,網站內容仍遭擷取。公司先行確認客戶設定無誤後,進一步購買數個全新且對外完全隱藏的測試網域,並在其中同樣下達「全面禁止爬蟲」指令。

接著,Cloudflare 直接向 Perplexity 詢問這些測試網域的內容,結果卻收到詳盡回答,證實有未經宣告的爬蟲進入。最後,Cloudflare 透過流量分析比對,發現這批爬蟲假冒一般瀏覽器身分,每日仍對全球網站發送約兩千萬次請求,且頻繁更換 IP 與網路識別碼。

綜合上述三項證據,Cloudflare 認定 Perplexity違反公開爬蟲規範,隨即取消其「已驗證機器人」資格並將相關流量列入封鎖清單。

Cloudflare抓包Perplexity.jpeg
這張圖解釋了 Perplexity 的「官方→偽裝→重試」路徑與每一步判斷條件,凸顯其繞過網站保護機制的行為模式。
圖/ Cloudflare

Perplexity 遭剔除「已驗證機器人」名單

Cloudflare 隨即將 Perplexity 剔除「已驗證機器人」名單,並於所有方案推送新簽章,協助站點自動阻擋或挑戰此類隱形爬蟲。公司同時呼籲業者遵守「透明、節制、單一目的」等五大善意爬蟲原則,並與 IETF 共同推動擴充版 robots.txt。

官方亦肯定 OpenAI (開放人工智慧) 旗下 ChatGPT-User 嚴格尊重封鎖指令,並採用 Web Bot Auth 身分簽章,作為業界良好示範。

Perplexity反嗆:我看你是完全不懂AI助理

針對Cloudflare指控,Perplexity在X聲明反擊,直言傳統網路爬蟲(bot)與現代AI助理(agent)的本質不同。傳統爬蟲會自動、大規模地抓取網頁內容並建立資料庫,而AI助理(如Perplexity)則是根據用戶即時需求,臨時抓取並回應,不會儲存或用於訓練。

Perplexity強調其「user-driven agent」只在用戶發出請求時才抓取內容,且僅用於當下回答,不會長期保存或訓練模型。

Perplexity批評Cloudflare將AI助理誤認為惡意bot,認為這種做法會傷害用戶權益,阻礙資訊自由流通,甚至可能影響如醫療、新聞等重要資訊的取得。

聲明指出,Cloudflare在技術分析上有重大錯誤,將第三方流量誤歸因於Perplexity,並發布不正確的技術圖示,顯示其對現代AI助理運作方式缺乏理解。

Perplexity認為,若基礎設施供應商無法區分合法AI助理與惡意爬蟲,將危及開放網路的創新與用戶選擇權。

合規爬蟲的5大原則

依據 Cloudflare 的說明,守規矩的爬蟲至少符合下列五項原則:

  • 透明 (Transparency)
    主動標示專屬的 User-Agent,公開 IP 範圍或使用 Web Bot Auth 驗證,並附上聯絡資訊,便於站方追蹤與溝通。
  • 克制 (Good Netizenship)
    不大量灌流量、不抓取敏感資料,也不使用隱藏或偽裝手段規避偵測。
  • 明確目的 (Clear Purpose)
    每一隻爬蟲都應說清楚用於哪項服務,例如語音助理、比價、無障礙輔助等,讓站方能判斷是否開放。
  • 分工清楚 (Separate Bots for Separate Activities)
    不同功能用不同爬蟲執行,避免讓站方陷入「全開或全關」的兩難。
  • 遵守規則 (Follow the Rules)
    必須檢查並尊重 robots.txt、維持合理速率,且不得繞過 WAF 或其他安全防護。

這五條囊括了對網站「可辨識、可控管、可信任」的核心要求,亦是 Cloudflare 評定爬蟲是否值得授予「已驗證機器人」資格的依據。

延伸閱讀:Lawsnote為什麼「判4年、賠1億」那麼重?律師解讀一審判決:爬蟲到底行不行?
影片|6萬次爬蟲只換來1次點擊!AI搜尋促成「流量大斷崖」:Google如何改寫搜尋行規?

資料來源:CloudflareTechChurch

本文初稿為AI編撰,整理.編輯/ 李先泰

往下滑看下一篇文章
溝通時間砍半、成交率衝 3 成!創造智能以完整 AI解方讓行銷事半功倍
溝通時間砍半、成交率衝 3 成!創造智能以完整 AI解方讓行銷事半功倍

隨著生成式 AI 工具快速普及,使用 AI 生成圖片、文案與影音素材,早已不再稀奇;真正困難的是,如何讓 AI 內容不只具備媲美真人拍攝的質感,還能精準貼合品牌語氣、商品賣點與社群傳播節奏,進一步帶動流量、轉換率與會員經營。

不過,有一家成立不到 5 年的團隊,卻憑藉著這項能力,吸引百年家電品牌、大型連鎖零售品牌、化妝品代工龍頭到政府機關等不同類型客戶合作。近期更與以創意出名的電商平台 蝦皮購物共同合作。

這家隱身在眾多一線大廠背後的 AI 操盤手,正是三立集團旗下的 MarTech 公司「創造智能」。相較於單純提供 AI 工具或單點行銷服務,創造智能更像是企業的 AI 行銷整合夥伴,不只是生成 AI 影音內容,而是從行銷目標出發,運用 AI 串起從內容生成、社群導流、顧客互動到會員經營的完整行銷旅程,突破過往內容與數據各自為政的盲點,這才是它真正讓企業買單的關鍵。

#1 創造智能
除了預算大幅減少、製作效率提升外,林慧珍指出,現在很多人都可以利用 AI 工具生成圖片或影片,但真正拉開差距的,不是 AI 應用能力,而是內容本身。創造智能刻意打造一支由行銷人才與工程師組成的「混血團隊」,兼顧 AI 影音內容的製作效率與品質。
圖/ 創造智能

串起行銷斷點,打造 AI 一條龍整合服務

對台灣企業行銷現場的長期觀察,是創造智能跳脫單一工具走向「AI 行銷整合」模式的起點。

創造智能執行長林慧珍指出,企業行銷工作往往交由不同廠商負責,從影音內容製作、廣告投放、社群經營到會員管理,各自使用不同工具與平台,導致資料散落在各處,形成一個個看不見的行銷斷點,一旦成效不如預期,很難釐清問題究竟出在哪一個環節,是素材無法打動消費者、投放策略失準,還是會員經營沒有發揮效益。

「很多 AI 或軟體業者的想法是,用自家產品去解決客戶的問題,但我們想的不只是解決問題,而是如何讓客戶用最方便、最完整的一條龍方式達成商業目標,」林慧珍強調,也因此,創造智能成立初期便鎖定AIGC 商業影音、AI客服/虛擬人及LINE CRM三大領域,希望從內容、互動到會員經營,串起完整的行銷流程。

在行銷旅程的前端,創造智能透過自家研發的系統與深厚的行銷經驗,快速產製出 AI 影音內容,協助品牌放大聲量、吸引目標受眾;接著透過 AI 客服與 AI 虛擬人即時回應顧客需求,不受時間、地點與語言限制,提高互動與成交機率;最後再藉由 LINE CRM 將流量收斂為品牌的第一方會員資產,透過會員貼標、分群分眾、自動化推播、再行銷等機制,持續深化顧客關係,將一次性的流量轉化為持續回購的忠誠會員。

用 AI 加速內容測試,快速找到市場答案

除了串起完整的行銷流程外,創造智能還能為企業創造兩大價值,第一個是協助企業更快找到真正打動消費者的內容。

「現在很多人都可以利用 AI 工具生成圖片或影片,但真正拉開差距的,不是 AI 應用能力,而是內容本身。」林慧珍指出,創造智能刻意打造一支由行銷人才與工程師組成的「混血團隊」,兼顧 AI 影音內容的製作效率與品質。

林慧珍進一步說明,團隊許多成員原本就來自專業影音團隊,長期協助企業製作導流影片,因此在劇本企劃、分鏡設計與敘事節奏上,累積大量實戰經驗。以近期協助蝦皮購物製作 AI 短影音為例,團隊並非直接交由 AI 工具生成內容,而是先分析目標受眾的偏好,再於腳本設計時加入企劃巧思。像是刻意運用消費者熟悉的歌曲氛圍,營造「似曾相識」的共感,引發社群討論。這些對品牌語感、社群節奏與內容敘事的掌握,正是創造智能團隊多年累積的內容經驗,也是現階段 AI 難以取代的核心價值。

另一方面,團隊則負責研發系統,以滿足企業多元行銷需求。例如:創造智能自行開發的「AI 導演模板」,不僅能快速生成高度擬真的影音內容,還可以依據品牌的不同需求,快速調整畫面風格、配音語氣與敘事方式,協助品牌進行 A/B Test,找出最能吸引消費者的內容。同時,還能依照不同社群平台需求,自動延伸出不同秒數與尺寸的版本,讓同一支影片快速應用於不同投放渠道。

更重要的是,從企劃發想到完成影片,最快約一週即可完成,不僅大幅縮短製作時程,也較傳統真人拍攝節省約 4 至 6 成的成本

讓 AI 走進工作流程,從客服升級為企業數位夥伴

創造智能為企業帶來的第二個價值是,透過 AI 客服 / AI 虛擬人推動流程自動化。林慧珍認為,AI 的價值不只是回答問題,而是深入既有的工作流程,以自動化服務協助企業降低成本、提升營運效率。

舉例來說,創造智能在與百年家電品牌合作時,先以 LINE 官方帳號與會員經營為核心,透過 LINE CRM 建立會員數據基礎,依據會員的瀏覽行為、產品偏好及互動紀錄,自動完成會員標籤與分群,並透過精準推播提供更符合需求的內容。隨著會員數據逐步累積,再進一步串接 Facebook 等社群平台,讓會員經營從單一通路延伸至跨平台互動,逐步建立完整的品牌數位接觸點。

目前,雙方合作已進入第二階段,將 AI 客服真正導入企業日常營運中。從客服受理、案件分流到售後服務,整個流程皆可透過 AI 與系統自動串接完成,不僅縮短服務時間、提升案件處理效率,也讓 AI 的角色從單純的客服工具,進一步成為串聯客服、門市與售後服務的企業數位夥伴。

同樣的模式,也被延伸到 B2B 外貿場景。創造智能為某知名化妝品代工廠打造 AI Sales(AI 虛擬人),並匯入產品知識與各國出口法規,讓 AI 不僅能以多國語言即時回覆海外買家問題,更可自動完成名片蒐集、預約真人業務及商機派單等流程,不僅溝通時間由 6 個月降至 3 個月,減少 30% 以上真人處理成本,訂單成交率提升 25%-32%,

#0 創造智能
某知名化妝品代工廠打造 AI Sales(AI 虛擬人)為例,AI已經可以回復日常問題的70%,真正優化前端開發的營運效率。
圖/ 創造智能

未來,AI 工具將持續演進,但企業真正需要的,始終是能協助創造商業價值的解決方案。林慧珍相信,唯有整合技術、內容與流程,並站在企業角度思考,AI 才能從工具升級為夥伴。這也是創造智能希望實踐的品牌理念──最人性化的MarTech 公司,創造更有溫度的智能夥伴。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
代理式商務連動百兆商機
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓