請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

理財

Perplexity是資料小偷?Cloudflare揭「偽裝Chrome爬蟲」,每日狂送逾2千萬次請求

數位時代

更新於 1小時前 • 發布於 2小時前

重點一:雲端防護服務商Cloudflare指出AI搜尋引擎Perplexity以隱形爬蟲繞過robots.txt與WAF規則,仍能擷取受限網頁內容。

重點二:該爬蟲偽裝成Chrome瀏覽器並頻繁更換 IP、ASN,每日仍對全球網站送出約2,000至 2,500萬請求。

重點三:Cloudflare已撤銷Perplexity的「已驗證機器人」資格,並新增管制規則阻擋其潛行爬取行為。

Cloudflare (雲端防護服務商) 4 日發表最新觀測揭露 Perplexity 在遭封鎖後,改以偽裝瀏覽器的未宣告爬蟲繞過 robots.txt 與 WAF 限制,仍成功抓取原本禁止擷取的內容。此舉不僅違背 RFC 9309 所訂網路共識,也衝擊網站對合法爬蟲的基本信任機制。

換句話說,Perplexity 在被網站擋下後,沒有守規矩地停止,而是讓一支假扮成一般 Chrome 瀏覽器 的爬蟲再偷偷抓取資料。

Cloudflare指出,包括PerplexityBot和Perplexity-User兩種爬蟲,會忽視網站寫在 robots.txt 裏面「禁止抓資料」的指令,連 WAF(Web 應用程式防火牆)的封鎖也設法繞開。

結果就是: 網站原本不想被抓走的內容,仍被抓走;而這種故意違反網路約定(見 RFC 9309)的行為,會削弱網站對「守規矩的爬蟲都會自我標示、遵守限制」這套信任機制。

對於上述指控,Perplexity 發言人 Jesse Dwyer 反駁稱相關貼文只是 Cloudflare 的「銷售話術」,並否認爬蟲為自家所有。不過,Perplexity 去年確實因《Wired》等媒體指其未經授權引用全文而陷入「抄襲」爭議,執行長 Aravind Srinivas 也被質疑對「抄襲」定義語焉不詳。

Cloudflare 近月祭出「AI爬蟲按次付費」功能,讓出版社與網站能為資料存取設定明確定價;同時在旗下免費「Bot Fight Mode」新增 AI-bot 專用封鎖規則,網站只需一鍵即可拒絕或限速未付費的爬蟲,藉此把「給錢才給料」的談判主導權拉回內容擁有者。

Cloudflare如何抓包Perplexity?

Cloudflare 先接獲多家客戶反映,指出即便已在「禁止機器抓取」的 robots.txt 檔案與防火牆(WAF)中封鎖 Perplexity 的官方爬蟲,網站內容仍遭擷取。公司先行確認客戶設定無誤後,進一步購買數個全新且對外完全隱藏的測試網域,並在其中同樣下達「全面禁止爬蟲」指令。

接著,Cloudflare 直接向 Perplexity 詢問這些測試網域的內容,結果卻收到詳盡回答,證實有未經宣告的爬蟲進入。最後,Cloudflare 透過流量分析比對,發現這批爬蟲假冒一般瀏覽器身分,每日仍對全球網站發送約兩千萬次請求,且頻繁更換 IP 與網路識別碼。

綜合上述三項證據,Cloudflare 認定 Perplexity違反公開爬蟲規範,隨即取消其「已驗證機器人」資格並將相關流量列入封鎖清單。

這張圖解釋了 Perplexity 的「官方→偽裝→重試」路徑與每一步判斷條件,凸顯其繞過網站保護機制的行為模式。

Perplexity 遭剔除「已驗證機器人」名單

Cloudflare 隨即將 Perplexity 剔除「已驗證機器人」名單,並於所有方案推送新簽章,協助站點自動阻擋或挑戰此類隱形爬蟲。公司同時呼籲業者遵守「透明、節制、單一目的」等五大善意爬蟲原則,並與 IETF 共同推動擴充版 robots.txt。

官方亦肯定 OpenAI (開放人工智慧) 旗下 ChatGPT-User 嚴格尊重封鎖指令,並採用 Web Bot Auth 身分簽章,作為業界良好示範。

依據 Cloudflare 的說明,守規矩的爬蟲至少符合下列五項原則:

  • 透明 (Transparency)
    主動標示專屬的 User-Agent,公開 IP 範圍或使用 Web Bot Auth 驗證,並附上聯絡資訊,便於站方追蹤與溝通。
  • 克制 (Good Netizenship)
    不大量灌流量、不抓取敏感資料,也不使用隱藏或偽裝手段規避偵測。
  • 明確目的 (Clear Purpose)
    每一隻爬蟲都應說清楚用於哪項服務,例如語音助理、比價、無障礙輔助等,讓站方能判斷是否開放。
  • 分工清楚 (Separate Bots for Separate Activities)
    不同功能用不同爬蟲執行,避免讓站方陷入「全開或全關」的兩難。
  • 遵守規則 (Follow the Rules)
    必須檢查並尊重 robots.txt、維持合理速率,且不得繞過 WAF 或其他安全防護。

這五條囊括了對網站「可辨識、可控管、可信任」的核心要求,亦是 Cloudflare 評定爬蟲是否值得授予「已驗證機器人」資格的依據。

延伸閱讀:Lawsnote為什麼「判4年、賠1億」那麼重?律師解讀一審判決:爬蟲到底行不行?
影片|6萬次爬蟲只換來1次點擊!AI搜尋促成「流量大斷崖」:Google如何改寫搜尋行規?

資料來源:CloudflareTechChurch

本文初稿為AI編撰,整理.編輯/ 李先泰

延伸閱讀

美國國防獨角獸Anduril來台設辦事處!讓產業大咖齊聚的一場演說,揭示台灣哪些機會?
Google公布AI提示萬用公式!掌握「21字黃金法則」:先穩80分基本功再求好
「加入《數位時代》LINE好友,科技新聞不漏接」

查看原始文章

更多理財相關文章

01

雷虎現5,876萬違約交割 今年集中市場首例、元大松江分公司申報

經濟日報
02

又見當沖翻船?軍工飆股雷虎爆違約交割5876萬元 今年來上市首例

anue鉅亨網
03

關稅難題卡台積1/台灣對美貿易逆差超過日韓 傳川普只給2條路解套

鏡週刊
04

你的退休金靠這檔!新制勞退上半年10大持股出爐 台積電比重上升

民視新聞網
05

傳關稅15%二選一! 台積電進退兩難

中廣新聞網
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
查看更多

留言 0

沒有留言。

最新消息

加速自駕布局!上海今年內全面開放浦東新區 Robotaxi進程邁向新高度

anue鉅亨網

賴清德:推動五大信賴產業升級 明年國防預算達GDP 3%以上

anue鉅亨網

盤中速報 - 昇益(5455)急拉3.43%報27.8元,成交58張

anue鉅亨網

盤中速報 - 鈺鎧(5228)急跌-3.63%報17.1元,成交1張

anue鉅亨網

盤中速報 - 光寶科(2301)股價拉至漲停,漲停價133.5元,成交56,676張

anue鉅亨網

盤中速報 - 和椿(6215)大漲7.26%,報125.5元

anue鉅亨網

盤中速報 - 巨虹(8084)股價拉至漲停,漲停價45.55元,成交389張

anue鉅亨網

盤中速報 - 天蔥(2740)急拉4.14%報29.4元,成交3張

anue鉅亨網

盤中速報 - 皇將(4744)急拉3.41%報25.7元,成交520張

anue鉅亨網

比亞迪密會立院高層  網友:送立委試車

NOWNEWS今日新聞

〈焦點股〉台達電在輝達電力革命扮要角 飛越600元關再飆天價

anue鉅亨網

傳2奈米製程技術遭取得外洩!台積電回應

NOWNEWS今日新聞

盤中速報 - 皇將(4744)大漲7.45%,報25.95元

anue鉅亨網

盤中速報 - 精湛(2070)急拉3.01%報46.15元,成交1,636張

anue鉅亨網

砸4千億美元降關稅?經濟部緊急消毒 業者嘆犧牲台積電「沒Guts」

CTWANT

LINEPAY韓國市場佈局再下一城,進駐韓國鐵道零售公司Korail Retail

財訊快報

ALA-1000明年Q1進三期臨床,昱展新藥迎新一波里程碑金入帳

財訊快報

比亞迪來台「最後一關」?經濟部投審司說明

NOWNEWS今日新聞

美降息增溫「台股彈逾267點」 金融股+主動型ETF續衝

CTWANT

巨有切入28到6奈米先進製程NRE效益,下半年可望逐步發酵

財訊快報

盤中速報 - 邦泰(8935)股價拉至漲停,漲停價17.6元,成交1,794張

anue鉅亨網

台積電爆內部洩密疑雲 多名前員工涉竊2奈米機密資料遭開除與法辦

信傳媒

【AI 槓桿影響驚人】Palantir、OpenAI 公布亮眼成績單,反映市場需求飆升

TechOrange 科技報橘

盤中速報 - 玻璃陶瓷類股表現疲軟,跌幅2.6%,總成交額19.77億

anue鉅亨網

勞動部宣布3項「僱用安定措施」強化方案 哪些人適用?如何申請補貼?

新頭殼

舊金山聯準銀行總裁:降息時機近 可能需兩次以上

中央通訊社

高價、代工、軍工輪動,台股再創波段新高

財訊快報

威力彩頭獎台中1人獨得逾17億 花1600元包牌中獎

中央通訊社

京城銀「連三漲」股價衝破55元 7月獲利年增逾14倍

CTWANT

盤中速報 - 鑫傳(6856)急拉3.78%報54.0元,成交1張

anue鉅亨網

日媒:台積電多名員工涉違規獲取2奈米晶片技術 恐影響國安

太報

三商電除息首日秒填息,早盤亮燈,專案入帳高峰助未來營運動能

財訊快報

台積電2奈米機密疑被盜,火速開除數名員工!這些人還涉違《國安法》,官方怎麼說?

數位時代

AI開發者必學!Anthropic推免費線上課:MCP、API應用、雲端服務整合... 6堂精選課一次看

數位時代

盤中速報 - 邦泰(8935)急拉3.55%報17.35元,成交1,641張

anue鉅亨網

新台幣午盤貶0.3分 暫收29.921元

中央通訊社

台達電大飆股!4天漲幅18.9% 盤中飆630元創新天價

太報

美股三大指數全面強彈 台股開高走高、盤面百花齊放

商傳媒

邏輯、記憶體驅動 WSTS上調2025全球半導體產值年增15%

太報

蘋果考慮為iPhone導入「串聯式OLED」技術!顯示器大升級

anue鉅亨網