Cloudflare 指責 Perplexity 使用人工智能機器人秘密抓取被封鎖的網站

AI 創業公司被指控繞過網站限制
Cloudflare 最近的調查指出,AI 搜尋公司 Perplexity 一直在使用繞過網站擁有者實施的爬行限制的策略。互聯網基礎設施供應商報告說,他們觀察到 Perplexity 的網路爬行器在遇到存取障礙時,有系統地試圖進行偽裝。
規避策略
根據 Cloudflare 的發現,Perplexity 的爬蟲最初會顯示標準識別("PerplexityBot 「或 」Perplexity-User")。但是,當通過
- robots.txt 指令
- Web 應用程式防火牆規則
- 其他存取限制
系統據稱會改為在 macOS 上將其身份掩飾為一般 Chrome 瀏覽器使用者,利用
- 輪流使用未正式列出的 IP 位址
- 變更自治系統網路識別碼
- 未記錄的使用者代理模式
活動規模
Cloudflare 記錄此行為跨越
- 數以萬計的網域
- 數百萬的每日請求
- 各種網路配置
公司回應
Perplexity 的官方聲明反駁 Cloudflare 的定性,將其描述為
- 一個 "宣傳噱頭
- 包含 "許多誤解
- 有可能混淆合法的用戶流量和刮擦活動
該初創公司將某些偵測到的活動歸咎於
- 提出特定請求的實際使用者
- 第三方服務 BrowserBase
- 偶爾的技術需要
行業背景
此事件發生在
- 先前有關 Perplexity 繞過付費牆的報告
- 該公司過去對第三方爬蟲的歸咎
- 業界對 AI 內容搜刮的日益關注
Cloudflare 已採取以下行動
- 刪除 Perplexity 的驗證機器人身份
- 實施新的封鎖措施
- 擴大預設的 AI 爬蟲限制
這種情況反映了以下兩者之間更廣泛的緊張關係
- AI 公司的資料需求
- 發行者的權利和保護
- 不斷演進的網際網路基礎建設回應
相關文章
Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制
根據《商業內幕》的報道,谷歌正在測試 Remy,這是 Gemini 的一款全新 AI 個人代理工具。該工具旨在代表使用者執行任務,從而簡化專業工作流程和日常事務。目前,Remy 正在 Gemini 應用的內部員工專屬版本中進行測試。該報告引用了一份內部檔案以及對兩位熟悉該專案的個人的採訪。內部資料將 Remy 描述為“全天候個人代理”,將 Gemini 定位為能夠代表使用者行事的主動助手。接近該專案的訊息人士證實,谷歌員工正在積極測試 Remy。谷歌發言人拒絕提供進一步評論。該報告未提及公開發布
奧利押注隱私保護,力爭在 AI 助理競賽中勝出
要真正發揮實用價值,人工智慧助理必須深入了解其使用者。Ollie 是一款專為日常生活設計的個人助理,其運作前提是:這無需您交出個人資料,亦不會損害您的隱私。雖然某些企業級 AI 工具提供資料隱私保障,但 Ollie 作為首批獲得 SOC 2 合規認證的主流、以家庭為導向的 AI 服務之一,顯得格外突出。此框架允許企業透過獨立稽核證明,其已建立正式的管控措施來保護客戶資料,並確保系統運作的安全性。達
「AI LIVE:倫敦」將如何探討人工智慧與工業自動化
本次峰會將匯聚來自全球的高階主管,共同探討全球產業面臨的迫切挑戰,涵蓋範圍從人工智慧驅動的顛覆性變革到經濟波動。AI LIVE:倫敦峰會將以「科技+人類使命」為主題,匯聚逾 2,000 位國際領袖,共同探討人工智慧新興時代的發展。隸屬於 BizClik 旗下的《AI Magazine》已公佈其於「AI LIVE:倫敦峰會」上舉辦的「人工智慧與工業自動化」聯合爐邊談話的與會陣容。該座談會定於 10
相關專題推薦
評論 (3)
0/500
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?

AI 創業公司被指控繞過網站限制
Cloudflare 最近的調查指出,AI 搜尋公司 Perplexity 一直在使用繞過網站擁有者實施的爬行限制的策略。互聯網基礎設施供應商報告說,他們觀察到 Perplexity 的網路爬行器在遇到存取障礙時,有系統地試圖進行偽裝。
規避策略
根據 Cloudflare 的發現,Perplexity 的爬蟲最初會顯示標準識別("PerplexityBot 「或 」Perplexity-User")。但是,當通過
- robots.txt 指令
- Web 應用程式防火牆規則
- 其他存取限制
系統據稱會改為在 macOS 上將其身份掩飾為一般 Chrome 瀏覽器使用者,利用
- 輪流使用未正式列出的 IP 位址
- 變更自治系統網路識別碼
- 未記錄的使用者代理模式
活動規模
Cloudflare 記錄此行為跨越
- 數以萬計的網域
- 數百萬的每日請求
- 各種網路配置
公司回應
Perplexity 的官方聲明反駁 Cloudflare 的定性,將其描述為
- 一個 "宣傳噱頭
- 包含 "許多誤解
- 有可能混淆合法的用戶流量和刮擦活動
該初創公司將某些偵測到的活動歸咎於
- 提出特定請求的實際使用者
- 第三方服務 BrowserBase
- 偶爾的技術需要
行業背景
此事件發生在
- 先前有關 Perplexity 繞過付費牆的報告
- 該公司過去對第三方爬蟲的歸咎
- 業界對 AI 內容搜刮的日益關注
Cloudflare 已採取以下行動
- 刪除 Perplexity 的驗證機器人身份
- 實施新的封鎖措施
- 擴大預設的 AI 爬蟲限制
這種情況反映了以下兩者之間更廣泛的緊張關係
- AI 公司的資料需求
- 發行者的權利和保護
- 不斷演進的網際網路基礎建設回應
奧利押注隱私保護,力爭在 AI 助理競賽中勝出
要真正發揮實用價值,人工智慧助理必須深入了解其使用者。Ollie 是一款專為日常生活設計的個人助理,其運作前提是:這無需您交出個人資料,亦不會損害您的隱私。雖然某些企業級 AI 工具提供資料隱私保障,但 Ollie 作為首批獲得 SOC 2 合規認證的主流、以家庭為導向的 AI 服務之一,顯得格外突出。此框架允許企業透過獨立稽核證明,其已建立正式的管控措施來保護客戶資料,並確保系統運作的安全性。達
「AI LIVE:倫敦」將如何探討人工智慧與工業自動化
本次峰會將匯聚來自全球的高階主管,共同探討全球產業面臨的迫切挑戰,涵蓋範圍從人工智慧驅動的顛覆性變革到經濟波動。AI LIVE:倫敦峰會將以「科技+人類使命」為主題,匯聚逾 2,000 位國際領袖,共同探討人工智慧新興時代的發展。隸屬於 BizClik 旗下的《AI Magazine》已公佈其於「AI LIVE:倫敦峰會」上舉辦的「人工智慧與工業自動化」聯合爐邊談話的與會陣容。該座談會定於 10
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?





首頁






