Cloudflare、AIボットを使用してブロックされたウェブサイトを秘密裏にクロールしているとしてPerplexityを非難

AIスタートアップ、ウェブサイト制限の回避で訴えられる
Cloudflareの最近の調査によると、AI検索企業のPerplexityは、ウェブサイト所有者が実施するクロール制限を回避するための戦術を採用しているとのことです。インターネットインフラストラクチャプロバイダーは、アクセス制限に遭遇した際、Perplexityのウェブクローラーを偽装する組織的な試みを観察したと報告しています。
回避の手口
Cloudflareの調査結果によると、Perplexityのクローラは当初、標準的な識別情報("PerplexityBot "または "Perplexity-User")を表示しています。しかし
- robots.txt ディレクティブ
- ウェブアプリケーションファイアウォールルール
- その他のアクセス制限
を利用して、macOS上の通常のChromeブラウザのユーザーとしてのアイデンティティを隠すように切り替えたとされている:
- 公式にリストされていないIPアドレスのローテーション
- 自律システムネットワーク識別子の変更
- 文書化されていないユーザーエージェントパターン
活動の規模
Cloudflareはこの動作を以下の規模で記録しています:
- 数万ドメイン
- 1日あたり数百万のリクエスト
- さまざまなネットワーク構成
企業の対応
Perplexityの公式声明は、Cloudflareの説明に対して次のように反論している:
- "売名行為"
- 多くの誤解」を含む
- 正当なユーザートラフィックとスクレイピング活動を混同する可能性
同スタートアップは、検出されたアクティビティを以下のように説明している:
- 特定のリクエストを行った実際のユーザー
- サードパーティのサービスBrowserBase
- 時折発生する技術的な必要性
業界の背景
この事件は次のようなものである:
- Perplexityがペイウォールを回避したという過去の報告
- サードパーティのクローラーに起因する同社の過去の報告
- AIによるコンテンツスクレイピングに対する業界の懸念の高まり
Cloudflareは以下の措置をとりました:
- Perplexityの検証済みボットステータスの削除
- 新たなブロッキング対策の導入
- デフォルトのAIクローラーの制限を拡大
この状況は、以下のような幅広い緊張関係を反映している:
- AI企業のデータニーズ
- パブリッシャーの権利と保護
- 進化するインターネット・インフラへの対応
関連記事
オリー社、AIアシスタント競争で優位に立つためプライバシー重視を掲げる
真に役立つAIアシスタントであるためには、ユーザーを深く理解する必要があります。日常生活向けに設計されたパーソナルアシスタント「Ollie」は、そのためにデータを明け渡したり、プライバシーを犠牲にしたりする必要はないという前提で動作します。一部のエンタープライズ向けAIツールにはデータプライバシー保護措置が講じられていますが、OllieはSOC 2準拠を達成した、一般家庭向けのAIサービスとしては
「AI LIVE: London」がAIと産業オートメーションをどのように掘り下げるか
このサミットには、世界中から経営幹部が集まり、AIによる変革から経済の変動性に至るまで、世界の産業が直面する喫緊の課題について議論します。「AI LIVE: The London Summit」では、「テクノロジー+人間の目的」をテーマに、2,000名を超える国際的なリーダーが一堂に会し、人工知能の新たな時代について検討を行います。BizClik傘下の『AI Magazine』は、「AI LIVE
Anthropic、AI法テック市場に参入、競争激化
Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
関連特集おすすめ
コメント (3)
0/500
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?

AIスタートアップ、ウェブサイト制限の回避で訴えられる
Cloudflareの最近の調査によると、AI検索企業のPerplexityは、ウェブサイト所有者が実施するクロール制限を回避するための戦術を採用しているとのことです。インターネットインフラストラクチャプロバイダーは、アクセス制限に遭遇した際、Perplexityのウェブクローラーを偽装する組織的な試みを観察したと報告しています。
回避の手口
Cloudflareの調査結果によると、Perplexityのクローラは当初、標準的な識別情報("PerplexityBot "または "Perplexity-User")を表示しています。しかし
- robots.txt ディレクティブ
- ウェブアプリケーションファイアウォールルール
- その他のアクセス制限
を利用して、macOS上の通常のChromeブラウザのユーザーとしてのアイデンティティを隠すように切り替えたとされている:
- 公式にリストされていないIPアドレスのローテーション
- 自律システムネットワーク識別子の変更
- 文書化されていないユーザーエージェントパターン
活動の規模
Cloudflareはこの動作を以下の規模で記録しています:
- 数万ドメイン
- 1日あたり数百万のリクエスト
- さまざまなネットワーク構成
企業の対応
Perplexityの公式声明は、Cloudflareの説明に対して次のように反論している:
- "売名行為"
- 多くの誤解」を含む
- 正当なユーザートラフィックとスクレイピング活動を混同する可能性
同スタートアップは、検出されたアクティビティを以下のように説明している:
- 特定のリクエストを行った実際のユーザー
- サードパーティのサービスBrowserBase
- 時折発生する技術的な必要性
業界の背景
この事件は次のようなものである:
- Perplexityがペイウォールを回避したという過去の報告
- サードパーティのクローラーに起因する同社の過去の報告
- AIによるコンテンツスクレイピングに対する業界の懸念の高まり
Cloudflareは以下の措置をとりました:
- Perplexityの検証済みボットステータスの削除
- 新たなブロッキング対策の導入
- デフォルトのAIクローラーの制限を拡大
この状況は、以下のような幅広い緊張関係を反映している:
- AI企業のデータニーズ
- パブリッシャーの権利と保護
- 進化するインターネット・インフラへの対応
オリー社、AIアシスタント競争で優位に立つためプライバシー重視を掲げる
真に役立つAIアシスタントであるためには、ユーザーを深く理解する必要があります。日常生活向けに設計されたパーソナルアシスタント「Ollie」は、そのためにデータを明け渡したり、プライバシーを犠牲にしたりする必要はないという前提で動作します。一部のエンタープライズ向けAIツールにはデータプライバシー保護措置が講じられていますが、OllieはSOC 2準拠を達成した、一般家庭向けのAIサービスとしては
「AI LIVE: London」がAIと産業オートメーションをどのように掘り下げるか
このサミットには、世界中から経営幹部が集まり、AIによる変革から経済の変動性に至るまで、世界の産業が直面する喫緊の課題について議論します。「AI LIVE: The London Summit」では、「テクノロジー+人間の目的」をテーマに、2,000名を超える国際的なリーダーが一堂に会し、人工知能の新たな時代について検討を行います。BizClik傘下の『AI Magazine』は、「AI LIVE
Anthropic、AI法テック市場に参入、競争激化
Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?





家






