Heim
Cloudflare beschuldigt Perplexity, KI-Bots zum heimlichen Crawlen gesperrter Websites einzusetzen

AI-Startup beschuldigt, Website-Beschränkungen zu umgehen
Die jüngste Untersuchung von Cloudflare behauptet, dass das KI-Suchunternehmen Perplexity Taktiken anwendet, um Crawling-Beschränkungen von Website-Besitzern zu umgehen. Der Internet-Infrastrukturanbieter berichtet von systematischen Versuchen, die Web-Crawler von Perplexity zu verschleiern, wenn sie auf Zugangsbeschränkungen stoßen.
Die Umgehungstaktik
Nach den Erkenntnissen von Cloudflare weisen die Crawler von Perplexity zunächst eine Standardidentifikation auf ("PerplexityBot" oder "Perplexity-User"). Wenn sie jedoch durch:
- robots.txt-Richtlinien
- Web Application Firewall-Regeln
- Andere Zugangsbeschränkungen
Das System geht angeblich dazu über, seine Identität als normaler Chrome-Browser-Benutzer auf macOS zu verschleiern, indem es Folgendes verwendet:
- Rotierende IP-Adressen, die nicht offiziell aufgeführt sind
- Ändern von Netzwerkbezeichnern für autonome Systeme
- Undokumentierte User-Agent-Muster
Ausmaß der Aktivität
Cloudflare dokumentiert dieses Verhalten über:
- Zehntausende von Domains
- Millionen von täglichen Anfragen
- Verschiedene Netzwerkkonfigurationen
Antworten des Unternehmens
Die offizielle Erklärung von Perplexity widerspricht Cloudflare's Charakterisierung und beschreibt sie als:
- Ein "Publicity-Gag"
- Viele Missverständnisse" enthaltend
- Potenzielle Verwechslung von legitimem Nutzerverkehr mit Scraping-Aktivitäten
Das Startup schreibt einige erkannte Aktivitäten zu:
- Tatsächliche Nutzer, die bestimmte Anfragen stellen
- Drittanbieter-Dienst BrowserBase
- Gelegentliche technische Notwendigkeiten
Branchenkontext
Dieser Vorfall folgt:
- Frühere Berichte über die Umgehung von Paywalls durch Perplexity
- Frühere Zuschreibungen des Unternehmens an Crawler von Drittanbietern
- Wachsende Besorgnis in der Branche über das Scraping von KI-Inhalten
Cloudflare hat Maßnahmen ergriffen:
- Entzug des verifizierten Bot-Status von Perplexity
- Implementierung neuer Blockierungsmaßnahmen
- Ausweitung der Standardbeschränkungen für AI-Crawler
Die Situation spiegelt allgemeinere Spannungen zwischen:
- dem Datenbedarf von KI-Unternehmen
- Rechte und Schutz der Herausgeber
- sich entwickelnden Reaktionen der Internet-Infrastruktur
Verwandter Artikel
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen
Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei
So wird die „AI LIVE: London“ KI und industrielle Automatisierung beleuchten
Auf dem Gipfel werden Führungskräfte der obersten Ebene aus aller Welt zusammenkommen, um dringende Herausforderungen in globalen Branchen zu erörtern – von KI-getriebenen Umbrüchen bis hin zu wirtsch
Empfehlungen zu verwandten Spezialthemen
Kommentare (3)
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?

AI-Startup beschuldigt, Website-Beschränkungen zu umgehen
Die jüngste Untersuchung von Cloudflare behauptet, dass das KI-Suchunternehmen Perplexity Taktiken anwendet, um Crawling-Beschränkungen von Website-Besitzern zu umgehen. Der Internet-Infrastrukturanbieter berichtet von systematischen Versuchen, die Web-Crawler von Perplexity zu verschleiern, wenn sie auf Zugangsbeschränkungen stoßen.
Die Umgehungstaktik
Nach den Erkenntnissen von Cloudflare weisen die Crawler von Perplexity zunächst eine Standardidentifikation auf ("PerplexityBot" oder "Perplexity-User"). Wenn sie jedoch durch:
- robots.txt-Richtlinien
- Web Application Firewall-Regeln
- Andere Zugangsbeschränkungen
Das System geht angeblich dazu über, seine Identität als normaler Chrome-Browser-Benutzer auf macOS zu verschleiern, indem es Folgendes verwendet:
- Rotierende IP-Adressen, die nicht offiziell aufgeführt sind
- Ändern von Netzwerkbezeichnern für autonome Systeme
- Undokumentierte User-Agent-Muster
Ausmaß der Aktivität
Cloudflare dokumentiert dieses Verhalten über:
- Zehntausende von Domains
- Millionen von täglichen Anfragen
- Verschiedene Netzwerkkonfigurationen
Antworten des Unternehmens
Die offizielle Erklärung von Perplexity widerspricht Cloudflare's Charakterisierung und beschreibt sie als:
- Ein "Publicity-Gag"
- Viele Missverständnisse" enthaltend
- Potenzielle Verwechslung von legitimem Nutzerverkehr mit Scraping-Aktivitäten
Das Startup schreibt einige erkannte Aktivitäten zu:
- Tatsächliche Nutzer, die bestimmte Anfragen stellen
- Drittanbieter-Dienst BrowserBase
- Gelegentliche technische Notwendigkeiten
Branchenkontext
Dieser Vorfall folgt:
- Frühere Berichte über die Umgehung von Paywalls durch Perplexity
- Frühere Zuschreibungen des Unternehmens an Crawler von Drittanbietern
- Wachsende Besorgnis in der Branche über das Scraping von KI-Inhalten
Cloudflare hat Maßnahmen ergriffen:
- Entzug des verifizierten Bot-Status von Perplexity
- Implementierung neuer Blockierungsmaßnahmen
- Ausweitung der Standardbeschränkungen für AI-Crawler
Die Situation spiegelt allgemeinere Spannungen zwischen:
- dem Datenbedarf von KI-Unternehmen
- Rechte und Schutz der Herausgeber
- sich entwickelnden Reaktionen der Internet-Infrastruktur
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen
Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei
So wird die „AI LIVE: London“ KI und industrielle Automatisierung beleuchten
Auf dem Gipfel werden Führungskräfte der obersten Ebene aus aller Welt zusammenkommen, um dringende Herausforderungen in globalen Branchen zu erörtern – von KI-getriebenen Umbrüchen bis hin zu wirtsch
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?











