클라우드플레어, 차단된 웹사이트를 몰래 크롤링하기 위해 AI 봇을 사용하는 당혹스러움을 고발하다

웹사이트 제한을 우회한 혐의로 기소된 AI 스타트업
Cloudflare의 최근 조사에 따르면 AI 검색 회사인 Perplexity가 웹사이트 소유자가 구현한 크롤링 제한을 우회하는 전술을 사용해 왔다고 합니다. 이 인터넷 인프라 제공업체는 Perplexity의 웹 크롤러가 액세스 장벽에 직면했을 때 이를 위장하려는 조직적인 시도를 관찰했다고 보고했습니다.
우회 전술
Cloudflare의 조사 결과에 따르면, Perplexity의 크롤러는 처음에 표준 식별("PerplexityBot" 또는 "Perplexity-User")을 제시합니다. 그러나 차단된 경우
- robots.txt 지시어
- 웹 애플리케이션 방화벽 규칙
- 기타 액세스 제한
이 시스템은 다음을 활용하여 macOS에서 일반 Chrome 브라우저 사용자로 신분을 숨기는 것으로 추정됩니다:
- 공식적으로 나열되지 않은 IP 주소 순환
- 자율 시스템 네트워크 식별자 변경
- 문서화되지 않은 사용자 에이전트 패턴
활동 규모
Cloudflare는 이러한 행동을 문서화합니다:
- 수만 개의 도메인
- 매일 수백만 건의 요청
- 다양한 네트워크 구성
회사 대응
Perplexity의 공식 성명은 다음과 같이 설명하며 Cloudflare의 특징에 이의를 제기합니다:
- "홍보용 스턴트"
- "많은 오해" 포함
- 합법적인 사용자 트래픽과 스크래핑 활동을 혼동할 가능성이 있음
스타트업은 감지된 일부 활동의 원인을 다음과 같이 설명합니다:
- 실제 사용자가 특정 요청을 하는 경우
- 타사 서비스 브라우저베이스
- 때때로 기술적 필요성
업계 상황
이번 사건은 다음과 같습니다:
- 퍼플렉시티의 페이월 우회에 대한 이전 보고서
- 타사 크롤러에 대한 퍼플렉시티의 과거 기록
- AI 콘텐츠 스크래핑에 대한 업계의 우려 증가
Cloudflare는 다음과 같은 조치를 취했습니다:
- Perplexity의 확인된 봇 상태 제거
- 새로운 차단 조치 구현
- 기본 AI 크롤러 제한 확대
이 상황은 광범위한 긴장을 반영합니다:
- AI 기업의 데이터 요구
- 퍼블리셔의 권리 및 보호
- 진화하는 인터넷 인프라 대응
관련 기사
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트
비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
올리는 AI 비서 시장 경쟁에서 우위를 점하기 위해 개인정보 보호에 주력하고 있다
진정으로 도움이 되려면 AI 비서는 사용자를 깊이 이해해야 합니다. 일상 생활을 위해 설계된 개인 비서 ‘올리(Ollie)’는 이를 위해 사용자의 데이터를 제공하거나 개인정보를 침해할 필요가 없다는 전제 하에 운영됩니다.일부 기업용 AI 도구가 데이터 개인정보 보호 장치를 제공하기는 하지만, 올리는 SOC 2 인증을 획득한 최초의 대중적 가정용 AI 서비스
‘AI LIVE: London’이 AI와 산업 자동화를 어떻게 조명할 것인가
이번 정상회의에는 전 세계의 최고 경영진들이 한자리에 모여, AI에 의한 산업 혁신부터 경제 변동성에 이르기까지 글로벌 산업이 직면한 시급한 과제들을 논의할 예정입니다.‘AI LIVE: 런던 서밋’은 ‘기술 + 인간의 목적(Technology + Human Purpose)’이라는 주제로 2,000명 이상의 국제적 리더들을 한자리에 모아, 새롭게 도래하는 인
관련 특별 주제 추천
의견 (3)
0/500
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?

웹사이트 제한을 우회한 혐의로 기소된 AI 스타트업
Cloudflare의 최근 조사에 따르면 AI 검색 회사인 Perplexity가 웹사이트 소유자가 구현한 크롤링 제한을 우회하는 전술을 사용해 왔다고 합니다. 이 인터넷 인프라 제공업체는 Perplexity의 웹 크롤러가 액세스 장벽에 직면했을 때 이를 위장하려는 조직적인 시도를 관찰했다고 보고했습니다.
우회 전술
Cloudflare의 조사 결과에 따르면, Perplexity의 크롤러는 처음에 표준 식별("PerplexityBot" 또는 "Perplexity-User")을 제시합니다. 그러나 차단된 경우
- robots.txt 지시어
- 웹 애플리케이션 방화벽 규칙
- 기타 액세스 제한
이 시스템은 다음을 활용하여 macOS에서 일반 Chrome 브라우저 사용자로 신분을 숨기는 것으로 추정됩니다:
- 공식적으로 나열되지 않은 IP 주소 순환
- 자율 시스템 네트워크 식별자 변경
- 문서화되지 않은 사용자 에이전트 패턴
활동 규모
Cloudflare는 이러한 행동을 문서화합니다:
- 수만 개의 도메인
- 매일 수백만 건의 요청
- 다양한 네트워크 구성
회사 대응
Perplexity의 공식 성명은 다음과 같이 설명하며 Cloudflare의 특징에 이의를 제기합니다:
- "홍보용 스턴트"
- "많은 오해" 포함
- 합법적인 사용자 트래픽과 스크래핑 활동을 혼동할 가능성이 있음
스타트업은 감지된 일부 활동의 원인을 다음과 같이 설명합니다:
- 실제 사용자가 특정 요청을 하는 경우
- 타사 서비스 브라우저베이스
- 때때로 기술적 필요성
업계 상황
이번 사건은 다음과 같습니다:
- 퍼플렉시티의 페이월 우회에 대한 이전 보고서
- 타사 크롤러에 대한 퍼플렉시티의 과거 기록
- AI 콘텐츠 스크래핑에 대한 업계의 우려 증가
Cloudflare는 다음과 같은 조치를 취했습니다:
- Perplexity의 확인된 봇 상태 제거
- 새로운 차단 조치 구현
- 기본 AI 크롤러 제한 확대
이 상황은 광범위한 긴장을 반영합니다:
- AI 기업의 데이터 요구
- 퍼블리셔의 권리 및 보호
- 진화하는 인터넷 인프라 대응
올리는 AI 비서 시장 경쟁에서 우위를 점하기 위해 개인정보 보호에 주력하고 있다
진정으로 도움이 되려면 AI 비서는 사용자를 깊이 이해해야 합니다. 일상 생활을 위해 설계된 개인 비서 ‘올리(Ollie)’는 이를 위해 사용자의 데이터를 제공하거나 개인정보를 침해할 필요가 없다는 전제 하에 운영됩니다.일부 기업용 AI 도구가 데이터 개인정보 보호 장치를 제공하기는 하지만, 올리는 SOC 2 인증을 획득한 최초의 대중적 가정용 AI 서비스
‘AI LIVE: London’이 AI와 산업 자동화를 어떻게 조명할 것인가
이번 정상회의에는 전 세계의 최고 경영진들이 한자리에 모여, AI에 의한 산업 혁신부터 경제 변동성에 이르기까지 글로벌 산업이 직면한 시급한 과제들을 논의할 예정입니다.‘AI LIVE: 런던 서밋’은 ‘기술 + 인간의 목적(Technology + Human Purpose)’이라는 주제로 2,000명 이상의 국제적 리더들을 한자리에 모아, 새롭게 도래하는 인
Alors, cette nouvelle me fait vraiment réfléchir aux limites entre innovation et éthique dans l'IA. Perplexity ferait ça en cachette ? Si c'est vrai, c'est pas joli joli. On dirait un peu un jeu du chat et de la souris où les startups bousculent les règles. 😬 Mais bon, Cloudflare n'est pas parfait non plus, ils ont leur propre agenda. Un peu de transparence ne ferait de mal à personne ! C'est ce manque de clarté qui mine la confiance du public envers toute cette industrie.
¿Está Perplexity realmente raspando sitios web bloqueados a escondidas? 🤔 Si es verdad, es bastante preocupante. Muchas empresas de IA prometen ser 'éticas', pero a veces parece que sus acciones contradicen sus palabras. Espero que haya más transparencia en la industria y que respeten los archivos robots.txt de los sitios. Este caso podría suponer un precedente importante.
¿Es esto lo que llaman 'innovación'? Primero nos venden la IA como una herramienta mágica, y luego descubrimos que hacen trampas para robar datos. Si Perplexity realmente evita bloqueos a propósito, es un problema serio de ética y legal. ¡Qué hipocresía! 🙄 ¿Hasta dónde llegarán algunas startups para ganar la carrera de la IA?





집






