Hogar
Reddit presenta una demanda contra Anthropic por extraer datos de usuarios para entrenar inteligencia artificial
Reddit ha emprendido acciones legales contra Anthropic, alegando que la empresa de IA recopiló contenido de los usuarios de su plataforma sin permiso para entrenar sus modelos de IA Claude. La demanda, presentada ante un tribunal del estado de California, afirma que Anthropic realizó más de 100.000 peticiones no autorizadas a los servidores de Reddit, incluso después de haber afirmado públicamente que había dejado de hacerlo.
La demanda alega que Anthropic hizo caso omiso tanto de las salvaguardias técnicas como de sus condiciones de servicio. Según Reddit, Anthropic se saltó protecciones como el archivo robots.txt, diseñado para bloquear el scraping automatizado. La plataforma también afirma que Anthropic violó la privacidad de los usuarios al recopilar y utilizar publicaciones personales -incluido material eliminado- con fines comerciales.
Reddit señala que proporciona acceso a datos estructurados a través de acuerdos oficiales de licencia con empresas como OpenAI y Google. Estos acuerdos incluyen cláusulas que regulan el uso de contenidos, la protección de la privacidad y la eliminación de datos. Reddit afirma que Anthropic se negó a firmar un acuerdo formal de licencia, optando en su lugar por raspar el contenido directamente para evitar las tasas y eludir las protecciones de los usuarios.
En la solicitud se cita un trabajo de investigación de 2021 del que es coautor Dario Amodei, director general de Anthropic, en el que se identificaba a Reddit como una valiosa fuente de datos de entrenamiento para modelos lingüísticos. Reddit también presentó casos en los que Claude parecía reproducir publicaciones de Reddit casi al pie de la letra, incluidos contenidos que los usuarios habían eliminado. Según Reddit, esto demuestra que Anthropic no aplicó salvaguardias que respetaran la privacidad de los usuarios o las solicitudes de eliminación de contenidos.
Reddit solicita una indemnización por daños y perjuicios y una orden judicial que prohíba a Anthropic utilizar contenidos de Reddit en futuras versiones de sus modelos.
Anthropic ha respondido afirmando que rechaza las acusaciones y que tiene intención de defenderse. Sin embargo, este no es el primer desafío legal al que se enfrenta la empresa en relación con sus prácticas de recopilación de datos de entrenamiento.
En agosto de 2024, un grupo de autores presentó una demanda colectiva contra Anthropic, alegando que utilizaba sus obras protegidas por derechos de autor sin su consentimiento. Alegaban que la empresa entrenaba sus modelos en libros y otros escritos sin permiso, y luego pedía una compensación por el uso de los contenidos.
En octubre de 2023, Universal Music Group y otros editores interpusieron una demanda similar contra Anthropic por reproducir letras de canciones protegidas por derechos de autor a través de su chatbot Claude. Las compañías musicales alegaron que esto infringía sus derechos de propiedad intelectual y solicitaron una orden judicial contra el uso de letras de canciones.
A diferencia de esos casos, la demanda de Reddit no gira en torno a los derechos de autor. En su lugar, se centra en el incumplimiento de contrato y la competencia desleal. Reddit sostiene que los datos de su sitio no son meramente públicos, sino que están sujetos a condiciones que Anthropic ignoró a sabiendas. Esta distinción podría sentar un precedente importante para las plataformas que alojan contenidos generados por los usuarios pero pretenden regular su uso en sistemas comerciales de IA.
Reddit acusa además a Anthropic de engañar al público. La demanda apunta a las declaraciones públicas de Anthropic en las que afirma que sigue las normas de scraping y respeta la privacidad de los usuarios, afirmaciones que, según Reddit, se contradicen con la conducta real de la empresa.
"A pesar de lo que dice su material de marketing, a Anthropic no le importan las normas de Reddit ni sus usuarios", afirma la demanda. "Cree que tiene derecho a coger cualquier contenido que quiera y utilizarlo como desee, con impunidad".
Tras el anuncio de la demanda, las acciones de Reddit subieron casi un 67%, lo que indica el apoyo de los inversores al desafío legal. El resultado podría establecer un punto de referencia legal para equilibrar el contenido abierto de Internet con los derechos de los usuarios y los propietarios de contenidos.
A medida que más empresas de inteligencia artificial dependen de grandes cantidades de datos en línea, las implicaciones jurídicas y éticas del web scraping son cada vez más urgentes. El caso de Reddit contribuye a un creciente número de demandas que influirán en la próxima fase de desarrollo de la IA.
Véase también: Ética en la automatización: Cómo abordar la parcialidad y el cumplimiento en la IA
¿Quiere saber más sobre IA y big data de la mano de los líderes del sector? Visite la AI & Big Data Expo, que tendrá lugar en Ámsterdam, California y Londres. Este completo evento se celebra junto con otros eventos destacados como Intelligent Automation Conference, BlockX, Digital Transformation Week y Cyber Security & Cloud Expo.
Explore aquí otros próximos eventos y seminarios web sobre tecnología empresarial organizados por TechForge.
Artículo relacionado
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
Recomendaciones de temas especiales relacionados
comentario (2)
0/500
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.
Reddit ha emprendido acciones legales contra Anthropic, alegando que la empresa de IA recopiló contenido de los usuarios de su plataforma sin permiso para entrenar sus modelos de IA Claude. La demanda, presentada ante un tribunal del estado de California, afirma que Anthropic realizó más de 100.000 peticiones no autorizadas a los servidores de Reddit, incluso después de haber afirmado públicamente que había dejado de hacerlo.
La demanda alega que Anthropic hizo caso omiso tanto de las salvaguardias técnicas como de sus condiciones de servicio. Según Reddit, Anthropic se saltó protecciones como el archivo robots.txt, diseñado para bloquear el scraping automatizado. La plataforma también afirma que Anthropic violó la privacidad de los usuarios al recopilar y utilizar publicaciones personales -incluido material eliminado- con fines comerciales.
Reddit señala que proporciona acceso a datos estructurados a través de acuerdos oficiales de licencia con empresas como OpenAI y Google. Estos acuerdos incluyen cláusulas que regulan el uso de contenidos, la protección de la privacidad y la eliminación de datos. Reddit afirma que Anthropic se negó a firmar un acuerdo formal de licencia, optando en su lugar por raspar el contenido directamente para evitar las tasas y eludir las protecciones de los usuarios.
En la solicitud se cita un trabajo de investigación de 2021 del que es coautor Dario Amodei, director general de Anthropic, en el que se identificaba a Reddit como una valiosa fuente de datos de entrenamiento para modelos lingüísticos. Reddit también presentó casos en los que Claude parecía reproducir publicaciones de Reddit casi al pie de la letra, incluidos contenidos que los usuarios habían eliminado. Según Reddit, esto demuestra que Anthropic no aplicó salvaguardias que respetaran la privacidad de los usuarios o las solicitudes de eliminación de contenidos.
Reddit solicita una indemnización por daños y perjuicios y una orden judicial que prohíba a Anthropic utilizar contenidos de Reddit en futuras versiones de sus modelos.
Anthropic ha respondido afirmando que rechaza las acusaciones y que tiene intención de defenderse. Sin embargo, este no es el primer desafío legal al que se enfrenta la empresa en relación con sus prácticas de recopilación de datos de entrenamiento.
En agosto de 2024, un grupo de autores presentó una demanda colectiva contra Anthropic, alegando que utilizaba sus obras protegidas por derechos de autor sin su consentimiento. Alegaban que la empresa entrenaba sus modelos en libros y otros escritos sin permiso, y luego pedía una compensación por el uso de los contenidos.
En octubre de 2023, Universal Music Group y otros editores interpusieron una demanda similar contra Anthropic por reproducir letras de canciones protegidas por derechos de autor a través de su chatbot Claude. Las compañías musicales alegaron que esto infringía sus derechos de propiedad intelectual y solicitaron una orden judicial contra el uso de letras de canciones.
A diferencia de esos casos, la demanda de Reddit no gira en torno a los derechos de autor. En su lugar, se centra en el incumplimiento de contrato y la competencia desleal. Reddit sostiene que los datos de su sitio no son meramente públicos, sino que están sujetos a condiciones que Anthropic ignoró a sabiendas. Esta distinción podría sentar un precedente importante para las plataformas que alojan contenidos generados por los usuarios pero pretenden regular su uso en sistemas comerciales de IA.
Reddit acusa además a Anthropic de engañar al público. La demanda apunta a las declaraciones públicas de Anthropic en las que afirma que sigue las normas de scraping y respeta la privacidad de los usuarios, afirmaciones que, según Reddit, se contradicen con la conducta real de la empresa.
"A pesar de lo que dice su material de marketing, a Anthropic no le importan las normas de Reddit ni sus usuarios", afirma la demanda. "Cree que tiene derecho a coger cualquier contenido que quiera y utilizarlo como desee, con impunidad".
Tras el anuncio de la demanda, las acciones de Reddit subieron casi un 67%, lo que indica el apoyo de los inversores al desafío legal. El resultado podría establecer un punto de referencia legal para equilibrar el contenido abierto de Internet con los derechos de los usuarios y los propietarios de contenidos.
A medida que más empresas de inteligencia artificial dependen de grandes cantidades de datos en línea, las implicaciones jurídicas y éticas del web scraping son cada vez más urgentes. El caso de Reddit contribuye a un creciente número de demandas que influirán en la próxima fase de desarrollo de la IA.
Véase también: Ética en la automatización: Cómo abordar la parcialidad y el cumplimiento en la IA
¿Quiere saber más sobre IA y big data de la mano de los líderes del sector? Visite la AI & Big Data Expo, que tendrá lugar en Ámsterdam, California y Londres. Este completo evento se celebra junto con otros eventos destacados como Intelligent Automation Conference, BlockX, Digital Transformation Week y Cyber Security & Cloud Expo.
Explore aquí otros próximos eventos y seminarios web sobre tecnología empresarial organizados por TechForge.
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.











