Maison
Reddit intente une action en justice contre Anthropic au sujet de l'utilisation de données d'utilisateurs pour l'entraînement à l'IA
Reddit intente une action en justice contre Anthropic, alléguant que la société d'intelligence artificielle a recueilli sans autorisation le contenu des utilisateurs de sa plateforme pour entraîner ses modèles d'intelligence artificielle Claude. La plainte, déposée auprès d'un tribunal de l'État de Californie, indique qu'Anthropic a effectué plus de 100 000 requêtes non autorisées sur les serveurs de Reddit, même après avoir prétendu publiquement avoir arrêté.
La plainte affirme qu'Anthropic n'a pas tenu compte des garanties techniques et de ses conditions d'utilisation. Selon Reddit, Anthropic a contourné des protections telles que le fichier robots.txt, conçu pour bloquer le scraping automatisé. La plateforme affirme également qu'Anthropic a violé la vie privée des utilisateurs en collectant et en utilisant les messages personnels, y compris les messages supprimés, à des fins commerciales.
Reddit indique qu'il fournit un accès aux données structurées par le biais de partenariats de licence officiels avec des sociétés telles que OpenAI et Google. Ces accords comprennent des clauses régissant l'utilisation du contenu, la protection de la vie privée et la suppression des données. Reddit affirme qu'Anthropic a refusé de conclure un accord de licence officiel, choisissant plutôt de récupérer le contenu directement pour éviter les frais et contourner les protections des utilisateurs.
La plainte cite un document de recherche de 2021 coécrit par le PDG d'Anthropic, Dario Amodei, qui identifie Reddit comme une source précieuse de données d'entraînement pour les modèles de langage. Reddit a également présenté des cas où Claude semblait reproduire les messages de Reddit presque mot pour mot, y compris le contenu que les utilisateurs avaient supprimé. Selon Reddit, cela démontre l'incapacité d'Anthropic à mettre en œuvre des mesures de protection qui respectent la vie privée des utilisateurs ou les demandes de suppression de contenu.
Reddit demande des dommages et intérêts et une décision de justice interdisant à Anthropic d'utiliser le contenu de Reddit dans les futures versions de ses modèles.
Anthropic a réagi en déclarant qu'elle contestait les allégations et qu'elle avait l'intention de se défendre. Ce n'est toutefois pas la première fois que l'entreprise est confrontée à une procédure judiciaire concernant ses pratiques en matière de collecte de données de formation.
En août 2024, un groupe d'auteurs a intenté une action collective contre Anthropic, affirmant qu'elle avait utilisé leurs œuvres protégées par le droit d'auteur sans leur consentement. Selon eux, l'entreprise a entraîné ses modèles sur des livres et d'autres écrits sans autorisation, puis a demandé une compensation pour l'utilisation du contenu.
Un procès similaire, datant d'octobre 2023, a impliqué Universal Music Group et d'autres éditeurs, qui ont poursuivi Anthropic pour avoir prétendument reproduit des paroles de chansons protégées par le droit d'auteur par l'intermédiaire de son chatbot Claude. Les sociétés musicales ont fait valoir qu'il s'agissait d'une violation de leurs droits de propriété intellectuelle et ont demandé une injonction contre l'utilisation ultérieure des paroles de chansons.
Contrairement à ces affaires, le procès intenté par Reddit ne porte pas sur les droits d'auteur. Elle porte plutôt sur la rupture de contrat et la concurrence déloyale. Reddit soutient que les données de son site ne sont pas simplement publiques - elles sont soumises à des conditions qu'Anthropic a sciemment ignorées. Cette distinction pourrait constituer un précédent important pour les plateformes qui hébergent des contenus générés par les utilisateurs, mais qui cherchent à réglementer leur utilisation dans des systèmes d'IA commerciaux.
Reddit accuse également Anthropic de tromper le public. L'action en justice souligne les déclarations publiques d'Anthropic selon lesquelles elle suit les règles de scraping et respecte la vie privée des utilisateurs - des déclarations qui, selon Reddit, sont contredites par le comportement réel de l'entreprise.
"En dépit de ce que dit son matériel de marketing, Anthropic ne se soucie pas des règles de Reddit ni de ses utilisateurs", indique la plainte. "Elle estime qu'elle a le droit de prendre le contenu qu'elle veut et de l'utiliser comme elle le souhaite, en toute impunité.
Après l'annonce de la plainte, les actions de Reddit ont augmenté de près de 67 %, ce qui indique que les investisseurs soutiennent la contestation judiciaire. Le résultat pourrait établir une référence juridique pour équilibrer le contenu ouvert de l'internet avec les droits des utilisateurs et des propriétaires de contenu.
Étant donné que de plus en plus d'entreprises du secteur de l'intelligence artificielle dépendent de vastes quantités de données en ligne, les implications juridiques et éthiques du "web scraping" deviennent de plus en plus urgentes. L'affaire Reddit vient s'ajouter à un nombre croissant de procès qui influenceront la prochaine phase de développement de l'IA.
Voir aussi : L'éthique dans l'automatisation : Aborder la question des préjugés et de la conformité dans l'IA
Vous voulez en savoir plus sur l'IA et le big data auprès des leaders de l'industrie ? Rendez-vous à AI & Big Data Expo qui se tiendra à Amsterdam, en Californie et à Londres. Cet événement complet est situé au même endroit que d'autres événements de premier plan, notamment Intelligent Automation Conference, BlockX, Digital Transformation Week et Cyber Security & Cloud Expo.
Découvrez d'autres événements et webinaires sur les technologies d'entreprise organisés par TechForge ici.
Article connexe
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Recommandations de sujets spéciaux liés
commentaires (2)
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.
Reddit intente une action en justice contre Anthropic, alléguant que la société d'intelligence artificielle a recueilli sans autorisation le contenu des utilisateurs de sa plateforme pour entraîner ses modèles d'intelligence artificielle Claude. La plainte, déposée auprès d'un tribunal de l'État de Californie, indique qu'Anthropic a effectué plus de 100 000 requêtes non autorisées sur les serveurs de Reddit, même après avoir prétendu publiquement avoir arrêté.
La plainte affirme qu'Anthropic n'a pas tenu compte des garanties techniques et de ses conditions d'utilisation. Selon Reddit, Anthropic a contourné des protections telles que le fichier robots.txt, conçu pour bloquer le scraping automatisé. La plateforme affirme également qu'Anthropic a violé la vie privée des utilisateurs en collectant et en utilisant les messages personnels, y compris les messages supprimés, à des fins commerciales.
Reddit indique qu'il fournit un accès aux données structurées par le biais de partenariats de licence officiels avec des sociétés telles que OpenAI et Google. Ces accords comprennent des clauses régissant l'utilisation du contenu, la protection de la vie privée et la suppression des données. Reddit affirme qu'Anthropic a refusé de conclure un accord de licence officiel, choisissant plutôt de récupérer le contenu directement pour éviter les frais et contourner les protections des utilisateurs.
La plainte cite un document de recherche de 2021 coécrit par le PDG d'Anthropic, Dario Amodei, qui identifie Reddit comme une source précieuse de données d'entraînement pour les modèles de langage. Reddit a également présenté des cas où Claude semblait reproduire les messages de Reddit presque mot pour mot, y compris le contenu que les utilisateurs avaient supprimé. Selon Reddit, cela démontre l'incapacité d'Anthropic à mettre en œuvre des mesures de protection qui respectent la vie privée des utilisateurs ou les demandes de suppression de contenu.
Reddit demande des dommages et intérêts et une décision de justice interdisant à Anthropic d'utiliser le contenu de Reddit dans les futures versions de ses modèles.
Anthropic a réagi en déclarant qu'elle contestait les allégations et qu'elle avait l'intention de se défendre. Ce n'est toutefois pas la première fois que l'entreprise est confrontée à une procédure judiciaire concernant ses pratiques en matière de collecte de données de formation.
En août 2024, un groupe d'auteurs a intenté une action collective contre Anthropic, affirmant qu'elle avait utilisé leurs œuvres protégées par le droit d'auteur sans leur consentement. Selon eux, l'entreprise a entraîné ses modèles sur des livres et d'autres écrits sans autorisation, puis a demandé une compensation pour l'utilisation du contenu.
Un procès similaire, datant d'octobre 2023, a impliqué Universal Music Group et d'autres éditeurs, qui ont poursuivi Anthropic pour avoir prétendument reproduit des paroles de chansons protégées par le droit d'auteur par l'intermédiaire de son chatbot Claude. Les sociétés musicales ont fait valoir qu'il s'agissait d'une violation de leurs droits de propriété intellectuelle et ont demandé une injonction contre l'utilisation ultérieure des paroles de chansons.
Contrairement à ces affaires, le procès intenté par Reddit ne porte pas sur les droits d'auteur. Elle porte plutôt sur la rupture de contrat et la concurrence déloyale. Reddit soutient que les données de son site ne sont pas simplement publiques - elles sont soumises à des conditions qu'Anthropic a sciemment ignorées. Cette distinction pourrait constituer un précédent important pour les plateformes qui hébergent des contenus générés par les utilisateurs, mais qui cherchent à réglementer leur utilisation dans des systèmes d'IA commerciaux.
Reddit accuse également Anthropic de tromper le public. L'action en justice souligne les déclarations publiques d'Anthropic selon lesquelles elle suit les règles de scraping et respecte la vie privée des utilisateurs - des déclarations qui, selon Reddit, sont contredites par le comportement réel de l'entreprise.
"En dépit de ce que dit son matériel de marketing, Anthropic ne se soucie pas des règles de Reddit ni de ses utilisateurs", indique la plainte. "Elle estime qu'elle a le droit de prendre le contenu qu'elle veut et de l'utiliser comme elle le souhaite, en toute impunité.
Après l'annonce de la plainte, les actions de Reddit ont augmenté de près de 67 %, ce qui indique que les investisseurs soutiennent la contestation judiciaire. Le résultat pourrait établir une référence juridique pour équilibrer le contenu ouvert de l'internet avec les droits des utilisateurs et des propriétaires de contenu.
Étant donné que de plus en plus d'entreprises du secteur de l'intelligence artificielle dépendent de vastes quantités de données en ligne, les implications juridiques et éthiques du "web scraping" deviennent de plus en plus urgentes. L'affaire Reddit vient s'ajouter à un nombre croissant de procès qui influenceront la prochaine phase de développement de l'IA.
Voir aussi : L'éthique dans l'automatisation : Aborder la question des préjugés et de la conformité dans l'IA
Vous voulez en savoir plus sur l'IA et le big data auprès des leaders de l'industrie ? Rendez-vous à AI & Big Data Expo qui se tiendra à Amsterdam, en Californie et à Londres. Cet événement complet est situé au même endroit que d'autres événements de premier plan, notamment Intelligent Automation Conference, BlockX, Digital Transformation Week et Cyber Security & Cloud Expo.
Découvrez d'autres événements et webinaires sur les technologies d'entreprise organisés par TechForge ici.
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.











