Reddit poursuit Anthropic pour ses pratiques d'extraction de données d'IA
Reddit allègue qu'Anthropic a développé ses modèles d'IA Claude en utilisant les données de la base d'utilisateurs de Reddit, et ce sans autorisation ni compensation.
Toute personne qui accède à Reddit, y compris les robots d'indexation, doit accepter les conditions d'utilisation de la plateforme. Ces conditions stipulent explicitement que le contenu ne peut être extrait et utilisé à des fins commerciales sans un accord formel. Reddit affirme que les robots d'Anthropic se livrent précisément à cette activité depuis des années, récoltant de vastes quantités de discussions et de messages pour former et améliorer Claude.
La contestation directe de l'image publique d'Anthropic ajoute à l'intrigue de cette action en justice. Anthropic s'est forgé une réputation de développeur d'IA éthique et digne de confiance, se positionnant comme le "chevalier blanc" de l'industrie. Le dossier juridique rejette toutefois ces affirmations comme n'étant guère plus que des "gadgets marketing vides de sens".
Par exemple, Reddit cite une déclaration datant de juillet 2024 dans laquelle Anthropic affirme qu'elle a cessé d'explorer Reddit avec ses robots. L'action en justice qualifie cette affirmation de "fausse", en présentant des journaux qui montreraient que les robots d'Anthropic ont tenté d'accéder au site plus de cent mille fois au cours des mois suivants.
Au-delà des litiges entre entreprises, cette question touche directement à la vie privée des utilisateurs. Lorsqu'un utilisateur de Reddit supprime un message ou un commentaire, il s'attend à ce qu'il soit entièrement supprimé. Reddit a conclu des accords de licence officiels avec d'autres grandes entreprises d'intelligence artificielle, telles que Google et OpenAI, qui prévoient des garanties techniques pour que le contenu supprimé par l'utilisateur soit également effacé des systèmes des entreprises d'intelligence artificielle.
Selon l'action en justice, Anthropic n'a pas conclu d'accord de ce type et a refusé d'en conclure un. Cela signifie que si Claude a été formé à partir d'un message que vous avez supprimé par la suite, cette information peut rester intégrée dans sa base de connaissances, contournant ainsi votre décision de le supprimer. Le procès comprend même une capture d'écran dans laquelle Claude admet qu'il n'a pas la capacité de déterminer si les données Reddit sur lesquelles il a été formé ont été supprimées par un utilisateur :

Que demande donc Reddit ? S'il demande des dommages et intérêts pour couvrir l'augmentation des coûts de serveur et la perte de revenus de licence, sa demande va au-delà de la compensation financière. Il demande au tribunal d'ordonner à Anthropic de cesser immédiatement d'utiliser les données dérivées de Reddit.
En outre, Reddit souhaite empêcher Anthropic de vendre ou d'octroyer des licences pour tout produit développé à partir de ces données. Il faudrait donc qu'un juge retire Claude du marché.
Cette confrontation juridique soulève une question essentielle : Un contenu "publiquement disponible" sur l'internet donne-t-il aux entreprises le droit de l'exploiter librement et de le monétiser ? La position de Reddit est un "non" définitif, et l'issue de cette affaire pourrait redéfinir les règles régissant le développement de l'IA à l'avenir.
Voir aussi : S'attaquer aux hallucinations : Une jeune pousse du MIT apprend à l'IA à admettre qu'elle n'a pas compris.
Vous souhaitez en savoir plus sur l'IA et le big data auprès des leaders du secteur ? Rendez-vous à AI & Big Data Expo, qui se tiendra à Amsterdam, en Californie et à Londres. Cet événement complet est organisé en même temps que d'autres événements de premier plan, notamment Intelligent Automation Conference, BlockX, Digital Transformation Week et Cyber Security & Cloud Expo.
Découvrez d'autres événements et webinaires sur les technologies d'entreprise organisés par TechForge ici.
Article connexe
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Recommandations de sujets spéciaux liés
commentaires (0)
Reddit allègue qu'Anthropic a développé ses modèles d'IA Claude en utilisant les données de la base d'utilisateurs de Reddit, et ce sans autorisation ni compensation.
Toute personne qui accède à Reddit, y compris les robots d'indexation, doit accepter les conditions d'utilisation de la plateforme. Ces conditions stipulent explicitement que le contenu ne peut être extrait et utilisé à des fins commerciales sans un accord formel. Reddit affirme que les robots d'Anthropic se livrent précisément à cette activité depuis des années, récoltant de vastes quantités de discussions et de messages pour former et améliorer Claude.
La contestation directe de l'image publique d'Anthropic ajoute à l'intrigue de cette action en justice. Anthropic s'est forgé une réputation de développeur d'IA éthique et digne de confiance, se positionnant comme le "chevalier blanc" de l'industrie. Le dossier juridique rejette toutefois ces affirmations comme n'étant guère plus que des "gadgets marketing vides de sens".
Par exemple, Reddit cite une déclaration datant de juillet 2024 dans laquelle Anthropic affirme qu'elle a cessé d'explorer Reddit avec ses robots. L'action en justice qualifie cette affirmation de "fausse", en présentant des journaux qui montreraient que les robots d'Anthropic ont tenté d'accéder au site plus de cent mille fois au cours des mois suivants.
Au-delà des litiges entre entreprises, cette question touche directement à la vie privée des utilisateurs. Lorsqu'un utilisateur de Reddit supprime un message ou un commentaire, il s'attend à ce qu'il soit entièrement supprimé. Reddit a conclu des accords de licence officiels avec d'autres grandes entreprises d'intelligence artificielle, telles que Google et OpenAI, qui prévoient des garanties techniques pour que le contenu supprimé par l'utilisateur soit également effacé des systèmes des entreprises d'intelligence artificielle.
Selon l'action en justice, Anthropic n'a pas conclu d'accord de ce type et a refusé d'en conclure un. Cela signifie que si Claude a été formé à partir d'un message que vous avez supprimé par la suite, cette information peut rester intégrée dans sa base de connaissances, contournant ainsi votre décision de le supprimer. Le procès comprend même une capture d'écran dans laquelle Claude admet qu'il n'a pas la capacité de déterminer si les données Reddit sur lesquelles il a été formé ont été supprimées par un utilisateur :

Que demande donc Reddit ? S'il demande des dommages et intérêts pour couvrir l'augmentation des coûts de serveur et la perte de revenus de licence, sa demande va au-delà de la compensation financière. Il demande au tribunal d'ordonner à Anthropic de cesser immédiatement d'utiliser les données dérivées de Reddit.
En outre, Reddit souhaite empêcher Anthropic de vendre ou d'octroyer des licences pour tout produit développé à partir de ces données. Il faudrait donc qu'un juge retire Claude du marché.
Cette confrontation juridique soulève une question essentielle : Un contenu "publiquement disponible" sur l'internet donne-t-il aux entreprises le droit de l'exploiter librement et de le monétiser ? La position de Reddit est un "non" définitif, et l'issue de cette affaire pourrait redéfinir les règles régissant le développement de l'IA à l'avenir.
Voir aussi : S'attaquer aux hallucinations : Une jeune pousse du MIT apprend à l'IA à admettre qu'elle n'a pas compris.
Vous souhaitez en savoir plus sur l'IA et le big data auprès des leaders du secteur ? Rendez-vous à AI & Big Data Expo, qui se tiendra à Amsterdam, en Californie et à Londres. Cet événement complet est organisé en même temps que d'autres événements de premier plan, notamment Intelligent Automation Conference, BlockX, Digital Transformation Week et Cyber Security & Cloud Expo.
Découvrez d'autres événements et webinaires sur les technologies d'entreprise organisés par TechForge ici.
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements





Maison






