Maison
Apple fait l'objet de plaintes pour violation du droit d'auteur concernant des données d'entraînement pour l'IA, dans un contexte de litiges liés à l'open source
Le 18 mars, Apple a de nouveau été citée comme défenderesse dans un procès pour violation du droit d'auteur intenté par Chicken Soup for the Soul, LLC. La plainte allègue qu'Apple a utilisé l'ensemble de données « The Pile » — qui contient des livres piratés — pour l'entraînement de ses modèles d'intelligence artificielle. Ce vaste litige vise également d'autres géants mondiaux de la technologie, notamment Meta, xAI, Google, Anthropic, OpenAI, Perplexity et NVIDIA. Au cœur de l'affaire se trouve le module de bibliothèque fantôme « Books3 » au sein de l'ensemble de données, qui abrite une vaste collection d'œuvres littéraires protégées par le droit d'auteur.

En réponse à ces allégations, Apple a réaffirmé son engagement à développer des ensembles de données d'IA de manière légale et éthique depuis 2024. Bien que les chercheurs d'Apple aient effectivement utilisé l'ensemble de données « The Pile » dans le cadre du projet open source OpenELMs, la société a précisé que cela était uniquement destiné à la recherche publique et n'avait pas été utilisé dans son système central Apple Intelligence. Les analystes juridiques soulignent toutefois une complication potentielle : étant donné que le modèle de base d'Apple a bénéficié de l'aide de Google Gemini, Apple pourrait être confrontée à une responsabilité solidaire complexe si Google était reconnu coupable d'avoir enfreint la réglementation, en raison de leur relation technique au sein de la chaîne d'approvisionnement.
Actuellement, des entreprises telles que Perplexity ont défendu leurs pratiques de web scraping, tandis qu'Apple continue de mettre l'accent sur la transparence et la conformité de l'entraînement de son propre modèle. Alors que la réglementation en matière d'IA se durcit, ce recours collectif, qui vise les données d'entraînement de base, représente une escalade significative de la riposte des créateurs contre ce qu'ils considèrent comme une « exploitation des données » par les géants de la tech. Il devrait également contraindre le secteur à réévaluer les coûts de conformité et les limites techniques de la mise en œuvre de la « traçabilité des données » dans le développement des modèles.
Article connexe
Le lancement par Seed de ByteDance d’une campagne mondiale de recrutement sur les campus, offrant des actions virtuelles pour attirer les meilleurs talents en grands modèles
Dans le paysage concurrentiel des grands modèles de langage, la sécurisation des talents de premier plan reste l’actif stratégique le plus critique.Le 1er avril, ByteDance a annoncé le lancement de son initiative de recrutement sur les campus mondiau
Suno appose des filigranes aux chansons dans le cadre de batailles juridiques
Suno, la plateforme permettant aux utilisateurs de générer de la musique créée par l’intelligence artificielle, a dévoilé de nouvelles fonctionnalités pour étiqueter les titres produits sur la plateforme, restreindre les téléchargements et mettre à j
Musk admet que la construction de Grok a divulgué le code utilisateur, promet d’effacer toutes les données historiques
Elon Musk a abordé directement la controverse sur la vie privée concernant Grok Build, en commençant par un simple « Vrai » pour confirmer la validité de l’incident. Il s’est engagé à ce que toutes les données utilisateur précédemment téléchargées su
Recommandations de sujets spéciaux liés
commentaires (0)
Le 18 mars, Apple a de nouveau été citée comme défenderesse dans un procès pour violation du droit d'auteur intenté par Chicken Soup for the Soul, LLC. La plainte allègue qu'Apple a utilisé l'ensemble de données « The Pile » — qui contient des livres piratés — pour l'entraînement de ses modèles d'intelligence artificielle. Ce vaste litige vise également d'autres géants mondiaux de la technologie, notamment Meta, xAI, Google, Anthropic, OpenAI, Perplexity et NVIDIA. Au cœur de l'affaire se trouve le module de bibliothèque fantôme « Books3 » au sein de l'ensemble de données, qui abrite une vaste collection d'œuvres littéraires protégées par le droit d'auteur.

En réponse à ces allégations, Apple a réaffirmé son engagement à développer des ensembles de données d'IA de manière légale et éthique depuis 2024. Bien que les chercheurs d'Apple aient effectivement utilisé l'ensemble de données « The Pile » dans le cadre du projet open source OpenELMs, la société a précisé que cela était uniquement destiné à la recherche publique et n'avait pas été utilisé dans son système central Apple Intelligence. Les analystes juridiques soulignent toutefois une complication potentielle : étant donné que le modèle de base d'Apple a bénéficié de l'aide de Google Gemini, Apple pourrait être confrontée à une responsabilité solidaire complexe si Google était reconnu coupable d'avoir enfreint la réglementation, en raison de leur relation technique au sein de la chaîne d'approvisionnement.
Actuellement, des entreprises telles que Perplexity ont défendu leurs pratiques de web scraping, tandis qu'Apple continue de mettre l'accent sur la transparence et la conformité de l'entraînement de son propre modèle. Alors que la réglementation en matière d'IA se durcit, ce recours collectif, qui vise les données d'entraînement de base, représente une escalade significative de la riposte des créateurs contre ce qu'ils considèrent comme une « exploitation des données » par les géants de la tech. Il devrait également contraindre le secteur à réévaluer les coûts de conformité et les limites techniques de la mise en œuvre de la « traçabilité des données » dans le développement des modèles.
Le lancement par Seed de ByteDance d’une campagne mondiale de recrutement sur les campus, offrant des actions virtuelles pour attirer les meilleurs talents en grands modèles
Dans le paysage concurrentiel des grands modèles de langage, la sécurisation des talents de premier plan reste l’actif stratégique le plus critique.Le 1er avril, ByteDance a annoncé le lancement de son initiative de recrutement sur les campus mondiau
Suno appose des filigranes aux chansons dans le cadre de batailles juridiques
Suno, la plateforme permettant aux utilisateurs de générer de la musique créée par l’intelligence artificielle, a dévoilé de nouvelles fonctionnalités pour étiqueter les titres produits sur la plateforme, restreindre les téléchargements et mettre à j
Musk admet que la construction de Grok a divulgué le code utilisateur, promet d’effacer toutes les données historiques
Elon Musk a abordé directement la controverse sur la vie privée concernant Grok Build, en commençant par un simple « Vrai » pour confirmer la validité de l’incident. Il s’est engagé à ce que toutes les données utilisateur précédemment téléchargées su











