Maison
Plusieurs médias américains bloquent le robot d'indexation « Wayback Machine » d'Internet Archive afin d'empêcher toute utilisation abusive à des fins d'entraînement de l'IA
Comme le rapporte Wired, plusieurs grands médias et plateformes — dont le New York Times, Reddit et la société mère d’USA Today — ont récemment bloqué l’accès à la Wayback Machine d’Internet Archive. Cette mesure vise à empêcher les entreprises spécialisées dans l’IA d’utiliser cet outil d’archivage pour extraire indirectement des contenus protégés par le droit d’auteur afin d’entraîner leurs modèles.

L’ironie d’un blocage tout en en tirant profit
Ironiquement, la récente enquête approfondie menée par USA Today sur les statistiques relatives à la politique d’immigration s’appuyait justement sur des données historiques conservées par la Wayback Machine. Pourtant, le porte-parole du groupe de presse a déclaré avoir entièrement bloqué tous les robots d’indexation, y compris ia_archiverbot, afin de faire face au risque croissant de violation des droits d’auteur par l’IA.
Comment les médias appliquent-ils ces restrictions ?
Au moins 23 sites d’information grand public ont désormais mis en place des restrictions :
Blocage total : le New York Times et Reddit ont directement bloqué le robot d’indexation dédié de la Wayback Machine.
Filtrage de l’interface : The Guardian n’a pas complètement bloqué les robots d’indexation, mais a exclu son contenu de l’API d’Internet Archive et filtré son interface de recherche, rendant ainsi extrêmement difficile l’accès des utilisateurs aux archives historiques.
En réponse à ces mesures de blocage, plus de 100 journalistes en activité, dont Rachel Maddow, ont cosigné une lettre de soutien adressée à l’Electronic Frontier Foundation (EFF). Ils décrivent la Wayback Machine comme un « outil indispensable » pour la vérification des faits, le suivi des changements dans le comportement des institutions puissantes et la préservation de l’histoire numérique.
Les éditeurs affirment que les entreprises d’IA qui entraînent leurs modèles à partir des vastes données d’Internet Archive enfreignent la loi sur le droit d’auteur et leur font directement concurrence. Cependant, Mark Graham, directeur d’Internet Archive, met en garde contre le fait que la fermeture continue de contenus web publics sape gravement la capacité de la société à comprendre les vérités historiques et à exercer un contrôle public. Si cette tendance se poursuit, une grande partie des premiers documents numériques risque d’être définitivement perdue.
Article connexe
La trio de DeepMind derrière l'IA de poker génère désormais des rendements pour les fonds spéculatifs quantitatifs
Trois anciens chercheurs de DeepMind, qui avaient précédemment développé une IA capable de vaincre des champions humains de poker, ont orienté cette technologie vers les marchés financiers, et la stratégie génère des rendements significatifs. Leur en
Sony et Warner intentent un procès à Anthropic pour allégations de violation massive des droits d’auteur en matière d’IA
Sony et Warner Music Group ont intenté une action en justice historique contre l’entreprise d’intelligence artificielle Anthropic, l’accusant d’utilisation massive non autorisée de musique protégée par le droit d’auteur pour l’entraînement de la séri
Lancement officiel de l’agent Qwen3.8-Flash, Qwen Office entre dans l’ère d’une gestion abondante et efficace
La plateforme Qwen Office a officiellement lancé le grand modèle Qwen3.8-Flash ainsi qu’un nouveau mode standard, permettant à tous les utilisateurs d’accéder immédiatement à cette fonctionnalité. Grâce à des capacités de modèle améliorées, les utili
Recommandations de sujets spéciaux liés
commentaires (0)
Comme le rapporte Wired, plusieurs grands médias et plateformes — dont le New York Times, Reddit et la société mère d’USA Today — ont récemment bloqué l’accès à la Wayback Machine d’Internet Archive. Cette mesure vise à empêcher les entreprises spécialisées dans l’IA d’utiliser cet outil d’archivage pour extraire indirectement des contenus protégés par le droit d’auteur afin d’entraîner leurs modèles.

L’ironie d’un blocage tout en en tirant profit
Ironiquement, la récente enquête approfondie menée par USA Today sur les statistiques relatives à la politique d’immigration s’appuyait justement sur des données historiques conservées par la Wayback Machine. Pourtant, le porte-parole du groupe de presse a déclaré avoir entièrement bloqué tous les robots d’indexation, y compris ia_archiverbot, afin de faire face au risque croissant de violation des droits d’auteur par l’IA.
Comment les médias appliquent-ils ces restrictions ?
Au moins 23 sites d’information grand public ont désormais mis en place des restrictions :
Blocage total : le New York Times et Reddit ont directement bloqué le robot d’indexation dédié de la Wayback Machine.
Filtrage de l’interface : The Guardian n’a pas complètement bloqué les robots d’indexation, mais a exclu son contenu de l’API d’Internet Archive et filtré son interface de recherche, rendant ainsi extrêmement difficile l’accès des utilisateurs aux archives historiques.
En réponse à ces mesures de blocage, plus de 100 journalistes en activité, dont Rachel Maddow, ont cosigné une lettre de soutien adressée à l’Electronic Frontier Foundation (EFF). Ils décrivent la Wayback Machine comme un « outil indispensable » pour la vérification des faits, le suivi des changements dans le comportement des institutions puissantes et la préservation de l’histoire numérique.
Les éditeurs affirment que les entreprises d’IA qui entraînent leurs modèles à partir des vastes données d’Internet Archive enfreignent la loi sur le droit d’auteur et leur font directement concurrence. Cependant, Mark Graham, directeur d’Internet Archive, met en garde contre le fait que la fermeture continue de contenus web publics sape gravement la capacité de la société à comprendre les vérités historiques et à exercer un contrôle public. Si cette tendance se poursuit, une grande partie des premiers documents numériques risque d’être définitivement perdue.
La trio de DeepMind derrière l'IA de poker génère désormais des rendements pour les fonds spéculatifs quantitatifs
Trois anciens chercheurs de DeepMind, qui avaient précédemment développé une IA capable de vaincre des champions humains de poker, ont orienté cette technologie vers les marchés financiers, et la stratégie génère des rendements significatifs. Leur en
Sony et Warner intentent un procès à Anthropic pour allégations de violation massive des droits d’auteur en matière d’IA
Sony et Warner Music Group ont intenté une action en justice historique contre l’entreprise d’intelligence artificielle Anthropic, l’accusant d’utilisation massive non autorisée de musique protégée par le droit d’auteur pour l’entraînement de la séri
Lancement officiel de l’agent Qwen3.8-Flash, Qwen Office entre dans l’ère d’une gestion abondante et efficace
La plateforme Qwen Office a officiellement lancé le grand modèle Qwen3.8-Flash ainsi qu’un nouveau mode standard, permettant à tous les utilisateurs d’accéder immédiatement à cette fonctionnalité. Grâce à des capacités de modèle améliorées, les utili











