Un modèle d'IA japonais de grande envergure accusé d'avoir copié DeepSeek

Un lancement très médiatisé dans le secteur technologique japonais a déclenché un débat public sur la transparence technologique. Le groupe Rakuten a récemment dévoilé ce qu’il décrit comme le « plus grand et le plus puissant » modèle linguistique de grande envergure développé en interne. Ce modèle de 70 milliards de paramètres est l’un des principaux résultats d’un projet soutenu par le ministère japonais de l’Économie, du Commerce et de l’Industrie (METI) dans le cadre de son initiative GENIAC. Peu après sa sortie, cependant, la communauté open source a commencé à se demander s'il ne s'agissait pas simplement d'une version remaniée d'un modèle existant.
Les développeurs ont découvert que l'architecture centrale et le fichier de configuration du modèle renvoyaient sans équivoque à un modèle créé par une équipe chinoise. Les preuves indiquent que le modèle de Rakuten a non seulement conservé l'identifiant d'origine « DeepseekV3ForCausalLM », mais qu'il s'agissait en réalité d'une adaptation affinée à partir de données japonaises, et non d'un développement entièrement nouveau.
La controverse porte sur ce que beaucoup considèrent comme une « zone grise » dans la communication et la gestion des licences de Rakuten :
Divulgation insuffisante : le communiqué de presse officiel mentionnait uniquement « l'intégration de l'essence de la communauté open source », sans reconnaître l'origine du modèle de base.
Problèmes de gestion des licences : la communauté a souligné que la version initiale de Rakuten aurait omis les fichiers de licence MIT requis. Bien qu'un fichier NOTICE ait été ajouté par la suite pour se conformer aux conditions légales, cette correction rétroactive a été critiquée pour son manque de transparence et d'intention sincère.
À ce jour, le groupe Rakuten n'a pas directement abordé la question de la suppression des fichiers de licence ni celle des similitudes architecturales frappantes.
Article connexe
Comment corriger les Core Web Vitals pour de meilleurs classements SEO
Comment créer un site web gratuit : Domaine gratuit, hébergement et générateur de sites web par IATable des matièresIntroductionGénérateur de sites web par IA 1 : Hookous AIÉtape 1 : InscriptionÉtape 2 : Choisir le type d'entreprise / nicheÉtape
Apple et Google s'associent à Anthropic pour remédier à une faille de sécurité vieille de 27 ans grâce à la protection « Glass Wing »
Alors que l’intelligence artificielle progresse à grands pas dans les domaines de la génération de code et du raisonnement logique, le secteur de la cybersécurité est confronté à des défis sans précéd
Le chef scientifique d'OpenAI aborde le débat sur la transparence du raisonnement de l'IA : la complexité reste stable, pas de saut soudain
Le 2 septembre, Jakub Pachocki, scientifique en chef d’OpenAI, s’est adressé aux préoccupations du public sur X concernant le modèle d’IA Astra, précisant les affirmations selon lesquelles il fonctionnerait sans surveillance et manquerait de raisonne
Recommandations de sujets spéciaux liés
commentaires (0)

Un lancement très médiatisé dans le secteur technologique japonais a déclenché un débat public sur la transparence technologique. Le groupe Rakuten a récemment dévoilé ce qu’il décrit comme le « plus grand et le plus puissant » modèle linguistique de grande envergure développé en interne. Ce modèle de 70 milliards de paramètres est l’un des principaux résultats d’un projet soutenu par le ministère japonais de l’Économie, du Commerce et de l’Industrie (METI) dans le cadre de son initiative GENIAC. Peu après sa sortie, cependant, la communauté open source a commencé à se demander s'il ne s'agissait pas simplement d'une version remaniée d'un modèle existant.
Les développeurs ont découvert que l'architecture centrale et le fichier de configuration du modèle renvoyaient sans équivoque à un modèle créé par une équipe chinoise. Les preuves indiquent que le modèle de Rakuten a non seulement conservé l'identifiant d'origine « DeepseekV3ForCausalLM », mais qu'il s'agissait en réalité d'une adaptation affinée à partir de données japonaises, et non d'un développement entièrement nouveau.
La controverse porte sur ce que beaucoup considèrent comme une « zone grise » dans la communication et la gestion des licences de Rakuten :
Divulgation insuffisante : le communiqué de presse officiel mentionnait uniquement « l'intégration de l'essence de la communauté open source », sans reconnaître l'origine du modèle de base.
Problèmes de gestion des licences : la communauté a souligné que la version initiale de Rakuten aurait omis les fichiers de licence MIT requis. Bien qu'un fichier NOTICE ait été ajouté par la suite pour se conformer aux conditions légales, cette correction rétroactive a été critiquée pour son manque de transparence et d'intention sincère.
À ce jour, le groupe Rakuten n'a pas directement abordé la question de la suppression des fichiers de licence ni celle des similitudes architecturales frappantes.
Comment corriger les Core Web Vitals pour de meilleurs classements SEO
Comment créer un site web gratuit : Domaine gratuit, hébergement et générateur de sites web par IATable des matièresIntroductionGénérateur de sites web par IA 1 : Hookous AIÉtape 1 : InscriptionÉtape 2 : Choisir le type d'entreprise / nicheÉtape
Apple et Google s'associent à Anthropic pour remédier à une faille de sécurité vieille de 27 ans grâce à la protection « Glass Wing »
Alors que l’intelligence artificielle progresse à grands pas dans les domaines de la génération de code et du raisonnement logique, le secteur de la cybersécurité est confronté à des défis sans précéd
Le chef scientifique d'OpenAI aborde le débat sur la transparence du raisonnement de l'IA : la complexité reste stable, pas de saut soudain
Le 2 septembre, Jakub Pachocki, scientifique en chef d’OpenAI, s’est adressé aux préoccupations du public sur X concernant le modèle d’IA Astra, précisant les affirmations selon lesquelles il fonctionnerait sans surveillance et manquerait de raisonne





Maison






