Un modèle d'IA japonais de grande envergure accusé d'avoir copié DeepSeek

Un lancement très médiatisé dans le secteur technologique japonais a déclenché un débat public sur la transparence technologique. Le groupe Rakuten a récemment dévoilé ce qu’il décrit comme le « plus grand et le plus puissant » modèle linguistique de grande envergure développé en interne. Ce modèle de 70 milliards de paramètres est l’un des principaux résultats d’un projet soutenu par le ministère japonais de l’Économie, du Commerce et de l’Industrie (METI) dans le cadre de son initiative GENIAC. Peu après sa sortie, cependant, la communauté open source a commencé à se demander s'il ne s'agissait pas simplement d'une version remaniée d'un modèle existant.
Les développeurs ont découvert que l'architecture centrale et le fichier de configuration du modèle renvoyaient sans équivoque à un modèle créé par une équipe chinoise. Les preuves indiquent que le modèle de Rakuten a non seulement conservé l'identifiant d'origine « DeepseekV3ForCausalLM », mais qu'il s'agissait en réalité d'une adaptation affinée à partir de données japonaises, et non d'un développement entièrement nouveau.
La controverse porte sur ce que beaucoup considèrent comme une « zone grise » dans la communication et la gestion des licences de Rakuten :
Divulgation insuffisante : le communiqué de presse officiel mentionnait uniquement « l'intégration de l'essence de la communauté open source », sans reconnaître l'origine du modèle de base.
Problèmes de gestion des licences : la communauté a souligné que la version initiale de Rakuten aurait omis les fichiers de licence MIT requis. Bien qu'un fichier NOTICE ait été ajouté par la suite pour se conformer aux conditions légales, cette correction rétroactive a été critiquée pour son manque de transparence et d'intention sincère.
À ce jour, le groupe Rakuten n'a pas directement abordé la question de la suppression des fichiers de licence ni celle des similitudes architecturales frappantes.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)

Un lancement très médiatisé dans le secteur technologique japonais a déclenché un débat public sur la transparence technologique. Le groupe Rakuten a récemment dévoilé ce qu’il décrit comme le « plus grand et le plus puissant » modèle linguistique de grande envergure développé en interne. Ce modèle de 70 milliards de paramètres est l’un des principaux résultats d’un projet soutenu par le ministère japonais de l’Économie, du Commerce et de l’Industrie (METI) dans le cadre de son initiative GENIAC. Peu après sa sortie, cependant, la communauté open source a commencé à se demander s'il ne s'agissait pas simplement d'une version remaniée d'un modèle existant.
Les développeurs ont découvert que l'architecture centrale et le fichier de configuration du modèle renvoyaient sans équivoque à un modèle créé par une équipe chinoise. Les preuves indiquent que le modèle de Rakuten a non seulement conservé l'identifiant d'origine « DeepseekV3ForCausalLM », mais qu'il s'agissait en réalité d'une adaptation affinée à partir de données japonaises, et non d'un développement entièrement nouveau.
La controverse porte sur ce que beaucoup considèrent comme une « zone grise » dans la communication et la gestion des licences de Rakuten :
Divulgation insuffisante : le communiqué de presse officiel mentionnait uniquement « l'intégration de l'essence de la communauté open source », sans reconnaître l'origine du modèle de base.
Problèmes de gestion des licences : la communauté a souligné que la version initiale de Rakuten aurait omis les fichiers de licence MIT requis. Bien qu'un fichier NOTICE ait été ajouté par la suite pour se conformer aux conditions légales, cette correction rétroactive a été critiquée pour son manque de transparence et d'intention sincère.
À ce jour, le groupe Rakuten n'a pas directement abordé la question de la suppression des fichiers de licence ni celle des similitudes architecturales frappantes.
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés





Maison






