Modelo gigante de IA japonês é acusado de copiar o DeepSeek

Um lançamento de grande repercussão no setor de tecnologia do Japão desencadeou um debate público sobre a transparência tecnológica. O Grupo Rakuten revelou recentemente o que descreve como o “maior e mais poderoso” modelo de linguagem de grande escala desenvolvido internamente. Esse modelo de 70 bilhões de parâmetros é um dos principais resultados de um projeto apoiado pelo Ministério da Economia, Comércio e Indústria do Japão (METI) no âmbito de sua iniciativa GENIAC. Logo após seu lançamento, no entanto, a comunidade de código aberto começou a questionar se se tratava apenas de uma versão reempacotada de um modelo já existente.
Os desenvolvedores descobriram que a arquitetura central e o arquivo de configuração do modelo apontavam inequivocamente para um modelo criado por uma equipe chinesa. As evidências indicam que o modelo da Rakuten não apenas manteve o identificador original “DeepseekV3ForCausalLM”, mas era, na verdade, uma adaptação otimizada usando dados japoneses, e não um desenvolvimento totalmente novo.
A controvérsia gira em torno do que muitos consideram uma “área cinzenta” nas comunicações e no gerenciamento de licenças da Rakuten:
Divulgação inadequada: O comunicado de imprensa oficial mencionou apenas “integrar a essência da comunidade de código aberto”, deixando de reconhecer a origem do modelo fundamental.
Problemas de gerenciamento de licenças: a comunidade destacou que o lançamento inicial da Rakuten pode ter omitido os arquivos de licença MIT exigidos. Embora um arquivo NOTICE tenha sido adicionado posteriormente para cumprir os termos legais, essa correção retroativa foi criticada por carecer de transparência e intenção genuína.
Até o momento, o Grupo Rakuten não abordou diretamente a remoção dos arquivos de licença nem as impressionantes semelhanças arquitetônicas.
Artigo relacionado
A Superinteligência Chega: Vamos Deixá-la Entrar?
Carregando o player…As empresas de inteligência artificial vêm falando sobre uma IA superinteligente como se fosse inevitável, mas recentes incidentes de segurança, como a violação do Hugging Face pela OpenAI, estão demonstrando os potenciais perigo
iFLYTEK Apresenta o Modelo Grande Geral Spark X2.5
Em 1º de setembro, a iFlytek lançará como código aberto dois modelos de linguagem de grande escala focados em dispositivos de borda, o Xinghuo X2.5-4B e o Xinghuo X2.5-1.7B, conforme o mais recente anúncio oficial. Ambos os modelos suportam nativamen
Meta Remove Funcionalidade de Edição de Fotos por IA Após Reação Negativa dos Usuários
A Meta, gigante das redes sociais, está novamente envolvida em um debate público sobre o delicado equilíbrio entre inteligência artificial e privacidade dos usuários. De acordo com a TechCrunch, o Superintelligence Labs da Meta apresentou um novo ger
Recomendações de tópicos especiais relacionados
Comentários (0)

Um lançamento de grande repercussão no setor de tecnologia do Japão desencadeou um debate público sobre a transparência tecnológica. O Grupo Rakuten revelou recentemente o que descreve como o “maior e mais poderoso” modelo de linguagem de grande escala desenvolvido internamente. Esse modelo de 70 bilhões de parâmetros é um dos principais resultados de um projeto apoiado pelo Ministério da Economia, Comércio e Indústria do Japão (METI) no âmbito de sua iniciativa GENIAC. Logo após seu lançamento, no entanto, a comunidade de código aberto começou a questionar se se tratava apenas de uma versão reempacotada de um modelo já existente.
Os desenvolvedores descobriram que a arquitetura central e o arquivo de configuração do modelo apontavam inequivocamente para um modelo criado por uma equipe chinesa. As evidências indicam que o modelo da Rakuten não apenas manteve o identificador original “DeepseekV3ForCausalLM”, mas era, na verdade, uma adaptação otimizada usando dados japoneses, e não um desenvolvimento totalmente novo.
A controvérsia gira em torno do que muitos consideram uma “área cinzenta” nas comunicações e no gerenciamento de licenças da Rakuten:
Divulgação inadequada: O comunicado de imprensa oficial mencionou apenas “integrar a essência da comunidade de código aberto”, deixando de reconhecer a origem do modelo fundamental.
Problemas de gerenciamento de licenças: a comunidade destacou que o lançamento inicial da Rakuten pode ter omitido os arquivos de licença MIT exigidos. Embora um arquivo NOTICE tenha sido adicionado posteriormente para cumprir os termos legais, essa correção retroativa foi criticada por carecer de transparência e intenção genuína.
Até o momento, o Grupo Rakuten não abordou diretamente a remoção dos arquivos de licença nem as impressionantes semelhanças arquitetônicas.
A Superinteligência Chega: Vamos Deixá-la Entrar?
Carregando o player…As empresas de inteligência artificial vêm falando sobre uma IA superinteligente como se fosse inevitável, mas recentes incidentes de segurança, como a violação do Hugging Face pela OpenAI, estão demonstrando os potenciais perigo
iFLYTEK Apresenta o Modelo Grande Geral Spark X2.5
Em 1º de setembro, a iFlytek lançará como código aberto dois modelos de linguagem de grande escala focados em dispositivos de borda, o Xinghuo X2.5-4B e o Xinghuo X2.5-1.7B, conforme o mais recente anúncio oficial. Ambos os modelos suportam nativamen
Meta Remove Funcionalidade de Edição de Fotos por IA Após Reação Negativa dos Usuários
A Meta, gigante das redes sociais, está novamente envolvida em um debate público sobre o delicado equilíbrio entre inteligência artificial e privacidade dos usuários. De acordo com a TechCrunch, o Superintelligence Labs da Meta apresentou um novo ger





Lar






