Modelo gigante de IA japonês é acusado de copiar o DeepSeek

Um lançamento de grande repercussão no setor de tecnologia do Japão desencadeou um debate público sobre a transparência tecnológica. O Grupo Rakuten revelou recentemente o que descreve como o “maior e mais poderoso” modelo de linguagem de grande escala desenvolvido internamente. Esse modelo de 70 bilhões de parâmetros é um dos principais resultados de um projeto apoiado pelo Ministério da Economia, Comércio e Indústria do Japão (METI) no âmbito de sua iniciativa GENIAC. Logo após seu lançamento, no entanto, a comunidade de código aberto começou a questionar se se tratava apenas de uma versão reempacotada de um modelo já existente.
Os desenvolvedores descobriram que a arquitetura central e o arquivo de configuração do modelo apontavam inequivocamente para um modelo criado por uma equipe chinesa. As evidências indicam que o modelo da Rakuten não apenas manteve o identificador original “DeepseekV3ForCausalLM”, mas era, na verdade, uma adaptação otimizada usando dados japoneses, e não um desenvolvimento totalmente novo.
A controvérsia gira em torno do que muitos consideram uma “área cinzenta” nas comunicações e no gerenciamento de licenças da Rakuten:
Divulgação inadequada: O comunicado de imprensa oficial mencionou apenas “integrar a essência da comunidade de código aberto”, deixando de reconhecer a origem do modelo fundamental.
Problemas de gerenciamento de licenças: a comunidade destacou que o lançamento inicial da Rakuten pode ter omitido os arquivos de licença MIT exigidos. Embora um arquivo NOTICE tenha sido adicionado posteriormente para cumprir os termos legais, essa correção retroativa foi criticada por carecer de transparência e intenção genuína.
Até o momento, o Grupo Rakuten não abordou diretamente a remoção dos arquivos de licença nem as impressionantes semelhanças arquitetônicas.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (0)

Um lançamento de grande repercussão no setor de tecnologia do Japão desencadeou um debate público sobre a transparência tecnológica. O Grupo Rakuten revelou recentemente o que descreve como o “maior e mais poderoso” modelo de linguagem de grande escala desenvolvido internamente. Esse modelo de 70 bilhões de parâmetros é um dos principais resultados de um projeto apoiado pelo Ministério da Economia, Comércio e Indústria do Japão (METI) no âmbito de sua iniciativa GENIAC. Logo após seu lançamento, no entanto, a comunidade de código aberto começou a questionar se se tratava apenas de uma versão reempacotada de um modelo já existente.
Os desenvolvedores descobriram que a arquitetura central e o arquivo de configuração do modelo apontavam inequivocamente para um modelo criado por uma equipe chinesa. As evidências indicam que o modelo da Rakuten não apenas manteve o identificador original “DeepseekV3ForCausalLM”, mas era, na verdade, uma adaptação otimizada usando dados japoneses, e não um desenvolvimento totalmente novo.
A controvérsia gira em torno do que muitos consideram uma “área cinzenta” nas comunicações e no gerenciamento de licenças da Rakuten:
Divulgação inadequada: O comunicado de imprensa oficial mencionou apenas “integrar a essência da comunidade de código aberto”, deixando de reconhecer a origem do modelo fundamental.
Problemas de gerenciamento de licenças: a comunidade destacou que o lançamento inicial da Rakuten pode ter omitido os arquivos de licença MIT exigidos. Embora um arquivo NOTICE tenha sido adicionado posteriormente para cumprir os termos legais, essa correção retroativa foi criticada por carecer de transparência e intenção genuína.
Até o momento, o Grupo Rakuten não abordou diretamente a remoção dos arquivos de licença nem as impressionantes semelhanças arquitetônicas.
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri





Lar






