Modelo US Opus 4.8 Acusado de Utilizar Tecnologia de IA de Código Aberto Chinesa
Anthropic, uma das principais empresas norte-americanas de modelos de linguagem grande, lançou silenciosamente o modelo Claude Opus 4.8 à meia-noite de hoje. Embora tenha alcançado resultados positivos em vários testes, muitos desenvolvedores e usuários relataram que o modelo parece sofrer de “confusão cognitiva”.
Durante um teste API, um usuário descobriu que, quando perguntado sobre sua própria identidade, o modelo afirmou incorretamente ser o “Qwen” da Alibaba ou o “DeepSeek”, dois modelos open-source chineses bem conhecidos.
Teste API Provoca Confusão de Identidade
Alguns usuários que testaram através da interface web disseram não conseguir reproduzir o problema e argumentaram que o modelo não havia sido desenvolvido a partir de modelos chineses. No entanto, desenvolvedores familiarizados com o assunto explicaram que a interface web usa prompts sistemáticos rigorosos, os quais ocultam esse comportamento.
Em contraste, quando testado através de uma configuração mínima da API sem prompts sistemáticos, o problema ocorreu frequentemente. Isso sugere fortemente que o modelo de alto nível norte-americano pode ter sido treinado ou aprimorado usando uma grande quantidade de dados gerados por modelos open-source chineses através de um processo de distilação.
Políticas Inconsistentes Geram Acusações de Duplo Padrão
O incidente provocou muita discussão na comunidade tecnológica, principalmente porque a Anthropic já havia adotado uma posição firme contra a China. A empresa trabalhou com o Departamento de Defesa dos EUA e outras agências para elaborar legislação que visava classificar a distilação de modelos grandes como uma ameaça adversária.
Eles não apenas pressionaram o governo dos EUA a reforçar as restrições de chips e software à indústria de IA da China, mas também estabeleceram como objetivo estratégico manter uma vantagem de dois anos sobre a China em IA até 2028. Agora, com seu modelo principal supostamente sendo desenvolvido a partir de modelos chineses, muitos veem isso como um caso irônico de duplo padrão.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (1)
Anthropic, uma das principais empresas norte-americanas de modelos de linguagem grande, lançou silenciosamente o modelo Claude Opus 4.8 à meia-noite de hoje. Embora tenha alcançado resultados positivos em vários testes, muitos desenvolvedores e usuários relataram que o modelo parece sofrer de “confusão cognitiva”.
Durante um teste API, um usuário descobriu que, quando perguntado sobre sua própria identidade, o modelo afirmou incorretamente ser o “Qwen” da Alibaba ou o “DeepSeek”, dois modelos open-source chineses bem conhecidos.
Teste API Provoca Confusão de Identidade
Alguns usuários que testaram através da interface web disseram não conseguir reproduzir o problema e argumentaram que o modelo não havia sido desenvolvido a partir de modelos chineses. No entanto, desenvolvedores familiarizados com o assunto explicaram que a interface web usa prompts sistemáticos rigorosos, os quais ocultam esse comportamento.
Em contraste, quando testado através de uma configuração mínima da API sem prompts sistemáticos, o problema ocorreu frequentemente. Isso sugere fortemente que o modelo de alto nível norte-americano pode ter sido treinado ou aprimorado usando uma grande quantidade de dados gerados por modelos open-source chineses através de um processo de distilação.
Políticas Inconsistentes Geram Acusações de Duplo Padrão
O incidente provocou muita discussão na comunidade tecnológica, principalmente porque a Anthropic já havia adotado uma posição firme contra a China. A empresa trabalhou com o Departamento de Defesa dos EUA e outras agências para elaborar legislação que visava classificar a distilação de modelos grandes como uma ameaça adversária.
Eles não apenas pressionaram o governo dos EUA a reforçar as restrições de chips e software à indústria de IA da China, mas também estabeleceram como objetivo estratégico manter uma vantagem de dois anos sobre a China em IA até 2028. Agora, com seu modelo principal supostamente sendo desenvolvido a partir de modelos chineses, muitos veem isso como um caso irônico de duplo padrão.
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri





Lar






