DeepSeek apresenta o teste em escala de cinza V4 e o modo especialista

Em 7 de abril, o Readhub informou que o DeepSeek V4 está passando por testes intensivos em escala de cinza. Capturas de tela compartilhadas por vários programadores e blogueiros de tecnologia revelam que a nova geração do modelo alcançou avanços em sua arquitetura subjacente, além de melhorias significativas em sua lógica de interação e capacidades multimodais.
Principais destaques: uma nova arquitetura funcional em três camadas
Com base na interface de teste que vazou, o DeepSeek V4 oferece três opções principais, sinalizando uma evolução abrangente de sua linha de produtos:
Versão Lite (DeepSeek V4 Lite): Prioriza a velocidade de resposta, ideal para conversas cotidianas e leves.
Versão Expert (DeepSeek V4): Um modo focado em raciocínio lógico profundo, potencialmente construído com base na “nova arquitetura de memória” mencionada em um artigo co-autoria de Liang Wenfeng.
Versão Vision (DeepSeek V4 Vision): Representa a integração profunda de recursos multimodais, permitindo o tratamento direto de tarefas de análise de imagens e vídeos.
Abordagem técnica: um firme defensor dos “chips nacionais”
A ascensão do DeepSeek é impulsionada não apenas por algoritmos, mas também pela integração profunda com o ecossistema de computação local:
Priorizando chips de IA nacionais: Relatórios indicam que a DeepSeek está desenvolvendo pelo menos dois grandes modelos totalmente baseados em chips de IA nacionais, tendo já iniciado um aumento na aquisição de chips nacionais .
Recusa à dependência externa: Em aplicações de teste anteriores com fabricantes de chips dos EUA, a DeepSeek não concedeu acesso aos testes do modelo V4 , priorizando, em vez disso, empresas nacionais para otimização colaborativa.
Expectativas do setor: será que ela pode desafiar o auge da programação?
Além dos ganhos gerais de desempenho, o mercado tem expectativas verticais específicas para o DeepSeek V4 :
Edição especial de programação de IA: as especulações do setor apontam para uma versão adaptada para geração de código e implementação de engenharia, posicionando-a para competir diretamente com o Mythos da Anthropic ou a série GPT da OpenAI .
Processamento de contextos ultralongos: Com base nos pontos fortes já estabelecidos do DeepSeek , espera-se que o V4 seja capaz de lidar com contextos ultralongos de milhões de tokens em uma única passagem.
Acompanhamento de Tópicos: Um Ciclo de Lançamento Muito Aguardado
Desde o vazamento da nova arquitetura MODEL1 em janeiro, passando pelo lançamento do modelo OCR 2 em fevereiro, até os frequentes testes em escala de cinza atuais, o lançamento do DeepSeek V4 parece iminente. À medida que a janela de lançamento prevista se aproxima neste mês, este modelo emblemático — com ênfase na “memória nativa” e na “adaptação doméstica” — pode mais uma vez redefinir o padrão de referência de custo-benefício para grandes modelos nacionais.
Conclusão: Uma IA que compreende melhor o poder de computação chinês
Da validação automatizada de código a novas interações visuais, o DeepSeek está demonstrando que os modelos nacionais podem alcançar um progresso evolutivo notável sem depender de chips estrangeiros de ponta.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (1)

Em 7 de abril,
Principais destaques: uma nova arquitetura funcional em três camadas
Com base na interface de teste que vazou,
Versão Lite (DeepSeek V4 Lite): Prioriza a velocidade de resposta, ideal para conversas cotidianas e leves.
Versão Expert (DeepSeek V4): Um modo focado em raciocínio lógico profundo, potencialmente construído com base na “nova arquitetura de memória” mencionada em um artigo co-autoria de Liang Wenfeng.
Versão Vision (DeepSeek V4 Vision): Representa a integração profunda de recursos multimodais, permitindo o tratamento direto de tarefas de análise de imagens e vídeos.
Abordagem técnica: um firme defensor dos “chips nacionais”
A ascensão do
Priorizando chips de IA nacionais: Relatórios indicam que a DeepSeek está desenvolvendo pelo menos dois grandes modelos totalmente baseados em chips de IA nacionais, tendo já iniciado um
Recusa à dependência externa: Em aplicações de teste anteriores com fabricantes de chips dos EUA,
Expectativas do setor: será que ela pode desafiar o auge da programação?
Além dos ganhos gerais de desempenho, o mercado tem expectativas verticais específicas para
Edição especial de programação de IA: as especulações do setor apontam para uma versão adaptada para geração de código e implementação de engenharia, posicionando-a para competir diretamente com o Mythos
Processamento de contextos ultralongos: Com base nos
Acompanhamento de Tópicos: Um Ciclo de Lançamento Muito Aguardado
Desde o vazamento da
Conclusão: Uma IA que compreende melhor o poder de computação chinês
Da validação automatizada de código a novas interações visuais,
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri





Lar






