DeepSeek V4 deve ser lançado em abril, juntamente com o modelo Mengyuan da Tencent

De acordo com uma reportagem exclusiva do BaiMing Lab, o tão aguardado DeepSeek V4 e o novo modelo MixFormer, de Yao Shunyu, têm lançamento oficial previsto para abril de 2026. O DeepSeek V4 é um grande modelo multimodal liderado por Liang Wenfeng. Após um extenso aperfeiçoamento, espera-se que ele alcance avanços significativos em proficiência de codificação e memória de longo prazo. Este lançamento está alinhado com a trajetória de pesquisa da equipe do DeepSeek nos últimos anos, particularmente no processamento de conteúdo visual e nos recursos de pesquisa impulsionados por IA.
A pesquisa de Liang Wenfeng concentra-se na exploração de mecanismos de “memória condicional”. Em janeiro de 2026, ele publicou um artigo intitulado “Conditional Memory via Scalable Lookup”, delineando as principais teorias. Além disso, em dezembro de 2025, ele divulgou outro estudo, “mHC: Manifold-Constrained Hyper-Connections”, que otimiza ainda mais a arquitetura subjacente. Esse trabalho visa abordar as limitações conhecidas dos modelos Transformer no que diz respeito à memória e à estabilidade do treinamento. O DeepSeek V4 não apenas possui um robusto poder de processamento multimodal, mas também está sendo profundamente otimizado para chips nacionais, com o objetivo de se tornar um modelo central totalmente dependente da infraestrutura de computação nacional.
Paralelamente, o novo modelo MixFormer de Yao Shunyu também está programado para ser lançado em abril. Desde dezembro de 2025, Yao atua como Cientista-Chefe de IA no Comitê Executivo da Tencent, ao mesmo tempo em que supervisiona os departamentos de Infraestrutura de IA e de grandes modelos de linguagem. Em fevereiro de 2026, ele apresentou o CL-bench, um novo benchmark de avaliação para “aprendizado contextual” que enfatiza o tratamento de contextos longos e a usabilidade do agente. Relatórios indicam que o novo modelo de Yao contará com cerca de 3 bilhões de parâmetros, com sua equipe priorizando a aplicação prática desde o início em vez da mera competição em escala de parâmetros.
Os lançamentos iminentes de ambos os modelos têm despertado considerável interesse do mercado, destacando o progresso acelerado da China em inteligência artificial. Seja pelos avanços do DeepSeek V4 na memória de longo prazo ou pelas melhorias do modelo MixFormer da Tencent na avaliação de tarefas do mundo real, ambos os esforços estão abordando fundamentalmente como futuros modelos de grande porte podem ser integrados de forma mais eficaz em ambientes de produção.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (0)

De acordo com uma reportagem exclusiva do BaiMing Lab, o tão aguardado DeepSeek V4 e o novo modelo MixFormer, de Yao Shunyu, têm lançamento oficial previsto para abril de 2026. O DeepSeek V4 é um grande modelo multimodal liderado por Liang Wenfeng. Após um extenso aperfeiçoamento, espera-se que ele alcance avanços significativos em proficiência de codificação e memória de longo prazo. Este lançamento está alinhado com a trajetória de pesquisa da equipe do DeepSeek nos últimos anos, particularmente no processamento de conteúdo visual e nos recursos de pesquisa impulsionados por IA.
A pesquisa de Liang Wenfeng concentra-se na exploração de mecanismos de “memória condicional”. Em janeiro de 2026, ele publicou um artigo intitulado “Conditional Memory via Scalable Lookup”, delineando as principais teorias. Além disso, em dezembro de 2025, ele divulgou outro estudo, “mHC: Manifold-Constrained Hyper-Connections”, que otimiza ainda mais a arquitetura subjacente. Esse trabalho visa abordar as limitações conhecidas dos modelos Transformer no que diz respeito à memória e à estabilidade do treinamento. O DeepSeek V4 não apenas possui um robusto poder de processamento multimodal, mas também está sendo profundamente otimizado para chips nacionais, com o objetivo de se tornar um modelo central totalmente dependente da infraestrutura de computação nacional.
Paralelamente, o novo modelo MixFormer de Yao Shunyu também está programado para ser lançado em abril. Desde dezembro de 2025, Yao atua como Cientista-Chefe de IA no Comitê Executivo da Tencent, ao mesmo tempo em que supervisiona os departamentos de Infraestrutura de IA e de grandes modelos de linguagem. Em fevereiro de 2026, ele apresentou o CL-bench, um novo benchmark de avaliação para “aprendizado contextual” que enfatiza o tratamento de contextos longos e a usabilidade do agente. Relatórios indicam que o novo modelo de Yao contará com cerca de 3 bilhões de parâmetros, com sua equipe priorizando a aplicação prática desde o início em vez da mera competição em escala de parâmetros.
Os lançamentos iminentes de ambos os modelos têm despertado considerável interesse do mercado, destacando o progresso acelerado da China em inteligência artificial. Seja pelos avanços do DeepSeek V4 na memória de longo prazo ou pelas melhorias do modelo MixFormer da Tencent na avaliação de tarefas do mundo real, ambos os esforços estão abordando fundamentalmente como futuros modelos de grande porte podem ser integrados de forma mais eficaz em ambientes de produção.
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri





Lar






