Lar
DeepSeek revela a prévia do V4, tornando o acesso a contextos longos de 1M disponível para todos
A DeepSeek lançou oficialmente e disponibilizou como código aberto a versão preliminar de sua mais recente série de modelos, DeepSeek-V4 . Através de inovações estruturais, esta série alcança o tratamento padronizado de contexto ultra-longo de 1M (um milhão de tokens) e lidera os modelos nacionais e de código aberto em colaboração de Agentes, conhecimento do mundo e raciocínio lógico.

Layout de Duas Versões: Pro para Excelência, Flash para Eficiência
DeepSeek-V4 oferece duas especificades adaptadas a diferentes necessidades de aplicação:
DeepSeek-V4-Pro (1,6T parâmetros, 49B ativados): O desempenho rivaliza com os principais modelos fechados. Ele alcança os melhores resultados de código aberto em avaliações de Codificação Agêntica, com qualidade de saída próxima à do Opus4.6. Em testes de matemática, STEM e programação competitiva, supera todos os modelos de código aberto avaliados publicamente, demonstrando capacidades de raciocínio de classe mundial.
DeepSeek-V4-Flash (284B parâmetros, 13B ativados): Prioriza a extrema relação custo-benefício. Embora seu conhecimento do mundo seja ligeiramente inferior ao da versão Pro, ele iguala o nível de raciocínio do Pro para tarefas simples e o desempenho de Agentes, fornecendo serviços de API mais rápidos e econômicos.
Inovação Estrutural: O Mecanismo DSA Torna o Contexto Longo Acessível
DeepSeek-V4 introduz um inovador **mecanismo de atenção esparsa DSA**. Ao comprimir ao nível de tokens, o modelo reduz significativamente as demandas computacionais e de memória para contextos ultra-longos. Isso torna o contexto de 1M um recurso padrão em todos os serviços oficiais da DeepSeek, resolvendo a dor de alta custo do setor no processamento de textos longos.
Adaptação Profunda ao Ecossistema de Agentes
Otimizado para produtos de Agentes principais como Claude Code e CodeBuddy, DeepSeek-V4 suporta tanto o modo não-pensante quanto o modo pensante. A API expõe o parâmetro reasoning_effort, permitindo que os usuários ajustem a intensidade do pensamento (alto/máximo) com base na complexidade da tarefa, aumentando significativamente o desempenho em cenários complexos, como geração de código e processamento de documentos.
Acesso e Plano de Código Aberto
Os usuários agora podem acessar o modelo mais recente através do site oficial ou do aplicativo oficial, com atualizações correspondentes da API. Observe que os nomes de modelo legados deepseek-chat e deepseek-reasoner serão descontinuados após três meses (até 24 de julho de 2026).
Links de Código Aberto: Disponíveis no Hugging Face e na Comunidade Moba .
Relatório Técnico: Publicado no repositório do Hugging Face .
Este lançamento de DeepSeek-V4 valida a viabilidade dos modelos de código aberto alcançarem os principais modelos fechados em capacidades de contexto longo e Agentes, estabelecendo uma base sólida para a popularização da AGI por meio de avanços tecnológicos.
Artigo relacionado
Chrome e Edge silenciosamente elevam a necessidade de armazenamento para modelos de IA local para 20GB, à medida que os navegadores evoluem para motores de inferência de IA
O Google Chrome e o Microsoft Edge elevaram os requisitos de espaço em disco para modelos de IA local para 20 GB. Esses navegadores baixam silenciosamente os modelos em segundo plano para habilitar capacidades de IA no dispositivo. Em maio, foi desco
A Zhipu AI mira uma receita anual recorrente (ARR) de US$ 1 bilhão com foco em programação, após crescimento de 15 vezes em cinco meses
Fontes independentes confirmam que a Receita Recorrente Anual (ARR) da Zhipu atingiu US$ 1 bilhão até julho de 2026. A empresa ainda não comentou esses relatórios.A codificação por IA e a geração de vídeo emergiram como os setores comerciais de cresc
A Microsoft revela o primeiro modelo de IA de cibersegurança MAI-Cyber-1-Flash e lança a Plataforma de Segurança Perception
A Microsoft apresentou oficialmente o MAI-Cyber-1-Flash, seu primeiro modelo especializado em cibersegurança, juntamente com uma nova plataforma de segurança impulsionada por IA chamada Perception. Revelados em um evento em São Francisco, essas inova
Recomendações de tópicos especiais relacionados
Comentários (0)
A DeepSeek lançou oficialmente e disponibilizou como código aberto a versão preliminar de sua mais recente série de modelos,

Layout de Duas Versões: Pro para Excelência, Flash para Eficiência
DeepSeek-V4-Pro (1,6T parâmetros, 49B ativados): O desempenho rivaliza com os principais modelos fechados. Ele alcança os melhores resultados de código aberto em avaliações de Codificação Agêntica, com qualidade de saída próxima à do Opus4.6. Em testes de matemática, STEM e programação competitiva, supera todos os modelos de código aberto avaliados publicamente, demonstrando capacidades de raciocínio de classe mundial.
DeepSeek-V4-Flash (284B parâmetros, 13B ativados): Prioriza a extrema relação custo-benefício. Embora seu conhecimento do mundo seja ligeiramente inferior ao da versão Pro, ele iguala o nível de raciocínio do Pro para tarefas simples e o desempenho de Agentes, fornecendo serviços de API mais rápidos e econômicos.
Inovação Estrutural: O Mecanismo DSA Torna o Contexto Longo Acessível
Adaptação Profunda ao Ecossistema de Agentes
Otimizado para produtos de Agentes principais como Claude Code e CodeBuddy, reasoning_effort, permitindo que os usuários ajustem a intensidade do pensamento (alto/máximo) com base na complexidade da tarefa, aumentando significativamente o desempenho em cenários complexos, como geração de código e processamento de documentos.
Acesso e Plano de Código Aberto
Os usuários agora podem acessar o modelo mais recente através do deepseek-chat e deepseek-reasoner serão descontinuados após três meses (até 24 de julho de 2026).
Links de Código Aberto: Disponíveis no
Relatório Técnico: Publicado no repositório do
Este lançamento de
Chrome e Edge silenciosamente elevam a necessidade de armazenamento para modelos de IA local para 20GB, à medida que os navegadores evoluem para motores de inferência de IA
O Google Chrome e o Microsoft Edge elevaram os requisitos de espaço em disco para modelos de IA local para 20 GB. Esses navegadores baixam silenciosamente os modelos em segundo plano para habilitar capacidades de IA no dispositivo. Em maio, foi desco
A Zhipu AI mira uma receita anual recorrente (ARR) de US$ 1 bilhão com foco em programação, após crescimento de 15 vezes em cinco meses
Fontes independentes confirmam que a Receita Recorrente Anual (ARR) da Zhipu atingiu US$ 1 bilhão até julho de 2026. A empresa ainda não comentou esses relatórios.A codificação por IA e a geração de vídeo emergiram como os setores comerciais de cresc
A Microsoft revela o primeiro modelo de IA de cibersegurança MAI-Cyber-1-Flash e lança a Plataforma de Segurança Perception
A Microsoft apresentou oficialmente o MAI-Cyber-1-Flash, seu primeiro modelo especializado em cibersegurança, juntamente com uma nova plataforma de segurança impulsionada por IA chamada Perception. Revelados em um evento em São Francisco, essas inova











