DeepSeek V4 é lançado com as versões Flash e Pro; preços divulgados
Chegou uma grande atualização no campo dos modelos de grande porte. A DeepSeek, empresa chinesa líder em IA, lançou hoje seu novo modelo principal, o DeepSeek V4. O principal destaque é sua estratégia diferenciada, que atende a diversas necessidades — desde tarefas leves de alta frequência até raciocínios complexos — por meio de duas versões: Flash e Pro. Com preços competitivos, ela mais uma vez estabelece um novo padrão de referência para os custos comerciais da IA.
Matriz de Modelos: Posicionamento Diferenciado do Flash e do Pro
O DeepSeek V4 integra e aprimora os modelos originais deepseek-chat e deepseek-reasoner, dividindo-os oficialmente em duas versões:
DeepSeek-V4-Flash: Focado em extrema eficiência de custo e alto rendimento, ideal para conversas gerais de resposta rápida e tarefas básicas de texto.
DeepSeek-V4-Pro: Otimizado para lógica complexa, raciocínio profundo e computação de alto desempenho, oferecendo capacidades de raciocínio e processamento mais robustas.
Ambos os modelos oferecem suporte ao modo de raciocínio (exceto em cenários específicos), saída em JSON, chamadas de ferramentas, continuação de prefixos de diálogo (Beta) e uma janela de contexto de até 1 milhão de tokens com uma saída máxima de 384 mil tokens, proporcionando uma base sólida para implementações complexas de engenharia.

Sistema de preços: faturamento transparente e por níveis
A estrutura de preços do DeepSeek é clara e reduz significativamente o custo marginal para chamadas de API corporativas de longo prazo por meio de um mecanismo de cache. Aqui estão as taxas de cobrança por milhão de tokens (em RMB):
ModeloEntrada (acerto no cache)Entrada (erro no cache)SaídaDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBObservação: as taxas são deduzidas primeiro do saldo gratuito e, em seguida, do saldo pago.
Análise do setor: por que esse preço é um marco
A lógica de precificação mostra que o DeepSeek está incentivando os desenvolvedores a reduzir o desperdício de computação por meio da otimização do uso do cache, permitindo um controle de custos mais preciso graças à diferença significativa de preço entre entradas em cache e fora do cache.
Para os desenvolvedores, a versão Flash, a 1 RMB por milhão de tokens (falha de cache), reduz drasticamente a barreira para acessar arquiteturas de modelos MoE de ponta. Ao mesmo tempo, o preço da versão Pro para tarefas complexas de raciocínio oferece uma solução nacional para a construção de sistemas de perguntas e respostas baseados em conhecimento, agentes autônomos e outras aplicações avançadas, equilibrando desempenho e custo.
Observação importante sobre compatibilidade
Lembrete oficial: os nomes originais dos modelos, deepseek-chat e deepseek-reasoner, serão formalmente descontinuados. Para garantir uma transição tranquila, os desenvolvedores agora podem chamar deepseek-v4-flash (correspondente ao modo sem raciocínio) e deepseek-v4-pro (correspondente ao modo com raciocínio).
Para obter informações detalhadas sobre a API e guias de migração, os desenvolvedores podem acessar a documentação oficial da API do DeepSeek .
Artigo relacionado
Vazamentos da IA Rebel da Meta Revelam Segredos Internos, Elevando a Segurança ao Segundo Maior Nível
De acordo com o The Information, a Meta teve recentemente um incidente crítico de “perda de controle” envolvendo um agente de IA. Uma ferramenta interna destinada a auxiliar fluxos de trabalho expuse acidentalmente dados sensíveis da empresa e inform
CEO do Meituan, Wang Xing: Agentes de IA têm impacto mais forte que o ChatGPT
Durante uma sessão de comunicação gerencial em 13 de março de 2026, o CEO do Meituan, Zhang Wang, discutiu a trajetória da inteligência artificial (IA). Ele argumentou que a transformação impulsionada pela IA superará o impacto de toda a era da Inter
Jensen Huang revela a “nova” oportunidade de mercado de US$ 200 bilhões da Nvidia
O fundador e CEO da Nvidia, Jensen Huang, destaca-se como um dos visionários corporativos mais convincentes, se não o maior, ao impulsionar a narrativa de sua empresa. Ele pode até superar Marc Benioff, da Salesforce, em seu otimismo inabalável sobre
Recomendações de tópicos especiais relacionados
Comentários (0)
Chegou uma grande atualização no campo dos modelos de grande porte. A DeepSeek, empresa chinesa líder em IA, lançou hoje seu novo modelo principal, o DeepSeek V4. O principal destaque é sua estratégia diferenciada, que atende a diversas necessidades — desde tarefas leves de alta frequência até raciocínios complexos — por meio de duas versões: Flash e Pro. Com preços competitivos, ela mais uma vez estabelece um novo padrão de referência para os custos comerciais da IA.
Matriz de Modelos: Posicionamento Diferenciado do Flash e do Pro
O DeepSeek V4 integra e aprimora os modelos originais deepseek-chat e deepseek-reasoner, dividindo-os oficialmente em duas versões:
DeepSeek-V4-Flash: Focado em extrema eficiência de custo e alto rendimento, ideal para conversas gerais de resposta rápida e tarefas básicas de texto.
DeepSeek-V4-Pro: Otimizado para lógica complexa, raciocínio profundo e computação de alto desempenho, oferecendo capacidades de raciocínio e processamento mais robustas.
Ambos os modelos oferecem suporte ao modo de raciocínio (exceto em cenários específicos), saída em JSON, chamadas de ferramentas, continuação de prefixos de diálogo (Beta) e uma janela de contexto de até 1 milhão de tokens com uma saída máxima de 384 mil tokens, proporcionando uma base sólida para implementações complexas de engenharia.

Sistema de preços: faturamento transparente e por níveis
A estrutura de preços do DeepSeek é clara e reduz significativamente o custo marginal para chamadas de API corporativas de longo prazo por meio de um mecanismo de cache. Aqui estão as taxas de cobrança por milhão de tokens (em RMB):
ModeloEntrada (acerto no cache)Entrada (erro no cache)SaídaDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBObservação: as taxas são deduzidas primeiro do saldo gratuito e, em seguida, do saldo pago.
Análise do setor: por que esse preço é um marco
A lógica de precificação mostra que o DeepSeek está incentivando os desenvolvedores a reduzir o desperdício de computação por meio da otimização do uso do cache, permitindo um controle de custos mais preciso graças à diferença significativa de preço entre entradas em cache e fora do cache.
Para os desenvolvedores, a versão Flash, a 1 RMB por milhão de tokens (falha de cache), reduz drasticamente a barreira para acessar arquiteturas de modelos MoE de ponta. Ao mesmo tempo, o preço da versão Pro para tarefas complexas de raciocínio oferece uma solução nacional para a construção de sistemas de perguntas e respostas baseados em conhecimento, agentes autônomos e outras aplicações avançadas, equilibrando desempenho e custo.
Observação importante sobre compatibilidade
Lembrete oficial: os nomes originais dos modelos, deepseek-chat e deepseek-reasoner, serão formalmente descontinuados. Para garantir uma transição tranquila, os desenvolvedores agora podem chamar deepseek-v4-flash (correspondente ao modo sem raciocínio) e deepseek-v4-pro (correspondente ao modo com raciocínio).
Para obter informações detalhadas sobre a API e guias de migração, os desenvolvedores podem acessar
Vazamentos da IA Rebel da Meta Revelam Segredos Internos, Elevando a Segurança ao Segundo Maior Nível
De acordo com o The Information, a Meta teve recentemente um incidente crítico de “perda de controle” envolvendo um agente de IA. Uma ferramenta interna destinada a auxiliar fluxos de trabalho expuse acidentalmente dados sensíveis da empresa e inform
CEO do Meituan, Wang Xing: Agentes de IA têm impacto mais forte que o ChatGPT
Durante uma sessão de comunicação gerencial em 13 de março de 2026, o CEO do Meituan, Zhang Wang, discutiu a trajetória da inteligência artificial (IA). Ele argumentou que a transformação impulsionada pela IA superará o impacto de toda a era da Inter
Jensen Huang revela a “nova” oportunidade de mercado de US$ 200 bilhões da Nvidia
O fundador e CEO da Nvidia, Jensen Huang, destaca-se como um dos visionários corporativos mais convincentes, se não o maior, ao impulsionar a narrativa de sua empresa. Ele pode até superar Marc Benioff, da Salesforce, em seu otimismo inabalável sobre





Lar






