Lar
A Moonshot lança o modelo de alta velocidade Kimi 2.7 Code, aumentando a velocidade de produção em seis vezes
A Moonshot AI deu continuidade ao lançamento, na semana passada, do modelo Kimi 2.7 Code com uma variante de alta velocidade lançada esta noite. Essa versão oferece um aumento significativo na velocidade de saída, ao mesmo tempo em que preserva os recursos essenciais da versão original, com o objetivo de ajudar os desenvolvedores a escrever código de forma mais eficiente.

A alta velocidade reduz drasticamente o tempo de espera
De acordo com dados oficiais, o modelo Kimi 2.7 Code de alta velocidade gera resultados de 5 a 6 vezes mais rápido do que a versão padrão. Em cenários típicos de codificação, ele atinge cerca de 180 tokens por segundo, enquanto em tarefas de contexto curto a velocidade máxima pode chegar a 260 tokens por segundo.
Quanto ao preço, a API de alta velocidade custa apenas o dobro da versão regular, oferecendo uma eficiência várias vezes maior por um preço um pouco mais alto. Os usuários do Kimi Code Plan podem participar do programa de acesso antecipado para experimentar essa novidade no Kimi Code antes de todo mundo.
O Modo de Raciocínio libera todo o desempenho
Para garantir que o modelo tenha o melhor desempenho possível, os usuários devem ativar o modo de reflexão ao usar os modelos da série Kimi 2.7 Code. A API do Kimi e o Kimi Code têm esse recurso ativado por padrão. Se os usuários desativarem manualmente, a API exibirá um erro e o sistema reverterá automaticamente para a versão K2.6.
À medida que o poder de computação continua a se expandir, a Moonshot AI ampliará o acesso a esse modelo de alta velocidade. A partir de julho deste ano, ele será gradualmente disponibilizado para membros do nível Allegretto e superiores. Nessa ocasião, o custo de uso no Plano Kimi Code será ajustado para o triplo do valor da versão regular.
Artigo relacionado
Dentro dos Detalhes Revelados Sobre o Gemini de Próxima Geração: Poder de Cálculo Sobrecarregado, Equipes Internas Discordaram Sobre Prioridades de Desenvolvimento e Alocação de Recursos
Os relatórios indicam que o lançamento do tão aguardado modelo Gemini de próxima geração do Google foi adiado. Desentendimentos internos sobre prioridades de desenvolvimento e alocação de recursos, combinados com capacidade computacional limitada e p
A OpenAI descarta preocupações com a desaceleração do crescimento e afirma que múltiplas unidades de negócio estão acelerando.
Em resposta à escrutínio externo sobre o desaceleramento do crescimento das vendas e o não cumprimento de metas internas, o líder em inteligência artificial, OpenAI, emitiu uma declaração confiante na terça-feira, 28 de abril. A empresa esclareceu qu
Alibaba Super Cup: Qwen3.8-Max estreia com aprimoramento nas ferramentas de programação e escritório
A Alibaba revelou oficialmente o Qwen3.8-Max, um modelo de base de próxima geração com 2,4 trilhão de parâmetros. Este avanço significativo em IA oferece ganhos substanciais de desempenho em áreas principais, como programação e tarefas profissionais
Recomendações de tópicos especiais relacionados
Comentários (1)
A Moonshot AI deu continuidade ao lançamento, na semana passada, do modelo Kimi 2.7 Code com uma variante de alta velocidade lançada esta noite. Essa versão oferece um aumento significativo na velocidade de saída, ao mesmo tempo em que preserva os recursos essenciais da versão original, com o objetivo de ajudar os desenvolvedores a escrever código de forma mais eficiente.

A alta velocidade reduz drasticamente o tempo de espera
De acordo com dados oficiais, o modelo Kimi 2.7 Code de alta velocidade gera resultados de 5 a 6 vezes mais rápido do que a versão padrão. Em cenários típicos de codificação, ele atinge cerca de 180 tokens por segundo, enquanto em tarefas de contexto curto a velocidade máxima pode chegar a 260 tokens por segundo.
Quanto ao preço, a API de alta velocidade custa apenas o dobro da versão regular, oferecendo uma eficiência várias vezes maior por um preço um pouco mais alto. Os usuários do Kimi Code Plan podem participar do programa de acesso antecipado para experimentar essa novidade no Kimi Code antes de todo mundo.
O Modo de Raciocínio libera todo o desempenho
Para garantir que o modelo tenha o melhor desempenho possível, os usuários devem ativar o modo de reflexão ao usar os modelos da série Kimi 2.7 Code. A API do Kimi e o Kimi Code têm esse recurso ativado por padrão. Se os usuários desativarem manualmente, a API exibirá um erro e o sistema reverterá automaticamente para a versão K2.6.
À medida que o poder de computação continua a se expandir, a Moonshot AI ampliará o acesso a esse modelo de alta velocidade. A partir de julho deste ano, ele será gradualmente disponibilizado para membros do nível Allegretto e superiores. Nessa ocasião, o custo de uso no Plano Kimi Code será ajustado para o triplo do valor da versão regular.
Dentro dos Detalhes Revelados Sobre o Gemini de Próxima Geração: Poder de Cálculo Sobrecarregado, Equipes Internas Discordaram Sobre Prioridades de Desenvolvimento e Alocação de Recursos
Os relatórios indicam que o lançamento do tão aguardado modelo Gemini de próxima geração do Google foi adiado. Desentendimentos internos sobre prioridades de desenvolvimento e alocação de recursos, combinados com capacidade computacional limitada e p
A OpenAI descarta preocupações com a desaceleração do crescimento e afirma que múltiplas unidades de negócio estão acelerando.
Em resposta à escrutínio externo sobre o desaceleramento do crescimento das vendas e o não cumprimento de metas internas, o líder em inteligência artificial, OpenAI, emitiu uma declaração confiante na terça-feira, 28 de abril. A empresa esclareceu qu
Alibaba Super Cup: Qwen3.8-Max estreia com aprimoramento nas ferramentas de programação e escritório
A Alibaba revelou oficialmente o Qwen3.8-Max, um modelo de base de próxima geração com 2,4 trilhão de parâmetros. Este avanço significativo em IA oferece ganhos substanciais de desempenho em áreas principais, como programação e tarefas profissionais











