Qwen3.8-LiveTranslate Lança Modelo de Tradução em Tempo Real com Atraso de 2,3s
Qwen3.8-LiveTranslate, o mais recente modelo de tradução de fala em tempo real do Alibaba Qwen, redefine a interpretação simultânea por meio de sua arquitetura Unificada Interleave. Esta inovação aumenta a precisão, a fluência e a concisão, reduzindo a latência média por caractere (LAAL) de 2,8 para 2,3 segundos — uma melhoria crítica de 0,5 segundo que garante uma experiência de audição natural em um campo onde até mesmo um leve atraso pode interromper o fluxo.
Expandindo o suporte para 60 idiomas, o modelo atualizado introduz três melhorias práticas para a interpretação em tempo real. Primeiro, ele suporta a separação de falantes em tempo real, atribuindo com precisão cada frase ao falante correto enquanto mantém a clonagem de voz estável, evitando assim cruzamentos de áudio ou confusão entre falantes. Segundo, ele exibe o texto original e o texto traduzido lado a lado, permitindo que os ouvintes acompanhem visualmente enquanto escutam a tradução. Terceiro, ele melhora a desambiguação de contexto longo, permitindo que o modelo utilize o contexto anterior para aumentar a precisão — especialmente para nomes e terminologia especializada, que são pontos comuns de erro.

Em seu núcleo, o Qwen3.8-LiveTranslate emprega um design de dois módulos Pensador–Falante baseado em MoE Híbrido. O mecanismo Interleave integra perfeitamente a compreensão em streaming, a geração de texto e a síntese de fala em um único pipeline. O Pensador processa vídeo, áudio, texto original e saídas de tradução em uma sequência causal unificada, ordenando-os cronologicamente para produzir resultados de ponta a ponta que lidam simultaneamente com “compreensão” e “tradução”. O Falante então converte o texto traduzido, guiado pelo áudio original, em fala que preserva a identidade vocal do falante original.

Artigo relacionado
A OpenAI revela Filtro de Privacidade para Contexto de 128K com Oito Modos de Reconhecimento
A OpenAI apresentou o Privacy Filter, um modelo de anonimização de Informações Pessoais Identificáveis (PII) de última geração. Agora disponível sob a licença Apache 2.0 no Hugging Face e no GitHub, esta ferramenta capacita os desenvolvedores com uma
A NewCore levanta US$ 66 milhões para equipar agentes de IA com identidades à medida que eles assumem funções de colaboradores
A startup de cibersegurança NewCore foi oficialmente lançada, deixando o anonimato, e garantiu US$ 66 milhões em financiamento na segunda-feira. A empresa visa abordar um desafio crítico que muitas organizações logo enfrentarão ao integrar agentes de
Microsoft e Mistral firmam parceria europeia de IA no valor de vários bilhões de dólares
No cerne dessa colaboração está um acordo de vários bilhões de dólares destinado a fortalecer a infraestrutura de inteligência artificial em toda a Europa. Crédito: MicrosoftA Microsoft e a Mistral, u
Recomendações de tópicos especiais relacionados
Comentários (0)
Qwen3.8-LiveTranslate, o mais recente modelo de tradução de fala em tempo real do Alibaba Qwen, redefine a interpretação simultânea por meio de sua arquitetura Unificada Interleave. Esta inovação aumenta a precisão, a fluência e a concisão, reduzindo a latência média por caractere (LAAL) de 2,8 para 2,3 segundos — uma melhoria crítica de 0,5 segundo que garante uma experiência de audição natural em um campo onde até mesmo um leve atraso pode interromper o fluxo.
Expandindo o suporte para 60 idiomas, o modelo atualizado introduz três melhorias práticas para a interpretação em tempo real. Primeiro, ele suporta a separação de falantes em tempo real, atribuindo com precisão cada frase ao falante correto enquanto mantém a clonagem de voz estável, evitando assim cruzamentos de áudio ou confusão entre falantes. Segundo, ele exibe o texto original e o texto traduzido lado a lado, permitindo que os ouvintes acompanhem visualmente enquanto escutam a tradução. Terceiro, ele melhora a desambiguação de contexto longo, permitindo que o modelo utilize o contexto anterior para aumentar a precisão — especialmente para nomes e terminologia especializada, que são pontos comuns de erro.

Em seu núcleo, o Qwen3.8-LiveTranslate emprega um design de dois módulos Pensador–Falante baseado em MoE Híbrido. O mecanismo Interleave integra perfeitamente a compreensão em streaming, a geração de texto e a síntese de fala em um único pipeline. O Pensador processa vídeo, áudio, texto original e saídas de tradução em uma sequência causal unificada, ordenando-os cronologicamente para produzir resultados de ponta a ponta que lidam simultaneamente com “compreensão” e “tradução”. O Falante então converte o texto traduzido, guiado pelo áudio original, em fala que preserva a identidade vocal do falante original.

A OpenAI revela Filtro de Privacidade para Contexto de 128K com Oito Modos de Reconhecimento
A OpenAI apresentou o Privacy Filter, um modelo de anonimização de Informações Pessoais Identificáveis (PII) de última geração. Agora disponível sob a licença Apache 2.0 no Hugging Face e no GitHub, esta ferramenta capacita os desenvolvedores com uma
A NewCore levanta US$ 66 milhões para equipar agentes de IA com identidades à medida que eles assumem funções de colaboradores
A startup de cibersegurança NewCore foi oficialmente lançada, deixando o anonimato, e garantiu US$ 66 milhões em financiamento na segunda-feira. A empresa visa abordar um desafio crítico que muitas organizações logo enfrentarão ao integrar agentes de
Microsoft e Mistral firmam parceria europeia de IA no valor de vários bilhões de dólares
No cerne dessa colaboração está um acordo de vários bilhões de dólares destinado a fortalecer a infraestrutura de inteligência artificial em toda a Europa. Crédito: MicrosoftA Microsoft e a Mistral, u





Lar






