Hogar
Qwen3.8-LiveTranslate lanza un modelo de traducción en tiempo real con una demora de 2,3 segundos
Qwen3.8-LiveTranslate, el último modelo de traducción de voz en tiempo real de Alibaba Qwen, redefine la interpretación simultánea mediante su arquitectura unificada Interleave. Esta innovación mejora la precisión, la fluidez y la concisión, reduciendo la latencia promedio por carácter (LAAL) de 2,8 a 2,3 segundos, una mejora crítica de 0,5 segundos que garantiza una experiencia de escucha natural en un campo donde incluso un ligero retraso puede interrumpir el flujo.
Ampliando el soporte para 60 idiomas, el modelo actualizado introduce tres mejoras prácticas para la interpretación en tiempo real. En primer lugar, admite la separación de hablantes en tiempo real, asignando con precisión cada frase al hablante correcto mientras mantiene una clonación de voz estable, evitando así cruces de voz o confusión entre hablantes. En segundo lugar, muestra el texto original y la traducción lado a lado, lo que permite a los oyentes seguir visualmente el contenido mientras escuchan la traducción. En tercer lugar, mejora la desambiguación de contextos largos, permitiendo que el modelo utilice el contexto previo para aumentar la precisión, especialmente en nombres y terminología especializada, que son puntos comunes de error.

En su núcleo, Qwen3.8-LiveTranslate emplea un diseño de doble módulo Pensador–Hablante basado en MoE híbrido. El mecanismo Interleave integra sin problemas la comprensión en streaming, la generación de texto y la síntesis de voz en una única canalización. El Pensador procesa el video, el audio, el texto original y las salidas de traducción en una secuencia causal unificada, ordenándolos cronológicamente para producir resultados de extremo a extremo que manejan simultáneamente la «comprensión» y la «traducción». El Hablante convierte luego el texto traducido, guiado por el audio original, en voz que preserva la identidad vocal del hablante original.

Artículo relacionado
El parlamentario británico critica a xAI por permitir la difusión de deepfakes de pornografía infantil en Grok
El diputado del Partido Laborista británico, Jess Asato, ha iniciado acciones legales contra la empresa de inteligencia artificial de Elon Musk, xAI, en el Tribunal Superior del Reino Unido, alegando que su plataforma Grok fue utilizada para generar
OpenAI presenta un filtro de privacidad para contexto de 128K con ocho modos de reconocimiento
OpenAI ha presentado Privacy Filter, un modelo de anonimización de información de identificación personal (PII) de última generación. Ahora disponible bajo la licencia Apache 2.0 en Hugging Face y GitHub, esta herramienta proporciona a los desarrolla
NewCore recauda 66 millones de dólares para dotar a los agentes de IA de identidades a medida que pasan a desempeñar funciones de empleados
La startup de ciberseguridad NewCore ha salido oficialmente del anonimato, asegurando 66 millones de dólares en financiación el lunes. La empresa tiene como objetivo abordar un desafío crítico que muchas organizaciones pronto enfrentarán al integrar
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Qwen3.8-LiveTranslate, el último modelo de traducción de voz en tiempo real de Alibaba Qwen, redefine la interpretación simultánea mediante su arquitectura unificada Interleave. Esta innovación mejora la precisión, la fluidez y la concisión, reduciendo la latencia promedio por carácter (LAAL) de 2,8 a 2,3 segundos, una mejora crítica de 0,5 segundos que garantiza una experiencia de escucha natural en un campo donde incluso un ligero retraso puede interrumpir el flujo.
Ampliando el soporte para 60 idiomas, el modelo actualizado introduce tres mejoras prácticas para la interpretación en tiempo real. En primer lugar, admite la separación de hablantes en tiempo real, asignando con precisión cada frase al hablante correcto mientras mantiene una clonación de voz estable, evitando así cruces de voz o confusión entre hablantes. En segundo lugar, muestra el texto original y la traducción lado a lado, lo que permite a los oyentes seguir visualmente el contenido mientras escuchan la traducción. En tercer lugar, mejora la desambiguación de contextos largos, permitiendo que el modelo utilice el contexto previo para aumentar la precisión, especialmente en nombres y terminología especializada, que son puntos comunes de error.

En su núcleo, Qwen3.8-LiveTranslate emplea un diseño de doble módulo Pensador–Hablante basado en MoE híbrido. El mecanismo Interleave integra sin problemas la comprensión en streaming, la generación de texto y la síntesis de voz en una única canalización. El Pensador procesa el video, el audio, el texto original y las salidas de traducción en una secuencia causal unificada, ordenándolos cronológicamente para producir resultados de extremo a extremo que manejan simultáneamente la «comprensión» y la «traducción». El Hablante convierte luego el texto traducido, guiado por el audio original, en voz que preserva la identidad vocal del hablante original.

El parlamentario británico critica a xAI por permitir la difusión de deepfakes de pornografía infantil en Grok
El diputado del Partido Laborista británico, Jess Asato, ha iniciado acciones legales contra la empresa de inteligencia artificial de Elon Musk, xAI, en el Tribunal Superior del Reino Unido, alegando que su plataforma Grok fue utilizada para generar
OpenAI presenta un filtro de privacidad para contexto de 128K con ocho modos de reconocimiento
OpenAI ha presentado Privacy Filter, un modelo de anonimización de información de identificación personal (PII) de última generación. Ahora disponible bajo la licencia Apache 2.0 en Hugging Face y GitHub, esta herramienta proporciona a los desarrolla
NewCore recauda 66 millones de dólares para dotar a los agentes de IA de identidades a medida que pasan a desempeñar funciones de empleados
La startup de ciberseguridad NewCore ha salido oficialmente del anonimato, asegurando 66 millones de dólares en financiación el lunes. La empresa tiene como objetivo abordar un desafío crítico que muchas organizaciones pronto enfrentarán al integrar











