opción
Hogar
Última hora
Contenido
GregoryRodriguez
GregoryRodriguez
16 de septiembre de 2026

Google lanzó Gemini 3.8 Live y Extended Thinking, lo que permite el procesamiento de voz casi en tiempo real mediante llamadas de API en segundo plano y la detección automática de 97 idiomas. Los modelos admiten multitarea continua, integrando la voz con el razonamiento y la ejecución de herramientas sin pausas por parte del usuario. Entre los destacados de rendimiento se encuentran los primeros puestos en pruebas de calidad de voz. Integrados en plataformas como Agora y LiveKit, los modelos cuentan con marcas de agua de audio SynthID para la identificación de IA, lo que avanza hacia interacciones de agentes inteligentes y continuas en el ámbito de la voz artificial.

Google lanzó Gemini 3.8 Live y Extended Thinking, lo que permite el procesamiento de voz casi en tiempo real mediante llamadas de API en segundo plano y la detección automática de 97 idiomas. Los modelos admiten multitarea continua, integrando la voz con el razonamiento y la ejecución de herramientas sin pausas por parte del usuario. Entre los destacados de rendimiento se encuentran los primeros puestos en pruebas de calidad de voz. Integrados en plataformas como Agora y LiveKit, los modelos cuentan con marcas de agua de audio SynthID para la identificación de IA, lo que avanza hacia interacciones de agentes inteligentes y continuas en el ámbito de la voz artificial.
comentario (0)
0/300
OR