opción
Hogar
Última hora
Contenido
EdwardMoore
EdwardMoore
24 de abril de 2026

Xiaomi lanza la serie de modelos de voz de pila completa MiMo-V2.5, que incluye tres modelos de síntesis de voz (TTS) que permiten controlar las emociones, el tono y la voz mediante comandos en lenguaje natural, así como un modelo de reconocimiento de voz (ASR) de código abierto que ofrece un rendimiento sólido en entornos ruidosos y multilingües. Los modelos están disponibles de forma gratuita con acceso limitado y en código abierto para acelerar el desarrollo del ecosistema de agentes.

Xiaomi lanza la serie de modelos de voz de pila completa MiMo-V2.5, que incluye tres modelos de síntesis de voz (TTS) que permiten controlar las emociones, el tono y la voz mediante comandos en lenguaje natural, así como un modelo de reconocimiento de voz (ASR) de código abierto que ofrece un rendimiento sólido en entornos ruidosos y multilingües. Los modelos están disponibles de forma gratuita con acceso limitado y en código abierto para acelerar el desarrollo del ecosistema de agentes.
comentario (0)
0/300
OR