Qwen lanza Fun-ASR-Realtime, un modelo de reconocimiento de voz en tiempo real cuya latencia para el primer carácter es inferior a 100 ms y cuya precisión compite con la de los modelos sin conexión. Este modelo admite 30 idiomas y 16 dialectos chinos, lo que permite mejorar las funciones de asistentes de voz y las herramientas de reuniones para desarrolladores.





Hogar
