opção
EdwardMoore
EdwardMoore
24 de Abril de 2026

A Xiaomi lança a série de modelos de voz full-stack MiMo-V2.5, que inclui três modelos de síntese de voz (TTS) capazes de reproduzir emoções, tons e controlar a voz por meio de comandos em linguagem natural, além de um modelo de reconhecimento de fala (ASR) de código aberto, robusto em ambientes ruidosos e multilíngues. Os modelos estão disponíveis gratuitamente com acesso limitado e em código aberto para acelerar o desenvolvimento do ecossistema de agentes.

A Xiaomi lança a série de modelos de voz full-stack MiMo-V2.5, que inclui três modelos de síntese de voz (TTS) capazes de reproduzir emoções, tons e controlar a voz por meio de comandos em linguagem natural, além de um modelo de reconhecimento de fala (ASR) de código aberto, robusto em ambientes ruidosos e multilíngues. Os modelos estão disponíveis gratuitamente com acesso limitado e em código aberto para acelerar o desenvolvimento do ecossistema de agentes.
Comentários (0)
0/300
OR