opção
JoseGonzalez
JoseGonzalez
16 de Setembro de 2026

A iFLYTEK lançou o Spark-Audio-1.0-Preview, um modelo de base de fala totalmente nacional, treinado com computação local. Ele suporta entrada de texto e fala com saída de texto, realizando transcrição, tradução e reconhecimento de dialetos em 99 idiomas e 202 dialetos. O modelo vai além da conversão básica, oferecendo compreensão profunda de áudio, com funcionalidades de identificação de locutor, análise de emoções e reconhecimento de sons ambientais. Atualmente, está disponível para experiência pública, com acesso à API em breve por meio da Plataforma Aberta da iFLYTEK.

Comentários (0)
0/300
OR