opção
ThomasAllen
ThomasAllen
6 de Maio de 2026

A Inworld AI lança o modelo de voz TTS-2 em tempo real por meio de suas versões prévias da API. O sistema de circuito fechado processa áudio ao vivo para detectar o tom e a emoção do usuário, visando conversas mais naturais. Os principais recursos incluem instruções de voz por meio de prompts, reconhecimento de diálogo, suporte multilíngue com identidade de voz consistente e design de voz baseado em texto, sem a necessidade de amostras de áudio.

A Inworld AI lança o modelo de voz TTS-2 em tempo real por meio de suas versões prévias da API. O sistema de circuito fechado processa áudio ao vivo para detectar o tom e a emoção do usuário, visando conversas mais naturais. Os principais recursos incluem instruções de voz por meio de prompts, reconhecimento de diálogo, suporte multilíngue com identidade de voz consistente e design de voz baseado em texto, sem a necessidade de amostras de áudio.
Comentários (0)
0/300
OR