Option
Heim
Eilmeldung
Inhalt
ThomasAllen
ThomasAllen
6. Mai 2026

Inworld AI stellt über seine API-Vorschau das Echtzeit-Sprachmodell „TTS-2“ vor. Das geschlossene System verarbeitet Live-Audio, um den Tonfall und die Emotionen des Nutzers zu erkennen und so natürlichere Gespräche zu ermöglichen. Zu den wichtigsten Funktionen zählen Sprachansagen über Eingabeaufforderungen, Dialogverständnis, sprachübergreifende Unterstützung mit einheitlicher Stimmidentität sowie textbasiertes Sprachdesign ohne Audio-Samples.

Inworld AI stellt über seine API-Vorschau das Echtzeit-Sprachmodell „TTS-2“ vor. Das geschlossene System verarbeitet Live-Audio, um den Tonfall und die Emotionen des Nutzers zu erkennen und so natürlichere Gespräche zu ermöglichen. Zu den wichtigsten Funktionen zählen Sprachansagen über Eingabeaufforderungen, Dialogverständnis, sprachübergreifende Unterstützung mit einheitlicher Stimmidentität sowie textbasiertes Sprachdesign ohne Audio-Samples.
Kommentare (0)
0/300
OR