option
Maison
Flash info
Contenu
TerryYoung
TerryYoung
30 mars 2026

Microsoft a mis en open source ses modèles d'IA VibeVoice destinés à la reconnaissance vocale et à la synthèse vocale. La suite comprend VibeVoice-ASR-7B pour la transcription d'enregistrements audio d'une heure, VibeVoice-TTS-1.5B pour la génération de dialogues impliquant plusieurs locuteurs d'une durée maximale de 90 minutes, ainsi qu'un modèle de synthèse vocale en temps réel avec un temps de latence de 300 ms. Publiée sous licence MIT, cette suite prend en charge le déploiement local et vise à faire progresser l'innovation en matière de synthèse vocale.

Microsoft a mis en open source ses modèles d'IA VibeVoice destinés à la reconnaissance vocale et à la synthèse vocale. La suite comprend VibeVoice-ASR-7B pour la transcription d'enregistrements audio d'une heure, VibeVoice-TTS-1.5B pour la génération de dialogues impliquant plusieurs locuteurs d'une durée maximale de 90 minutes, ainsi qu'un modèle de synthèse vocale en temps réel avec un temps de latence de 300 ms. Publiée sous licence MIT, cette suite prend en charge le déploiement local et vise à faire progresser l'innovation en matière de synthèse vocale.
commentaires (0)
0/300
OR