Qwen lance Fun-ASR-Realtime, un modèle de reconnaissance vocale en temps réel dont le délai jusqu’au premier caractère est inférieur à 100 ms et dont la précision rivalise avec celle des modèles hors ligne. Il prend en charge 30 langues ainsi que 16 dialectes chinois, ce qui améliore les assistants vocaux et les outils de visioconférence destinés aux développeurs.





Maison
