option
Maison
Flash info
Contenu
JoseGonzalez
JoseGonzalez
16 septembre 2026

iFLYTEK a lancé Spark-Audio-1.0-Preview, un modèle de base pour la parole entièrement développé en Chine, entraîné sur des infrastructures de calcul locales. Il prend en charge les entrées textuelles et vocales avec une sortie textuelle, gérant la transcription, la traduction et la reconnaissance des dialectes dans 99 langues et 202 dialectes. Le modèle va au-delà de la simple conversion pour offrir une compréhension audio approfondie, avec des fonctionnalités telles que l’identification des locuteurs, l’analyse des émotions et la reconnaissance des sons environnementaux. Il est actuellement disponible pour une expérience publique, et l’accès par API sera bientôt proposé via la plateforme ouverte d’iFLYTEK.

commentaires (0)
0/300
OR