вариант
Дом
Срочные новости
Содержание
GaryPerez
GaryPerez
16 сентября 2026 г.

iFLYTEK представила Spark-Audio-1.0-Preview, речевую базовую модель, обученную на полностью отечественных вычислительных мощностях. В отличие от традиционных каскадных систем, преобразующих речь в текст, эта модель напрямую понимает аудио, улавливая семантику, эмоции и звуки окружающей среды. Модель построена с использованием 0,65B аудиокодировщика и 30B-A3B LLM, поддерживает 99 языков и 202 диалекта. Она превосходит конкурентов в шумных сценариях и достигает SOTA в распознавании китайско-английских пар. Модель позволяет выполнять такие задачи, как анализ тональности и сложные вопросы и ответы, что знаменует переход от транскрипции к настоящему пониманию аудио. Доступ по API будет предоставлен через платформу iFLYTEK Open Platform.

iFLYTEK представила Spark-Audio-1.0-Preview, речевую базовую модель, обученную на полностью отечественных вычислительных мощностях. В отличие от традиционных каскадных систем, преобразующих речь в текст, эта модель напрямую понимает аудио, улавливая семантику, эмоции и звуки окружающей среды. Модель построена с использованием 0,65B аудиокодировщика и 30B-A3B LLM, поддерживает 99 языков и 202 диалекта. Она превосходит конкурентов в шумных сценариях и достигает SOTA в распознавании китайско-английских пар. Модель позволяет выполнять такие задачи, как анализ тональности и сложные вопросы и ответы, что знаменует переход от транскрипции к настоящему пониманию аудио. Доступ по API будет предоставлен через платформу iFLYTEK Open Platform.
OR