Дом
ElevenLabs устанавливает новый рекорд в области преобразования речи в текст; Google Gemini следует за ним, предлагая широкий спектр возможностей
Компания Artificial Analysis выпустила новую версию своего теста производительности систем преобразования речи в текст — AA-WER v2.0. Результаты тестирования показывают, что ElevenLabs и Google являются явными лидерами по эффективности транскрипции аудиозаписей.

По показателю коэффициента ошибок по ключевым словам (WER) первое место заняла система Scribe v2 от ElevenLabs с впечатляюще низким показателем ошибок — 2,3%. С небольшим отрывом за ней следует система Gemini3Pro от Google с показателем 2,9%. Стоит отметить, что Google не проводила точную настройку Gemini для транскрипции; этот результат обусловлен исключительно ее надежными мультимодальными общими возможностями.
Другие ведущие модели показали следующие результаты:
Mistral Voxtral Small: заняла третье место с показателем ошибок 3,0%.
Google Gemini3Flash: продемонстрировал стабильную производительность с показателем ошибок 3,1%.
OpenAI Whisper Large v3: самая широко используемая модель с открытым исходным кодом заняла место в середине рейтинга с показателем ошибок 4,2%.
Наименее эффективные модели: Qwen3ASR Flash от Alibaba (5,9%), Nova2Omni от Amazon (6,0%) и Rev AI (6,1%) заняли последние места в рейтинге.

В специальном тесте AA-AgentTalk для команд голосовых помощников лидеры остались прежними. Scribe v2 от ElevenLabs и Gemini3Pro от Google сохранили лидерство с показателями ошибок 1,6% и 1,7% соответственно, продемонстрировав высокую надежность при коротких и прямых голосовых взаимодействиях.
Связанная статья
Индийский технологический магнат инвестирует $30 млн в ИИ-аналог Microsoft Office
Серийный предприниматель Бхавин Турахия инвестирует $30 млн собственных средств, делая ставку на то, что сектор корпоративного искусственного интеллекта всё ещё имеет место для новых игроков. Его последний стартап, Neo, основан на ключевой идее: уста
Бывший главный научный сотрудник OpenAI Илья представляет SSI и раскрывает первую модель
Искусственный интеллект достиг еще одной важной вехи. После своего ухода из OpenAI бывший главный научный сотрудник Илья Сутскер основал компанию Safe Superintelligence Inc. (SSI), которая недавно раскрыла детали своей первой модели. Сообщения в зару
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
14 мая 2026 года платформа разработки приложений на базе искусственного интеллекта Lovable объявила о своем участии в раундеSeed-финансирования на сумму $800 000 для датского стартапа в области аппаратного обеспечения Atech. При ведущем участии Lovab
Рекомендации по связанным специальным темам
Комментарии (1)
Компания Artificial Analysis выпустила новую версию своего теста производительности систем преобразования речи в текст — AA-WER v2.0. Результаты тестирования показывают, что ElevenLabs и Google являются явными лидерами по эффективности транскрипции аудиозаписей.

По показателю коэффициента ошибок по ключевым словам (WER) первое место заняла система Scribe v2 от ElevenLabs с впечатляюще низким показателем ошибок — 2,3%. С небольшим отрывом за ней следует система Gemini3Pro от Google с показателем 2,9%. Стоит отметить, что Google не проводила точную настройку Gemini для транскрипции; этот результат обусловлен исключительно ее надежными мультимодальными общими возможностями.
Другие ведущие модели показали следующие результаты:
Mistral Voxtral Small: заняла третье место с показателем ошибок 3,0%.
Google Gemini3Flash: продемонстрировал стабильную производительность с показателем ошибок 3,1%.
OpenAI Whisper Large v3: самая широко используемая модель с открытым исходным кодом заняла место в середине рейтинга с показателем ошибок 4,2%.
Наименее эффективные модели: Qwen3ASR Flash от Alibaba (5,9%), Nova2Omni от Amazon (6,0%) и Rev AI (6,1%) заняли последние места в рейтинге.

В специальном тесте AA-AgentTalk для команд голосовых помощников лидеры остались прежними. Scribe v2 от ElevenLabs и Gemini3Pro от Google сохранили лидерство с показателями ошибок 1,6% и 1,7% соответственно, продемонстрировав высокую надежность при коротких и прямых голосовых взаимодействиях.
Индийский технологический магнат инвестирует $30 млн в ИИ-аналог Microsoft Office
Серийный предприниматель Бхавин Турахия инвестирует $30 млн собственных средств, делая ставку на то, что сектор корпоративного искусственного интеллекта всё ещё имеет место для новых игроков. Его последний стартап, Neo, основан на ключевой идее: уста
Бывший главный научный сотрудник OpenAI Илья представляет SSI и раскрывает первую модель
Искусственный интеллект достиг еще одной важной вехи. После своего ухода из OpenAI бывший главный научный сотрудник Илья Сутскер основал компанию Safe Superintelligence Inc. (SSI), которая недавно раскрыла детали своей первой модели. Сообщения в зару
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
14 мая 2026 года платформа разработки приложений на базе искусственного интеллекта Lovable объявила о своем участии в раундеSeed-финансирования на сумму $800 000 для датского стартапа в области аппаратного обеспечения Atech. При ведущем участии Lovab











