ElevenLabsが音声認識の新たなベンチマークを樹立、Google Geminiが幅広い機能を備えてこれに続く
Artificial Analysisは、音声認識ベンチマーク「AA-WER v2.0」の最新版を公開した。その結果、音声文字変換性能においてElevenLabsとGoogleが圧倒的なトップに立っていることが明らかになった。

主要指標である単語誤り率(WER)で測定したところ、ElevenLabsの「Scribe v2」が2.3%という驚異的な低誤り率を記録し、首位に立った。これに僅差でGoogleの「Gemini3Pro 」が2.9%で続いた。特筆すべきは、GoogleがGeminiを文字起こし用に微調整していない点であり、この結果は同モデルの堅牢なマルチモーダル汎用能力に由来するものである。
その他の主要モデルの結果は以下の通りです:
Mistral Voxtral Small:3.0%の誤り率で3位となった。
Google Gemini3Flash:3.1%の誤り率で堅実なパフォーマンスを示した。
OpenAI Whisper Large v3:最も広く利用されているオープンソースモデルで、誤り率4.2%という結果で中位につけた。
最下位グループ:AlibabaのQwen3ASRFlash(5.9%)、AmazonのNova2Omni(6.0%)、Rev AI(6.1%)がランキングの下位を占めました。

音声アシスタントコマンド専用のAA-AgentTalkベンチマークにおいても、順位は変わらなかった。ElevenLabsのScribe v2とGoogleのGemini3Proは、それぞれ1.6%と 1.7%の誤認識率で首位を維持し、短く直接的な音声対話において高い信頼性を示した。
関連記事
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン
カリフォルニア州の自動運転車規制:違反切符、ジオフェンス、そして100万マイルという新たな時代
Guident社は南フロリダでAuveTechのシャトルを運行しており、同社の遠隔監視技術を活用して、ウェストパームビーチでの4マイルのルートとボカラトンでの1マイルのルートを管理している。 | 提供:Guidentカリフォルニア州は、自動運転車の規制環境を再定義しつつあり、テクノロジー業界の「迅速に動き、失敗を恐れない」という考え方から、厳格な説明責任と厳しい走行距離要件へと移行している。Gui
関連特集おすすめ
コメント (1)
0/500
Artificial Analysisは、音声認識ベンチマーク「AA-WER v2.0」の最新版を公開した。その結果、音声文字変換性能においてElevenLabsとGoogleが圧倒的なトップに立っていることが明らかになった。

主要指標である単語誤り率(WER)で測定したところ、ElevenLabsの「Scribe v2」が2.3%という驚異的な低誤り率を記録し、首位に立った。これに僅差でGoogleの「Gemini3Pro 」が2.9%で続いた。特筆すべきは、GoogleがGeminiを文字起こし用に微調整していない点であり、この結果は同モデルの堅牢なマルチモーダル汎用能力に由来するものである。
その他の主要モデルの結果は以下の通りです:
Mistral Voxtral Small:3.0%の誤り率で3位となった。
Google Gemini3Flash:3.1%の誤り率で堅実なパフォーマンスを示した。
OpenAI Whisper Large v3:最も広く利用されているオープンソースモデルで、誤り率4.2%という結果で中位につけた。
最下位グループ:AlibabaのQwen3ASRFlash(5.9%)、AmazonのNova2Omni(6.0%)、Rev AI(6.1%)がランキングの下位を占めました。

音声アシスタントコマンド専用のAA-AgentTalkベンチマークにおいても、順位は変わらなかった。ElevenLabsのScribe v2とGoogleのGemini3Proは、それぞれ1.6%と 1.7%の誤認識率で首位を維持し、短く直接的な音声対話において高い信頼性を示した。
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン





家






