オプション
速報
コンテンツ
JoseGonzalez
JoseGonzalez
2026年9月16日

科大訊飛は、国内の計算資源を用いて訓練された完全な国産音声基盤モデル「Spark-Audio-1.0-Preview」をリリースしました。このモデルはテキストおよび音声の入力に対してテキスト出力をサポートし、99言語および202つの方言における文字起こし、翻訳、方言認識を処理します。本モデルは基本的な変換を超えて高度な音声理解に進化しており、話者識別、感情分析、環境音認識の機能を備えています。現在、一般公開された体験版として利用可能であり、APIアクセスは近日中に科大訊飛のオープンプラットフォームを通じて提供される予定です。

コメント (0)
0/300
OR