「SkyReels V4」が世界の動画ランキングで首位に、中国のAI映像・音声技術が世界トップクラスに
Kunlun Wanyiの「SkyReels V4」(同社の「TianGong AI」大規模モデルファミリーの一員)は、Artificial Analysisの「テキストから動画(音声付き)」部門において、世界1位を獲得しました。 その性能は、Kling 3.0、Google Veo 3.1、Vidu Q3、OpenAI Sora 2といった主流モデルを大幅に上回り、現在、動画生成において世界最強のAI大規模モデルとしての地位を確立しました。

中核となる技術的ブレークスルー:フルモーダル強化学習と論理的推論
SkyReels V4は、動画生成における一貫性と物語の論理性という長年の課題に対処する、2つの中核的なアーキテクチャ革新を導入しています:
強化学習システム(RL):フルモーダルな意味的報酬モデルを構築し、段階的な学習カリキュラムに従うことで、システムはモデルに論理的推論能力を付与し、1080p解像度で15秒間の商用レベルのロングシーケンス動画生成を可能にします。
高度な参照タスク:「キーフレーム参照」と「グリッドマップ参照」という新機能が追加されました。前者はキーノード間の整合性のあるシーンを正確に推論し、後者はユーザーが複数のストーリー画像をアップロードできるようにすることで、短編映画制作全体を通じてキャラクターの特徴やシーンのスタイルの一貫性を確保します。
このトップランクの評価を受け、SkyReels V4 APIはあらゆるシナリオで正式に利用可能となり、モデルのコア機能への完全なアクセスが提供されます:
全機能の網羅:テキストから動画、画像から動画、マルチモーダル参照生成、動画編集・修復、さらには音声と映像の連動生成などが含まれます。
低ハードルでの活用:EC、教育、コンテンツプラットフォーム、開発チームは、多額の研究開発投資を行うことなく、世界トップクラスの視聴覚生成機能を直接活用できます。
Kunlun Wanyiはこれまで、SkyReelsシリーズにおいて複数のモデルをリリースし、オープンソース化してきました。 V1の「人間主導の生成」から、V2の「長編動画生成」、そして今回のV4における音声・映像の同期と論理的表現における包括的なブレークスルーに至るまで、SkyReelsファミリーは「生成できる」ことから「質の高い生成」へと明確な進化を遂げています。
本発表に併せて、「SkyReels V4」の技術レポートも公開されました。開発者は公式プラットフォームを通じてAPIドキュメントにアクセスし、ビジネスへの統合を開始できます。この画期的な成果は、映像・音声コンテンツ生成という垂直分野において、中国のAIが世界的なリーダーシップの地位を確立したことを示しています。
関連記事
ユーザーからの反発を受け、MetaはAI写真編集機能を削除
Meta、ソーシャルメディアの巨人は、人工知能とユーザープライバシーの微妙なバランスをめぐる公的な論争に再び巻き込まれている。TechCrunch によると、Meta の Superintelligence Labs は今週初めに新しい AI 画像ジェネレーター「Muse Image」を導入した。しかし、ユーザーが「@」記号でタグ付けすることで、公開されている Instagram アカウントから画像を修正・生成できるという、高い評価を受けた主要機能は、適切な通知メカニズムの欠如により、ユーザー
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン
関連特集おすすめ
コメント (0)
0/500
Kunlun Wanyiの「SkyReels V4」(同社の「TianGong AI」大規模モデルファミリーの一員)は、Artificial Analysisの「テキストから動画(音声付き)」部門において、世界1位を獲得しました。 その性能は、Kling 3.0、Google Veo 3.1、Vidu Q3、OpenAI Sora 2といった主流モデルを大幅に上回り、現在、動画生成において世界最強のAI大規模モデルとしての地位を確立しました。

中核となる技術的ブレークスルー:フルモーダル強化学習と論理的推論
SkyReels V4は、動画生成における一貫性と物語の論理性という長年の課題に対処する、2つの中核的なアーキテクチャ革新を導入しています:
強化学習システム(RL):フルモーダルな意味的報酬モデルを構築し、段階的な学習カリキュラムに従うことで、システムはモデルに論理的推論能力を付与し、1080p解像度で15秒間の商用レベルのロングシーケンス動画生成を可能にします。
高度な参照タスク:「キーフレーム参照」と「グリッドマップ参照」という新機能が追加されました。前者はキーノード間の整合性のあるシーンを正確に推論し、後者はユーザーが複数のストーリー画像をアップロードできるようにすることで、短編映画制作全体を通じてキャラクターの特徴やシーンのスタイルの一貫性を確保します。
このトップランクの評価を受け、SkyReels V4 APIはあらゆるシナリオで正式に利用可能となり、モデルのコア機能への完全なアクセスが提供されます:
全機能の網羅:テキストから動画、画像から動画、マルチモーダル参照生成、動画編集・修復、さらには音声と映像の連動生成などが含まれます。
低ハードルでの活用:EC、教育、コンテンツプラットフォーム、開発チームは、多額の研究開発投資を行うことなく、世界トップクラスの視聴覚生成機能を直接活用できます。
Kunlun Wanyiはこれまで、SkyReelsシリーズにおいて複数のモデルをリリースし、オープンソース化してきました。 V1の「人間主導の生成」から、V2の「長編動画生成」、そして今回のV4における音声・映像の同期と論理的表現における包括的なブレークスルーに至るまで、SkyReelsファミリーは「生成できる」ことから「質の高い生成」へと明確な進化を遂げています。
本発表に併せて、「SkyReels V4」の技術レポートも公開されました。開発者は公式プラットフォームを通じてAPIドキュメントにアクセスし、ビジネスへの統合を開始できます。この画期的な成果は、映像・音声コンテンツ生成という垂直分野において、中国のAIが世界的なリーダーシップの地位を確立したことを示しています。
ユーザーからの反発を受け、MetaはAI写真編集機能を削除
Meta、ソーシャルメディアの巨人は、人工知能とユーザープライバシーの微妙なバランスをめぐる公的な論争に再び巻き込まれている。TechCrunch によると、Meta の Superintelligence Labs は今週初めに新しい AI 画像ジェネレーター「Muse Image」を導入した。しかし、ユーザーが「@」記号でタグ付けすることで、公開されている Instagram アカウントから画像を修正・生成できるという、高い評価を受けた主要機能は、適切な通知メカニズムの欠如により、ユーザー
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン





家






