Black Forest Labsは、自己教師ありのフローフレームワークを通じて画像、動画、音声の学習を統合したマルチモーダル基盤モデル「FLUX3」を早期アクセス版としてリリースしました。このモデルは、ネイティブ音声付きの最大20秒間の動画を生成し、テキストから動画への変換や画像から動画への変換などをサポートしています。 ベンチマークテストにおいて、FLUX3はGrok Imagine Videoに対して69%、Seedance 2.0およびGemini Omni Flashに対して52%の勝率を達成し、ロボットの行動予測にも応用可能です。





家
