Black Forest Labsは、動画生成AIプラットフォームにおける最新モデル「Flux 3」を発表しました。本モデルは最大20秒の動画生成に対応しており、映像と同時にネイティブ音声を生成できる点が大きな特徴です。
Flux 3の最大の特徴は、動画生成プロセスにおいて映像と連動した音声を同時に出力する機能です。従来、動画生成AIでは音声を後から生成または合成するプロセスが必要でしたが、本モデルはネイティブでの音声生成を統合しており、最長20秒までの動画制作を単一のワークフローで完結させることが可能です。
Black Forest Labsによると、動画生成AIにおいてネイティブ音声生成を実装するのは本モデルが業界初となります。この技術的アプローチにより、映像の内容と整合性の取れた音響効果を自動的に構築でき、動画制作におけるワークフローの効率化と品質向上が期待されます。
Black Forest Labsは、Flux 3の投入により、既存の画像および動画生成市場におけるソリューションを強化します。詳細は今後、同社の公式プラットフォームを通じて順次公開される予定です。