ByteDanceは、動画生成AIモデルの最新版「Seedance 2.5」を公開しました。本モデルは、最大30秒の長さの動画クリップを生成できるだけでなく、映像内容と同期した音声を統合的に生成する機能を備えています。
Seedance 2.5の最大の特徴は、映像と音声の同時生成機能です。従来の動画生成モデルでは映像生成後に別途音声生成が必要でしたが、本モデルではプロセスを統合し、より自然で一貫性のある動画コンテンツの作成を可能にしました。生成時間は最大30秒に達し、短尺動画プラットフォームにおけるクリエイターの作業効率化が期待されます。
動画生成における課題である「映像と音の同期」に対し、Seedance 2.5は統合的なモデルアーキテクチャを採用することで、視覚と聴覚の整合性を高めています。ByteDanceが運営するプラットフォーム上の膨大なマルチメディアデータが、モデルの学習基盤として活用されていると推察されます。
ByteDanceは本モデルのリリースを通じ、クリエイターがより高品質な動画を効率的に制作できる環境を整備しています。AIによる動画生成技術の進化は、コンテンツ制作のあり方を根本から変える可能性を秘めており、今後の機能拡張が注目されます。