出来事の日付:2026年8月1日

ByteDanceのSeed研究チームは、より長い音声付き映像シーケンスと、参照素材を活用した制作について、クリエイターにより大きな制御力を与えるよう設計された新たな動画生成モデル、Seedance 2.5を発表した。同社によると、このモデルはJimeng AIとDoubao Proを通じて順次提供されており、BytePlus ModelArk API経由でのアクセスは後日予定されている。

今回のリリースでは、1回の生成で作れる最長時間が15秒から30秒に延長された。ByteDanceによると、利用者は既存の生成結果を複数回にわたって延長することもでき、登場人物、舞台設定、テンポを維持しながら数分間の動画を組み立てられる。同社は、この連続性により、物語を短いクリップに分割し、結合後に切り替わりを修正する手作業を減らせるとしている。

Seedance 2.5は、Seedance 2.0で導入された音声・映像の統合アーキテクチャを基盤としている。ByteDanceによると、新モデルは、単一の場面を持続させるだけでなく、相互に関連する複数のショットを1回の生成内で構成することを目的としている。発表資料では、導入、展開、結末を備えたシーケンスのほか、被写体や場所の間を移動するカメラワークが実演されている。

このモデルでは、クリエイターが提供できる参照素材の量も拡大された。同社によると、1回のリクエストに最大30枚の画像、10本の動画クリップ、10本の音声クリップを含められる。これらの入力によって、被写体、動き、映像表現、音響を誘導できる。ByteDanceは、対応する制御方法として、粘土表現のレンダリング用参照素材や、より一般的な創作用参照素材を強調し、入力素材の拡充によって複数の場面にまたがるアイデアをより適切に伝えられると主張した。

編集も今回の更新の重点の一つだ。Seedance 2.5はタイムスタンプに連動した制御機能を備え、生成された音声または映像の特定の瞬間を利用者が指定できる。同社はまた、グリーンスクリーン作業、カメラ視点の変更、参照素材に基づく編集を改善された機能として挙げ、映画や広告を業務用途の候補として提示した。

ByteDanceは、画像、動き、音声の品質が向上し、場面転換がより滑らかになり、音声と映像の同期も一層緊密になったと説明した。これらの評価は開発元自身の発表に基づくもので、提示された証拠には独立したベンチマークや比較評価は含まれていない。このため、数分にわたる延長の実用上の一貫性と、詳細な編集の信頼性は、選定された実演以外でのテストに左右される。

今回の発表は、生成動画が孤立したクリップの制作から、エンドツーエンドの創作ワークフローの支援へと移行する、より広範な変化を反映している。連続性には映像上の被写体だけでなく、声、効果音、タイミングも関わるため、一体化された音声生成はこの提案にとって重要だ。Seedance 2.5についてByteDanceが掲げる中心的な主張は、単に出力が長くなったことではなく、共通の音声・映像表現を維持しながら、クリエイターが生成、参照素材、延長、局所的な編集を組み合わせられるという点にある。