industryモデルとインサイト26分で読めます

Seedance 2.5で何がリリースされたか:2.0からの変更点を徹底解説

Seedance 2.5がOmniArtで利用可能になりました。1回30秒の生成、60秒までの動画延長、180秒の長尺動画、50件の参照素材、秒単位のタイムスタンプ制御まで、2.0からの変更点を整理します。

OmniArt チーム
Seedance 2.5で何がリリースされたか:2.0からの変更点を徹底解説

Seedance 2.5はOmniArtの動画ワークスペースから選択できるようになりました。バージョン番号から受ける印象よりも、はるかに大きなリリースです。Seedance 2.0は、画像・動画・音声・テキストをすべて1つのプロンプトに集約するというマルチモーダルの前提を確立しました。Seedance 2.5はその前提を引き継ぎながら、実運用で足かせになっていた2点を作り直しています。1回の生成をどれだけ長く回せるか、そしてモデルが実際にどれだけの参照素材を尊重できるか、という2点です。

本記事はプロンプトのチュートリアルではなく、機能の総まとめです。何が新しくなり、実際の上限がどこにあり、どこにまだ粗さが残っているのかを整理します。発表内容についてはSeedance 2.5リリース先取り解説でリリース前の情報をもとに取り上げましたが、正式リリースまでにいくつかの数値が変わりました。以下に挙げる解像度の数値が最終的な事実です。

メモ

以下の仕様はすべて、Dreamina公式のSeedance 2.5ローンチ文書および利用ガイドに基づいています。公式文書が絶対的な上限と推奨範囲を区別している箇所は、本記事でも同じように区別しています。見出しになる数値そのものよりも、この区別のほうが重要です。

Seedance 2.5とSeedance 2.0を一覧で比較

機能Seedance 2.0Seedance 2.5
1回の生成の長さ4〜15秒(97〜361フレーム)4〜30秒(97〜721フレーム)
1リクエストあたりの画像0〜9枚最大30枚
動画の延長非対応30秒以下の結果を繰り返し延長でき、合計60秒まで
長尺動画非対応30〜180秒を一度の生成で出力
タイムスタンプ制御非対応ネイティブ対応、秒単位の精度
生成モードOmni Reference、Smart Edit、Long Video、First and Last Frames
出力解像度480p、720p

4つのモードのうち2つは新規です。Smart Edit(スマート編集)とLong Video(長尺動画)は2.0には存在しませんでした。Smart Editにはさらに、Edit with marksという強化版の操作画面があります。アップロードした動画に矩形、ブラシ、矢印、テキスト、目印となる点で注釈を描き込めるもので、生成済みのクリップに同じ注釈ワークフローを適用するEdit Videoという派生機能も用意されています。

15秒を超えるための3つの方法

最も影響の大きい変更は、「どこまで長くできるか」という問いに3通りの答えができたことです。選択を誤ると、生成が1回無駄になります。

単発生成:4〜30秒

基本の範囲が2倍になりました。2.0では15秒・361フレームだったところ、1つのプロンプトで最大30秒・721フレームまで生成できます。公式文書は、この30秒全体にわたって時空間の整合性とカット間の一貫性が保たれるとしています。人物の見た目、空間的な辻褄、ショット同士のつなぎが、後半で崩れることなく最後まで維持されるという主張です。

動画の延長:入れ子式に合計60秒まで

30秒以下の生成結果は、新しいプロンプトを与えて延長できます。さらに、その延長結果をもう一度延長することも可能です。公式文書はこれを入れ子人形のような積み重ねと表現しており、累計の上限は60秒です。

面白いのは合計時間ではありません。延長のたびに新しい演出指示を出せる点です。公式文書はこれを分割された演出コントロールと呼んでいます。人物が走る場面をまず10秒生成して内容を確認し、次の延長でジャンプを指示する。動作全体を1回の送信に賭ける必要がなくなります。アクションの立ち回りや、特定のタイミングで決めたい物語の転換点では、長いプロンプトを書くのとはまったく別の作り方になります。

延長は前方にも後方にも実行できます。ショット全体を延長する場合、公式文書は連続性の制約を明示することを推奨しています。自然な延長、なめらかな動きの接続、ショットを不自然に断ち切らないこと、物体が何もないところから出現しないこと、の4点です。このワークフローはSeedance 2.5の動画編集・延長ガイドで詳しく解説しています。

Long Video:一度の生成で30〜180秒

Long Videoは独立したモードであり、通常モードの長さ設定を伸ばしたものではありません。つなぎ合わせも延長の連鎖もなく、30〜180秒を直接生成します。公式に掲げられた設計目標は、3分間を通した人物の特徴、衣装のディテール、シーンの空間構造の一貫性、そしてゆっくりとした寄り、旋回、通し撮りといった、長回しに耐える滑らかで長いカメラワークです。

3分の生成は失敗したときの代償が大きいため、公式の長尺動画向けプロンプト定型はグローバルパラメータから始まります。操作画面ですでに設定していても、長さとアスペクト比をプロンプトの冒頭で改めて書き直してください。

参照素材の予算:50件をどう配分するか

Seedance 2.5は1回のリクエストで最大50件の参照素材を受け付けます。この上限は3種類に分かれ、種類ごとに絶対的な上限と、それとは別の推奨範囲が定められています。

種類絶対的な上限推奨範囲
画像最大30枚、1枚あたり4K以下異なる被写体1〜8件。9〜12件も可能だが安定性は落ちる
動画最大10本、合計30秒異なる被写体1〜5件、被写体1件あたり5〜10秒。6〜10件も可能だが安定性は落ちる
音声最大10本、合計30秒そのショットに実際に必要な台詞、声、環境音、音楽だけ
動画編集元動画1本と参照画像元動画は20秒未満、参照画像1〜5枚。6〜8枚も可能

この2つの列の差こそが本質です。30枚はリクエストが受け付ける枚数であり、8件はモデルが確実に扱える被写体の数です。上限まで埋めることは戦略ではありません。公式文書は、複数の参照素材を使った制作とはシーンごとに正しい素材を選び取ることであって、すべての素材を一度に登場させることではない、と明言しています。

身につけておく価値のある実務ルールが1つあります。5件を超える被写体にそれぞれ複数のアングルが必要な場合は、アングルごとに別々の画像として用意してください。1枚にまとめたコラージュよりも、視点ごとに独立した画像のほうが安定します。

入力ファイルの条件も押さえておきましょう。画像はjpeg、png、webp、bmp、tiff、gif、heic、heifに対応し、アスペクト比は0.4〜2.5、寸法は300〜6000ピクセル、1枚あたり30MB未満、リクエスト全体は64MB未満です。参照動画はmp4またはmovで、480p〜4K、アスペクト比と寸法の条件は画像と同じです。

参照素材の並べ方と役割の割り当てについては、Seedance 2.5の参照素材プロンプトガイドを参照してください。

秒単位のタイムスタンプ制御

Seedance 2.5は、タイムスタンプによる展開とショット区間の制御にネイティブ対応しています。ショット、台詞、動作の前に[00.0-05]のようなマーカーを書き、その後を時間順に記述します。区間は連続していて、重なってはいけません。

公式文書の説明は誠実です。タイムスタンプの区間は、そのイベントに割り当てられた時間の予算であって、フレーム単位で正確な編集点ではありません。動作は区間の境目より少し前や少し後にずれることがあります。区間に対して内容が少なすぎるとモデルに望まない自由を与えてしまい、多すぎるとカットが過剰になったりイベントが欠落したりします。1秒間に3つの異なる動作を入れるといった頻度の要求は機能しません。

それでも正しく使えば、テンポを操作する手段としては最も強力です。30秒の複数ショット生成を、雰囲気の寄せ集めではなく脚本のように振る舞わせるのがタイムスタンプであり、Seedance 2.5の30秒動画プロンプトガイドで解説する手法の背骨でもあります。

多言語入力と台詞

Seedance 2.5は多くの言語のテキスト入力を受け付けますが、公式には2つの段階が示されています。最適化の優先度が最も高いのは中国語、英語、スペイン語、インドネシア語、マレー語です。対応範囲はさらに、タイ語、アラビア語、ポルトガル語、ベトナム語、日本語、韓国語まで広がります。

今回のリリースでは、発音の正確さ、珍しい単語の読み間違いの減少、多言語音声に対する口の動きの同期精度も改善の対象になっています。ローカライズした広告のバリエーションや、登場人物が異なる言語を話す短編を制作する人にとっては、この組み合わせが実用面での突破口です。指示は自分の言語で書き、台詞は目的の言語で指定し、口の形がそれに追従する、という組み合わせです。

基盤モデルの品質改善

2.5の内容は新しいボタンばかりではありません。リリースのかなりの部分は、公式文書が「AIっぽさを取り除く」と表現する目的での基盤モデルの作り直しに充てられています。

  • — プラスチックのような光沢とテカリを抑え、実際の毛穴と光の反応を取り戻しました。
  • 動物の毛 — 束になって固まるのではなく、ふんわりと1本ずつ分離するようになりました。
  • — 生成される台詞から、機械的な合成音声らしい音色が減りました。
  • 出現頻度の低い動き — 変わったダンス、複雑な武術、細かな表情の変化が、破綻せずに滑らかに生成されるようになりました。
  • 一貫性 — 30秒の生成全体で、時空間の論理とカットをまたいだ人物の連続性が保たれます。

プロンプト側で使える取っかかりは小さく具体的です。リアルさを出すなら「素の肌の質感」「髪の生え際が明瞭」といった表現を使い、カットをまたいだ一貫性を保つなら、人物設定の説明を全ショットで同じ文言のまま繰り返します。

字幕なし・BGMなしが、ようやく本当に効くようになりました

これは小さな修正ですが、制作現場への影響は大きい変更です。以前のバージョンは、プロンプトで禁止しても字幕を焼き付けたり、背景音楽を足したりしていました。Seedance 2.5はこの指示を守ります。公式が示す書き方は「pure video, no subtitles, no background music」のような修飾句です。

編集者やサウンドデザイナーに加工前の映像を渡す場合、これは使える出力と作り直しになる出力の分かれ目になります。

マルチモーダル参照機能の強化

リリースノートで最も分量が多いのは、参照素材まわりの機能群です。まとめて見ると、Seedanceを単なる生成器から、演出可能な編集環境に近いものへと押し上げています。

  • BGMの分離 — 話し声を残したまま背景音楽だけを取り除きます。しかも画面上の字幕やその他の視覚要素はそのまま保持されます。
  • 発想とカメラ言語の転写 — 表面的な体の動きだけでなく、参照素材の寄り・引き・パンの軌道、手持ちの揺れ、色の論理、感情的な空気感まで移植します。
  • 部分的な消去と編集 — ブラシや矩形で領域を指定して痕跡なく消去でき、背景は物理と光の論理に従って補完されます。指定した位置への要素の差し替えにも対応します。
  • 空間パースの変更 — 既存のショットを俯瞰、ローアングル、一人称視点に振り直しつつ、比率とレイアウトの整合性を保ちます。
  • 声質の参照 — 音色に加えて、参照した録音の感情の張り詰め方やリズムまで再現します。
  • 複数人物の参照 — 人物同士で顔の特徴が混ざらず、衣装が入れ替わらず、絡み合う場面でも前後の遮蔽関係が正しく表現されます。
  • グリーンバック — 動く背景に対してもフレーム単位で安定した、高精度の前景切り抜きができます。
  • Clay Renderer — MayaとBlender向けのブロックアウト・白モデル用プラグインです。カメラ言語を復元し、空間と構図を固定し、人物の位置と移動経路を制御します。
  • シームレストランジション — 2つの独立したクリップのどちらにも手を加えずに、その間をつなぐ映像を生成します。動作、視線、遮蔽をきっかけに、焦点距離、回転、飛び込みといったトランジションを使えます。
  • マルチグリッドのストーリーボード — 複数コマのストーリーボード画像を、展開の参照として入力できます。

このうち2つには、繰り返しておく価値のある注意点があります。Clay Rendererは現時点では、作り込んだ精細なモデルよりも粗いブロックアウトのほうが良い結果になります。単純な球、円柱、直方体が動きの骨格を与える形です。マルチグリッドのストーリーボードは、単純な線画か棒人間が最も相性がよく、コマ数は15以内、文字ラベルは最小限に抑えるのが理想です。どちらもSeedance 2.5のストーリーボード・ブロックアウトガイドで扱っています。

自動的に固定されるパラメータ

3つのタスク種別では、自分で設定できると思っている項目が自動的に上書きされます。送信前に知っておけば、無駄な生成を1回減らせます。

タスク種別アスペクト比長さ
動画編集入力動画の比率を引き継ぎ、個別に指定できません入力とほぼ同じ長さを引き継ぎ、個別に指定できません。入力フレームの処理により最大0.3秒程度ずれることがあります
最初のフレーム/最初と最後のフレーム最初の画像の比率を使用します指定できます
動画の延長入力動画の比率を引き継ぎ、個別に指定できません指定できます

最初と最後のフレームのルールには落とし穴があります。比率は最初の画像から決まるため、比率の異なる最後の画像を入れると引き伸ばされてしまいます。アップロード前に2枚の比率をそろえてください。

計画に織り込むべき制約

出力解像度は480pと720pです。これがリリース時点の上限であり、納品の判断に最も影響しやすい制約です。720pで作った3分の生成物は、3分のマスター素材とはまったく別物です。Seedance 2.5は事前ビジュアライゼーション、ソーシャル向けの納品、参照素材といった用途に位置づけ、長い生成に踏み切る前に納品仕様を確認してください。

公式文書は、いくつかの挙動上の限界についても率直です。

  • タイムスタンプはイベントに時間を割り当てるものであり、フレーム単位で正確な編集点ではありません。
  • 編集用のプロンプトは、重要なイベントが元動画と一致する確率を高めますが、フレーム単位の一致を保証するものではありません。
  • 動画編集の出力は、入力と最大0.3秒程度ずれることがあります。
  • 延長した区間は、元のクリップと音量がわずかに異なる場合があります。
  • シームレストランジションが目指すのは映像と音の連続性であり、ピクセル単位で一致するつなぎ目ではありません。
  • 延長部分の境界フレームは視覚的に自然につながりますが、ピクセル単位で同一ではありません。
  • 字幕、数式、看板の文字、製品仕様、フレーム単位で正確でなければならないタイミングについては、事前に用意した参照素材、生成、ポストプロダクションを組み合わせてください。

どれも致命的な欠点ではありません。これらは、Seedance 2.5を制作パイプラインの中の演出可能な生成器として扱うか、仕上げ用のツールとして扱うかの違いを示しています。後者ではない、というのが答えです。

OmniArtで始める

OmniArtの動画ワークスペースを開いてSeedance 2.5を選び、実際に習熟しやすい順番で新機能を試していきましょう。

  1. まずはタイムスタンプ付きの30秒生成を1本。 連続して重ならない区間を3つか4つ書き、テンポがどれだけ狙いどおりに決まるかを見てください。モデルのタイミングの癖は、これが一番早く身につきます。
  2. 次に延長を試します。 満足のいく10秒を生成し、新しい指示を与えて延長し、その結果をさらに延長します。つなぎ目と、各境界での音量を確認してください。
  3. 参照素材のセットは、絶対的な上限ではなく推奨範囲の中で組み立てます。 役割が1つずつ明確な被写体画像を数枚と、カメラ言語が必要なら短い参照動画を1本です。
  4. Long Videoは、短い長さですでに検証済みの内容にだけ使います。 未検証のプロンプトに3分を賭けるのは重すぎます。
  5. 編集者に渡す素材には必ず「pure video, no subtitles, no background music」を加えます。

すべてのSeedanceバージョンに共通するプロンプトの考え方は、Seedanceプロンプトの書き方から始めてください。そのうえで、自分の仕事に合うガイドを選びましょう。参照素材のプロンプト30秒動画のプロンプト動画編集と延長ストーリーボードとブロックアウトがあります。

制作を始めますか?

AIで魅力的なコンテンツを生成しましょう

無料で始める