Seedance 2.5 Reference-to-Video ガイド
Seedance 2.5 で image・video・audio リファレンスをどう組み合わせるかに絞った実践ガイドです。競合する制御を混ぜずに、reference-to-video を安定して回すための考え方をまとめています。

先に結論を言うと、1 枚の画像だけではショット全体を定義しきれないときに Seedance 2.5 の reference-to-video が効きます。被写体の同一性、モーション、タイミングをまとめて制御したいときに強いですが、各リファレンスが 1 つの役割だけを持っていることが前提です。まだ素材整理の段階なら China Video AI ホームページ から始めてください。テストに入るなら、Seedance 2.5 ワークスペース を開き、最小の有用パッケージで短いクリップを 1 本だけ回すのが正解です。
このガイドは Seedance 2.5 のリファレンス設計と人手レビューの回し方に絞っています。低コストな初回検証だけが目的なら Seedance 2 Mini reference-to-video チェックリスト を先に見てください。逆に、被写体・モーション・音声をもっと強く分離したいなら MiniMax H3 reference-to-video ガイド と比較する価値があります。モデル比較をするなら、中国 AI 動画モデルガイド、China Seedance ページ、1 枚の画像から AI 商品広告を作る方法 を並べて読むのが最もわかりやすいです。

簡単な答え: ビデオへの参照はパッケージ化の問題です
Seedance 2.5 の失敗のほとんどは、プロンプトの創造性の欠如が原因ではありません。これらは、参照パッケージが同時に解決しようとするジョブが多すぎるために発生します。 1 つの画像は被写体のアイデンティティを定義することになっており、1 つのモーション クリップはカメラのリズムを定義することになっており、1 つのオーディオ クリップはタイミングを定義することになっており、プロンプトはまだシーンを再設計しようとしています。各層があいまいな場合、モデルが一貫して動作している場合でも、結果はランダムに見えます。
Seedance 2.5 について考えるより良い方法は次のとおりです。ビデオへの参照は、プロンプトの問題になる前にパッケージ化の問題です。膨大な資産を持ってモデルに感銘を与えようとしているわけではありません。人間のレビュー担当者が次に何が失敗したかを判断できるほど、一発で明確に回答できる最小限の参考資料セットを渡そうとしているのです。
そのため、最初の実行は小規模で、慎重で、レビュー可能である必要があります。被写体の一貫性が保たれているかどうか、モーション キューが引き継がれているかどうか、タイミングが正しく読み取られているかどうか、スケールアップを正当化するのに十分な使用可能なフレームがクリップに含まれているかどうかを知りたいと考えています。最初の実行でこれら 4 つの質問に答えることができない場合、アセットをさらに追加すると、通常、次回の再試行での診断が困難になります。
1. このサイトにおける Seedance 2.5 のビデオへの参照の意味
China Video AI に関して、Seedance 2.5 は単なる抽象的な「参照をサポートする」という主張ではありません。現在のランタイムは、参照画像、参照ビデオ、参照オーディオ、およびプロンプト参照バインディングをサポートする個別のマルチモーダル パスを公開します。このワークスペースでは、画像からビデオへの Seedance 2.5 に直接ディープリンクすることもできます。この記事は、別のプラットフォームからの一般的な Seedance の約束ではなく、現在の製品フローについて説明しているため、これは重要です。
重要な操作上の詳細は、サイトが参照を構造化コントロールとして扱うことです。リクエスト正規化ロジックは、参照画像、参照ビデオ、および参照オーディオのリストを保持できます。 UI は @Image、@Video、および @Audio スタイル バインディングも公開するため、プロンプトはパッケージ全体について漠然と説明するのではなく、特定のアセットを指すことができます。これにより、1 つの静止画にアイデンティティ ジョブを、1 つのモーション クリップにカメラ ジョブを、1 つのオーディオ クリップにタイミング ジョブを割り当てることができます。
これは、単純な 1 つの画像のアニメーション ワークフローとは異なります。最初の 1 つのフレームと短い制御されたリビールだけが必要な場合は、より単純なパスで十分かもしれません。ビデオへの参照は、静止画で提供できる以上のショットが必要な場合に便利ですが、それでもパッケージを人間のレビュー担当者に説明できる状態にしておきたい場合に便利です。
2. 最初の厳しいルール: 制御パスを 1 つ選択する
最初のルールは、ほとんどの人がスキップするルールです。ショットが最初または最後のフレームの問題なのか、それともマルチモーダル参照の問題なのかを決定します。現在の China Video AI ランタイムでは、Seedance 2.5 では、最初または最後のフレーム コントロールを同じリクエスト内のマルチモーダル参照と組み合わせることができません。それは文体的な推奨ではありません。これは、製品フローにおける実際の検証ルールです。
この分離を無視すると、有益な創造的な反復に到達する前にワークフローが崩壊してしまいます。修正は簡単です。ショットが主に制御された視覚的なエンドポイントに関するものである場合は、最初または最後のフレームを使用します。ショットで画像、モーション、またはオーディオ キューを連携させる必要がある場合は、マルチモーダル リファレンスを使用します。両方のパスを 1 回の実行に強制しようとしないでください。
最初にパスを 1 つ選択します。
- エンドポイントが主な問題である場合の最初/最後のフレーム
- アイデンティティ、モーション、タイミングに追加の制御が必要な場合のマルチモーダル参照
- このサイトでは、両方のパスを 1 つの Seedance 2.5 リクエストに結合しないでください。
この 1 つの決定により、多くの偽りの複雑さが解消されます。また、デバッグを正確に保つことができます。実行が失敗した場合、フレーム主導のアプローチと参照主導のアプローチのどちらから問題が発生したかがわかり、両方を 1 つの判読不能な実験に混ぜ合わせるのではありません。
3. ここで重要となる実際の Seedance 2.5 の制限
公式の Seedance 2.5 メッセージングは、より長い出力とより大きなマルチモーダル パッケージを強調しており、これは有益なコンテキストです。しかし、リリース ノートだけでは実用的な制作ガイドとしては十分ではありません。実際のワークフローでは、現在のサイト制限が必要です。これは、実際のリクエストが検証される境界であるためです。
現在の China Video AI ランタイムでは、Seedance 2.5 は最大 30 個の参照画像、10 個の参照ビデオ、および 10 個の参照オーディオをサポートします。時間指定されたビデオまたはオーディオの各リファレンスは 2 ~ 30 秒の間に留まる必要があります。リファレンス ビデオの合計時間は 30 秒に制限されており、リファレンス オーディオの合計時間も 30 秒に制限されています。それは寛大に聞こえますが、実際的な教訓は「最大の法的パッケージを使用する」ということではありません。実際的な教訓は、「各資産が存在する理由が 1 つだけ残るように、十分に小規模に留まること」です。
このサイトの現在の Seedance 2.5 参照境界:
- 最大 30 枚の参照画像
- 最大 10 個の参考ビデオ
- 最大 10 個のリファレンスオーディオ
- 各時間基準: 2 ~ 30 秒
- 合計ビデオ参照時間: 30 秒
- オーディオリファレンスの合計時間: 30 秒
これらの制限により、本格的なパッケージを構築する余地が与えられますが、本格的なパッケージと肥大化したパッケージは同じではありません。最初の実行にすでに 6 つのアイデンティティ フレーム、4 つのモーション サンプル、および 2 つのオーディオが含まれている場合、次の再試行は最初の再試行よりも読みにくくなります。最も有用な最初のパスでは、1 ~ 3 つの画像、1 つのモーション キュー、およびオプションで 1 つの短いオーディオ キューで十分です。
4. すべての参照に 1 つのジョブを与える
Seedance 2.5 をパッケージ化する最も信頼できる方法は、プロンプトを作成する前に各参照に 1 つのジョブを割り当てることです。基本的なことのように聞こえますが、レビュー ループ全体が変わります。 「優れたアセットが 8 つある」と考えるのではなく、「どのアセットが主体のアイデンティティを所有し、どのアセットが動きを所有し、どのアセットがタイミングを所有するのか」を考え始めます。
毎回の実行前に短い役割シートを使用します。
参照役割:
- アイデンティティ参照: 変更してはならないものを定義する静止画またはフレーム
- モーションリファレンス: カメラの動きや体のリズムを示すクリップ
- タイミング基準: ビートまたはペーシングを定義するオーディオキュー
- オプションのサポート イメージ: 実際のあいまいさを解決する場合のみ
これにより 2 つの便利なことが行われます。まず、互いに競合する重複ファイルをアップロードできなくなります。次に、失敗の分類が容易になります。 ID が変動する場合は、プロンプト内の ID 参照と ID 行を検査します。タイミングが間違っていると感じた場合は、ショットの説明全体を最初から書き直すのではなく、オーディオ キューを検査します。
最も簡単な間違いの 1 つは、モーション参照がスタイル、背景デザイン、および被写体のアイデンティティを同時に担当することです。これは、クリップがすでに答えに近づいている場合にのみ機能します。ほとんどの場合、狭い参照を維持する必要があります。静止画は主題を定義する必要があります。モーション クリップはモーションを定義する必要があります。オーディオ クリップはリズムを定義する必要があります。これらのジョブが分離されると、再試行によりさらに多くの情報が得られるようになります。
5. 最小の有用なパッケージから始める
Seedance 2.5 は大規模なマルチモーダル パッケージを受け入れることができますが、最初の実行で受け入れるべきであるというわけではありません。通常、最小の有用なパッケージは、最小限の可動部分で単一のショットに応答するパッケージです。たとえ最終的なシーケンスがより複雑になるとしても、そこから始めてください。
多くのショットに対して、最小の有用なパッケージは次のようになります。
パッケージA:
- アイデンティティ静止画 1 つ
- 短いモーションリファレンス 1 つ
- 音声なし
- 1 つの直接プロンプト
モーションは機能するが、タイミングがまだずれていると感じる場合は、短い音声キューを 1 つ追加します。
パッケージB:
- アイデンティティ静止画 1 つ
- 短いモーションリファレンス 1 つ
- 1 つの短いオーディオキュー
- 同じコアショットプロンプト
それでもショットにアイデンティティを保持できない場合は、すぐにさらに 5 つのアセットを追加しないでください。まず、そのアイデンティティが実際に最高のアイデンティティであるかどうかを尋ねます。小さなパッケージのポイントは、障害を切り分けられることです。大規模に始めると、その利点が失われます。
ここは、Seedance 2.5 が安価な初回パス ワークフローと異なる点でもあります。このモデルには十分なヘッドルームがあるため、人々はすべてを 1 回の実行に投入したくなるでしょう。実際には、そのヘッドルームを最大限に活用するのは、小さなパッケージですでにアイデアが実証された後です。
6. 参照を明示的に指すプロンプトを作成する
Seedance 2.5 では、プロンプトが詩ではなく概要のように動作する場合、制御が容易になります。このサイトでは、マルチモーダル UI が明示的な参照バインディングをサポートしています。つまり、「参照」を 1 つの漠然とした山として説明する必要はありません。どのアセットがリクエストのどの部分を処理するかをモデルに伝える命令を書くことができます。
次のようなプロンプト パターンを使用します。
@Image1 をサブジェクト ID 参照として使用します。
カメラのリズムと動きのペーシングには @Video1 を使用します。
@Audio1 はビートのタイミングにのみ使用し、シーンの再設計には使用しません。
被写体のシルエット、素材、色、ラベルの配置を同じにします。
1 つのカメラ移動と 1 つの主要なアクションで 1 つのショート ショットを作成します。
余分なオブジェクトや創作テキストを追加しないでください。
あの構造はいい意味で退屈だ。これにより、リクエストが監査可能になります。レビュー担当者は各参照が何を行うべきかを確認でき、実験を見失うことなく一度に 1 行ずつ変更できます。最初のパスでは、文体的な花火は必要ありません。 2 番目のパスがノイズを増やすのではなく、よりスマートになるように、十分な明瞭さが必要です。
もう 1 つの良いルールは、固定しなければならないものについては 1 文にし、変更を許可するものについては 1 文にすることです。多くのドリフトは、主題が何になることが許されていないのかをまったく言わずに、「映画的、エネルギッシュ、プレミアム、ダイナミック、未来的」というプロンプトから来ています。
7. 30秒の部屋の予算を慎重に立てる
より長い Seedance 2.5 クリップの存在は、ペーシングについての人々の考え方を変えましたが、そのせいで最初の実行が質問で要求されているより長くなってしまうことはありません。ショットのデザインがすでに安定している場合は、継続時間を長くすると便利です。パッケージに基本的なアイデンティティやタイミングの問題がまだ残っている場合、混乱は高くつきます。
30 秒を、自動的に消費するスペースではなく、獲得するスペースとして扱います。強力なワークフローは、多くの場合、パッケージを検証する 1 つの短いテストから始まり、次に同じロジックを拡張する 2 回目の実行で始まります。このシーケンスは、最初の実行に 30 分丸々クリエイティブな意図を保持させるよりもデバッグがはるかに簡単です。
次のような期間ラダーを使用します。
期間ラダー:
- パッケージの検証には 4 ~ 6 秒かかります
- 8 ~ 12 秒でより強力な動きに耐えます
- 長いクリップは、アイデンティティ、モーション、タイミングがレビューに残った後にのみ使用できます
これは、オーディオ参照を追加する場合に特に重要です。短いオーディオ キューはタイミングを計るのに役立ちますが、ビジュアル パッケージが安定する前に長いクリップと組み合わせると、複数の可動部分を同時にデバッグすることになります。テストを短くすると、レビュー ループが正直に保たれます。
8. Seedance 2.5 が適切なツールであることを知る
Seedance 2.5 は、単純な画像からビデオへのベースライン以上のショットが必要だが、完全に異なるワークフローはまだ必要ではない場合に適しています。製品の発表、ブランド化されたモーション テスト、明確なビート タイミングを持つクリエイター シーケンス、短いマルチリファレンス シーンはすべて、パイプライン全体を再構築する必要なく追加の制御の恩恵を受けるため、有力な候補となります。
これは、Mini が小さすぎて問題を完全に異なる参照戦略に切り替える必要がない場合の優れた中間点でもあります。たとえば、製品ショットのワークフローでアイデンティティを維持できるが、カメラのリズムがまだ弱いことがすでに証明されている場合、同じコア ルートを放棄することなくモーション参照を追加できるため、Seedance 2.5 が次のステップとして合理的です。
どのファミリがそのタスクに適合するかをまだ決定していない場合は、シーダンス 2 ミニチェックリスト、この Seedance 2.5 ガイド、および MiniMax H3 リファレンスとビデオのガイド の 1 つの狭い範囲を比較してください。問題は、抽象的にどのモデルが「最良」であるかということではありません。問題は、どのワークフローが未知数を最小限に抑えて現在のショットに応答するかということです。
9. フラストレーションではなく、失敗の種類によって失敗を診断する
Seedance 2.5 の実行に失望した場合は、何かを書き直す前に失敗を分類してください。遅いように思えますが、再試行を節約できます。
この障害テーブルを使用します。
話題が逸れる場合:
- まだ身元を調べます
- 余分な視覚的な形容詞を減らす
- 変更してはいけないものを再度説明する
モーションが間違っている場合:
- モーション参照を短くします
- 競合する動作の説明を削除します
- 1 つのカメラ命令のみを保持します
タイミングが悪いと感じた場合:
- オーディオキューをトリムします
- オーディオがビート、ムード、ペースを制御するかどうかを説明する
- 不安定なビジュアルパッケージを修正するためにオーディオを使用しないでください
重要なことは、それぞれの障害タイプが異なる修復を示しているということです。アイデンティティのドリフトは、タイミングが悪い場合と同じ方法では解決されません。タイミングが悪い場合は、モーション キューが濁る場合と同じ方法では解決できません。失敗に正しく名前を付けると、次の再試行は感情的ではなく、小規模かつ合理的なものになります。
ここで、書き込まれた実行ログが役に立ちます。
実行ID:seed25-ref-01
パッケージ: 静止画 1 枚、ビデオ 1 枚
目標: ゆっくりと明らかにして対象者の身元を確認する
観察された問題: モーションが保留され、エンディングでアイデンティティが緩和される
次の変更: パッケージを維持し、アイデンティティラインを引き締め、クリップを短くします
そのログは官僚主義ではありません。これにより、最初の実行で「違和感を感じた」ために 5 つの変数を変更することがなくなります。何かを変更して結果が改善された場合、ワークフローは次のプロジェクトに引き継がれるようになります。
10. ファンではなく編集者のようにクリップをレビューする
レビューの最終的な質問は、「これはクールに見えますか?」ではありません。それは、「これが最初のパスだった場合、次に何を修正すればよいかわかるでしょうか?」です。編集者は、使用可能なフレーム、安定した被写体のアイデンティティ、読みやすいモーション、および正確なタイミングを探します。ラッキーショットが 1 つ含まれているという理由だけでクリップに報酬を与えるわけではありません。
すべての Seedance 2.5 の最初のパスを 4 つの質問に対して確認してください。
- 被写体は最初から最後まで認識可能な状態にありますか?
- モーションキューは明確に読み取られますか? それともふらつきますか?
- そのタイミングは偶然ではなく、意図的に行われたと感じますか?
- より長い再試行またはよりリッチな再試行を正当化するのに十分な使用可能なフレームはありますか?
クリップがこれらの質問のうち 2 つまたは 3 つを満たしていない場合は、1 つの美しいフレームを称賛しないでください。パッケージを締めて再実行します。それらのほとんどに合格した場合、シーケンスを拡張したり、リファレンスを 1 つ追加したり、より長い生産カットに移行したりする権利を獲得したことになります。
上のビデオは、近くの主張を裏付ける類の資産です。この場合、短い所有モーション サンプルが装飾としてよりも参照の役割として役立つ理由がわかります。この記事でのボディビデオのポイントは、印象的に見せることではありません。これは、パッケージがすでにクリアされている場合に、安定したモーション キューがどのような貢献ができるかを示すためです。
11. 最初のパスから次に進むタイミング
最初のパスは、次のステップが何であるべきかを示した時点で成功です。次のステップは、より長い Seedance 2.5 クリップになる可能性があります。それはもう一つの音声キューかもしれません。それはさらに強固なアイデンティティになるかもしれません。別のワークフローへの切り替えになる場合もあります。間違いは、すべての最初のパスがすでに公開可能であるかのように扱っていることです。
パッケージが人間によるレビューに耐えた場合にのみ先に進みます。ショットにまだアイデンティティ ドリフト、読めないタイミング、または矛盾した制御信号が含まれている場合、正しい行動は、参照をさらに増やさないことです。正しい行動は、パッケージをより小さく、より明確にすることです。
ワークフローを組み直す必要があるなら China Video AI ホームページ に戻り、最小の有用パッケージが見えているなら Seedance 2.5 ワークスペース に直接進んでください。まだモデル ファミリーを比較しているなら、中国 AI 動画モデルガイド、China Seedance、1 枚の画像から AI 商品広告を作る方法 を同時に開くと判断しやすくなります。順序は単純です。まず制御パスを決め、次に各リファレンスへ役割を与え、短いクリップで成立を証明してから、初めて追加コストを払います。
