Skip to main content
We’ve moved.ClipDance.ai
2 日間 16:27:34
無制限 GPT Image 2 & Nano Banana 2 LiteUnlimited を取得
Seedance 2.5 プロンプトガイド:実例とテンプレート

Seedance 2.5 プロンプトガイド:実例とテンプレート

30秒尺、リファレンス、編集、延長、キーフレーム、ブロックアウト、音声、カメラワークまで、公式Seedance 2.5プロンプト公式を実例つきで学ぶ。

優れたSeedance 2.5プロンプトは、視覚的な形容詞の羅列というより、コンパクトな制作指示書のように読める。被写体と見える出来事を特定し、参照ファイルごとに役割を割り当て、長いシーンを段階に分割し、変えてはいけないものを明記する。これがByteDance公式のDreamina Seedance 2.5 Prompt Guideを貫く筋道だ。[1]

この記事はそのガイドを実用的なリファレンスライブラリに落とし込む。作例は公式の教育意図を保ちつつ、逐語訳ではなく応用・拡張している。

これは明確にSeedance 2.5プロンプトガイドである。モード、アップロード操作、生成設定の解説が必要な場合は、別記事のSeedance 2.5ユーザーガイドを使ってほしい。プロンプト設計とプロダクト操作を分けておくことで、両方の資料が使いやすくなる。

60秒でわかる答え

  • 被写体 + アクション/出来事 から始める。シーン、ビジュアルスタイル、カメラ、音声は結果を変える場合にのみ追加する。
  • アップロードしたファイルはすべて「制作部門」として扱う。画像は外見を定義し、動画は動きやカメラを定義し、音声は声・音楽・リズム・環境音を定義する。
  • 参照は名前付きの被写体一つ一つに個別に紐づける。「画像1〜4はそれぞれ」のような書き方でモデルに4人の別人物を推測させてはいけない。
  • 長いプロンプトでは、1段階につき1つの主要な状態変化と目に見える終了状態を持つ連続した段階を書く。正確な秒数は本当に合図が必要な出来事にだけ使う。
  • 編集では、ソース動画をタイムラインとカメラの唯一のマスターと明言する。編集範囲、ターゲット参照の役割、保持すべきすべてを記述する。
  • 区別が重要な場合、音楽は丸括弧、効果音は山括弧、セリフは波括弧、字幕は全角の隅付き括弧に入れる。
  • アイデンティティ、人数、服装、小道具の所有権、空間の向き、音声、除外事項をカバーする一貫性ブロックで締めくくる。

再利用可能な骨格はこうなる:

[生成目標]
[素材]
@Image 1 は...を定義する
@Video 1 は...を定義する
@Audio 1 は...を定義する

[シーンまたは段階プラン]
被写体 + 目に見える行動/出来事 + 環境 + スタイル + カメラ + 音声。

[一貫性を維持]
...を変えずに保つ。...を持ち込まない。

まず、Dreamina 2.5の制限とこのサイトの現行APIを切り分ける

公式ガイドはアップストリームのDreamina Seedance 2.5制作環境を説明している。それは、あらゆるサードパーティ製品やAPIが同じ日に同じ制限を公開していることを意味しない。30秒・50参照のプロンプトを別のインターフェースにそのままコピーする前に、自分が今どのルートにいるのかを確認すること。このサイトでは、Seedance 2.5ルートがアップストリームの上限に並んだ一方、旧来の2.0ルートはそうではない。

機能公式Dreamina Seedance 2.5ワークフロー現行のSeedance2.soワークフロー
参照総数最大50Seedance 2.5ルートでは最大50、2.0ルートでは最大15
画像参照最大30枚、各最大4KSeedance 2.5では最大30枚、2.0ルートでは最大9枚
動画参照最大10本、合計最大30秒Seedance 2.5では最大10本・合計最大30秒、2.0ルートでは最大3本・合計最大15秒
音声参照最大10ファイル、合計最大30秒Seedance 2.5では最大10ファイル・合計最大30秒、2.0ルートでは最大3ファイル・合計最大15秒
生成尺文書化された2.5ワークフローでは4〜30秒Seedance 2.5では4〜30秒、2.0ルートでは4〜15秒
実用上望ましい参照量少数で明確に役割づけられた素材の方が安定する同じ原則が当てはまる。全スロットを埋めることは品質の近道にはならない

Dreaminaの制限は公式の2.5文書2本に由来する。[1][2] 安定性のため、ガイドは1〜8体の異なる画像被写体、1体あたり約5〜10秒の1〜5体の動画被写体、そして編集では20秒未満のソースと1〜5個の補助参照を推奨している。それより多い数でも動作しうるが安定性は下がる。Seedance2.so列は現在のスタジオ設定を反映したもので、モデルの理論上の上限ではない。[4] Seedance 2.5ルートがここで公開されて以降、その素材上限と30秒出力は文書化されたアップストリームの数値と一致しており、実務上の差は主に旧来の2.0ルートに残っている。Seedance2.soは独立したサービスであり、ByteDanceによって運営・提携・承認されたものではない。

以下の例では公式ラベルの@Image 1@Video 1@Audio 1を使用する。このサイトのreference-to-videoツールでは、UIが示すコンパクトなフィールドラベル@image1@video1@audio1を使うこと。

公式Seedance 2.5プロンプト公式

ByteDanceは6要素の公式を示している:[1]

被写体 + 行動/出来事 + シーン/環境(任意) + ビジュアルスタイル(任意)
+ カメラワーク/カット(任意) + 音声(任意)

必須なのは被写体と出来事だけだ。任意項目は、それが何らかの判断材料になるときだけ含める。画像が部屋を固定しているなら壁紙を繰り返し記述するのは注意力の無駄遣いであり、カメラの動きがコマーシャルを定義するならそれを明示すべきだ。

ガイドの陶芸スタジオの例は、以下のような完全なテキストのみのジョブに応用できる:

入力 — 完全なプロンプト

Create an 8-second realistic video set in a quiet pottery studio just after sunrise.

[Subject and goal]
One ceramicist completes one pale-blue cup on a spinning wheel, lifts the same cup with both hands, and places it upright at the center of a wooden display shelf.

[Timeline]
0-3s: Medium eye-level shot. The ceramicist makes the final smoothing pass around the wet rim while the wheel turns slowly.
3-5s: Gently push in to show the damp glaze, small finger marks, and the circular motion stopping. The ceramicist lifts the single cup; keep its shape and color unchanged.
5-8s: Cut to a frontal shelf view. The ceramicist places the cup on the center mark, releases both hands, and holds for one second on the completed arrangement.

[Light, camera, and sound]
Use soft dawn light through one side window, natural wood tones, shallow but readable depth of field, and restrained documentary realism. Preserve the low wheel motor, wet-clay friction, one quiet ceramic-on-wood contact, and subtle room tone. No dialogue or music.

[Continuity]
Exactly one ceramicist and one pale-blue cup. Keep the bench orderly. Do not duplicate the cup, change its color, add text, skip the shelf placement, or end before both hands release it.

最初の行が被写体、行動、対象物、時間帯を与える。残りは光、単一のカメラワーク、音、そしてブレてはいけない対象物を指定する——空虚な品質形容詞でプロンプトを水増しすることなく。

プロンプト設定はシーン描写ではない

アスペクト比、出力尺、解像度は生成コントロールやAPIリクエストに属するものだ。公式ガイドは、ページ上ですでに選択済みの設定をプロンプト内で繰り返すべきではないと明確に述べている。[1] vertical phone videoと書くのは、選択キャンバスが9:16だからではなく、スマホ撮影の映像的言語を求める場合だけにすべきだ。

一部のワークフローはパラメータをロックする。編集はおおむねソース動画の比率と尺に従い、先頭フレームまたは先頭・最終フレーム指定のジョブは最初の画像の比率を継承し、延長はソース比率に従う。これらの場合、プロンプト本文はロックされた入力ジオメトリを上書きできない。[1]

シーンを書く前に参照マップを組む

公式のマルチリファレンスワークフローは説明するのは簡単だが省略されやすい:

各素材の役割を定義する → 被写体をマッピングする → タイプ別にグループ化する
→ 被写体プロファイルを作成する → シーンごとに参照を選ぶ

この順序が、モデルにすべての参照をどこにでも使おうとさせるのを防ぐ。

1. 各素材に1つの主要な役割を与える

明示的な役割行を使う:

@Image 1 は、マーラの顔、短い黒髪、緑の作業用ジャケットを定義する。
@Image 2 は、真鍮のデスクランプ——そのプロポーション、経年の風合い、プルチェーン——を定義する。
@Image 3 は、資料室の棚、色調、窓の配置を定義する。
@Video 1 は、マーラの手の動きと左から右へのゆっくりとしたカメラトラックを定義する。
@Audio 1 は、静かな室内音とセリフの抑揚を定義する。

そして、ファイルに継承させたくない情報が含まれる場合は除外事項を明記する:

@Video 1 は動きとカメラのためだけに使う。その俳優、服装、背景、照明、字幕、
音楽は継承しない。

これは「すべての参照をもとに動画を作って」よりずっと信頼できる。後者は、2つのファイルが矛盾する場合にどちらが優先されるかを一切示さない。

2. すべての被写体を個別に紐づける

画像1〜4はそれぞれ4人のキャラクターのようなコンパクトなマッピングは避ける。それはモデルに、アップロード順序・アイデンティティ・シーン参加を同時に推測させてしまう。1つずつ紐づける:

@Image 1 は、オレンジのレインコートを着た配達員ニアを定義する。
@Image 2 は、ネイビーのエプロンをつけた花屋ソルを定義する。
@Image 3 は、ニアだけが運ぶ紙包みの荷物を定義する。
@Image 4 は、外に停められた自転車を定義する。このシーンではどちらのキャラクターもそれに乗らない。

1つの商品や人物を複数のアングルで示す場合は、そう明記する。公式ガイドは、コラージュより個別のビューの方が安定しやすいと述べている:[1]

@Image 1、@Image 2、@Image 3 は、同一の1台のエスプレッソマシンを3つの角度から見た写真である。
これらは合わせて、1台のマシンの形状、素材、操作部、ロゴの配置を定義する。
マシンは必ず1台だけ表示する。3台のマシンや分割画面のコラージュを作ってはならない。

3. 大きなパックを制作上の役割ごとにグループ化する

複雑なシーンでは、筋書きの前に参照台帳をグループ化する:

[キャラクター]
@Image 1 はニアを定義する。@Image 2 はソルを定義する。

[小道具]
@Image 3 はニアの荷物を定義する。@Image 4 は花屋のレジを定義する。

[シーン]
@Image 5 は店の外観を定義する。@Image 6 は梱包カウンターを定義する。

[動きと音声]
@Video 1 は荷物の受け渡しとカメラの動きのみを定義する。
@Audio 1 は通りの雨音とドアの上のベルの音のみを定義する。

4. 被写体プロファイルを作り、シーンごとに参照を選ぶ

再利用可能なプロファイルは、アイデンティティを筋書きから切り離しておく:

[ニアのプロファイル]
外見: @Image 1。服装: @Image 1 のオレンジのレインコート。
固定小道具: @Image 3 の荷物は、受け渡しまでニアの右手に留まる。
動きの参照: @Video 1 の歩くペース。
除外事項: 帽子なし、傘なし、服装の変更なし、荷物の複製なし。

シーンごとに、そこで必要な素材だけをリストする:

[シーン1 — 店頭]
使用: @Image 1, @Image 3, @Image 5, @Audio 1。
出来事: ニアが小雨の中、閉まった花屋のドアに近づく。
終了状態: 彼女の右手が真鍮のドアハンドルに届く。荷物は左腕の下に留まっている。

[シーン2 — カウンター]
使用: @Image 1, @Image 2, @Image 3, @Image 4, @Image 6, @Video 1。
出来事: ソルが荷物を受け取り、レジの横に置く。
終了状態: 荷物はソルの所有物になる。ニアの手は空になる。

終了状態は次のシーンの出発点となる真実になる。これがなければ、小道具や人数はブレていく。

以下が組み立てられた完全な入力と、検証すべき結果だ:

入力 — 完全なプロンプト

Mode: Omni Reference / Reference to Video
Materials: @Image 1 Nia; @Image 2 Sol; @Image 3 parcel; @Image 4 register; @Image 5 storefront; @Image 6 packing counter; @Video 1 handoff motion; @Audio 1 rain and door bell
Parameters: 15 seconds; 16:9; 720p

Prompt:
[Characters] @Image 1 defines Nia in one orange raincoat. @Image 2 defines Sol in one navy apron.
[Props and scenes] @Image 3 defines the only parcel. @Image 4 defines the register. @Image 5 defines the exterior. @Image 6 defines the counter.
[Motion and audio] @Video 1 defines only handoff timing and a slow camera track; do not inherit its people, clothes, room, captions, or music. @Audio 1 defines rain and the door bell only.
[Scene 1 — approximately 0–7s] Nia approaches the storefront through light rain with the parcel under her left arm. End with her right hand on the brass door handle.
[Scene 2 — approximately 7–15s] Continue inside. Sol receives the same parcel and places it beside the register. End with Sol owning the parcel and Nia's hands empty.
[Consistency] Exactly two people and one parcel. Preserve identity, clothing, shop layout, screen direction, weather, and prop ownership. No bicycle use, subtitles, logo, duplicate parcel, or wardrobe change.

各音に役割を与える音声記号法

公式プロンプトガイドはコンパクトな記法システムを使う:[1]

意図記法
音楽( ... )(ドアが開いた後、抑制の効いたピチカートの弦楽が始まる。)
効果音・環境音< ... ><ガラスを打つ雨、ドアベル、木の上を滑る紙の音。>
セリフ{ ... }ソルが静かに言う: {閉店前に間に合ったね。}
字幕テキスト【 ... 】【一つの配達。三つの人生が変わった。】

中国語以外の発話では、セリフの前に言語、地域的な方言、話し方、話者を明記する:

スペイン語、メキシコ方言、温かいが息が切れた口調、ニアが話す:
{雨が私を止めると思っていた。}

話者を近接性からモデルに推測させてはいけない。参照ファイルに無関係な音楽や字幕を残したまま、それが無視されると期待してもいけない。アップロード前に取り除くか、その参照は動きのみを提供し、BGM・字幕・声・環境音は継承させてはならないと明記すること。

30秒のプロンプトを連続した状態変化として書く

公式の2.5ワークフローでは、30秒のシーンは12の行動を含む1つの段落であるべきではない。段階に分割する。各段階には1つの主要な変化と観察可能な終了状態を持たせる。[1]

ガイドの花屋の梱包シナリオを拡張した応用例がこちらだ:

入力 — 完全なプロンプト

Mode: Dreamina Seedance 2.5 Omni Reference / 30-second generation
Materials: @Image 1 Sol; @Image 2 Nia; @Image 3 flower-shop interior; @Video 1 parcel handoff; optional @Audio 1 room tone
Parameters: 30 seconds; 16:9; 720p

Prompt:
[Generation goal]
A grounded 30-second short film about a florist preparing the final order of the day.
Naturalistic performance, warm shop interior, rain-dark street outside.

[Reference roles]
@Image 1 defines Sol's identity and work clothes. @Image 2 defines Nia's identity and orange
raincoat. @Image 3 defines the shop layout, materials, and lighting. @Video 1 defines only the
parcel-handoff timing and body mechanics; do not inherit its people, clothing, setting, captions,
or music. If supplied, @Audio 1 defines shop room tone only; do not inherit voices or music.

[Stage 1 — approximately 0–8s]
Initial state: Sol stands at the packing counter; loose flowers and an empty kraft box
are arranged in front of her. Event: she selects three pale peonies and wraps the stems.
Camera: locked medium-wide shot with a very slow push.
End state: the wrapped bouquet rests inside the open box.

[Stage 2 — approximately 8–18s]
Continue from the unchanged box and bouquet. Sol folds the box flaps, ties one blue ribbon,
and presses a small blank card beneath the knot. <Paper fold, ribbon tension, rain on window.>
End state: the box is closed and the ribbon is secure; no loose flowers remain in her hands.

[Stage 3 — approximately 18–26s]
The door bell rings. Nia enters in her orange raincoat. Sol turns, carries the same box
with both hands, and passes it across the counter. Use the handoff timing from @Video 1 only.
At 23s, ownership of the box visibly transfers from Sol to Nia.
End state: Nia holds the box; Sol's hands are empty.

[Stage 4 — approximately 26–30s]
Nia gives a relieved smile and exits. Sol watches from the doorway as the bell settles.
(A two-note musical resolution begins only after the door closes.)
Final state: Sol remains alone inside; Nia and the box are outside.

[Maintain consistency]
Keep faces, clothing, shop layout, box dimensions, ribbon color, screen direction,
rain intensity, and prop ownership consistent. Exactly two people. No subtitles or logo.

予算にはレンジ、受け渡しにはポイント、リアクションには相対的なタイミングを使う

  • シーン時間の配分にはapproximately 8–18sのようなレンジを使う。
  • 受け渡し、登場、退場、ビート、転換にはat 23sのような1点の正確な時刻を使う。
  • タイミングよりも反応そのものが重要なときはone beat after the bellのような相対表現を使う。

レンジは連続させ、重複させないこと。正確な秒数指定はフレーム精度の編集ではなく、多用しすぎると行動が消えてしまうことがある。「1秒間に3つの動作」は不可能な演技指示だ。

現在のSeedance2.soでは、Seedance 2.5ルートは最大30秒を生成するため、上記の4段階版をそのまま実行できる。そのルートはSeedanceスタジオで選択でき、段階分けしたプロンプトをそのまま貼り付けられる。2.0ルートでは、この方法を4〜15秒に応用する。2段階に留めるか、連続したクリップとしてより長い尺を生成する。いずれの場合も、尺はプロンプトではなく選択したコントロールで決まる。15秒で頭打ちのルートに「30秒」と書いてもそれが解放されることはない。

ソース動画を意図せず再生成せずに編集する

編集では、ソース動画をタイムライン、シーン、カメラ、動き、遮蔽、出来事の順序についての唯一のマスターと宣言する。その上でターゲット参照、編集範囲、保持すべきすべてを定義する。[1]

[ソース]
@Video 1 が唯一のマスター動画である。その尺、ショットの順序、カメラの動き、
俳優の動き、演技配置、遮蔽、照明の向き、元の音声を保持する。

[ターゲット]
@Image 1 は、対象物の形状、素材、色、構造のみを定義する。

[編集]
以下で説明する元の対象物だけを置き換える。部屋や俳優をデザインし直さない。

[保持]
編集していないすべてのピクセルを @Video 1 と概念的に一致させたまま保つ。新しいカット、
キャラクター、小道具、テキスト、音楽、カメラの動きは追加しない。

公式パターンの例:ランプを1つ交換する

入力 — 完全なプロンプト

Mode: Smart Edit / source-video object replacement
Materials: @Video 1 source clip; @Image 1 replacement lamp
Parameters: preserve source aspect ratio and approximately source duration; preserve original audio

Prompt:
@Video 1 is the sole source and timeline master. It shows one table lamp beside an actor.
@Image 1 defines the replacement lamp only: aged brass stem, green glass shade,
short pull chain, and the exact proportions shown in the image.

Replace only the single lamp in @Video 1 with the single lamp from @Image 1.
The replacement must follow the original lamp's position, scale, perspective, occlusion,
reflections, light interaction, and visibility over time. Preserve the actor, table,
room, camera, edit, motion, dialogue, and ambience. Exactly one lamp; no duplicate shade,
no extra furniture, no change to the actor's hands.

「ランプを交換して」は情報不足だ。完全版はタイムラインマスター、外見のソース、対象物の数、変えてはいけない関係性を特定している。

背景の交換、音のクリーンアップ、色の変更、要素の除去にも同じ構造を使う。変えるのはターゲットと保持リストだけだ。動画編集ワークスペースは、現在利用可能なSeedance 2.0ルート向けにこのソース+指示のパターンを公開している。

境界を設計して前後に延長する

延長がうまくいくのは、生成される側の継ぎ目が、ソース側で見えるまさにその状態を用意するときだ。2つの境界フレームは自然につながるべきだが、ピクセル単位で同一である必要はないとガイドは注意している。[1]

前方向延長のテンプレート

@Video 1 がソース動画である。その前に新しいコンテンツを延長する。
新しいセグメントの最終フレームは、@Video 1 の最初のフレームに自然につながる必要がある。
境界において、ポーズ、向き、小道具の位置、背景のジオメトリ、空間的な関係性、
カメラの高さ、構図、照明、動きの方向を一致させる。
すべての被写体について、連続した1つのインスタンスを保つ。ソース動画の
後半で初めて登場する対象物を早く見せてはならない。

応用したキュレーターの例:

入力 — 完全なプロンプト

Mode: Extend Video backward
Materials: @Video 1 source clip; @Image 1 curator identity and suit; @Image 2 display case
Parameters: add 6 seconds before source; preserve source aspect ratio; preserve source segment

Prompt:
@Image 1 defines the curator's face and charcoal suit. @Image 2 defines the display case.
@Video 1 is the source: it begins with the curator's right hand already touching the case.

Extend 6 seconds before @Video 1. The curator walks from the left aisle toward the same case,
slows, turns her shoulders toward it, and raises her empty right hand. End the extension with
her fingertips about to make contact in the same pose, direction, framing, and light as the
first source frame. The artifact visible inside the source case must not appear outside it,
and no second curator or second case may appear. Use quiet gallery room tone and measured
footsteps in the new segment, then match the source audio naturally at the boundary.
Do not alter the source segment or its original audio.

前方向延長の場合はロジックを逆にする:新しく生成される最初のフレームがソースの最終フレームを引き継ぐ。そのポーズと小道具の関係を延長部分の初期状態にすること。選択したモデルが対応していれば動画延長を使う。

先頭・最終フレーム、マルチキーフレーム、ストーリーボードグリッド

これら3つのコントロールはそれぞれ異なる問題を解決する。

先頭・最終フレーム:エンドポイントを固定する

マルチモーダルモードでは、両方の画像が単にエンドポイントだと漠然と言うのではなく、明示的にアンカーを割り当てる:

入力 — 完全なプロンプト

Mode: First and Last Frames in multimodal mode
Materials: @Image 1 first frame; @Image 2 last frame; both use the same 9:16 ratio
Parameters: 8 seconds; 9:16; 720p

Prompt:
@Image 1 is the exact first-frame composition: an unopened red umbrella on wet pavement.
@Image 2 is the exact last-frame composition: the same umbrella open above the same child.

[Timeline]
Approximately 0–2s: hold the opening composition long enough to read the closed umbrella as the
child enters from frame-right. Approximately 2–6s: the child reaches down, picks up the handle,
and opens the umbrella in one continuous action. Approximately 6–8s: let the motion settle into
the exact final-frame composition.

Keep the street, rain direction, clothing, umbrella design, and screen direction consistent.
Use light rain, wet footsteps, and one natural umbrella-opening sound; no dialogue or music.
Do not override either anchor with other references. No second child, second umbrella,
teleportation, reverse entry, or unexplained camera cut.

出力比率は最初の画像に従うため、アップロード前に最初と最後の画像の比率を合わせておくこと。追加の参照はアイデンティティや素材感を補強してもよいが、エンドポイントの構図を再定義すべきではない。[1]

マルチキーフレーム:順序づけられた可視状態を固定する

@Image 1 から @Image 4 を、この正確な順序でキーフレームとして使う。
キーフレーム1: 密封されたコーヒー豆の袋がカウンターの中央にある。
キーフレーム2: 同じ袋が開けられ、豆がグラインダーに注がれる。
キーフレーム3: 挽いた粉がポルタフィルターに落ちる。袋はフレームに写っていない。
キーフレーム4: 完成したエスプレッソが元の袋の横にあり、ラベルはカメラに向いている。

連続した1つの準備工程を作る。各キーフレームは、別々の製品ではなく、
その段階の目に見える終了状態を定義する。袋のデザイン、カウンター、マシン、手の見た目、
光の向き、左から右への動きの流れを保持する。

独立した画像はグリッドよりもマッピングしやすい。キーフレームは順序と主要な状態を制御するのであって、すべての中間フレームを制御するわけではない。

ストーリーボードグリッド:最終的なピクセルではなくショットの順序を伝える

公式ガイドは、約15枚以内のクリーンなパネル、シンプルな線画、最小限のラベル、明示的な読み順を推奨している。[1]

入力 — 完全なプロンプト

Mode: Omni Reference / storyboard-grid control
Materials: @Image 1 six-panel storyboard grid; @Image 2 subject identity; @Image 3 flower-shop location
Parameters: 15 seconds; 16:9; 720p

Prompt:
@Image 1 is a six-panel storyboard read left-to-right, top row then bottom row.
Use it only for story order, approximate framing, subject blocking, and camera direction.
Do not inherit line-art style, panel borders, arrows, labels, placeholder faces, or text.
@Image 2 defines the subject's face, hair, and clothing. @Image 3 defines the shop's layout,
window placement, materials, and warm interior light. Do not let either reference reorder shots.

Shot 1, approximately 0–3s: wide exterior, slow approach to the shop.
Shot 2, approximately 3–5s: close-up, hand reaches for the door.
Shot 3, approximately 5–8s: medium interior, bell rings as the subject enters.
Shot 4, approximately 8–11s: over-shoulder view of the package handoff.
Shot 5, approximately 11–13s: close-up on the blue ribbon.
Shot 6, approximately 13–15s: wide closing frame through the rain-streaked window.

Final treatment: naturalistic 35mm drama, warm interior against cool rain,
restrained cuts, continuous room tone, one natural door bell in Shot 3, and no dialogue,
music, captions, logos, or storyboard graphics in the output.

粗いブロックアウトと精密なブロックアウト

粗いブロックアウトは動きと空間の骨格だ。単純な図形が、経路、演技配置、動作のタイミング、カメラの動き、カット、照明の変化、音のきっかけを定義できる。すべての幾何学的プレースホルダーを最終的な被写体に対応づけ、灰色の図形を明示的に除外する。[1]

入力 — 完全なプロンプト

Mode: Omni Reference / coarse-blockout transfer
Materials: @Video 1 primitive blockout; @Image 1 cyclist; @Image 2 delivery box; @Image 3 market street
Parameters: 12 seconds; 16:9; 720p

Prompt:
@Video 1 is a coarse blockout. The blue capsule maps to the cyclist from @Image 1.
The orange cube maps to the delivery box from @Image 2. The gray corridor maps to the
market street from @Image 3. Inherit only timing, movement paths, blocking, camera path,
cuts, and screen direction. Render the final subjects and environment photorealistically.
Use restrained bicycle-chain, tire, and market ambience synchronized to the inherited action;
no dialogue or music. Keep exactly one cyclist and one attached delivery box. Do not inherit
primitive shapes, gray materials, guide lines, labels, viewport UI, or empty scenery.

精密なブロックアウトはすでに完全にモデリングされた構造を持っている。ジオメトリ、動作、空間、カメラ、カットを保持しながら、最終的な素材、キャラクター、照明、スタイルを再レンダリングしたい場合に使う。

@Video 1 is the fine 3D blockout and sole structural master.
Preserve architecture, furniture dimensions, actor blocking, action timing, camera lenses,
camera route, and cuts. @Image 1 defines the final actor; @Image 2 defines oak and brushed
steel materials; @Image 3 defines the evening light. Rerender as a finished live-action scene.
Do not show axes, controllers, camera frustums, path lines, default shaders, or viewport UI.

アップロード前に精密なブロックアウトをクリーンにしておくこと。目に見えるパススプラインは架空のケーブルになりかねないし、軸ギズモは小道具になりかねない。

画像セットからワンクリックで動画を作る

「これらの画像を動画にして」という指示は、順序、動き、編集、音を未解決のままにする。公式の手順を使う:[1]

Material roles → Image order → Motion amount → Editing style → Visual treatment → Audio

入力 — 完全なプロンプト

Mode: Omni Reference / one-click image-set video
Materials: @Image 1 desk pack shot; @Image 2 product in hand; @Image 3 outdoor use; @Image 4 final pack shot
Parameters: 12 seconds; 9:16; 720p

Prompt:
@Image 1 defines the opening product-on-desk composition.
@Image 2 defines the same product in a hand.
@Image 3 defines the outdoor use scene.
@Image 4 defines the final pack shot.
Use the images in this order and treat them as one continuous product story.

[Timeline]
Approximately 0–3s: begin on @Image 1 and add one slow 5-degree product turn.
Approximately 3–6s: match cut by product shape and screen position to @Image 2; use only
slight, anatomically plausible hand movement.
Approximately 6–9s: match cut to @Image 3; add shallow parallax and slow background drift while
the product remains the visual anchor.
Approximately 9–12s: match cut to @Image 4, settle all movement, and hold the final pack shot.

Use restrained match cuts based on shape and screen position.
Final look: warm editorial daylight, tactile paper and metal, high contrast but natural skin.
<Soft room tone becomes outdoor ambience; one clean product click at the final frame.>
Preserve product shape, color, label, orientation logic, and scale across all four beats.
No invented text, warped packaging, extra accessories, abrupt zooms, or frantic motion.

スタイルリファレンス動画は、そのアクターやロケーションを明示的に除外しつつ、リズム・トランジション・字幕の処理・音楽を定義することができる。

トランジション、感情表現、プロフェッショナルなカメラ言語

シームレスなトランジションでは視覚的な橋渡しを記述する

transition from @Video 1 to @Video 2とだけ書いてはいけない。継ぎ目を隠す共通の形、方向、色、対象物、動きを名指しする:

Use @Video 1 before @Video 2. Preserve both source clips outside the transition.
At the end of @Video 1, the camera moves into the courier's orange raincoat until orange
fills the frame. Begin @Video 2 on the same orange field, then pull back to reveal a sunset wall.
Match motion direction, exposure, blur, and transition speed. No flash frame, logo, or extra cut.

継ぎ目ごとに1つの仕組みだけを与える。同じ0.5秒に4つのエフェクトを重ねてはいけない。

感情のラベルではなく、観察可能な演技を指示する

「彼女は悲しくなる」は内面の状態を名づけているだけで、演技を提供していない。きっかけと目に見える振る舞いを書く:

Sol hears the door bell and first assumes the customer returned.
She lifts her chin and starts a smile. One beat later she sees the empty doorway;
the smile stops, her shoulders lower, and her gaze settles on the parcel left behind.
Keep the performance restrained: no tears, collapse, shouting, or exaggerated trembling.

複数段階の感情では、各変化を出来事に結びつける:音の後の期待、間の後の疑念、認識の後の安堵。それによって、3つの感情を同時に求めるのではなく、演じられる一連の流れが生まれる。

カメラ用語を曖昧さのない指示として使う

目的有用な指示避けるべき表現
被写体に接近するslow dolly in at eye levelzoom in cinematically
横方向の動きを追うparallel tracking shot, left to rightdynamic camera
空間的な文脈を明かすcrane up from medium shot to high wideepic reveal
注意を移すrack focus from the parcel to Sol's eyesfocus on everything
臨場感を加えるrestrained handheld medium close-upshaky documentary
カットを隠すwhip pan ending in full-frame motion blurcool transition
不安感を作るslow push with subtle Dutch anglescary lens
スケールを強調するlow-angle wide shot with foreground depthmake it huge

ショットごとに支配的な動きを1つ選ぶ。オービット、クレーン、ドリー、ハンドヘルドの揺れ、ラックフォーカスが必要なら、そのアイデアをショットごとに分割し、カットの順序を明記する。

提出前チェックリスト

生成する前に、あなたの意図を見ることができない制作クルーになったつもりでプロンプトを読み返す。

  • 目標: 成果物は複数の競合するコンセプトではなく、明確な1本の動画になっているか?
  • 被写体: 人物、商品、小道具、幾何学的プレースホルダーはすべて名前づけられ、数えられているか?
  • 素材の役割: すべての画像・動画・音声ファイルに明確な1つの役割と除外事項があるか?
  • シーンの選択: 各段階は、実際に必要な参照だけをリストしているか?
  • 状態の連続性: 各段階は、次の段階が引き継ぐ目に見える状態で終わっているか?
  • タイミング: レンジは連続しているか?正確なタイムスタンプは重要な合図のために取ってあるか?
  • カメラ: ショットごとに支配的な動きは1つで、画面の向きは保たれているか?
  • 音声: 話者、言語、話し方、音楽、効果音、不要な参照音声は明確か?
  • 編集: ソース動画が唯一のマスターとして宣言され、編集範囲は狭く絞られているか?
  • エンドポイント: 先頭・最終フレームは互換性のある比率を共有し、別々に記述されているか?
  • 除外事項: 重複、不要なテキスト、継承されたガイド、無関係なBGM、スタイルの漏出を禁止しているか?
  • インターフェースの制限: プロンプトは、どこか別で読んだ上流の仕様ではなく、実際に選択したモデルと尺に合っているか?

Seedanceプロンプトジェネレーターは初稿を作成できる。生成する前にすべての役割を確認し、矛盾を取り除くこと。

1つの層を直して出力を診断する

失敗最も可能性の高いプロンプトの問題最初の修正
意図しない参照が被写体を支配する役割や紐づけが暗黙的ファイルごとに1つの役割行、被写体ごとに1つのプロファイルを追加する
小道具が複製される、または所有者が変わる個数や終了状態の指定がない正確な個数、所有者、手、受け渡しの瞬間を明記する
後半の行動が消える出来事が多すぎる、または正確なタイムスタンプが多すぎる各段階に1つの状態変化を与え、重要でないタイミングは緩める
編集で動画全体が変わってしまうソースがマスターとして宣言されていないソースの役割、狭い範囲、保持リストを追加する
延長の継ぎ目でジャンプする境界の状態が曖昧両側のポーズ、フレームの向き、小道具の関係、光、カメラを記述する
ストーリーボードのグラフィックが現れる継承の除外指定が抜けている枠線、矢印、テキスト、ラベル、線画スタイルを拒否する
ブロックアウトが灰色のままプレースホルダーのマッピングが不完全各図形を対応づけ、最終的な再レンダリングを明示的に要求する
感情が芝居がかって見える指示が抽象的きっかけ、身体的な反応、間、抑制を追加する
音声が意図しないソースのものになる音声の役割が未指定声/音楽/環境音のソースを特定し、他の音声を拒否する

一度に1つの層だけを変える。アイデンティティが間違っている場合、レンズ・照明・セリフ・尺を同時に変えてはいけない。

今日、これらのプロンプトをAPI経由で使う

公式文書は、Dreamina内のSeedance 2.5について、30秒生成やより大きな素材パックを含めて説明している。[2][3] それらは、このサイトが公開のSeedance 2.5開発者向けエンドポイントを提供している証拠ではないし、そのような主張もしていない。

今日利用可能な本番アクセスとしては、開発者は同じ役割マッピングの原則をSeedance 2.0 API概要に適用するか、reAPIが公開しているSeedance 2.0モデルを使うか、reference-to-videoで参照の挙動をテストできる。ジョブは、そのルートが公開している許容範囲に合わせて調整すること:2.0ルートは画像最大9枚、動画3本、音声3ファイル、参照動画/音声15秒、出力4〜15秒に対応し、スタジオのSeedance 2.5ルートは画像最大30枚、動画10本、音声10ファイル、出力4〜30秒に対応する。プロンプトの技法は引き継がれるが、機能の許容範囲は引き継がれない。

FAQ

最良のSeedance 2.5プロンプト構造とは?

被写体と目に見える行動から始める。環境、スタイル、1つのカメラ指示、音声は、シーンを変える場合にのみ追加する。マルチモーダル作業では、シーンの前に素材の役割台帳を、その後に一貫性ブロックを置く。長い動画では、中間部を明示的な終了状態を持つ連続した段階に分割する。

Seedance 2.5プロンプトで使える参照数は?

公式のDreamina 2.5ドキュメントは、合計最大50件(画像最大30枚、動画最大10本、音声最大10ファイル)を許容し、動画は合計30秒、音声も合計30秒までとしている。[1] Seedance2.soのSeedance 2.5ルートは同じ数値、つまり画像30枚、動画10本、音声10ファイルを公開している一方、旧来の2.0ルートは画像9枚、動画3本、音声3ファイルで頭打ちで、参照と出力の尺の上限もより短い。[4] サイト全体に単一の上限があると考えず、選択したルートのコントロールを確認すること。

アップロードした参照はすべてのシーンに現れるべきか?

いいえ。各ファイルに役割を割り当て、被写体プロファイルを構築し、シーンごとに必要な参照をリストする。モーション参照は、そのアクターや背景を提供することなくカメラのタイミングを制御できる。目指すべきは正しい選択であって、すべての素材を同時に使うことではない。

30秒の動画でタイムスタンプはどう書くべきか?

段階の予算配分には連続したレンジを使い、正確な秒数は重要な受け渡し、登場、退場、転換、音のビートにだけ使う。各段階には1つの主要な状態変化と目に見える終了状態を与える。正確なタイムスタンプは重要な出来事の目安であり、フレーム精度の編集を保証するものではない。

キーフレームグリッドとストーリーボードグリッドの違いは?

個別のキーフレームは順序づけられた視覚的状態をより直接的に定義する。ストーリーボードグリッドは筋書き、ショットの順序、おおよその構図、カメラのアイデアを伝える。グリッドを使う場合は読み順を明記し、その枠線、矢印、ラベル、線画、プレースホルダーの顔を拒否すること。

ソース動画の編集がすべてを変えてしまわないようにするには?

ソース動画を、タイムライン、カメラ、動き、演技配置、遮蔽、出来事の順序の唯一のマスターと宣言する。ターゲット参照の狭い役割を定義し、正確な編集内容と対象物の個数を明記し、変えてはいけないものをすべてリストする。

プロンプトによってSeedance2.soで30秒出力が解放されるか?

いいえ。尺はモデルのパラメータであり、魔法の言葉ではない。ただし上限そのものはルートによって変わる。このサイトのSeedance 2.5ルートは、Dreaminaの文書化されたワークフローと同じく最大30秒を生成し、2.0ルートはプロバイダーとティアに応じて4〜15秒で頭打ちになる。長いテイクを可能にするのは2.5を選ぶことであり、15秒のルートでプロンプトに「30秒」と書いても何も起きない。常に選択したモデルの表示コントロールを信頼すること。

このサイトでSeedance 2.5のAPIアクセスは利用できるか?

ここでは公開のSeedance 2.5開発者向けエンドポイントは主張していない。自動化のベースラインとしては、現行のSeedance 2.0 API概要reAPIが公開しているSeedance 2.0モデルを使うこと。将来の2.5 APIリリースについては、それを前提に構築する前に必ず公式ソースで確認すること。

参照マップを次のプロンプトに変える

構造を証明する最小のジョブから始める:1つの被写体、1つの目に見える状態変化、1つのカメラの判断、そしてそれらの選択を制御する参照だけ。すべての素材の役割はシーンの上に、個数・アイデンティティ・小道具の所有権・向き・除外事項はその下に置く。各カードにはそのままコピーできる完全なプロンプトがあり、周囲の解説と最後のチェックリストでレンダーを評価できる。試すのに最も速いのは、Seedanceスタジオを開き、手元の素材に合うルートを選び、まずプロンプトの最小版を走らせることだ。

これらのコントロールが利用可能な場合は、Dreaminaの公式30秒・大規模参照テンプレートを使うこと。より小規模なサードパーティやAPIワークフローでは、同じ演出ロジックを保ちながら、そのチャネルが示す上限に合わせて素材パック、尺、段階の数を減らすこと。役立つSeedance 2.5プロンプトガイドとは、プロンプトを単に長くするのではなく、次の生成を診断しやすくするものであるべきだ。

References

  1. ByteDance / Dreamina. Dreamina Seedance 2.5 Prompt Guide. Official formulas, multimodal material limits, role mapping, staged timing, editing, extension, anchors, storyboards, blockouts, transitions, performance, and camera direction. Last modified July 31, 2026. Retrieved August 2026 from bytedance.larkoffice.com/docx/A88jd0B47oAd8zxWp5ycZFMfnxh
  2. ByteDance / Dreamina. Dreamina Seedance 2.5 User Guide. Official mode, input, duration, language, long-video, editing, extension, and Clay Renderer documentation. Last modified July 31, 2026. Retrieved August 2026 from bytedance.larkoffice.com/wiki/NjnWwvf4BiFYFLk2RzrcEgaunGf
  3. Dreamina. AI creation home. Official product entry linked from the Seedance 2.5 User Guide. Retrieved August 2026 from dreamina.capcut.com/ai-tool/home
  4. Seedance2.so. Current omni-reference fields and model configuration. Independent third-party implementation. The Seedance 2.5 route exposes 30 image, 10 video, and 10 audio input fields with 4–30-second outputs; the 2.0 routes expose 9 image, 3 video, and 3 audio fields with 4–15-second outputs. Retrieved August 2026 from seedance2.so/reference-to-video

著者

avatar for Seedance Team
Seedance Team

カテゴリー

60秒でわかる答えまず、Dreamina 2.5の制限とこのサイトの現行APIを切り分ける公式Seedance 2.5プロンプト公式プロンプト設定はシーン描写ではないシーンを書く前に参照マップを組む1. 各素材に1つの主要な役割を与える2. すべての被写体を個別に紐づける3. 大きなパックを制作上の役割ごとにグループ化する4. 被写体プロファイルを作り、シーンごとに参照を選ぶ各音に役割を与える音声記号法30秒のプロンプトを連続した状態変化として書く予算にはレンジ、受け渡しにはポイント、リアクションには相対的なタイミングを使うソース動画を意図せず再生成せずに編集する公式パターンの例:ランプを1つ交換する境界を設計して前後に延長する前方向延長のテンプレート先頭・最終フレーム、マルチキーフレーム、ストーリーボードグリッド先頭・最終フレーム:エンドポイントを固定するマルチキーフレーム:順序づけられた可視状態を固定するストーリーボードグリッド:最終的なピクセルではなくショットの順序を伝える粗いブロックアウトと精密なブロックアウト画像セットからワンクリックで動画を作るトランジション、感情表現、プロフェッショナルなカメラ言語シームレスなトランジションでは視覚的な橋渡しを記述する感情のラベルではなく、観察可能な演技を指示するカメラ用語を曖昧さのない指示として使う提出前チェックリスト1つの層を直して出力を診断する今日、これらのプロンプトをAPI経由で使うFAQ最良のSeedance 2.5プロンプト構造とは?Seedance 2.5プロンプトで使える参照数は?アップロードした参照はすべてのシーンに現れるべきか?30秒の動画でタイムスタンプはどう書くべきか?キーフレームグリッドとストーリーボードグリッドの違いは?ソース動画の編集がすべてを変えてしまわないようにするには?プロンプトによってSeedance2.soで30秒出力が解放されるか?このサイトでSeedance 2.5のAPIアクセスは利用できるか?参照マップを次のプロンプトに変えるReferences