ガイド

Seedance 2.0 ガイド

基本公式から画像リファレンス、動画リファレンス、動画編集までの完全な書き方——すべての実例は Volcengine 公式プロンプトガイドの検証済み事例をアレンジしたもので、「試してみる」をクリックすれば Molyin のジェネレーターにそのまま入力されます。Seedance 2.0 を初めて使う方にも、成功率をもう一段上げたい方にも、最初から最後まで読む価値のあるガイドです。

最終更新 2026-08-12

01 基本公式

Seedance 2.0 は本質的にマルチモーダルな AI ディレクターです。テキスト・画像・動画・音声を同時に読み取り、プロンプトを内部で「空間レイヤー」(画面に何があるか)と「時間レイヤー」(物事がどう変化するか)に分解して理解します。だから良いプロンプトは散文ではなく、エンジニアリングの指示書です——誰が、どこで、何をするか、カメラがどう動くか、どんな順序で。本章では公式の応用公式を再利用可能なパーツに分解し、カット番号でマルチカットの物語を組み立てる方法を解説します。

1.1 基本プロンプト公式

公式の応用公式は8つのパーツから成ります:精確な主体 + 動作のディテール + シーン + 光と色 + カメラ + ビジュアルスタイル + 画質 + 制約条件。初日から8つ全部を書く必要はありません——主体と動作が必須の2要素で、残りは必要に応じて重ねるだけ。ただし締めの制約ワードは習慣にしましょう。「字幕を入れない」「透かしを生成しない」といった否定の指示は、失敗率を目に見えて下げます。

[主体] + [動作] + 任意 [環境] [美学] [カメラ] [音声] [制約]

必須

主体 (Subject)

画面の主役——人物・動物・プロダクト。具体的であるほど良い。

必須

動作 (Motion)

主体が何をするか。体の部位と速さ・強さまで書く。

任意

環境 (Environment)

シーンと空気感:場所、時間帯、光、天気。

任意

美学 (Aesthetics)

画風と画質:色調、質感、精細さ。

任意

カメラ (Camera)

フレーミングとカメラワーク:クローズアップ、プッシュイン、パン。1カット1種類。

任意

音声 (Audio)

セリフ、効果音、背景音楽の指定。

任意

制約 (Constraints)

締めの否定の指示:「字幕を入れない」「透かしを生成しない」「ロゴを生成しない」。

窓辺の茶トラ猫

プロンプト

午後の日差しが降り注ぐ窓辺で、茶トラの猫がうたた寝をしている。しっぽの先が時々ゆらりと動き、そよ風が白いレースカーテンの端を持ち上げる。カメラはゆっくりと猫の顔のクローズアップへ寄り、午後の陽光が毛並みに金色の輪郭を描く。温かく心癒される空気感、シネマティックな質感、柔らかな自然光、豊かなディテール。字幕は入れず、透かしは一切生成しない。

主体+動作を2文、環境・カメラ・画質を1文ずつ、最後に制約ワードで締める——公式の応用公式を一通りなぞった構成です。

1.2 主体と動作の定義

モデルの理解力の上限は、あなたの動作描写で決まります。公式の3つの鉄則。1つ目:動作は体の部位に分解し、強さを添える——手・肩・頭まで書き、「ゆっくり」「力強く」「わずかに」で修飾する。2つ目:ゆるやかで連続する小さな動きを優先する。疾走や大ジャンプのような爆発的な動作は崩れやすい。3つ目:連続する動作のつなぎを書く。例:「振り向いた勢いのまま、手を上げる」。感情は体のディテールで外化しましょう——「指先が無意識に服の裾を握りしめる」は「とても緊張している」に必ず勝ります。

バリスタのラテアート

プロンプト

深緑のエプロンを着たバリスタが木のカウンターの内側に立ち、両手でミルクピッチャーを持ってわずかに傾け、手首を一定のリズムで揺らしながら、ミルクフォームにゆっくりとリーフ模様を描いていく。描き終えると上体を起こし、その勢いのままカップをのぞき込む——思わず口元が緩む。固定のミディアムショット、暖色のカフェ空間、背景は柔らかくぼける、穏やかな光。顔は安定して歪まず、動きは自然で滑らか、カクつきもちらつきもなし。字幕は入れない。

動作は手首まで書き、速さを定量化(「一定のリズムで揺らす」)。「その勢いのまま」は公式推奨の動作のつなぎ表現。感情は「口元が緩む」で外化し、制約ワードで締めています。

1.3 ショット分割とカメラワーク

2カット以上の映像なら、「カット1 / カット2 / カット3」と番号を振って絵コンテを書きましょう。各カットには順に、カメラワーク、主体の動作、位置の変化、音声を書きます。公式の注意点:「秒単位の厳密な指定」への対応は不安定で、長さを強制すると異常な結果になることがあります——カット番号で書き、物語のテンポはモデルに任せましょう(これは Seedance 2.5 の秒単位タイムスタンプとは逆の書き方です。混同しないでください)。そして1カットにつきカメラワークは1種類——プッシュ・パン・トラックを重ねても、手に入るのはブレだけです。

寮の部屋のミニドラマ(公式実戦事例)

プロンプト

女の子の外見は画像1、寮の部屋のシーンスタイルは画像2、カメラワークは動画1、環境音は音声1を参照。カット1:夕方、女の子が軽快な足取りで寮のドアまで歩く。カメラはミディアムショットで滑らかに追い、暖かな黄色い日差しが窓から廊下に差し込む。彼女はドアの前で一度立ち止まり、深呼吸して、どこか緊張した面持ち。カット2:ドアを押し開けて中に入る。室内のミディアムショットに切り替わり、ルームメイトたちが本から顔を上げ、ひとりが笑いながら尋ねる{テストどうだった?受かった?}。カメラは数人の間をゆっくり切り替えながら半身のクローズアップを映す。カット3:女の子はまずうつむいて寂しそうな表情——カメラは近景へ——それから顔を上げ、笑いをこらえきれずに声を上げて笑う{うそだよ!だまされた?}。ルームメイトたちは追いかけっこを始め、カメラはゆっくり引いて、笑い声に包まれた寮の全景に落ち着く。全編、高精細なシネマティックなドキュメンタリー調、暖かい色調、柔らかな光。顔は安定して歪まず、動きは自然で滑らか、カクつきもちらつきもなし。環境音は音声1と自然に溶け合う。字幕は入れない。

参照画像2枚+カメラワークの参考動画1本+環境音の音声1本が必要です。公式実戦事例の完全な骨格——冒頭で素材を紐づけ、カット番号で分け、セリフは{}で囲み、画質と制約ワードで締めます。

1.4 画質・スタイル・制約ワード

締めの3種のワードはそれぞれ役割が違います。スタイルワードが画風を決め、画質ワードが精細さの下限を守り、制約ワードが仕上がりを締める——「字幕を入れない」「透かしを生成しない」「ロゴを生成しない」は公式の制約ワード3点セットで、失敗率を目に見えて下げます。次の実例は3種をすべて盛り込んだものです。

サイバーパンクの雨の路地

プロンプト

サイバーパンク調、寒色系のブルーバイオレットの色彩。雨の夜の細い路地、両側でネオン看板とホログラム広告が明滅し、発光ジャケットを着た人物の後ろ姿がゆっくり路地の奥へ歩いていく。濡れた路面に灯りが映り込む。カメラは滑らかにパンして追う。シネマティックな質感、豊かなディテール、鮮やかな発色、奥行きのある光。文字や字幕は一切生成しない。ロゴも透かしも入れない。

冒頭のスタイルワードで画風を決め、末尾の制約ワードで締める——字幕や透かしの混入を防ぐ鉄板の流儀です。

02 動画の中の文字

スローガン、字幕、吹き出し——Seedance 2.0 は読める文字を画面に直接生成できます。まず公式のシンボルプロトコルを覚えましょう:セリフは{}、字幕は【】、音楽は()、効果音は<>。記号が各テキストの種類をモデルに伝えます。画面内の文字は一般的な文字を使い(難読文字や特殊記号は崩れやすい)、セリフの言語はひとつに統一——日本語と英語の混在は避けます(固有名詞を除く)。

2.1 スローガンとタイトル文字

公式のスローガン型は5点セットです:テキスト内容 + 出現タイミング + 出現位置 + 出現方式 + 文字の特徴(色・スタイル)。書体の雰囲気はモデルが自動で合わせます。厳密にしたいときは色とスタイルを直接指定しましょう。最後に「指定した文言以外の文字は一切出さない」と添えれば、余計な看板や字幕の混入を防げます。

[テキスト内容] + [出現タイミング] + [位置] + [出現方式] + [スタイル]

必須

テキスト内容

画面に出す文字そのもの。引用符で一字一句正確に。

任意

出現タイミング

いつ文字を出すか。例:「映像の後半で」。

任意

位置

どこに出すか。例:「画面中央」「下部」。

任意

スタイル

色・書体の雰囲気・動き。例:「明るい黄色の手書き風文字がふわりと浮かび上がる」。

レモンティーの広告スローガン

プロンプト

手描きコミック風。3人の友人がキャンプテーブルを囲み、画像1のレモンティーを一緒に飲んでいる。和やかでのんびりした雰囲気。映像の後半で画面が徐々にぼけていき、画面中央に「夏限定、いつでもさっぱり」という文字が浮かび上がる。丸みのある手書き風フォント、明るい黄色、小さく弾む動き付き。指定した文言以外の文字や字幕は、画面のどこにも出さない。

商品の参照画像1枚が必要です。公式の5点セットを一通り押さえ、余計な文字を締め出す決めゼリフで締めています。

2.2 字幕

字幕とナレーションは生まれながらの相棒です。セリフは{}に一字一句書き、字幕は【】で示すか、公式の定型文——「画面下部に字幕を表示し、音声のリズムと完全に同期させる」——を使います。定型文をそのまま引用するのがいちばん安定します。

宇宙の夜明け・ナレーション付き

プロンプト

ナレーション付きの動画を生成。落ち着いた低い男性の声が言う{広大な宇宙の中で、私たちの世界はほんの束の間の瞬きにすぎない。それでもその中で、命はあらゆる困難に抗して花開く}。シーンは満天の星の夜から夜明けへとゆっくり移り変わり、星々がひとつずつ消え、尾根の向こうから太陽が昇り、雲海が金色に染まる。画面下部に字幕を表示し、音声のリズムと完全に同期させる。

締めの一文は公式の字幕定型文のそのまま。セリフを{}で書けば、字幕は自動で音声にそろいます。

2.3 セリフの吹き出し

マンガ風の吹き出しは、キャラクターのセリフを画面に直接「生やす」表現です。公式の言い回し:「キャラクターが{セリフ}と言い、話しているキャラクターのそばに対応するセリフ入りの吹き出しが現れる」。ショートドラマや販促の小劇場のような軽い物語に向き、セリフは短いほど決まります。

ランニングトラックの3つのセリフ(官方案例)

プロンプト

画像1の2人がスポーツウェア姿で学校のトラックを走っている。女の子は男の子に向き直り、自信に満ちた笑顔で言う{We can definitely do it!}。カメラは男の子の近景に切り替わり、彼はためらいがちに答える{Are you sure?}。カメラは女の子のミディアムクローズアップに戻り、彼女は明るく言う{Yes!}。雰囲気は明るく、意志は固い。話しているキャラクターのそばに、それぞれ対応するセリフ入りの吹き出しが現れる。吹き出しのセリフ以外の文字は、画面のどこにも出さない。

2人写りの参照画像1枚が必要です。セリフごとにカメラが2人の間を行き来——数秒で収まるのは、ひとりひとつの短いセリフまでです。

03 画像リファレンス

百の形容詞より1枚の参照画像。商品写真・キャラクター画像・ロゴをアップロードし、プロンプトで「画像1」「画像2」と名指しすれば、モデルは素材から外見とスタイルをロックします。アップロード順がそのまま番号です。複数主体のシーンでは公式の定義文を使いましょう——「画像1の赤いワンピースに麦わら帽子の女性を主体1と定義する」。以降は同じラベルで呼び続け、名前と「あの女性」を行き来しないこと。そして素材は多いほど良いわけではありません。公式の推奨は4〜5点の構成(キャラクター画像1〜2枚+シーン画像1枚+カメラワーク参考動画1本+音声1本)。スロットを使い切ると、モデルの特徴の優先順位がかえってぼやけます。

3.1 多角度の主体リファレンス

EC向けの回転展示も、キャラクターのシーンをまたいだ再利用も、多角度の参照画像で外見をロックするのが鍵です。同じ主体を別角度から撮った画像を2〜3枚アップロードすれば、モデルは完全な「顔のプロファイル」を構築し、シーンが変わっても別人になりません。人物なら、顔のクリーンなクローズアップ1枚と全身ショット1枚で十分。マルチビューのコラージュは避けてください——モデルが別角度を別人と読み取りがちです。

[画像N]の[主体]を参考に + [シーン描写]を生成 + [主体]の特徴を一貫させる

必須

参照主体

見た目を固定したい主体。「画像N」で対応する参照画像を指す。

任意

シーン描写

新しいシーンで起きること:動作、カメラ、環境。

任意

一貫性

「参照画像と一貫させる」の一文で見た目のロックを強化。

カメラの360°展示(官方案例)

プロンプト

画像1・画像2・画像3からカメラを抽出し、背景を真っ白に置き換え、白いテーブルの上に置く。冒頭はボディの素材感のクローズアップから始め、続いてカメラを中心にゆっくり一周まわり、正面・側面・背面をくまなく見せる。製品の外観は参照画像と一貫させる。スタジオ品質の照明、クリーンな画面。透かしや文字は一切生成しない。

別角度の商品画像を2〜3枚アップロードしてください。「抽出し……一貫させる」は多角度で外見を固定する公式の定型表現。締めは制約ワードです。

3.2 複数画像リファレンス

複数枚の画像にはそれぞれ担当をひとつずつ。キャラクター担当、ロゴ担当、シーン担当——という具合に。アップロード順に「画像1」「画像2」と役割を名指しすれば、モデルが取り違えることはありません。重要な素材ほど、プロンプトの早い位置で言及しましょう。

ネオン都市でロゴ登場(官方案例)

プロンプト

背景はネオンが瞬く未来都市の空中回廊。飛行機とホログラム広告が交錯する。画像2の女の子を参照に、冒頭はミディアムショットで、彼女がホログラムの輝きをまとった銀色の浮遊ランタンを放つ。続いてカメラはゆっくり引いて、満天の浮遊ランタンを見渡す。画面が徐々にぼけ、画像1のロゴが中央に浮かび上がって静止する。全体は3DサイバーパンクSFアニメ調、寒色のブルーバイオレット。女の子の外見は参照画像と一貫させる。

画像2枚(ロゴ+キャラクター)が必要です。ロゴの登場は画面がぼける転換の直後——最もセレモニー感が出る位置です。

カフェで5素材・5つの役割(官方案例)

プロンプト

シーンは画像4のレストランの店内。客が行き交う中、画像1の女の子が画像2の衣装を着て、カウンターの上の品を整えている。画像3の男の子は客で、近づいてきて連絡先を聞こうとする。画像5のサインは終始、画面右下に表示されたまま。顔・髪型・衣装のディテールは参照画像と一貫させ、映像は自然で滑らかに。字幕は入れない。

参照画像5枚(女の子/衣装/男の子/シーン/サイン)が必要です。1枚につき役割はひとつ、番号でひとつずつ名指し——公式の複数要素リファレンスの標準形です。

04 動画リファレンス

言葉で決めきれないもの——格闘の振り付け、急降下するカメラの軌跡、パーティクル演出——は参考動画に任せましょう。モデルは動作・カメラワーク・エフェクトの形態を再現します。あなたは主体とシーンを差し替えるだけ。アップロード順が「動画1」「動画2」の番号です。素材予算の鉄則も忘れずに:4〜5点がスイートスポット。スロットを使い切ると、スタイルの衝突や主体認識のぼやけを招きます。

4.1 動作リファレンス

格闘、ダンス、疾走——複雑な動作は文字にすると必ず情報が欠けます。動作の参考動画をアップロードすれば、モデルが振り付けとカメラワークをそのまま再現。キャラクターの外見とシーンはあなたの素材に差し替えるだけです。

二人の対決シーン(官方案例)

プロンプト

動画1の人物の動きとカメラワークを参照に、画像1と画像2の2キャラクターの対決シーンを生成する。画像1は右側のファイター、画像2は左側のファイター。打ち合いは緊密でテンポが速く、カメラはアクションの起伏に乗る(背景には激しいパーカッションが鳴っている)。顔は参照画像と一貫させ、動きは滑らかで硬直させず、クリッピングもカクつきもなし。字幕は入れない。

動作の参考動画1本+キャラクター画像2枚が必要です。動作とカメラは動画、顔は画像、音楽は()記号——公式の役割分担です。

4.2 カメラワークのリファレンス

FPVの急降下や旋回上昇のようなカメラの軌跡は、どんなカメラ用語よりも参考動画のほうが正確に伝わります。モデルは軌跡をなぞるだけ。あなたは新しい視覚の中心とシーンを指定します。

テクノロジーパークをFPVダイブ(官方案例)

プロンプト

動画1のカメラワークを参照に、テクノロジーパークのコンセプト映像を作る。画像1の高層ビルを視覚の中心に据え、同じ一人称視点のダイブ——雲の上から急降下し、タワー間のスカイブリッジをくぐり抜け、最後は水面すれすれを低空で滑空する——で、パークのハイテク感と近未来感を伝える。映像は滑らかで安定、シネマティックな質感。字幕は入れず、透かしは一切生成しない。

カメラワークの参考動画1本+シーン画像1枚が必要です。「同じ一人称視点のダイブ」は公式の言い回し——軌跡は参考動画から複写され、文字よりはるかに正確です。

4.3 エフェクトリファレンス

パーティクル、光の演出、変身の軌跡——エフェクトの形と動きのロジックを文字で説明するのは至難の業です。実戦の結論はひとつ。文字で指定したエフェクトが思い通りにならないときは、参考動画で指すにかぎります。命中率が一気に上がります。

笛を包む金色の粒子(官方案例)

プロンプト

動画1の金色のパーティクルエフェクトを参照に:画像1の古風な装いの人物が竹笛を奏でると、同じ金色の粒子がその周りを渦巻き、旋律のリズムに合わせて集まり、散っていく。顔は参照画像と一貫させ、動きは自然に。全体は武侠映画の空気感。字幕は入れない。

エフェクトの参考動画1本+キャラクター画像1枚が必要です。エフェクトは動画で指すほうが、形容詞を積み上げるより確実です。

05 動画編集

既存の動画をアップロードして、一文で要素の追加・削除・置換、前方・後方への延長、複数クリップの接続を行います。作業に合わせてモデルを選びましょう:要素の編集は Seedance 2.0 Video Edit——動画編集モードで 3〜15 秒のソース動画をアップロードし、出力の長さはソースに従います。延長は Seedance 2.0 Extend——1 回につき 4〜15 秒を追加できます。2 本のクリップの接続は引き続き参照から動画モードで、両方の動画を参照として添付します。書き方の鉄則は変わりません。編集タスクでは「参考」なしで「動画1」と直接書くこと——「動画1を参考に」と書くと、編集ではなくリファレンスタスクと誤認されます。

5.1 要素の追加・削除・置換

この作業は Seedance 2.0 Video Edit モデルに任せます。公式の言い回しは操作ごとに異なります:追加は「要素の特徴+出現位置」を明記。変更は「動画NのAを画像NのBに置き換える」。削除は消すものを名指しし——あわせて残すべきものを強調します。公式ガイドの実測で、このほうが明らかに良い結果になりました。置換では新しい要素の参照画像を添えると、見た目の精度が上がります。

[動画N]の[時間/位置]に + [要素の説明]を追加/削除/置換

必須

編集操作

追加・削除・置換のどれか。ひとことで操作を明示する。

任意

時間位置

動画のどのタイミングで起きるか。例:「映像の後半で」。

任意

空間位置

画面のどこで起きるか。例:「テーブルの左側」。

テーブルに軽食を追加(官方案例)

プロンプト

動画1のテーブルの上に、フライドチキンやピザなどの軽食を追加する。料理は自然に置かれ、光の当たり方は元の映像と一致させ、それ以外は一切変更しない。

元の動画1本が必要です。公式の追加表現=要素の特徴+位置。「それ以外は一切変更しない」で締めます。

テーブルを片づける(官方案例)

プロンプト

動画1のテーブルから他のパーツや工具を取り除き、天板をすっきり清潔に保つ——残るのは2人が手に持っている物だけ。2人の動き、光、カメラワークは完全に変更しない。

元の動画1本が必要です。公式の削除の鉄則:消すものを名指しし、残すべきものを強調する——実測で明らかに成績が上がります。

香水をクリームに置き換える(官方案例)

プロンプト

動画1の香水を、画像1のフェイスクリームに置き換える。動作とカメラワークは変更せず、置き換え後のパースと反射は元の映像に自然に溶け込ませ、それ以外はすべてそのままにする。

元の動画+置き換え後の参照画像1枚が必要です。公式の変更表現=「動画NのAを画像NのBに置き換える」+動作とカメラは不変。

5.2 動画の延長

Seedance 2.0 Extend モデルに切り替え、スライダーで 4〜15 秒の新規映像を選びます。前に延ばしてプロローグを足し、後ろに延ばして結末を続ける。映像・音声のスタイルと主体は自動で引き継がれます。書くのは新しい区間だけ——モデルがつなぎ目を自動でトリミングし、元の映像が再生成されることはありません。

前に足すオーバーショルダーの励まし(官方案例)

プロンプト

動画1を前に延長する:白い服の男性にオーバーショルダーショットを与え、彼は穏やかに言う{It's not that bad. You're just stressed. Everyone goes through this, you just need to keep going.}。室内の光は元の映像と一貫させる。

元の動画1本が必要です。「動画1を前/後ろに延長」とそのまま書けばOK——「参考」という言葉は絶対に足さないでください。リファレンスタスクと誤認されます。

友達との再会へ続ける(官方案例)

プロンプト

動画1の続きを生成する:遅れてきた2人が駆け寄り、5人の友達がついに顔を合わせ、和やかに語らう。外見・設定・光は元の映像から引き継ぎ、動きは自然で連続的に。

元の動画1本が必要です。後ろへの延長は新しい区間だけを書きます——モデルがつなぎ目を自動でトリミングし、元の映像を再生成することはありません。

5.3 トラック補完

冒頭のクリップと末尾のクリップを渡せば、欠けた中間のトランジションはモデルが補完します。プロンプトで書くのは継ぎ目で起きることだけ——一陣の風、パーティクルのトランジション、マッチカット、どれも優れた接着剤です。入力動画は最大3本まで、合計15秒以内に対応しています。

落ち葉の転換で新シーンへ(官方案例)

プロンプト

動画1。落ち葉が地面に触れた瞬間、金色の粒子が輪になって弾け、一陣の風が画面を吹き抜ける——そして動画2につながる。

動画を2本(冒頭と末尾)アップロードしてください。過渡描写は欠けた中間部分だけ——短く、的を絞るのがベストです。

Seedance 2.0 パラメータ早見表

以下は Molyin のジェネレーターで Seedance 2.0 に実際に開放されている全設定です。

Seedance 2.0Seedance 2.0 FastSeedance 2.0 Mini
モードテキストから動画 / 画像から動画 / 参照から動画テキストから動画 / 画像から動画 / 参照から動画テキストから動画 / 画像から動画 / 参照から動画
解像度480p / 720p / 1080p / 4k480p / 720p480p / 720p
長さ4〜15 秒4〜15 秒4〜15 秒
アスペクト比16:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:116:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:116:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:1
音声対応対応対応
先頭・最終フレーム対応対応対応
参照画像数1〜9 枚1〜9 枚1〜9 枚
参照動画数最大 3 本最大 3 本最大 3 本
参照音声数最大 3 本最大 3 本最大 3 本
最終フレーム返却対応対応対応

よくある質問

最も多い8つの失敗パターンと、公式ガイドが示す解決策。