ガイド

Seedance 2.5 ガイド

Seedance 2.5 は1回の生成を30秒まで伸ばし、秒単位のタイムスタンプ脚本をネイティブサポート——思い通りに指示できる時代が来ました。このガイドは公式マニュアルを実際の制作タスク別に再構成。基本公式・実写人物の書き方からタイムスタンプ長回し、マルチモーダル参照、部分編集まで、すべての実例はワンクリックでMolyinのジェネレーターに読み込めます。

最終更新 2026-08-06

01 基本公式

Seedance 2.5 は構造化された指示の理解がさらに進化。完全なプロンプトは素材説明・一言概要・具体的なプロット・全体補足の4層で構成されます。この章ではまず骨格を立て、次に公式検証済みの実写人物公式を紹介します——「AI顔」とプラスチック質感を退治する専門処方です。

1.1 完全プロンプト公式

完全な Seedance 2.5 プロンプト = 素材説明 + 一言概要 + 具体的なプロット描写 + 全体補足。素材をアップロードしていなければ第1層は省略。プロットは時間軸またはストーリーラインで段落分けし、全体補足は末尾に置いて、作品全体を貫く要素と出したくないもの(字幕、BGMなど)を強調します。

[素材説明] + [一言概要] + [具体的なプロット] + [全体補足]

必須

一言概要 (Summary)

主体 + 場所 + 出来事 + ジャンル/スタイル + 特殊なカメラワークを一文で。作品のトーンを伝えます。

必須

具体的なプロット (Plot)

時間軸かストーリーラインで分割:各カットに映像内容、カメラワーク、動作、セリフ、効果音、そして不要な要素(否定の描写)を書きます。

任意

素材説明 (Assets)

アップロード順に素材へ番号を振り、各素材の用途(人物の外見、声色、動作、シーンのどれか)を明記。参照素材がなければこの層は丸ごと省略できます。

任意

全体補足 (Global)

末尾で作品全体を貫くディテールを再強調:カメラポジション、環境の特徴、光と影の空気感、あるいは全体禁止項(字幕、BGM)。

湿地のタンチョウ ドキュメンタリー

プロンプト

写実的な自然ドキュメンタリー風、映画レベルのリアルな光と影。早朝の薄霧の中、広大な湿地の葦原(シーンは画像1を参照)で、優雅なタンチョウ(外見は画像2を参照)が翼を広げて舞っている——羽毛は雪のように白く、頭頂は鮮やかな紅、姿はすらりと気品がある。シーンは秋の浅瀬の湿地。水面はきらめき、周囲には黄金色の葦、浮き草、水草が茂り、ぼけた背景には遠くの朝霧と昇り始めた太陽。カメラはローアングルのミディアムショット、わずかな手持ち感でほぼ固定、常にタンチョウを画面中央に保つ。 0s-3s:タンチョウが浅瀬に静かに立ち、大きな白黒の両翼をゆっくりと広げる。動きはしなやかで、翼が扇ぐ気流が水面にさざ波を立てる。朝風が吹き、地平線から差し込む斜光が薄霧を貫いてチンダル効果を描く。 3s-8s:タンチョウが水面を軽やかに跳ね、両足を交互に着水させてきらめく水しぶきを上げる。細長い首を後ろに反らし、くちばしを空に向け、軽やかに着地して両翼をたたみ、優雅に頭で周囲を見回して澄んだ一声を放つ。 ローアングルのカメラがタンチョウの跳躍の軌道をわずかに追って上下し、被写界深度は自然、手前の葦は軽くぼける。環境音は水の流れる音、力強い翼ばたき、鶴の鳴き声のみ。全体は静謐で、澄み渡り、美しい。

参考画像を2枚アップロードしてください(シーン + 主体)。冒頭の一文でトーンを決め、中盤は時間軸でプロットを分割、末尾で全体の空気感を締める——4層構造が一目瞭然です。

1.2 実写人物公式(AI顔対策)

2.5 では「AIっぽさ」が大幅に弱まりましたが、本物と見紛う実写人物を出すには書き方が決め手です。公式検証済みの7次元公式は人物を年齢・人種、肌質、顔のディテール、目つき、髪型、服装、体型・雰囲気に分解します——なかでも目つきが魂。「微細な毛穴と肌の質感をそのまま保つ」という忠実度サフィックスはほぼ必須です。

[年齢/人種] + [肌色/肌質] + [顔のディテール] + [目つき/魂] + 任意 [髪型] [服装] [体型/雰囲気]

必須

年齢/人種

具体的な年齢 + 国籍/人種 + スタイル形容詞 + 顔型の名詞。例:「22歳の東アジア系女性、クールで古典的な骨格美の顔」。

必須

肌色/肌質

冷暖のトーン + 肌色の名詞 + 質感形容詞 + 忠実度サフィックス「微細な毛穴と肌の質感をそのまま保つ」(そばかすや小じわを足すとさらにリアル)。

必須

顔のディテール

目の形 + 眉骨 + 鼻梁 + 唇の形 + 顎のライン。最低3〜4点の組み合わせが人物の識別度を決めます。

必須

目つき/魂

目つきの形容詞 + 視線が伝える情報や比喩 + 根底の感情——人物の感情表現力を決める要素です。

任意

髪型/髪色

具体的な髪色 + 髪の状態/質感 + 髪型の名詞 + 環境との相互作用(風に舞うなど)。

任意

服装/質感

シルエットの裁断 + 色 + 衣類の名詞 + 布の素材/新旧の状態 + 着こなしのディテール。人物を間接的に引き立てます。

任意

体型/雰囲気

骨格・肩の特徴 + 構図の要求 + 動作と視線 + 全体の雰囲気ワード。

古典美人のクローズアップ

プロンプト

22歳の東アジア系女性、古典の趣あふれる淑やかな映画顔。寒色系の白い肌で、きめ細かくしっとりした質感。微細な毛穴と肌の質感をそのまま保つ。細く長い桃花眼(目元はかすかに潤む)、眉間は穏やかに開き、鼻梁は小ぶりでまっすぐ、唇はふっくらとして口元にかすかな優しい微笑みをたたえ、顎のラインは柔らかい。目つきはこのうえなく情深く、瞳の奥に春の水を湛えたよう。視線は優しく注がれ、深い愛惜とわずかな名残惜しさがにじむ。黒髪はラフで典雅な低めのまとめ髪に結い、素朴な玉のかんざし一つで留め、ほつれた細い房が頬の際に垂れて微風に揺れる。極めてシンプルな純白の交領の伝統衣装を纏い、布は柔らかな光沢のある素朴な絹で、襟元がわずかに開いている。体つきはほっそり、肩はなで肩で、優しく婉曲、情深くしっとりとした古典的ロマンの気質を漂わせる。クローズアップ構図、視線はカメラを真っ直ぐ見る、柔らかな自然光、浅い被写界深度。

テキストから動画だけでOK。この書き方はアニメキャラにも応用できます——「実写の質感」を対応する画風の描写に置き換えるだけです。

02 タイムスタンプと30秒長回し

Seedance 2.5 の最大のアップグレード:1回の生成が15秒から30秒へ倍増し、秒単位のタイムスタンプをネイティブサポート。何秒目にどんな動作が起き、何秒目にカットを切り替えるかを正確に指定でき、脚本レベルの精密な再現が可能になります。この章では長編動画の3層構造とトランジション公式を解説します。

2.1 タイムスタンプ脚本の絵コンテ

長編動画公式の核心は、作品を複数のタイムスライスに切り分けること。各スライスに「開始-終了秒数 + ステージテーマ + 動作/表情などの物理指示 + 感情のサブテキスト」を書きます。サブテキストはAIに「なぜそう設計したか」を説明するもの——これを書くかどうかで演技の繊細さが段違いです。スライスの前には「全体設定」モジュールも忘れずに:環境の質感、ビジュアルスタイル、カメラワーク、人物造型、演技の核心、禁止項。

[開始秒-終了秒] + [ステージテーマ] + [動作/表情指示] + 任意 [感情のサブテキスト]

必須

タイムスライス

明確な開始・終了秒数(0-3s、00:08-00:15 など)。2.5 は秒単位で正確に実行します。

必須

動作/物理指示

ショットサイズ + 構図 + 人物の細かい動作——このスライスで画面が厳密に従うべき内容。

任意

ステージテーマ

スライスに名前を付けます(「問いかけ」「諦念」など)。モデルが段落の感情トーンを把握しやすくなります。

任意

感情のサブテキスト

物理指示の背後にある表現意図をAIに説明。例:「彼女は泣き訴えているのではなく、答えを待っている」。

29秒ワンカット:川辺の別れ

プロンプト

29秒ワンカット(時代劇風の女性、川辺の別れ) 【全体シーン設定】 基本環境:早朝の川辺、背景にぼやけた小舟。寂しげな送別のシーン。空気は静かで抑制されている。 ビジュアルスタイル:シネマティック、浅い被写界深度(背景はシンプルにぼける)、柔らかな自然光。 カメラ言語:常に女性のミディアムクローズアップを保ち、向かいに立つ「彼」の主観視点のように。わずかな手持ちの呼吸感、早いカット割りはなし。 人物造型:22歳の東アジア系女性、古典の趣あふれる淑やかな映画顔。寒色系の白い肌で、きめ細かくしっとりした質感。微細な毛穴と肌の質感をそのまま保つ。細く長い桃花眼(目元はかすかに潤む)、鼻梁は小ぶりでまっすぐ、唇はふっくらとして口元にかすかな優しい微笑み。目つきはこのうえなく情深く、瞳の奥に春の水を湛えたよう。黒髪は古典的な低めのまとめ髪に結い、素朴な玉のかんざし一つで留めている。極めてシンプルな純白の交領の伝統衣装、柔らかな光沢のある絹の質地。体つきはほっそりとし、優しく婉曲な古典的ロマンの気質を漂わせる。 演技の核心:抑制された繊細さ。目つきの移ろい、呼吸の起伏、唇の微かな震え、眉間の緊張と弛緩、喉の嚥下、そして涙が自然にこぼれ落ちる過程を重点的に描く。 禁止項:大げさな泣き声は禁止。早いカット割り禁止。大きな身振り禁止。余計なセリフやBGMの生成禁止。涙が予定より早く落ちることを禁止。 【感情と動作の絵コンテ(0-29秒で段階的に進行)】 第1ステージ 0-3秒【問いかけ】:彼女はカメラを真っ直ぐ見つめ、目にまだ涙はなく、眉間にわずかにしわを寄せ、唇をわずかに開いて静かにささやく:「本当に行ってしまうの」。サブテキスト:彼女は泣き訴えているのではなく、とっくに予想していた答えを相手自身の口から聞こうと待っている。 第2ステージ 3-10秒【諦念】:彼女の視線はゆっくりと外れ、傍らの空き地へ向く。瞼は伏せられ、口元に短い苦笑が浮かんでは消え、鼻の翼がかすかにすぼまり、ごく控えめに小さく息を吸い、胸が一度だけ静かに上下する。サブテキスト:この動作で、彼女は無理やり悔しさと切なさを腹に飲み込もうとしている。 第3ステージ 11-17秒【記憶】:カメラがわずかにプッシュイン。彼女は再び視線を戻し、相手の顔をゆっくりと丹念に眺め渡す。目元はすでに赤く潤んでいるが、涙は必死にこらえて落ちない。途中0.5秒の静寂の間があり、彼女の唇がかすかに動いては結ばれ、顎が引き締まり、喉が小さく上下する。サブテキスト:この瞬間の凝視は別れではなく、人生最後にもう一度この人の姿を刻み、記憶しようとしている。 第4ステージ 18-23秒【惜別】:彼女は目を伏せ、予兆もなく一滴の涙がこぼれ落ち、襟元に落ちる。拭おうとはせず、再び目を上げた時、目つきは引き留めから極めて深い惜別へと変わっている。強く寄せられた眉間がゆっくりとほどけ始め、彼女はごく小さく(ほとんど気づかないほどの幅で)かぶりを振る。サブテキスト:眉間の弛緩は心の解放の象徴。小さなかぶり振りは運命への無力な最後の否定。 第5ステージ 24-29秒【手放し】:カメラはさらに近い極限のクローズアップへ。彼女は懸命に穏やかな微笑みを浮かべる(自嘲ではなく)、笑みが口元に届いたその時、2滴目の涙が目尻から鼻の脇を伝い唇のそばに止まる。彼女はほとんど聞こえないが懸命に落ち着かせた声で言った:「行って」。言い終えても笑みは顔に残り、涙は流れ続け、視線は決して逸れない。カメラは最後、涙を含んだ微笑みと瞳いっぱいの惜別をたたえた彼女の顔で止まる。

全体設定 + タイムスタンプ絵コンテの二段構えが30秒長回しの標準骨格です。「涙が早く落ちることを禁止」のような時系列の禁止項は、2.5 だからこそ抑え込める精度です。

2.2 カット切替とトランジション公式

マルチカットの物語にしたいなら、タイムスタンプスライスの中にトランジション指示を明記します。カット切替設定 = トランジション種類の指定 + 基本制約 + 切替ロジック。よく使うトランジション:自然なカット切替、フェードイン/フェードアウト、ディゾルブ、ホワイトフラッシュ/ブラックフラッシュ、マスクトランジション(物体がカメラを遮って暗転し、離れて開く)、類似物トランジション(満月が酒の碗に化ける)、アクショントランジション(ワイプパン)、動作リレートランジション(着替え)、プッシュイン/プルアウトトランジション(瞳孔の入れ子)、水墨画トランジション。候補をいくつか挙げてモデルに選ばせることもできます:「自然な切替/マスク/類似物トランジションの中から、本作のスタイルに最適なものを選んでください」。

[トランジション種類の指定] + 任意 [基本制約] + [切替ロジック]

必須

トランジション種類

方式を名指し:「カット切替箇所ではマスクトランジションを使用(生硬な切替禁止、物体の突然の出現禁止)」。

任意

基本制約

カメラの呼吸感と尺の調和を保ち、カットAとカットBそれぞれの内容を伝えます。

任意

切替ロジック

「シーンは必ず自然に切り替わること」を再強調。より豊かなカメラ言語が必要ならショットサイズの変化(クローズアップからミディアムへ等)を追記。

30秒 国風武侠アニメ:5種のトランジション連発

プロンプト

【全体設定】 基本環境と質感:深夜、静寂な竹林に佇む露天の旅籠。極限まで高品質な二次元作画の質感を強調。竹の葉の舞い散る軌道、酒に広がるさざ波は完全に物理法則に従い、国風特有の洒脱な趣を帯びる。 ビジュアルスタイル:最高峰の国風アニメ(セルルック3Dの写実画風)、縁は水墨画風の滲み。ハイコントラストな冷暖の光が交錯(冷ややかな青白い月光と旅籠の卓上の暖かな蝋燭の火が対比)。 カメラ言語:極めて鋭いモンタージュ編集と多様な物理的シームレストランジションを採用。静と動のコントラストは極大。 人物造型:22歳の青年剣客、国風アニメの凛々しい骨格美の顔。剣のような眉に星のような瞳、高い位置のポニーテールで結んだ髪、額には乱れた前髪。白地に黒の縁取りの交領の武術衣を纏い、卓上には黒い鞘の長剣。 演技の核心:最高峰の武侠における「一撃必殺」のスピード感、剣客の余裕と不動の佇まい、そして極めて東洋的な美学の詩的な余白を重点的に描く。 禁止項:3Dのテカテカ感は禁止(純正な国風セルルック3D画風を厳守)。武打の動作がだらしなく伸びたり、体がめり込んで歪んだりすることを禁止。字幕や余計なセリフの生成は一切禁止。水墨画効果は25秒以降、「カチャッ」という音とともにのみ出現させ、それ以前の出現を禁止。 【タイムスタンプ脚本の絵コンテ(明確なカット切替トランジション付き)】 00:00-00:04 カット1【静夜の酒】(類似物トランジション):カメラは静止して夜空を仰ぎ見る。巨大な皎々たる満月が画面中央を占める。空の満月が徐々に暗く薄れ、形も大きさもまったく同じ丸い酒の碗(真上から卓面を俯瞰する視点)が満月の位置からゆっくり浮かび上がり、月を完全に置き換える。碗の酒は月光の光点を映し、細かな波紋を立てる。過渡は必ず自然に。続いてカメラは俯瞰からゆっくり引いて水平視点へ。剣客が旅籠の卓に座り、ゆっくりとこの碗を持ち上げる。 00:05-00:10 カット2【殺気暗躍】(プッシュイン・クローズアップトランジション):剣客の動作がわずかに止まり、目つきが突如として鋭くなる。カメラは極めて速い速度で前方へプッシュインし、剣客の目を無限に拡大、瞳孔が全画面を占めると、画面は瞳孔の内側でシームレスに展開する——竹林の上空、黒衣の刺客が短刀を逆手に構え、蒼鷹が獲物に襲いかかるように空からカメラ目掛けて舞い降りる。 00:11-00:18 カット3【抜刀交錯】(アクションワイプパントランジション):カメラは急速に引いて剣客の全身ショットへ戻る。剣客は座から跳躍して抜刀。カメラは剣を振るう剣客の腕に追従して画面右へ激しく払い(ワイプパン)、全画面に横向きのモーションブラーを生じさせる。ブラーの中でシーンは一瞬で空中へ切り替わり、カメラ静止:剣客の長剣と刺客の短刀が激しく衝突し、武器の接点から巨大な橙色の火花と環状の衝撃波が炸裂する。 00:19-00:24 カット4【一撃必中】(マスクトランジション):二人は宙で交差してすれ違う。交錯の気流が竹の葉を一面に巻き上げ、そのうち巨大な一枚の青々とした竹の葉が横方向に飛来し、レンズを完全に遮って全画面が暗転。竹の葉がレンズから離れると、画面はすでに地上の水平ショットへ切り替わっている:背景で刺客が力なく墜落して倒れ、前景では剣客がカメラに背を向け、ゆっくりと長剣を鞘に収める。 00:25-00:30 カット5【余韻嫋々】(水墨画トランジション):剣客が剣を鞘に収める「カチャッ」という一音とともに、竹林と倒れた刺客の画面全体が、一滴の濃い墨が水に落ちたように、急速に白黒の水墨となって四方へ滲み、拡散し、泼墨の山水の意境の中で完全に静止して終わる。

各スライスでトランジションを1種ずつ名指しし、実行のディテールを明記。「それ以前の出現を禁止」のような否定の時系列制約が、トランジション効果のフライングを防ぐ鍵です。

03 マルチモーダル参照

2.5 では参照能力が全面的に解放されました:参照画像は最大30枚、参照動画・音声は1本あたり最長30秒(Molyin プラットフォームの設定値はパラメータ早見表を参照)、そして音声のみの駆動に初対応。この章では最も実用的な4つの参照シーンをカバーします:複数人物の共演、声色の複製、クリエイティブの転移、グリッド絵コンテ。

3.1 複数人物の参照(双子対策)

2.5 では複数人物シーンの「双子化」と「顔の入れ替わり」が重点的に修正されましたが、書き方は依然として重要です。キャラクターと参照画像を一つずつ紐づけ、全編で同じ呼称を使い、末尾に全体ロックを一文追加。人物の参照画像は単独写真を使い、マルチビューのコラージュは避けてください。

[キャラクター紐づけ] + 任意 [関係と動作] + [全体ロック]

必須

キャラクター紐づけ

「人物Aの外見は画像1を参照、人物Bの外見は画像2を参照」——キャラクターごとに単独の参照画像を1枚ずつ、順に名指し。

任意

関係と動作

人物同士の空間関係とインタラクションを明記:「AがBに水を1杯渡す」「4人が間隔を保ったまま同期して踊る」。

任意

全体ロック

末尾で強調:「キャラクターの顔の特徴と服装は全編を通じて参照画像と一致。顔の混入、入れ替わり、変形はなし」。

4人のレトロストリートダンス

プロンプト

レトロなアメリカンカートゥーン風の都会のストリート(シーンは画像5を参照)で繰り広げられる楽しい短編。4人の青年の外見・服装・顔の特徴はそれぞれ画像1、画像2、画像3、画像4を参照。4人はレトロな歩行者天国で同期してダンスを踊り、体の動きは揃って連続的、人物間の距離は常に一定。街のネオンの寒暖のコントラストライティングは全編統一。正面固定カメラ + ゆっくりした横移動のカメラワーク。キャラクターの服装、顔の特徴、体型のすべてが全編を通じて参照画像と高度に一致し、顔の混入、動作の入れ替わりはなく、それぞれのアイデンティティが貫かれる。動きは滑らかでめり込みや歪みはなく、レトロカートゥーンアニメの質感。

参照画像を5枚アップロードしてください(キャラクター4人 + シーン1)。2.5 の公式推奨は主体画像1〜8枚が最適。超えると安定性が下がり、再抽選が必要になります。

3.2 声色参照

ノイズのないクリアな人声を参照音声としてアップロードすれば、モデルはその声線の特徴をハイファイに複製し、感情の張りや話すリズムまで転移させます——熱のこもった演説、クールなアナウンサー調、寝る前のささやきまで自在。書き方は「声色は音声Nを参照」と直接名指しし、感情の指示を一文添えて細かく制御します。

雨の夜、探偵のささやき

プロンプト

雨の夜、ネオンが瞬く屋上で、画像1の私立探偵が欄干にもたれ、ゆっくりと顔を上げてカメラを見る。雨水が彼のトレンチコートを伝って滴り落ちる。彼は音声1の声色で低く言う:「見つけたぞ」。音声1の低くサスペンスフルな語調、呼吸のリズム、かすれた質感を保ち、口の動きと発音を厳密に同期させる。環境音は雨音と遠くの車の音のみ。BGMなし、字幕なし。

人物の参照画像1枚 + 参照音声1本をアップロードしてください。「音声1の語調と呼吸のリズムを保つ」はハイファイ複製の鍵となる言い回しです。

3.3 クリエイティブの転移(動作の転移だけではない)

2.5 では参照動画の理解が「動作の模倣」から「クリエイティブの転移」へ進化しました。体の動きだけでなく、原動画のカメラ言語、色彩ロジック、感情トーン、さらにはバズるネット感まで掴み取ります。書き方の鍵は、転移させたい核心——「愛らしい状態」「コメディ効果」「カメラのリズム」——を描写すること。表面的な動作だけではありません。

黒柴の茶目っ気たっぷりな日常

プロンプト

動画1の柴犬の愛らしい動き、表情、しぐさ、動作およびクリエイティブパターンを参考に、画像1の黒い柴犬のショート動画を作成する。参照動画の柴犬の茶目っ気あふれる活発な状態を精確に掴み取る。背景は明るいリビング、自然光は柔らかく、カメラは柴犬の動きをわずかに追う。画像1の黒柴の毛色と外見の特徴は変えず、画面は温かく癒し系に。

参照動画1本 + 主体画像1枚をアップロードしてください。「……の状態/表情を精確に掴み取る」は「同じ動作をする」よりクリエイティブレベルの転移を誘発します。

3.4 グリッド絵コンテ

グリッド状の絵コンテ(シンプルな線画や棒人間でOK)を物語の骨格としてアップロードすれば、モデルはカット割りに厳密に従った連続動画を生成します。書き方は4ステップ:まず各コマが何を表すか紹介し、次に主体設定と参照画像を紐づけ、続いてカットごとに構図・ショットサイズ・カメラワーク・動作を補完し、最後に全体スタイルと禁止項を書きます。

野良猫に家族ができた(9コマ絵コンテ)

プロンプト

画像1は完全な映画の絵コンテで、連続する9つのカットを含む。各コマは1つの完全なカットを表し、完全で温かく癒し系のシネマティックな物語を形成する。 中年女性は画像2を参照:40〜50代の女性、3Dアニメ映画CGスタイル、白い肌、ダークブラウンのショートカール、大きな目、穏やかで親しみやすい顔立ち、常に自然な微笑みを保つ。薄い黄色のニットカーディガン、白いインナー、青い足首丈のロングスカートを着用した、家庭的な母親のイメージ。キャラクターの外見、服装、プロポーションは全編一貫させる。 子猫は画像3を参照:まんまるでキュートなQ版風の茶白トラの子猫、3Dアニメ映画CGスタイル、大きな目、ピンクの鼻、ふわふわで柔らかい毛並み。黄色いニット帽を被り、緑の巾着袋を提げている。おとなしく愛らしいイメージ。キャラクターの毛色、服装、プロポーションは全編一貫させる。 カット1(0-3s):夕暮れの住宅街。ミディアムショットのローアングルでゆっくりプッシュイン。野良の子猫がそっと街角のゴミ箱に飛び乗り、前足で蓋を開けて顔を突っ込み食べ物を探す。暖色の夕日が街を照らし、空気はやや孤独だがリアル。 カット2(3-5s):クローズアップでゴミ箱の内部へわずかに寄る。子猫は両前足で縁を掴んで中を探り、耳を小刻みに動かし、目つきは真剣。飢えと無力さを際立たせる。 カット3(5-9s):アパートの玄関前、ミディアムショット固定。食べ物を持った中年女性がドアの前に立ち、子猫を発見する。子猫は振り返って女性を見る。少し警戒しているが逃げはしない。二者の初めての視線の交わり。 カット4(9-12s):全身ミディアムショット。子猫は庭の空き地に立ち、ゆっくりと玄関へ近づく。目つきは期待に満ちている。 カット5(12-16s):カメラは猫の目線まで下がる。女性はしゃがみ込み、食器をそっと子猫の前に置く。子猫はすぐに頭を下げて食べ始め、しっぽを軽く揺らす。女性は微笑んで見守り、画面は温かさに満ちる。 カット6(16-20s):ミディアムショットのフォロー。女性が野菜の籠を抱えて庭からゆっくり出てくると、子猫は静かにそばについて歩き、常に半歩の距離を保つ。 カット7(20-23s):室内の玄関。女性がゆっくりとドアを開け、暖かな黄色い室内の光が内側からこぼれ、外の夕暮れと寒暖のコントラストを描く。 カット8(23-26s):斜め後方からのミディアムショット。女性が振り返って微笑み、軽く手招きして、子猫に一緒に帰ろうと合図する。子猫は玄関に立って女性を見上げ、耳を立て、しっぽを小さく揺らし、ためらいの後に誘いを受け入れていく。 カット9(26-30s):カメラはゆっくりと引いていく。女性は玄関で辛抱強く待ち、子猫はついに足を踏み出して家の中へ。暖かな黄色い光が二つの後ろ姿を長く伸ばし、ドアがゆっくりと閉まり、画面は温かく静かな庭で止まる。 Pixar アニメ映画CGスタイルを採用。PBR物理マテリアル、高品質グローバルイルミネーション、柔らかなボリュメトリックライト、映画級の被写界深度。カメラの動きは自然で安定、キャラクターの動作は実際の動物行動に即し、カット間で時間・空間・人物位置・ライティングの連続性を保つ。キャラクターの顔の入れ替わり、変形、プロポーションの誤りを禁止。無関係な人物、動物、小道具の追加を禁止。

参照画像を3枚アップロードしてください(絵コンテ + 女性 + 子猫)。カットごとのタイムスタンプと絵コンテのコマを一対一で対応させると、再現度が最も高くなります。

04 音声と言語

2.5 は言語の壁を打ち破りました:中国語・英語・スペイン語・インドネシア語・マレー語を重点最適化し、タイ語・アラビア語・ポルトガル語・ベトナム語・日本語・韓国語を全面カバー。母語でプロンプトを書いても、多言語セリフの発音精度も向上しています。同時に「字幕なし/BGMなし」の否定指示がついに本当に聞き入れられ、参照動画のBGMと人声の無損失分離も可能になりました。

4.1 多言語プロンプトとセリフ

プロンプトはあなたが最も得意な言語でそのまま書けばOK。キャラクターに話させたい場合はセリフをターゲット言語で書けば、口の動きがその言語の発音と同期します。特定市場向けの広告動画では、言語制約を一文追加するのを忘れずに:すべての看板・字幕・ロゴをターゲット言語に統一し、他の文字の混入を禁止。

東京ラーメン店の日本語CM

プロンプト

全体スタイルはリアルな商業広告。シネマティックな撮影、暖かな黄色い照明、東京の夜の空気感。映像言語は自然で流暢。 カット1(0-3s):カメラは東京の夜の街並み(街並みは画像1を参照)からラーメン店の入口(店構えは画像2を参照)へゆっくりプッシュイン。店の看板、提灯、営業時間の札、メニューはすべて自然で正しい日本語。中国語、英語、文字化けは一切出さない。 カット2(3-7s):カメラは店内へ。店員(外見は画像3を参照)がオープンキッチンの中に立ち、微笑んでカメラに向かい、自然で流暢な日本語で言う:「いらっしゃいませ。自家製の豚骨ラーメンはいかがですか?」。発話中、口の動きは日本語の発音と厳密に同期し、声は自然でリアルな日本人男性の音声特徴を持つ。背景には麺を茹でる音、湯気、食器の触れ合う音などのリアルな環境音を残す。 カット3(7-11s):ラーメンのクローズアップ(画像4を参照)に切り替わる。湯気が絶えず立ち上り、チャーシューがわずかに揺れ、スープの油が自然に流れる。画面にブランドの宣伝字幕が現れる。字幕はすべて自然で正しい日本語:「濃厚な味わい、一杯のしあわせ。」。フォントは日本の商業広告のデザインスタイルに合致。 カット4(11-15s):客(外見は画像5を参照)が席でラーメンを味わい、満足そうな笑顔を浮かべ、カメラに向かって自然に言う:「本当においしいです。必ずまた来ます!」。声は自然な日本語の発音を保ち、口の動きは正確に同期。画面にブランドロゴ(画像6を参照)と日本語スローガンが浮かぶ:「毎日食べたくなる一杯。」 すべての看板、メニュー、ポスター、ロゴは統一された日本語を保ち、他言語の混入は不可。動画全体のセリフはすべて日本語とし、中国語の字幕や吹き替えの生成を禁止。人物の同一性を保ち、店員と客は全編を通じて顔も服装も変えない。

参照画像を6枚アップロードしてください(街並み/店構え/店員/ラーメン/客/ロゴ)。「すべてターゲット言語に統一し、他の文字の混入を禁止」という制約は必ず明記してください。

4.2 クリーンな画面とBGM分離

2.5 では生成の安定性が大幅に最適化され、「字幕なし、BGMなし」の否定指示がついに高確率で機能します——商用ポスプロが求めるクリーンな素地が手に入ります。逆に、音声付きの参照動画には「BGMを除去し、人声を残す」の一文で無損失で音声トラックを分離でき、原動画の字幕も完璧に保てます。

無音ECコーデ紹介

プロンプト

縦型9:16のECコーディネート紹介動画。真っ白なミニマルなシームレススタジオ背景(レイアウトは画像1を参照)。固定の分割レイアウトは全編一貫:画面左側に細い黒の角丸ボーダー付きの矩形モジュールを3つ縦に並べ、各モジュールの上部には黒いセリフ体の数字(1、2、3)、モジュール内には対応するコーデアイテムの平置き画像、アイテムの下に小さな文字で「1x」と表記。画面右側は若い女性モデルによる全身立ち姿の実着用ショーケース。全身の水平固定カメラ、柔らかなスタジオ均一照明、硬い影なし、服の生地の質感はクリアで繊細。モデルは自然で優雅な立ち姿を保ち、手を軽く上げて服を整えたり、立ち姿を調整したりする緩やかな動作。全体スタイルはクリーンで上品。全編を通じて文字、字幕、スローガン、透かし、ロゴ、余計な注釈の出現を禁止。全編を通じてBGM、人声ナレーション、環境ノイズなし。完全に無音の純粋なビジュアル。カメラは全編固定でプッシュ・パン・ティルトなし。レイアウト構造は全編不変。

レイアウト参照画像を1枚アップロードしてください。生成時に音声スイッチはオフになっています。「字幕禁止 + BGMなし + 無音」の三点セットが 2.5 ではついに安定して実行できます。

BGMを分離して人声だけ残す

プロンプト

動画1のBGMをすべて除去し、人物の話し声と環境ノイズだけを残してください。人声は元の声色、語気、呼吸、ディテールをそのまま保つこと。動画の画面、人物、字幕、画質、色調、構図はすべて変更せず、いかなる映像内容も改変しないでください。

人声入りの参照動画を1本アップロードしてください。映像の二次創作、インタビューの音声純化、多言語吹替の差し替えはすべてこの一手です。

05 編集・ホワイトモデル・グリーンバック

ソース動画を参照動画としてアップロードすれば、Seedance 2.5 は原動画の他の部分を一切動かさずに精密な手術ができます:部分消去と置換、ホワイトモデルのレンダリング、グリーンバック背景の置換、2本の動画のシームレストランジション。この章の4シーンはすべてリファレンスから動画モードで実行します。

5.1 部分消去と置換

編集公式の核心は「AからBへ」を明確に書くこと:具体的な編集対象 + 動作と変化の描写 + 適用タイミング。よく使う動詞:追加する、削除する/取り除く、修正する/置き換える/変更する。タイムスタンプと組み合わせれば変更の時間範囲をロックでき、書かなければ全編に適用されます。

[具体的な編集対象] + [動作と変化の描写] + 任意 [適用タイミング]

必須

編集対象

ターゲットをロック:「動画の左側の女性」「テーブルの上のグラス」「緑色の英字タイトル」——具体的なほど誤爆しません。

必須

動作と変化

指示を下す:AからBへ——「消去して背景を自然に補完する」「濃い黒のスラックスに置き換える」。

任意

適用タイミング

「全編を通じて一貫して変更」または「5〜8秒の間のみ変化」。時間軸をロックして時系列の断裂を防ぎます。

不要な人物を消去

プロンプト

動画1の左側の女性と右側の男性を消去し、中央の女性だけを残す。動作は変更しない。消去領域は原動画の光と影とパースに沿って背景を自然に補完し、残像やぼやけたパッチを残さない。その他の映像内容、構図、カメラの動きは完全に変更しない。

ソース動画を1本アップロードしてください。「誰を残し、誰を消すか」を位置で名指しし、補完の要求を一文書くのが、無痕跡消去の成功率を最も高める書き方です。

服の色を変更+テキスト除去

プロンプト

動画1に出ている緑色の英字タイトルを完全に除去し、背中のストレッチをしている人物の青いスポーツウェアを赤いスポーツウェアに編集する。服の色だけを変えること。背景右側の青いケトルベル、左側の青いバランスパッドなどの余計なフィットネス器具も完全に除去してください。人物本人、肌、頭部、手足、体の姿勢、運動の動作、ヨガマット、カーペット、壁面、カメラの画面はすべて変更しない。文字と器具の除去後、遮られていた領域は自然に補完し、文字の残像、ぼやけたパッチ、器具の残像を残さないこと。赤いスポーツウェアは人物の寝返り、足上げ、ストレッチの動作に追従して安定させ、元の服のしわと布の質感を保つこと。

ソース動画を1本アップロードしてください。複数の編集ターゲットは一度に書けますが、各ターゲットに「どう変えるか」を個別に明記してください。

5.2 ホワイトモデルレンダリング

Maya/Blender から書き出したホワイトモデル(グレーモデル)アニメーションを参照動画としてアップロードすれば、AI がプロンプト通りに最終映像をレンダリングします——カメラワーク、立ち位置、動線はホワイトモデルに厳密に従い、マテリアル・光影・キャラクターは文字で与えます。現状は粗い粒度のホワイトモデル(シンプルな幾何体)が最も効果的:「参照宣言 + モデルとキャラクターの対応関係 + ストーリーの詳述 + シーンの処理 + 全体の締め」を書き切りましょう。四肢や翼のあるホワイトモデルは動作シーケンスを全部書かないと硬直しがちです。

ホワイトモデルがエルフの女王に

プロンプト

動画1の動的なカメラワークと物理的な光影変化を参照し、動画中の白いモデルを画像1のエルフの女王に精確に置き換える。人物の外見は画像に厳密に従う:銀白の長い髪、華麗な白金の刺繍ローブ、先端に輝くクリスタルを嵌めた魔法の杖を手に持つ。キャラクターの一貫性を保ち、めり込みや顔変わりはなし。 シーンは全体としてエルフの大殿。動画1のシーンを残す。カメラ位置は原動画と一致させ、エルフの女王は参照動画のモデルの動作に従って優雅に魔法の杖を掲げる。その間、彼女の銀白の長い髪と大きな白いローブの裾は気流に乗って自然に揺れ動き、質感はなめらかで垂れ下がる重みがある。動作に伴い、参照動画中の光エフェクトは神聖な光柱へと変化して地上から立ち昇り、女王の手の杖が放つまばゆい金光と呼応し合う。 最終動画は映画級CGの写実画質。光影はリアルで神聖、叙事詩的な壮大さに満ち、画面は高精細、人物の肌は繊細、衣装の金属質感はクリア、ディテールは豊かで、動作は滑らかで自然。

ホワイトモデル動画1本 + キャラクター参照画像1枚をアップロードしてください。「白いモデルを画像Nのキャラクターに精確に置き換える」がホワイトモデルレンダリングの核心の言い回しです。

5.3 グリーンバック生成と置換

両方向に対応:通常の動画の背景をグリーンバックに変えて(自分でポスプロ合成するため)、あるいはグリーンバック素材の人物を新しいシーンへシームレスに合成します——前景の切り抜きは髪の毛レベルまで精細で、人物と新背景のパース・光影は自動で融合し、チラつきや浮きはありません。

ワンクリックでグリーンバック素材化

プロンプト

動画全体の白い背景をすべて純粋なグリーンバック背景に変える。人物の動作、前景要素、画面構図は変更せず、人物のエッジはクリーンで白い残りなし、髪の毛のディテールは完全に保つ。音声は除去して無音にする。

ソース動画を1本アップロードしてください。生成時に音声スイッチはオフになっています。グリーンバック素材が手に入ったら、任意の編集ソフトで背景を差し替えられます。

5.4 2本の動画のシームレストランジション

前後2本の動画をアップロードすれば、モデルは元の素材を変更せずに、隙間を補完する過渡映像を自動生成します——動作トリガー、視線誘導、マスクトランジションなどの高度な手法にも対応。プロンプトは継ぎ目で何が起きるかを書くだけで構いません。

鯉が龍門を越えて龍になる

プロンプト

動画1と動画2をシームレスに接続する。ただし動画1と動画2は変更しない。動画1の最終フレームの鯉が速く前方へ泳ぎ始め、勢いよく水面を飛び出して空中へ昇ると、空に荘重で古風な石の門が現れる。鯉は石門を越えて雲霧へ入り、ついに見事に龍へと姿を変え、動画2へとつながる。

動画を2本(冒頭と末尾)アップロードしてください。「原動画を変更しない」の一文は必須。過渡の描写は中間に欠けた部分だけを書きます。

Seedance 2.5 パラメータ早見表(vs 2.0)

以下は Molyin のジェネレーターで Seedance 2.5 に実際に開放されている全設定で、2.0 スタンダード版との対照表です。

Seedance 2.5Seedance 2.0
モードテキストから動画 / 画像から動画 / リファレンスから動画テキストから動画 / 画像から動画 / リファレンスから動画
解像度480p / 720p480p / 720p / 1080p / 4k
長さ4〜30秒4〜15秒
アスペクト比16:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:116:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:1
音声対応対応
首尾フレーム対応対応
参照画像数1–9 枚1–9 枚
参照動画数最大 3 本最大 3 本
参照音声数最大 3 本最大 3 本
最終フレーム返却対応対応

よくある質問

最も多い8つの失敗パターンと、検証済みの解決策。