指南

Seedance 2.5 指南

Seedance 2.5 把单次生成拉长到 30 秒,并原生支持秒级时间戳剧本——指哪打哪的时代来了。本指南按真实创作任务重组官方使用手册:从基础公式、真人人物写法到时间戳长镜头、多模态参考与局部编辑,每个示例都可一键预填进 Molyin 生成器。

更新于 2026-08-06

01 基础公式

Seedance 2.5 对结构化指令的理解再上台阶:完整提示词由素材描述、一句话概述、具体情节与全局补充四层组成。本章先立骨架,再给你官方验证过的真人人物公式——专门治「AI 脸」和塑料质感。

1.1 完整提示词公式

一条完整的 Seedance 2.5 提示词 = 素材描述 + 一句话概述 + 具体情节描述 + 全局补充。没上传素材就跳过第一层;情节按时间轴或故事线分段写;全局补充放在结尾,强调贯穿全片的元素与不想出现的东西(比如字幕、BGM)。

[素材描述] + [一句话概述] + [具体情节描述] + [全局补充]

必需

一句话概述 (Summary)

主体 + 地点 + 事件 + 题材/风格 + 特殊运镜,一句话交代这部片子的基调。

必需

具体情节 (Plot)

分时间轴或故事线写:每个分镜含画面内容、运镜、动作、台词、音效,以及不想要的元素(反向描述)。

可选

素材描述 (Assets)

按上传顺序给素材编号,并说清每个素材的用途:人物形象、音色、动作还是场景。没有参考素材可整层省略。

可选

全局补充 (Global)

结尾再次强调贯穿全片的细节:机位、环境特征、光影氛围,或全局禁止项(字幕、BGM)。

湿地丹顶鹤纪录片

提示词

写实自然纪录片风格,电影级真实光影。清晨的薄雾中,在广阔的湿地芦苇荡(场景参考图片1)里,一只优雅的丹顶鹤(形象参考图片2)正展翅起舞——它羽毛洁白如雪,头顶鲜红,身姿修长挺拔。场景为秋季的浅水湿地,水面波光粼粼,周围长满金黄色的芦苇、浮萍与水草,虚化背景中是远处的晨雾与初升的太阳。镜头为低机位中景,轻微手持感,整体基本固定,始终保持丹顶鹤在画面中央。 0s-3s:丹顶鹤静立在浅水中,缓慢展开宽大的黑白双翼,动作轻柔,水面被翅膀扇动的气流带起阵阵涟漪。晨风吹拂,阳光从地平线斜射过来,穿透薄雾形成丁达尔光效。 3s-8s:丹顶鹤在水面上轻盈跳跃,双脚交替点水,溅起晶莹的水花。它修长的颈部向后仰起,鸟喙指向天空,随后轻盈落地收拢双翼,头部优雅地环顾四周,发出一声清脆的长鸣。 低机位轻微跟随丹顶鹤的跳跃轨迹上下移动,景深自然,前景芦苇轻微虚化。自然环境音:水流声、翅膀有力的扑击声与鹤鸣声,整体宁静、空灵、唯美。

需上传 2 张参考图(场景 + 主体);开头一句话定基调,中间按时间轴拆情节,结尾收束全局氛围——四层结构一目了然。

1.2 真人人物公式(治 AI 脸)

2.5 大幅弱化了「AI 感」,但想要以假乱真的真人,写法仍是决定因素。官方验证过的七维公式把人物拆成年龄种族、皮肤质感、面部细节、眼神、发型、服装、体型气质——其中眼神是灵魂,「保留真实的微细毛孔与肌肤纹理」这句保真后缀几乎必带。

[年龄/种族] + [肤色/皮肤质感] + [面部细节] + [眼神/灵魂] + 可选 [发型] [服装] [体型/气质]

必需

年龄/种族

具体岁数 + 国籍/人种 + 风格形容词 + 脸型名词,如「22 岁东亚女性,清冷古典的骨相脸」。

必需

肤色/皮肤质感

冷暖色调 + 肤色名词 + 质感形容词 + 保真后缀「保留真实的微细毛孔与肌肤纹理」(可加雀斑/瑕疵更真实)。

必需

面部细节

眼型 + 眉骨 + 鼻梁 + 唇形 + 下颌线,至少写 3-4 点组合,决定人物辨识度。

必需

眼神/灵魂

眼神形容词 + 目光传达的信息或比喻 + 底层情绪——决定人物的情感表现力。

可选

发型/发色

具体发色 + 头发状态/质感 + 发型名词 + 环境互动(被风吹起等)。

可选

服装/质感

版型剪裁 + 颜色 + 服装名词 + 布料材质/新旧状态 + 穿着细节,从侧面烘托人物。

可选

体型/气质

骨架肩部特征 + 构图要求 + 动作视线 + 整体氛围词。

古典女子特写

提示词

22 岁东亚女性,极具古典韵味的温婉电影脸。冷调白皙肤色,透出细腻的温润质感,保留真实的微细毛孔与肌肤纹理。细长的桃花眼(眼眶微润),眉心微微舒展,鼻梁小巧挺直,唇部丰润且嘴角带着若有若无的温柔浅笑,下颌线线条柔和。眼神极其深情、含情脉脉,眼底仿佛有一汪春水,目光温柔而专注,透着深深的眷恋与一丝不舍。乌黑的发丝绾成随性典雅的古典低盘发,仅用一支素色玉簪固定,几缕细碎的黑发不经意地垂落在脸颊边缘,随着微风轻轻拂动。穿着极简的素白色交领古装,布料是带有柔软光泽的素雅真丝,衣襟处微微散开。身姿纤细,双肩削瘦,散发出一种温柔婉约、深情缱绻的古典浪漫气质。特写构图,眼神直视镜头,柔和自然光,浅景深。

纯文生视频即可;这套写法对动画人物同样适用——把「真人质感」换成对应的画风描述即可。

02 时间戳与 30 秒长镜头

Seedance 2.5 的头号升级:单次生成从 15 秒翻倍到 30 秒,并且原生支持秒级时间戳——你可以精确指定第几秒发生什么动作、第几秒切镜,实现剧本级的精准还原。本章教你写长视频的三层结构与转场公式。

2.1 时间戳剧本分镜

长视频公式的核心是把片子切成若干时间切片:每个切片写清「开始-结束秒数 + 阶段主题 + 动作/表情等物理指令 + 情感潜台词」。潜台词是向 AI 解释你为什么这么设计——写了它,表演细腻度天差地别。切片前别忘了「全局设定」模块:环境质感、视觉风格、镜头语言、人物造型、表演核心与禁止项。

[开始秒-结束秒] + [阶段主题] + [动作/表情指令] + 可选 [情感潜台词]

必需

时间切片

明确的起止秒数(如 0-3s、00:08-00:15),2.5 能精确到秒级执行。

必需

动作/物理指令

景别 + 构图 + 人物细节动作——这个切片里画面必须严格遵守的内容。

可选

阶段主题

给切片起个名字(如「追问」「认命」),帮助模型把握段落情绪基调。

可选

情感潜台词

向 AI 解释物理指令背后的表达意图,如「她不是在痛诉,而是在等一个答案」。

29 秒一镜到底:江边告别

提示词

29 秒一镜到底(古装女子江边告别) 【全局场景设定】 基础环境:清晨江边,背景有模糊的小船,寂寥的送别场景。氛围安静、克制。 视觉风格:电影感,浅景深(背景简洁虚化),柔和自然光。 镜头语言:始终保持在女子的近景特写,犹如站在她对面的「他」的主观视角。轻微手持呼吸感,无快速剪辑。 人物造型:22 岁东亚女性,极具古典韵味的温婉电影脸。冷调白皙肤色,透出细腻的温润质感,保留真实的微细毛孔与肌肤纹理。细长的桃花眼(眼眶微润),鼻梁小巧挺直,唇部丰润且嘴角带着若有若无的温柔浅笑。眼神极其深情、含情脉脉,眼底仿佛有一汪春水。乌黑的发丝绾成古典低盘发,仅用一支素色玉簪固定。穿着极简的素白色交领古装,柔软光泽的真丝质地。身姿纤细,散发出温柔婉约的古典浪漫气质。 表演核心:克制细腻。重点呈现眼神流转、呼吸起伏、唇部微颤、眉心松紧、喉头吞咽及眼泪自然滑落的过程。 禁止项:禁止夸张哭腔,禁止快速剪辑,禁止大幅度肢体动作,禁止生成多余台词或 BGM,禁止眼泪提前滴落。 【情绪与动作分镜(0-29 秒递进)】 第一阶段 0-3 秒【追问】:她直视镜头,眼神里还没有眼泪,眉心微微蹙起,嘴唇微启,轻声低语:「真的要走吗」。潜台词:她不是在痛诉,而是在等对方亲自回答一个她早就猜到的答案。 第二阶段 3-10 秒【认命】:她的视线慢慢移开,望向旁边的空地,眼睑低垂,嘴角轻轻牵起一抹短促的苦笑旋即落下,鼻翼轻微收缩,极其克制地小声吸气,胸口轻轻起伏一次。潜台词:通过这个动作,她仿佛要强行把委屈和酸楚咽回肚子里。 第三阶段 11-17 秒【记住】:镜头微微推进。她重新将目光转回,眼神在对方脸上缓慢、仔细地扫过。眼眶已经泛红,但眼泪被死死屏住没有滴落。中间伴随 0.5 秒的死寂停顿,她的嘴唇轻动一下又抿住,下巴收紧,喉头轻微滚动。潜台词:这一刻的注视不是告别,而是要在生命里最后一遍刻画、记住这个人的模样。 第四阶段 18-23 秒【惋惜】:她垂下眼,一滴眼泪没有预兆地直接掉下来,落在衣襟上。她没有去擦,再抬眼时眼神由挽留转为极深的惋惜。紧皱的眉心开始慢慢松开,她微微摇了摇头(幅度极小)。潜台词:眉心舒展象征内心释然,微小的摇头是对命运无奈的最后一次否定。 第五阶段 24-29 秒【放手】:镜头推至更近的极限特写。她努力牵起一个轻柔的微笑(没有自嘲),笑意刚到嘴角,第二滴眼泪从眼角滑过鼻翼停留在唇边。她用几乎听不见、但尽力稳住的声音说了一句:「你走吧。」说完笑停在脸上,眼泪继续往下滑,眼神始终没有移开。镜头最终停在她含泪微笑、眼底全是惋惜的脸上。

全局设定 + 时间戳分镜两段式是 30 秒长镜头的标准骨架;「禁止眼泪提前滴落」这类时序禁止项,正是 2.5 才压得住的精度。

2.2 切镜与转场公式

想要多镜头叙事,就在时间戳切片里写明转场指令。切镜设定 = 转场类型指引 + 基础约束要求 + 切镜逻辑要求。常用转场:自然镜头切换、淡入淡出、叠化、白闪/黑闪、遮罩转场(物体遮挡镜头变黑后拉开)、相似物转场(圆月化酒碗)、动作转场(甩镜)、动态接力转场(换装)、拉近/拉远转场(瞳孔套娃)、水墨转场。也可以给几个候选让模型自选:「请从自然切换/遮罩/相似物转场中,根据本片风格选择最合适的一种」。

[转场类型指引] + 可选 [基础约束要求] + [切镜逻辑要求]

必需

转场类型

点名转场方式:「需要在切镜处使用遮罩转场(禁止生硬切镜、禁止物体凭空出现)」。

可选

基础约束

保持镜头呼吸感与时长协调,交代镜头 A 与镜头 B 各自的内容。

可选

切镜逻辑

再次强化「必须自然切换场景」;需要更丰富镜头语言时追加景别变化(如特写转中景)。

30 秒国漫武侠:五种转场连发

提示词

【全局设定】 基础环境与质感:深夜幽静竹林中的一座露天野客栈。强调极致的二次元高质量作画质感,竹叶飘落轨迹、酒水泛起的涟漪需完全符合物理规律,带有国风特有的飘逸感。 视觉风格:顶级国漫古风(三渲二写实画风),水墨渲染边缘。高对比度冷暖光交织(凄冷的蓝白月光与客栈桌上暖黄的烛火对冲)。 镜头语言:采用极其凌厉的蒙太奇剪辑与多类物理无缝转场,动静反差极大。 人物造型:22 岁青年剑客,国漫俊朗骨相脸。剑眉星目,高马尾束发,额前有凌乱碎发。身穿一袭白底黑边的交领劲装,桌上放着一把黑鞘长剑。 表演核心:重点展现顶级武侠中「一击必杀」的速度感、剑客的从容不迫,以及极具东方美学的诗意留白。 禁止项:禁止 3D 油腻感(严格保持纯正国漫三渲二画风)。禁止武打动作拖泥带水或肢体穿模扭曲。禁止生成任何字幕或多余台词。水墨化效果只能在 25 秒之后随着「咔哒」声出现,禁止提前出现。 【时间戳剧本分镜(含明确切镜转场)】 00:00-00:04 镜头一【静夜酌酒】(相似物转场):镜头静止仰拍夜空,一轮巨大的皎洁满月占据画面正中心。天上的圆月逐渐变暗淡化,一个形状大小完全相同的圆形酒碗(正俯拍桌面视角)从圆月的位置慢慢浮现并完全替代月亮,酒碗中印照出点点月光,泛起细微波纹。过渡必须自然。随后镜头从俯拍缓慢拉远降至平视,剑客正坐在客栈桌前,缓缓端起这碗酒。 00:05-00:10 镜头二【杀机暗藏】(拉近特写转场):剑客动作微顿,眼神突然变得极其凌厉。镜头以极快的速度向前推进,无限放大剑客的眼睛直至瞳孔占据全屏,画面在瞳孔内部无缝展开——高空竹林上方,一名黑衣刺客正反握短刃,如苍鹰扑食般从天而降直扑镜头。 00:11-00:18 镜头三【拔剑交锋】(动作甩镜转场):镜头急速向后拉远退回剑客全身景别,剑客从座位上跃起拔剑。镜头跟随剑客挥剑的手臂向画面右侧猛烈甩动(Whip Pan),造成全屏横向运动模糊。在模糊中场景瞬间变换到半空,镜头定格:剑客的长剑与刺客短刃用力相撞,武器交接处爆发出巨大的橙色火花与环形气浪。 00:19-00:24 镜头四【一击即中】(遮罩转场):两人在半空中错身而过。交锋气流卷起漫天竹叶,其中一片巨大的翠绿竹叶横向飞过,完全遮挡镜头导致全屏变黑。竹叶飘离镜头后,画面已切为地面平视景别:刺客在背景中无力坠落倒地,剑客在前景背对镜头,缓缓将长剑收入鞘中。 00:25-00:30 镜头五【余音绕梁】(水墨转场):剑客收剑入鞘的「咔哒」一声,整个竹林与倒地的刺客画面突然像一滴浓墨滴入水中一般,迅速化为黑白水墨向四周晕染、扩散,画面在泼墨的山水意境中彻底定格结束。

每个切片点名一种转场并写明执行细节;「禁止提前出现」这类负向时序约束,是防止转场效果抢跑的关键。

03 多模态参考

2.5 的参考能力全面放宽:参考图最多 30 张、参考视频与音频单段最长 30 秒(Molyin 平台档位以参数速查表为准),并且首次支持纯音频驱动。本章覆盖四个最实用的参考场景:多人同框、音色复刻、创意迁移与多宫格分镜。

3.1 多人参考(治双胞胎)

2.5 重点修复了多人场景的「双胞胎」与「换脸错位」问题,但写法依然关键:逐一把角色和参考图绑定,全篇用同一称呼指代,并在结尾加一条全局锁定。人物参考图用单人独立照片,别用多视图拼图。

[角色绑定] + 可选 [关系与动作] + [全局锁定]

必需

角色绑定

「人物 A 的形象参考图片1,人物 B 的形象参考图片2」——每个角色一张独立参考图,逐一指名。

可选

关系与动作

写清人物之间的空间关系与互动:「A 递给 B 一杯水」「四人同步跳集体舞,间距固定」。

可选

全局锁定

结尾强调「角色五官、服饰全程与参考图一致,不串脸、不互换、不变形」。

四人复古街舞

提示词

复古美式卡通动画都市街头(场景参考图片5)欢乐短片。四位青年的人物形象、穿搭、面部特征分别参考图片1、图片2、图片3、图片4,四人在复古步行街同步跳集体舞蹈,肢体动作整齐连贯,人物之间间距固定不变。街边霓虹冷暖撞色光影全程统一,正面固定机位 + 缓慢横移运镜。角色每一处服饰、五官、身形全程与参考图高度匹配,不串脸、不互换动作、身份各自贯穿,动作流畅无穿模畸变,复古卡通动画质感。

需上传 5 张参考图(4 个角色 + 1 个场景);2.5 官方建议主体图 1-8 个效果最佳,超出后稳定性下降需要抽卡。

3.2 音色参考

上传一段清晰无杂音的人声作为参考音频,模型能高保真复刻其声线特征,甚至迁移情绪张力与语流节奏——激昂演讲、清冷播音腔、睡前呢喃都可以。写法上直接点名「音色参考音频N」,并补一句情感指令做精细控制。

雨夜侦探的低语

提示词

雨夜霓虹闪烁的天台上,图片1的私家侦探靠着栏杆,缓缓抬头看向镜头,雨水顺着他的风衣滴落。他用音频1的音色低沉地说:「我找到你了。」保持音频1低沉悬疑的语调、呼吸节奏与沙哑质感,口型与发音严格同步。环境音只有雨声与远处车流,无背景音乐,无字幕。

需上传 1 张人物参考图 + 1 段参考音频;「保持音频1的语调与呼吸节奏」是高保真复刻的关键句式。

3.3 迁移创意(不只是迁移动作)

2.5 把参考视频的理解从「动作模仿」升级为「创意迁移」:除了肢体动态,还能抓取原片的镜头语言、色彩逻辑、情绪基调甚至爆款网感。写法关键是描述想迁移的内核——「可爱的状态」「喜剧效果」「镜头节奏」,而不只是表面的动作。

黑柴的俏皮日常

提示词

参考视频1中柴犬可爱的动态表情、神态、动作及创意模式,创作图片1中黑色柴犬的短视频,精准抓取参考视频里柴犬俏皮灵动的状态。背景为明亮的客厅,自然光柔和,镜头轻微跟随柴犬的移动。保持图片1中黑柴的毛色与外形特征不变,画面温馨治愈。

需上传 1 段参考视频 + 1 张主体图;「精准抓取……的状态/神态」比「做一样的动作」更能触发创意层面的迁移。

3.4 多宫格分镜

上传一张多宫格分镜图(简约线稿/火柴人即可)作为剧情骨架,模型据此生成严格遵循镜头规划的连贯视频。写法四步走:先介绍每个分镜代表什么,再绑定主体设定与参考图,然后逐镜补齐构图、景别、运镜与动作,最后写全局风格与禁止项。

流浪猫有了家(9 宫格分镜)

提示词

图片1为完整电影分镜脚本,共包含 9 个连续镜头,每一个分镜代表一个完整镜头,形成完整、温馨、治愈的电影化叙事。 中年女子参考图片2:一位 40-50 岁中年女性,3D 动画电影 CG 风格,白皙肤色,深棕色短卷发,大眼睛,面容温柔亲切,始终保持自然微笑。身穿浅黄色针织开衫、白色内搭、蓝色及踝长裙,居家母亲形象,角色外观、服饰及比例全程保持一致。 小猫参考图片3:一只圆润 Q 版橘白虎斑幼猫,3D 动画电影 CG 风格,大眼睛,粉色鼻头,毛发蓬松柔软。头戴黄色针织帽,手提绿色抽绳布袋,形象乖巧可爱,角色毛色、服饰及比例全程保持一致。 镜头1(0-3s):城市居民区傍晚,中景低机位缓慢推进,流浪小猫轻轻跳上街边垃圾桶,用前爪掀开桶盖探头寻找食物。暖色夕阳照射街道,氛围略显孤独但真实。 镜头2(3-5s):近景轻微推近垃圾桶内部,小猫双爪扒住桶沿探入翻找,耳朵轻摆,眼神专注,突出饥饿与无助。 镜头3(5-9s):居民楼门口中景固定镜头,中年女人端着食物站在门前发现小猫。小猫回头望向女人,略显警惕但没有逃跑,两者第一次目光交流。 镜头4(9-12s):全身中景,小猫站在院子空地上缓缓靠近门口,眼神希冀。 镜头5(12-16s):摄影机降至猫的视角,女人蹲下身把食盆轻轻放到小猫面前,小猫立即低头吃饭,尾巴轻摆,女人微笑注视,画面充满温暖。 镜头6(16-20s):中景跟拍,女人抱着一篮蔬菜从院子缓缓走出,小猫安静跟随在身旁,始终保持半步距离。 镜头7(20-23s):室内门口,女人缓缓打开房门,暖黄色室内灯光从门内洒出,与室外傍晚形成冷暖光对比。 镜头8(23-26s):侧后方中景,女人回头微笑轻轻招手,示意小猫一起回家。小猫站在门口抬头望向女人,耳朵竖起,尾巴轻晃,犹豫后逐渐接受邀请。 镜头9(26-30s):镜头缓慢后拉,女人站在门口耐心等待,小猫最终迈步跟随走进屋内,暖黄色灯光将两个背影拉长,房门缓缓关闭,画面停留在温暖安静的院落。 采用 Pixar 动画电影 CG 风格,PBR 物理材质,高质量全局光照,柔和体积光,电影级景深。镜头运动自然平稳,角色动作符合真实动物行为,镜头之间保持时间、空间、人物位置及光照连续。禁止角色换脸、变形、比例错误;禁止新增无关人物、动物或道具。

需上传 3 张参考图(分镜图 + 女子 + 小猫);逐镜时间戳与分镜图格子一一对应,还原度最高。

04 声音与语言

2.5 打破了语言边界:重点优化中、英、西、印尼、马来语,全面覆盖泰、阿、葡、越、日、韩语——母语写提示词、多语种对白发音都更准了。同时「不要字幕/不要 BGM」的负向指令终于被真正听进去,还能把参考视频的 BGM 与人声无损分离。

4.1 多语言提示词与对白

直接用你最熟悉的语言写提示词即可,需要角色说话时把台词写成目标语言,口型会与该语言的发音同步。面向特定市场的广告片,记得加一条语言约束:所有招牌、字幕、Logo 统一为目标语言,禁止混入其他文字。

东京拉面店日语广告

提示词

整体风格为真实商业广告,电影级摄影,暖黄色灯光,东京夜晚氛围,画面语言自然流畅。 镜头1(0-3s):摄影机由东京夜晚街道(街景参考图片1)缓慢推进至拉面店门口(店面参考图片2)。店铺招牌、灯笼、营业时间牌、菜单全部为自然规范的日文,不出现任何中文、英文或乱码。 镜头2(3-7s):镜头进入店内,店员(形象参考图片3)站在开放式厨房内,微笑面对镜头,用自然流畅的日语说道:「您好,您想来一份自制豚骨拉面吗?」说话过程中嘴型与日语发音严格同步,声音自然,具有真实日本男性语音特点。背景保留煮面、水汽、餐具碰撞等真实环境音。 镜头3(7-11s):切换至拉面特写(参考图片4),热气持续升腾,叉烧轻微晃动,汤面油脂自然流动。画面中出现品牌宣传字幕,字幕全部使用自然规范日文:「浓厚的口感,一杯的幸福。」字体符合日本商业广告设计风格。 镜头4(11-15s):顾客(形象参考图片5)坐在桌前品尝拉面后露出满意笑容,对镜头自然说道:「真的很好吃,我一定会再来的!」声音保持自然日语发音,嘴型同步准确。画面浮现品牌 Logo(参考图片6)与日文 Slogan:「每天都想要吃一杯。」 所有招牌、菜单、海报、Logo 全部保持统一日文,不允许混入其他语言;整支视频对白均为日语,禁止生成中文字幕或配音。人物身份保持一致,店员与顾客全程不换脸、不变装。

需上传 6 张参考图(街景/店面/店员/拉面/顾客/Logo);「全部为目标语言,禁止混入其他文字」这条约束必须写死。

4.2 纯净画面与 BGM 分离

2.5 大幅优化了生成稳定性,「无字幕、无 BGM」的负向指令终于高概率生效——商业后期想要的干净底片有了。反过来,对带声音的参考视频,一句「去除背景音乐,保留人声」就能无损分离音轨,还能完美保留原片字幕。

静音电商穿搭展示

提示词

竖版 9:16 电商穿搭展示视频,纯白极简无缝影棚背景(版式参考图片1),固定分栏版式全程保持一致:画面左侧垂直排列 3 个带细黑色圆角边框的矩形模块,每个模块顶部是黑色衬线数字编号(1、2、3),模块内放置对应穿搭单品平铺图,单品下方标注小字「1x」;画面右侧是年轻女性模特全身站立穿搭实景展示,全身平视固定机位,柔和影棚均匀布光,无硬阴影,服装面料纹理清晰细腻。模特保持自然优雅站姿,有轻微的抬手整理衣物、调整站姿等舒缓动态,整体风格干净高级。全程禁止出现任何文字字幕、标语、水印、Logo、额外标注;全程无背景音乐、无人声旁白、无环境杂音,完全静音的纯视觉画面;镜头全程固定不推拉摇移,版式结构全程保持不变。

需上传 1 张版式参考图,生成时已为你关闭音频开关;「禁止字幕 + 无 BGM + 静音」三件套在 2.5 上终于能被稳定执行。

分离背景音乐,只留人声

提示词

请将视频1中的背景音乐全部移除,只保留人物说话的声音与环境噪音。人声需要保持原本的音色、语气、呼吸和细节,视频画面、人物、字幕、画质、色调、构图全部保持不变,也不要修改任何画面内容。

需上传 1 段带人声的参考视频;影视二创、采访提纯、多语种配音换轨都靠这一招。

05 编辑、白模与绿幕

把源视频作为参考视频上传,Seedance 2.5 就能在不动原片其余部分的前提下做精准手术:局部消除与替换、白模渲染成片、绿幕背景替换、双视频无缝转场。本章四个场景全部走参考生视频模式。

5.1 局部消除与替换

编辑公式的核心是把「从 A 到 B」写清楚:具体修改对象 + 动作与变化描述 + 生效时序。常用动词:增加/加上、删除/去掉、修改/替换/改成。搭配时间戳可以锁定修改的时间范围,不写则全片生效。

[具体修改对象] + [动作与变化描述] + 可选 [生效时序]

必需

修改对象

锁定目标:「视频里左边的女子」「桌上的水杯」「绿色英文标题文字」——越具体越不误伤。

必需

动作与变化

下达指令:从 A 变成 B——「消除并自然补全背景」「替换为深黑色西装裤」。

可选

生效时序

「全片统一修改保持一致」或「仅在第 5-8 秒期间变化」,锁定时间轴防时序断裂。

消除多余人物

提示词

将视频1里左边的女子和右边的男子消除掉,只留下中间的女子,动作保持不变。消除区域按原片光影与透视自然补全背景,不留残影与模糊补丁,其余画面内容、构图与镜头运动完全不变。

需上传 1 段源视频;「只留谁、消除谁」点名方位,补全要求写一句,无痕消除的成功率最高。

换衣服颜色 + 移除文字

提示词

请将视频1中出现的绿色英文标题文字完整移除,并将画面中做背部拉伸运动的人物蓝色运动服编辑成红色运动服,只改变衣服颜色。画面背景中右侧的蓝色壶铃、左侧的蓝色平衡垫等多余健身道具也请完整移除。人物本人、皮肤、头部、手脚、身体姿态、运动动作、瑜伽垫、地毯、墙面和镜头画面都保持不变。移除文字和道具后,原本被遮挡的区域需要自然补全,不能留下文字残影、模糊补丁或道具残影。红色运动服需要跟随人物翻身、抬腿和拉伸动作保持稳定,保留原本衣服褶皱和布料质感。

需上传 1 段源视频;多个编辑目标可以一次写完,但每个目标都要单独说清「改成什么样」。

5.2 白模渲染

把 Maya/Blender 导出的白模(灰模)动画作为参考视频上传,AI 按你的提示词渲染出最终成片——运镜、站位、动线严格跟随白模,材质、光影、角色由文字赋予。粗颗粒度白模(简单几何体)效果目前最好:写清「参考声明 + 模型与角色的对应关系 + 剧情详述 + 场景处理 + 整体收束」。带四肢/翅膀的白模要写全动作序列,否则容易僵直。

白模变精灵女王

提示词

参考视频1的动态运镜、物理光影变化,将视频中的白色模型精确替换为图片1里的精灵女王。人物形象严格参考图片:银白长发,身穿华丽的白金色刺绣长袍,手持顶端镶嵌发光水晶的魔法手杖,保持角色一致性,不穿模不变脸。 场景整体为精灵大殿,保留视频1中的场景。机位与原视频保持一致,精灵女王跟随参考视频里模型的动作优雅地抬起魔法手杖。期间,她银白色的长发和宽大的白袍裙摆随着气流自然飘动,质感丝滑且有垂坠感。伴随着动作,参考视频中的光效转化为一道神圣光柱从地上抬升,与女王手中法杖散发的耀眼金光交相辉映。 最终视频要求电影级 CG 写实画质,光影真实神圣且充满史诗感,画面高清,人物皮肤细腻,服饰金属纹理清晰,细节丰富,动作流畅自然。

需上传 1 段白模视频 + 1 张角色参考图;「将白色模型精确替换为图片N的角色」是白模渲染的核心句式。

5.3 绿幕生成与替换

两个方向都支持:把普通视频的背景变成绿幕(方便你自己做后期合成),或者把绿幕素材里的人物无缝合成进新场景——前景分割精细到发丝,人物与新背景的透视、光影自动融合,不闪烁跳脱。

一键转绿幕素材

提示词

把整个视频的白色背景,都变成纯绿幕背景。人物动作、前景元素与画面构图保持不变,人物边缘干净无残留白边,发丝细节完整。去掉声音,保持静音。

需上传 1 段源视频,生成时已为你关闭音频开关;拿到绿幕素材后用任意剪辑软件即可换背景。

5.4 双视频无缝转场

上传前后两段视频,模型在不修改原素材的前提下,自动生成补全间隙的过渡画面——动作触发、视线牵引、遮挡转场等高级手法都支持。提示词只需写清衔接处发生了什么。

鲤鱼跃龙门化龙

提示词

将视频1和视频2无缝衔接起来,但是不修改视频1和视频2。视频1尾帧的鲤鱼开始快速向前游,然后快速跃出水面升向空中,空中出现一扇厚重古朴的石门,鲤鱼越过石门进入云雾,最终成功化龙,衔接上视频2。

需上传 2 段视频(首段与尾段);「不修改原视频」这句必写,过渡描述只写中间缺失的那一段。

Seedance 2.5 参数速查(vs 2.0)

以下是 Molyin 生成器为 Seedance 2.5 实际开放的全部档位,与 2.0 标准版同表对照。

Seedance 2.5Seedance 2.0
模式文生视频 / 图生视频 / 参考生视频文生视频 / 图生视频 / 参考生视频
分辨率480p / 720p480p / 720p / 1080p / 4k
时长4–30 秒4–15 秒
比例16:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:116:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:1
音频支持支持
首尾帧支持支持
参考图数量1–9 张1–9 张
参考视频数量最多 3 段最多 3 段
参考音频数量最多 3 条最多 3 条
返回尾帧图支持支持

常见问题

八个最高频的翻车现场,以及我们验证过的解法。