成片拆解
来源 · X

暗红衣女主走进银色面具人群 · 深度视频驱动一镜到底 · Seedance 2.5
30 秒真人风短片,怎么做出来的?

《STORM》MV 二创:深度视频驱动 Seedance 2.5,一镜到底拉远,红衣女主走进鞠躬的银色面具人群。

套路 · 角色表演30秒 · 一镜到底4:3 画幅Seedance 2.5附深度驱动视频《STORM》MV 二创

钩子在哪

时间为抽帧估计

结构:红衣女主近景 → 转身走向人群 → 挤进队列 → 转回站定 → 人群一轮轮俯身 → 拉到最宽全景

看完成片再对照:这条片子靠什么在几秒内抓住人。点时间可跳到成片对应位置。

开场钩子

第 0 秒近景:暗红大衣、深棕长发的女主正面看镜头,嘴前飘着一小团白气,身后是一片戴银色无五官面具的深灰人群。

她怎么走进人群

约 0.5–2s 她低头转身背对镜头;约 2–9s 镜头一直往后拉,她走到前排两人之间的窄缝,侧身屈臂挤进去;约 9–13s 被前排挡住,在人群里慢慢转回来面对镜头。

人群怎么动

约 13–18s 她站到中央抬起脸,人群全部直立;约 18s 起面具人群一片片俯身又回起,上方露出弧形钢梁玻璃顶棚,只有她一直站着。

结尾怎么收

约 26–29.5s 拉到最宽全景:前排直立、双手交握在腹前,后面几排还弯着腰,红衣女主站在正中间,画面停在这里。

跟做照抄这一点

把原片转成深度(白模)视频当动作和运镜的骨架,提示词只负责换人换景:先写「第一规则」(全场只有她露脸、只有她穿暗红),再按原片时间轴逐段写动作,并逐排指定面具人群的外套款式,防止人物跨帧换衣服。

三步搞懂

别急着上视频模型。这个片子的秘密是:先把角色和场景锁死,再一次生成 9 个镜头。

1

作者公开的深度捕捉参考视频(推断即提示词里的「白模」)

1440×1080 · 约 30.0 秒 · 4:3 · 无声。作者在自回复里连同提示词一起公开了这段视频:把《STORM》原作 MV 的一镜到底转成黑白深度图,能看到原片的短发女主和一排排人群,负责人物站位、身体动作、前后遮挡和连续拉远的运镜。提示词末尾写「原片作为主要动作参考,白模作为结构辅助,头像作为身份参考」,所以作者实际还喂了原作 MV 和一张女主头像,这两样都没有公开。作者也没说深度图用什么工具做的。

2

第二步:选模型与画幅

模型是 Seedance 2.5(原帖写「Seedance 2.5 原生 30 秒一镜到底 + 多模态参考」)。成片 1920×1440(4:3)、30fps、约 29.5 秒,左上角全程有 HitPaw Edimakor 水印。声音:全程是一首带英文歌词的歌,语音识别断续听到「Like an empty fire」「Stand tall, go higher」,提示词里没写声音,疑似后期配的原作音乐(语音识别判断,未人工试听)。与提示词不符:提示词要结尾前排多人处于俯身状态,成片最后前排是直立、双手交握,弯腰的是后面几排;台阶上也看不太出提示词写的积水反光。

3

第三步:粘贴完整提示词

把下方中文提示词整段粘贴,并按末尾说明上传三样素材:原片(主要动作参考)、白模/深度视频(结构辅助)、人物头像(身份参考)。开头「以 参考视频」「以新的人物图 替换原片 中央女性」中间的空格,是作者原帖里 @ 素材的位置;{{Mixed 1}} 指女主头像。其余依次是:第一规则、场景、主角、群像(逐排外套)、按秒对应原片的动作、风格和负面词。

步骤二 · 9 镜头故事板(人话版)

方便你对照成片理解每一镜在干什么。

  1. Shot 1 — 0–0.5s 近景:暗红大衣、深棕长发的女主正面看镜头,嘴前一小团白气,身后是银色面具人群。
  2. Shot 2 — 0.5–2s 她低头转身,背对镜头。
  3. Shot 3 — 2–5.5s 镜头连续拉远,她朝台阶上的面具人群走去。
  4. Shot 4 — 5.5–9s 走到前排两人之间的窄缝,侧身屈臂挤进队列。
  5. Shot 5 — 9–13s 在人群里穿行,被前排挡住,逐渐转回面对镜头。
  6. Shot 6 — 13–18s 站到中央抬起脸,镜头扩大到人群全景,所有人直立。
  7. Shot 7 — 18–20s 人群第一次大范围俯身,上方露出弧形钢梁玻璃顶棚,女主直立不动。
  8. Shot 8 — 20–26s 人群一轮轮俯身、回起,女主始终站在中央。
  9. Shot 9 — 26–29.5s 拉到最宽全景:前排直立、双手交握在腹前,后几排仍在俯身,女主站在正中间。
关键约束:一个连续镜头、只往后拉,不环绕、不推近、不跳切;全场只有女主露脸、只有她穿暗红,其余人全部戴银色无五官面具、穿深灰外套;每个原片人物始终对应同一个替换人物,不能换衣服、不能增减人数;女主开场在镜头近处,要真的走进队列,不能瞬移;人群俯身要错落,不能全员同步鞠躬,女主不跟着弯腰。原作 MV 和女主头像作者没有公开。

步骤三 · 完整视频提示词

直接全选复制到 Seedance。@Image 1–0 必须对应上面 REF 编号。

GEN 01

《STORM》二创 · 暗红衣女性进入银色面具人群

作者自回复中文完整提示词 · Seedance 2.5 · 原片 + 白模深度视频 + 人物头像

复制
以 参考视频作为动作、运镜和节奏的首要依据,辅助约束人物位置、身体运动及前后遮挡。以新的人物图 替换原片  中央女性的身份与服装
保留原片连续拉远的镜头、构图变化、人物移动路线、动作顺序、动作幅度和节拍。光线与调色替换为雨后阴天的冷灰蓝色。整个视频为一个连续镜头。
【第一规则】
这是“一名露出真实面孔的暗红衣女性,进入银色面具人群”的画面。
全场只有主角露出面孔,只有她穿暗红色。其余人物全部佩戴银色无五官面具,穿深灰色系外套,禁止残留原片的白布头罩、白色短袖衬衫和米色长裤。
每个原片人物始终对应同一个替换人物。谁先俯身、谁后起身、谁向哪边倾斜,都跟随原片各自的动作,不把所有人简化成完全同步的循环。
主角开场位于镜头近处,随后实际走入队列,不能开场就站在人群中央,不能瞬移到最终站位。
【场景】
雨刚停,阴天,柔和冷色天光,低饱和冷灰蓝调。
背景可见三种主要结构:高大的弧形钢梁与玻璃顶棚、带雨痕的深色立柱、逐级向上延伸的宽阔湿石阶。钢梁轮廓接替原片上方砖拱的构图位置,保留原片建筑与人群之间的空间比例。
台阶边缘残留水珠,踏面有薄薄积水和暗淡反光。空气轻微潮湿,背景有很淡的雾,不下大雨,不出现遮挡人物的浓雾。
人群依照原片排列在台阶上,前后错位,形成密集队列。保留主角穿行时原有的窄小间隙,不新增宽阔通道。
【主角】
将原片黑衣短发女性替换为提供的角色头像中的同一位成年女性 {{Mixed 1}} 。视觉设定约25岁、东亚女性面孔,深棕色长发,自然分缝,发尾轻微波浪,小型耳饰,不戴眼镜。
五官比例、眼睛、鼻子、嘴唇和下颌轮廓以头像为准;正面、侧面及转回镜头时保持同一身份。
穿无文字、无标志的暗红色及膝大衣,内搭酒红色高领上衣,下穿黑色修身长裤和深色短靴。保留手臂活动空间,衣摆不遮住全部腿部动作。
神情平静、克制。她是全场唯一不戴面具、唯一穿暗红色的人。长发随转身和行走自然摆动,但不改变原片头部转动的方向、速度及停顿。
【群像】
周围为数十名成年人物,人数和每一帧的可见人数以原片为准;镜头拉远后,原本画外的人逐渐进入画面,不能凭空生成新的人。
人物高矮、肩宽、体型及露出手部的肤色有自然差异。全部佩戴贴合头部的银色金属无五官面具,没有可见眼睛和嘴巴。面具反射阴天光与钢梁轮廓,不发光、不变形、不脱落。
服装在深灰、炭黑、石墨灰范围内变化。按画面站位固定分配,跨帧不换衣服:
第1排从画面左至右依次采用:炭灰单排扣风衣、石墨灰立领外套、煤黑翻领长外套、深灰双排扣风衣、蓝灰直筒外套、炭黑腰带风衣、烟灰暗扣外套、深石墨灰窄翻领外套。超出这些位置的角色继续采用相近但有区别的剪裁,不强行改变原片每排人数。
第2排使用错位搭配:立领、翻领、单排扣、双排扣、暗扣及腰带款交错出现,避免前后相邻人物的衣服完全相同。
第3排起延续深灰色系,通过衣领、纽扣、衣长和材质区分人物。外套长度控制在大腿至膝部附近,不能拖地,确保俯身时手臂、腰部和膝盖动作可辨认。
开场所有人依原片站立,手臂自然下垂。主角穿行时,周围人保留原片对应人物的微小反应,不额外转头围观,不主动让出整条通道。
【动作——与原片时间轴对应】
以下时间为近似定位,分段衔接连续;具体动作起止与每个人的时间差以参考视频为准。左右方向均指画面左右。
0.0—0.5秒:
镜头从主角正面胸部以上的近景开始轻缓拉远;主角面对镜头,嘴前出现与原片开头对应的一小团浅淡白气;背景面具人群保持直立。
0.5—2.0秒:
镜头延续原片的拉远趋势;主角低头,经画面右侧的侧脸方向转身,逐渐背对镜头;背景人群维持原有站姿。
2.0—5.5秒:
镜头连续拉远,逐步显露主角更多身体;主角背对镜头,沿原片路径向台阶上的人群走去,保留原片一侧手臂屈起的姿态变化;人群留在各自站位。
5.5—8.0秒:
镜头继续拉远;主角沿原片步伐接近前排人物之间的窄缝;前排人群保持直立,保留各自轻微的头部及重心变化。
8.0—9.25秒:
镜头继续缓慢拉远;主角侧身屈臂,头部压低至身旁人物肩部附近,按原片姿态挤入队列间隙;身旁人物保留原片的局部反应,不夸张闪避。
9.25—11.5秒:
镜头拉远,呈现更多前后排人物;主角继续背向或斜背向镜头穿过人群,沿原片路线低头侧身移动,身体被前排人物自然遮挡;周围人物保持各自位置,不穿透主角身体。
11.5—13.5秒:
镜头继续拉远;主角在队列中逐渐转回面对镜头,保留原片低头、手停留在上胸附近的过渡姿态;周围人群继续直立。
13.5—15.0秒:
镜头继续拉远;主角在中央位置站稳,逐渐放下手臂并抬起脸;周围人群保持站立,不提前开始大幅俯身。
15.0—18.5秒:
镜头扩大为更完整的人群全景;主角正面站立,保留原片轻微的头部变化;人群保持原片中的轻微晃动及个别头部倾斜。
18.5—19.7秒:
镜头保持原有拉远速度;主角留在中央直立;周围人物按原片各自时序屈臂,将手移向腹部或下胸,俯身低头,形成第一次明显的大范围前倾。
19.7—20.6秒:
镜头继续拉远;主角保持直立;人群按各自原始节拍从俯身中回起,保留有人先直起、有人仍弯腰的差异。
20.6—22.2秒:
镜头继续拉远;主角保持中央位置;人群延续第二轮前倾与回起,双手维持原片对应的腹部附近姿态,身体倾斜方向不统一修改。
22.2—24.0秒:
镜头继续扩大可见台阶范围;主角依原片保持基本直立;人群再次以错落节奏俯身、回起,形成连续波动,不能变成机械同步鞠躬。
24.0—26.0秒:
镜头继续拉远,显露更多脚部和下方湿地面;主角保持中央稳定站姿;周围人物重复原片中的前倾、侧倾与回起,各自保留不同幅度。
26.0—28.0秒:
镜头连续拉远至更宽全景;主角保留原片轻微身体变化;人群继续各自的屈身起伏,脚部落点跟随原片,不自行走动换位。
28.0—30.0秒:
镜头拉远至与原片结束相同的构图尺度;主角仍在中央露出面孔、基本直立;前排多名人物处于俯身状态,后排人物错落地回起或倾斜,按原片结束时的姿态自然结束。
最后一帧:
暗红衣女性直立在人群中央,周围银色面具人物停留在各不相同的俯身或回起阶段,下方可见湿润地面,上方可见弧形钢梁。不要额外添加所有人站直、集体看镜头或静帧定格的结尾。
【风格】
电影级写实,一镜到底。皮肤、长发、金属面具和湿润布料细节自然。人物身份、服装和面具结构跨帧一致。面具反光随头部角度连续变化,大衣褶皱随俯身和回起自然变化。
主角行走进入人群的距离变化,以及镜头拉远带来的人物缩小,都遵循原片,不通过人物变形或突然缩放实现。
【负面】
白布蒙头、白色短袖衬衫、米色长裤、原片黑色短发主角、砖砌拱门、校服、领带、主角戴面具、其他人露出面孔、第二件红色衣服、开场主角已经站在队列中央、人物瞬移、人群主动分开形成宽通道、全员完全同步鞠躬、主角跟着人群反复弯腰、擅自新增舞蹈动作、换位、重复人物、增减人数、身份漂移、肢体畸形、身体穿透、面具软化、衣服换色、镜头环绕、突然推近、跳切、慢动作、暴雨、浓雾遮挡、卡通、白模残留、深度图残留、文字、水印、播放器界面。
上传素材时:原片作为主要动作参考,白模作为结构辅助,头像作为身份参考。 原片里的手部接触和遮挡细节比白模更清楚;如果两者产生冲突,以上述原片为准。

这是 Demo

当前是单页静态站:视频 + 指引 + 可复制提示词。后面可以做成多教程列表、账号、收藏提示词、一键复制、手机竖屏版等。

返回首页,看更多教程