空间/镜头调度
2026-07-21 19:11视频只有约 4 秒,720×1280 的 9:16 竖屏
用于锁定画面空间、左右关系、人物站位和镜头轴线,减少 AI 视频空间漂移。
空间/镜头调度
提示词
空间
参考图
3,380 字6 min
视频只有约 4 秒,720×1280 的 9:16 竖屏;你的故事板却是横向三联画。模型必须先把横版构图强行改造成竖版,于是它必然重新居中人物、压缩左右距离。更致命的是,4 秒里你要求它完成“抬手→藤蔓活化→抽中手腕→缠绕胳膊→甩飞三米→摔地→藤蔓缩回→雕花复原”,足足七八个状态变化。它没有时间逐项表现,所以直接合并成了“粗大的树枝缠住上半身,把人扔倒”。 成品里的具体错误很明显:藤蔓没有精准抽中右手腕,而是变成粗壮树根,碰到了肩膀和躯干;甩飞主要表现成了向镜头纵深方向翻滚,不是清楚的横向右移;第23镜要求 Seraphina 单人,Elara 却仍留在背景;藤蔓也没完成“缩回并恢复雕花”;第24格存在于故事板里,但文字没有给它对应的时间和动作,模型不知道它到底是本段指令,还是单纯的参考图。 还有两个隐藏得更深的硬伤。 第一,你让 Seraphina 一开始处于画面右侧,随后又要求她被甩向画面右侧。她本来就在右边,镜头内没有足够的右向运动空间。模型只能把运动改成向前、向后或者原地翻滚。要想她横向飞向右边,第23镜开始时必须把她放在画面左侧三分之一,并且给右侧留下至少一半以上的空地。 第二,藤蔓从左墙长出来,缠住手腕以后,如果只是“猛地拉扯”,物理上应该把她拉向左墙,而不是甩向右边。你必须告诉模型:**藤蔓不是收缩拉人,而是以左墙根部为支点,从左向右横向扫甩,并在人物离地后松开,人物依惯性飞向右侧。**不写这个力学机制,模型就不知道右向力量从哪里来。 所以这段不能继续写成一个长段落,必须拆成三个独立视频。故事板也不要再使用带编号、箭头、文字和三个格子的整张拼图;每一镜单独裁图,改成和成片一致的 9:16,最好为每段准备“起始帧+结束帧”。 第22镜:只完成抽腕和缠绕,不要甩飞 建议时长 2.5—3 秒。 9:16竖屏,哥特式宫殿长廊,同一场景,平视固定全景,摄影机完全不移动、不推拉、不摇晃。 角色身份固定: Seraphina,成年黑色卷发女性,深紫色维多利亚长裙。 Elara,成年金色长发女仆,黑色长裙、白色围裙,手持玻璃瓶。 空间位置固定: Elara站在画面左侧后方,距离摄影机较远,背对镜头,全程保持静止。 Seraphina站在画面右侧前方,距离摄影机较近,右后背朝向镜头,身体面向左后方的Elara。 画面最左侧清楚可见带玫瑰藤蔓浮雕的墙面。 两个人的位置全程不得交换,不得靠近,不得瞬移。 动作时间: 0.0—1.0秒,Seraphina愤怒地高高举起右手,准备挥向远处的Elara。 1.0—1.6秒,左侧墙面的一根细长玫瑰藤蔓突然活化,从墙面横向快速甩出。 1.6—2.5秒,藤蔓尖端只抽中Seraphina抬起的右手腕外侧,随后只在右前臂缠绕一圈并绷紧。 结束状态: Seraphina双脚仍然站在地面,右手腕被藤蔓锁住,身体尚未被甩飞。 Elara没有回头,没有移动。 声音: Seraphina愤怒喊叫:“AHHHHH!” 严格禁止: 藤蔓不得碰触Seraphina的脖子、胸口、腰部、肩膀或头部; 不得变成粗大树根或巨大触手; 本镜不得甩飞、不得摔地、不得缩回墙面; 摄影机不得切换角度; Elara不得转身或移动。 这一镜的结束帧,要明确画出“手腕被缠住、双脚仍然着地”。把这个结束帧直接作为下一镜的状态参考,连续性会稳定很多。 第23镜:只负责横向扫甩、松开和落地 建议时长 4 秒。这里必须重新设计构图,不能照旧把 Seraphina 放在右边。 9:16竖屏,延续上一镜的同一时刻、同一座哥特式宫殿长廊,人物身份和服装完全一致。 中远景侧拍,摄影机位于上一镜动作轴线的同一侧,不跨越轴线。 画面左边缘保留一小部分玫瑰藤蔓浮雕墙,后方是高大的哥特式窗户。 Seraphina在本镜起始时位于画面左侧三分之一。 画面右侧约60%的区域必须是完整、无障碍的空旷大理石地面,作为甩飞和落地区域。 画面内只出现Seraphina。 Elara仍然站在上一镜的原始位置,但处于摄影机左后方画外,不得突然消失或换位。 起始状态: 细长玫瑰藤蔓从画面左边缘进入,只在Seraphina右手腕和右前臂缠绕一圈。 Seraphina双脚仍然接触地面,身体侧面对着摄影机。 动作时间: 0.0—0.7秒,藤蔓绷紧,Seraphina的右臂被拉直,但身体尚未离地。 0.7—1.7秒,藤蔓根部不向左收缩,而是以左侧墙面为固定支点,从左向右完成一次快速、水平的弧形扫甩,带动Seraphina的右手腕向画面右侧加速。 1.7—2.2秒,Seraphina双脚离开地面后,藤蔓立刻松开她的手腕。 2.2—3.2秒,Seraphina依靠惯性从画面左侧横向飞向画面右侧,运动路线平行于地面;上半身在前,裙摆和双腿向左后方拖曳。 3.2—4.0秒,Seraphina重重落在画面右侧预留的大理石地面上,身体停止滑动。 结束状态: Seraphina倒在画面右侧地面。 藤蔓已经与她分离,但本镜暂时不要缩回墙面。 严格禁止: 不得把Seraphina拉向左墙; 不得朝摄影机冲来; 不得向画面纵深方向飞行; 不得原地旋转翻滚; 藤蔓不得缠绕躯干、腰部、胸口或脖子; 不得出现Elara; 不得改变窗户、墙面和地板的位置; 不得在本镜加入Elara回头的特写。 这里最重要的不是“甩飞三米”,因为模型对米数基本没有稳定概念,而是写成:从画面左侧三分之一,横向移动到画面右侧三分之一。这是模型真正能理解的画面距离。 藤蔓缩回与第24镜必须另拆 “摔地后藤蔓立刻缩回、变回雕花”单独做一个 1 秒左右的插镜;Elara 回头则再做一个独立近景。不要把两件事继续塞进第23镜。 藤蔓插镜可以这样写: 1秒固定近景,只拍左侧玫瑰浮雕墙面。 刚刚活动过的细长藤蔓快速缩回墙体,沿着原有浮雕纹路归位,表面重新变成静止的玫瑰枝蔓雕花。 没有人物出镜,没有新的藤蔓生长,没有墙体破裂,没有魔法光效。 第24镜这样写: 9:16竖屏,延续同一场景。 Elara近景,金色长发、黑色女仆长裙和白色围裙完全保持一致。 她仍然站在第22镜的原始位置,手中的玻璃瓶保持稳定。 Elara只缓慢地把头转向右后方,身体和双脚不转动,表情克制而警觉。 画面内不出现Seraphina,不出现活动的藤蔓,不切换场景。 以后故事板模板要这样写 故事板不能只有“镜号+景别+一段剧情”,必须增加一个真正控制空间的“镜头状态卡”。每一镜都按下面填写: 镜头编号: 成片比例: 时长: 【世界固定锚点】 房间中不可移动的墙、窗、门、家具分别在哪里。 人物在现实空间中的位置,不因切镜而改变。 【摄影机】 机位位于哪里,朝哪个方向拍。 是否允许移动、切镜、推拉或摇摄。 是否跨越动作轴线。 【画面空间】 人物分别位于画面的左、中、右哪一区域。 前景、中景、后景分别是谁。 运动终点留出多少空白区域。 【可见人物】 本镜谁出镜。 未出镜人物仍处于世界中的什么位置,不能写成凭空消失。 【起始状态】 第一帧每个人的姿势、朝向、接触物和受力状态。 【动作节拍】 按秒拆分,单镜最多三个核心动作。 一个动作完成后,再开始下一个动作。 【物理机制】 谁施力、力从哪里来、朝哪个方向、何时松开或停止。 【结束状态】 最后一帧必须明确写出来,并作为下一镜的起始状态。 【唯一接触点】 例如只允许藤蔓接触右手腕,其他部位全部禁止。 【禁止项】 角色换位、镜头越轴、错误接触点、错误运动方向、场景变形等。 故事板图片本身也要遵守四条:**一张图只对应一个镜头状态;不带箭头、编号和字幕;尺寸与成片画幅一致;复杂动作至少提供起始帧和结束帧。**箭头和文字对人类是说明,对生成模型往往只是画面里的奇怪图形,它不会像导演一样自动把箭头翻译成精确运动路径。 这次最核心的改法,不是继续往原提示词里堆形容词,而是把“故事叙述”改成“状态转换”。你原来写的是“她做了什么,然后又发生什么”;模型真正需要的是“第一帧在哪里——受什么力——沿哪条路径移动——最后一帧停在哪里”。这两者看起来只差一点,控制力却差一个数量级。