相邻镜头要共享事实,不只是共享风格

AI 视频跨镜头连续性

从状态账本、动作相位、空间轴线、视线、编辑把手到 J-cut 与 L-cut,建立可剪辑的 AI 视频跨镜头连续性工作流。

连续性不是“画风差不多”

两个镜头可以使用同一个角色、同一种色调,却仍然无法组接。观众会同时追踪人物站位、屏幕方向、视线目标、手中道具、动作进度、光源方向、环境声和情绪强度。任一事实无故跳变,镜头就不再属于同一个事件。

最稳的做法,是给每个镜头定义 state_instate_out:它从什么事实开始,结束时改变了什么。下一镜只能读取上一镜已经提交的结果,不能凭提示词重新猜测。

把动作拆成相位

不要写“她拿起文件并走到门口”。把动作拆成:

  1. 预备:视线落到文件,肩膀开始前倾。
  2. 启动:手离开桌面,伸向文件。
  3. 接触:手指压住文件夹边缘。
  4. 峰值:文件离桌并到达胸前。
  5. 释放:身体转向门口。
  6. 余波:其他人做出反应,环境声或音乐接管。

上一镜可以在“接触”后切出,下一镜从“文件刚离桌”切入。若两个镜头都完整执行拿文件,剪辑会重复;若一个停在预备、另一个已经走到门口,中间动作会消失。

维护空间轴线和视线

先画极简场景地图:门、窗、桌、人物座位、主要光源和摄影机可用区。双人对话建立 180 度轴线,为每个角色记录朝向与视线目标。需要越轴时,用中性正面、移动过轴、明确的建立镜头或人物运动重新建立空间。

多人场景尤其需要“谁看谁”的有向关系。单独生成的反应镜头若没有视线目标,模型会给出摄影棚式正视,剪进去就像人物看向另一个世界。

给剪辑留把手

每个镜头目标时长之外,尽量保留短暂的稳定入点与出点。演员动作完成后不要立刻让画面崩坏;摄影机运动开始前也要有可用静止区。把手让剪辑师能够调整节奏、做动作匹配、插入反应或藏掉生成瑕疵。

声音把手同样重要。房间底噪、衣料声、呼吸和对白尾音应能跨切点延续。J-cut 可以让下一场声音提前进入,L-cut 可以让上一句对白越过画面切换,它们通常比炫目的形变特效更能维持连续体验。

转场先定义叙事关系

选择转场前先回答:时间是否连续、地点是否变化、谁的主观经验占主导、观众需要感到冲击还是流动?

关系 常用方案 验收重点
同一动作连续发生 硬切、动作匹配 动作相位和屏幕方向
视线引出对象 视线匹配 视线角度和信息揭示顺序
时间或地点跳跃 声音桥、建立镜头、图形匹配 观众是否立即重新定位
主观记忆进入 声音先行、受控溶解、质感变化 主观性是否清楚
高速省略 蒙太奇、插入镜头 因果是否仍然可读

一次连续性验收

先静音看画面,检查动作、空间、光线和道具;再闭眼听声音,检查对白、环境、音乐与节奏;最后合起来检查注意力是否在正确时刻落到正确信息。发现错误后,把它标为身份、状态、空间、动作、光线、声音或剪辑问题,再送回对应工位。

常见问题

为什么两个单独好看的镜头剪不到一起?

因为它们可能没有共享动作相位、屏幕方向、视线、空间关系、光线状态、声音床或足够的编辑把手。

AI 形变转场能解决不连续吗?

通常不能。形变只能掩盖少量视觉差异,无法修复错误的叙事因果、空间方向和人物状态。

跨镜头动作应该怎样生成?

先把动作拆成预备、启动、接触、峰值、释放和余波,再明确上一镜的出点与下一镜的入点,避免让两个模型各自完整表演一次。