资讯中心 2026-09-14 19:36 204 次阅读

如果使用AI生成动作戏

AI动作戏最难的地方不是让人物动起来,而是让动作有明确的起势、受力、反应和结果。本文从动作参考图、白模或参考视频、动捕视频三个层次,说明如何提高AI生成动作戏的流畅度、打击感与镜头连续性,并解释不同制作阶段该怎样选择参考方式。

做AI动作戏时,最容易出现一种错觉:提示词写得越长,人物就会越会打。实际上,模型能从训练资料里学到奔跑、挥拳、闪避和摔倒的视觉样式,却未必知道你这一拳从哪里起、打到哪里、对手为什么后退,以及下一个镜头该怎样接上。复杂动作一旦只靠文字描述,常常就会变成手脚软绵、发力方向混乱,甚至人物在同一镜头里突然换了姿势。

这并不完全是模型“不会动作”,而是文字很难承载连续动作中的空间关系。导演在现场会用走位、节拍和镜头调度把动作拆开,AI创作也需要类似的准备。动作戏的质量,往往从生成之前就已经决定了一半。

第一层:动作参考图,成本最低,适合短镜头试做

小批量制作或临时补一个镜头时,可以先画出或生成一组动作分镜图。不要只做一张“人物正在打斗”的海报,而要把起手、出拳、命中、受击和收势分别表现出来,同时固定人物的服装、武器、场景方向和光线。输入图片参考时,再用提示词补充镜头景别、动作顺序和运镜,模型更容易理解这场戏的变化。

目前不少图生视频工具都提供图片或多帧参考能力,例如Seedance、Kling、Vidu,以及部分开源工作流中的视频模型。不同版本支持的参考张数、首尾帧方式和控制强度并不相同,使用前应以当期官方文档为准。这种方法成本相对低,适合短镜头和快速试错,但如果动作本身很复杂,几张静态图仍然难以交代完整的重心转移。

如果使用AI生成动作戏

第二层:白模与影视参考视频,增加中等成本换取更强控制

当镜头要求翻滚、追逐、连续格挡或多人交手时,可以先用Blender等工具制作简单白模视频。白模不需要漂亮,只要把人物位置、身体朝向、动作节奏和镜头运动交代清楚。再把文字说明和白模一起作为参考,生成模型得到的约束会比单看一张图更完整。白模需要额外的预演和镜头设计,成本会高于动作参考图,但通常还没有动捕那么重,适合对空间关系有明确要求的中等复杂镜头。

也可以使用经过授权的动作参考视频,提取其中的节奏、构图或运动关系。这里要分清“参考”和“拿来用”:参考视频应经过授权,最终成片还要重新设计镜头,不能把原片段换个画风就当成原创。实际制作中,多段参考往往需要拆解、重组,再通过剪辑建立新的动作逻辑。需要视频参考输入的能力并非所有模型都有,不能看到宣传页面有示例,就默认自己的账号和版本一定支持。

第三层:动捕参考视频,成本最高,换取最强的动作控制

如果是主角打斗、武术表演或需要严格还原身体力学的镜头,动作捕捉会提供更稳定的运动轨迹。动捕数据或拍摄的动作视频可以先确定人体关节、速度和重心,再交给AI完成角色外观、环境和风格转换。它的准备成本更高,也需要专业人员清理数据、调整节奏和处理穿插遮挡,但换来的控制力更适合高要求项目。

无论选哪一层方法,都不要把希望寄托在一次抽卡上。动作戏应先拆成可验收的镜头,逐条检查起止姿态、受力方向、人物距离、武器连续性和剪辑节拍,再处理烟尘、音效、配乐与调色。AI降低了画面生成门槛,却没有替代动作设计、镜头调度和后期判断。若项目需要编导、分镜、AI生成与后期协同,可以在AI视频制作服务中寻找合适的承制团队,让动作标准在制作前就被说清楚。

发布于 2026年09月14日