![]()
嗨大家好!我是阿真!
有时候真是不想规规矩矩码字,就想和大家唠唠嗑啊。我是个绝望的 i 人,但偏偏又话痨,只能靠写写文字废话和大家交流了。
今天分享我做的一个动作视频提示词 Skill,这个在我的选题清单里待了很久了。
其实我很久之前就做好了,但有点完美主义,粉丝多了,也多了一点(个人感觉的偶像)包袱,总想着把东西做得更好了再发。结果拖着拖着,很多选题要么过期了,要么自己提不起兴趣了。
不过我觉得这个还是挺有意思的。我混用了 Seedance 2.5、Seedance 2.0、Seedance 2.0 Fast 和 MiniMax H3 来做打斗视频的测试,反正我用的 Agent 很多,哪个还剩积分我就用哪个,整体感觉还可以。
![]()
积分花得差不多了就给甲方霸霸打工再赚,再捣鼓一些新的工具分享。这个过程中我也学到了很多,如果这些分享能够给大家带来一些帮助,我也挺开心的。
先废话少说,直接看视频效果。全是各种打斗场景。
大部分都是文生视频,如果是图生视频,我会放参考图。
Seedance 2.5,15 秒,720P
滑动查看完整提示词
none
[镜头 5] 00:11.60–00:15.00 正侧中景锁定终结。抢夺者最后抓住头盔边缘向她撞来,记者双掌控制头盔两侧改变方向,膝撞大腿、脚扫后踝,将他旋压到湿地;她拉开胸袋取回唯一存储卡,另一手锁住其腕。警车灯在远处进入画面,摩托仍未启动。声音:头盔掌控、扫腿水花、拉链与警笛。人物、头盔、摩托和存储卡全程唯一,直闪不改变动作速度、无字幕水印。Seedance 2.5,15 秒,720P
滑动查看完整提示词
none
[11–15秒] 腰高机位从巡行者侧后方快速推近。机器宠物收拢双翼形成窄梭形,沿中轴做最后一次贴地俯冲,双爪同时伸向水芯筒;巡行者在接触前侧滑半步,让双爪从腰侧穿空,钩杖从下方卡住右爪与翼根之间的机械缝隙。她顺着飞行方向转胯,把机器宠物引向挡风墙内侧的厚沙堆,机身肩部先撞入沙中,两翼仍在挣动。巡行者踩住钩杖尾端固定右爪,空手拉下腹部涡轮的红色紧急断电扣,琥珀色镜头与双涡轮同时熄灭。她取下仍固定在腰间的水芯筒确认无损,风沙继续掠过停机的机械翼。连续性锁定:一名巡行者、唯一猎隼形机器宠物、唯一钩杖、唯一水芯筒、固定平台结构和翼尖擦痕全程一致;机器宠物没有分身,机械翼、爪和涡轮数量不变化,受损痕迹跨镜保留。无字幕,无水印。声音:贴地涡轮轰鸣、机械爪扫空、机身撞入沙堆、断电扣咔哒、动力骤停后只剩风沙声。Seedance 2.0,15 秒,720P
![]()
滑动查看完整提示词
none
连续性锁定:红金灵力固定属于红衣女子,青蓝灵力固定属于蓝衣男子;石狮缺口、玉砖碎片、裂纹与翻转古碑跨镜保留。两人脸、发型、服装、配饰和身高比例稳定。全片没有拥抱、搂腰、抱肩、贴胸、身体缠绕或暧昧动作,没有第三人、分身、换脸、武器复制与肢体穿模。全程实时速度,无慢动作,无字幕,无水印。Seedance 2.5,15 秒,720P
滑动查看完整提示词
none
[11–15秒] 镜头沿消防楼梯金属平台快速前穿后回身接住两人。窃贼抓住平台扶手急转,抬膝阻止女教练接近;她前臂向下挡偏膝线,踩上平台边梁做短促转身跳,从他外侧越过并落在楼梯入口前。窃贼挥掌推肩,她外拍手腕,抓肘、转胯、勾踝连续完成,将他沿平台内侧摔倒。腰包带在摔落中绷直,她解开卡扣取回唯一信封,窃贼空手撑地停止追击。连续性锁定:两名角色、唯一腰包、唯一信封、通风机组、矮墙、屋顶缝隙和金属平台全程一致;每次落脚点可见,跨越距离符合人体能力,人物不瞬移。无字幕,无水印。声音:平台脚步、膝部格挡、身体落在金属板的重响、卡扣开启、远处车流与楼间风声。同一组提示词,我分别用 Seedance 2.5 和 MiniMax-H3 跑了一遍,放在一起更方便对比。视频上方是 Seedance 2.5,下方是 MiniMax-H3。
滑动查看完整提示词
none
[镜头 5] 00:11.60–00:15.00 正侧中景锁定接触点。破坏者最后反身抓柄,巡逻员脚尖勾腕、双手控制其肩肘,连续转髋将他甩离控制台,肩背撞入软垫墙。她立即按下绿色减速按钮,吊厢安全进站;镜头快速后拉,破坏者坐倒,红柄从未落下。声音:甩投落垫、按钮咔哒、轮组降速。人物、椅子和控制柄状态全程连续,无肢体粘连、无道具复制、无字幕水印。Seedance 2.5,15 秒,720P。这个多嘴一句,其实两个人以上也可以,但目前 Seedance 2.5 这个效果是最好的。
滑动查看完整提示词
none
[11–15秒] 35毫米高速环绕四名交战者。骑手把托盘推向焦橙者面前遮线,立即低扫其踝、掌击肩部,让他撞上刚起身的海军蓝;芥末黄从卡座跃下,她回身肘击腹部、脚勾后跟,将其送回座位。她踢远短棍,拉下卷帘门把三人留在店内,收银员安全退入后门。声音:托盘震响、扫腿、卷帘门落锁。四人、短棍、托盘凹痕和桌椅位置连续、无字幕水印。这一组我也放在同一个视频里对比。上方是 Seedance 2.5 下方是 MiniMax-H3。
滑动查看完整提示词
none
[11–15秒] 正对舱门的稳定中景。橙栖沿圆环连续蹬踏两次,以弧线避开机器人第二次直线夹取,把插头准确推入生命维持接口。接口由红转绿,机器人立即停止回收,屏幕表情从警戒变成确认,转而整理剩余线缆。橙栖抓住扶手停稳,尾巴余摆逐渐减小。声音依次为钳臂破空、插头咔哒接通、接口提示音和电机降速声。无第二只猫、无第二台机器人、无线缆复制、无钳臂增生、无字幕、无水印。MiniMax-H3,15 秒,720P
滑动查看完整提示词
none
最后,三只影犬从地面、左墙和车底同时向档案门前的最后一片暗区聚合。柯蓝跑到门前,把手电放在地面朝上照射,酸黄光形成完整圆形亮区。她抓住门把转身,三只影犬沿各自影面扑来,在圆形亮区边缘同时失去前爪,身体被迫停在三个不同方向。档案门开启,门内白光覆盖小巷中轴,三只影犬退回原附着面。镜头快速后拉,手电咬痕、墙面残影和三只犬的位置保持可辨。声音使用雨水、皮鞋、风衣抽动、犬爪刮影面、汽车喇叭与门锁声;无实体血肉犬、无第四只犬、无手电复制、无影犬脱离影面、无字幕、无水印。测试小结
测试场景我特意拉开了题材和材质跨度。从实际效果看,细节上偶尔也会有一些翻车点。
也可以看到,模型目前还会简化部分微动作。多人围攻、快速转身和复杂机械接触,偶尔会出现手脚粘连、接触不够实、道具短暂漂移的问题。提示词写得再细,也无法保证逐帧照做。
总体来说,短短 15 秒里细节还挺多的。
为什么做打斗Skill
我个人觉得这套 Skill 比较有价值的地方,是把一句“来一场打斗”翻译成了模型能执行的动作。Skill 里会要求,谁先出手,打向哪里,对方怎样回应,几个对象的位置发生什么变化,下一招怎么接上,全部要交代清楚。
这也是为什么我们测视频模型经常会让它去跑打斗视频,就是因为打斗视频极容易暴露 AI 模型的短板。
打斗场景的要求非常高,需要同时满足角色一致、肢体合理、动作接触、空间连续、镜头衔接清晰以及道具稳定性等等。
并且它需要在这短短的时间里,完成从起手、交锋到收尾的全过程。如果中间有任何一环松掉了,在衔接上大家会很快看出不自然的地方。
我尝试过很多失败的打斗视频,发现最经常出现的问题主要有下面几个:
双方同时乱挥,攻击是空的,或者是攻击并没有回应; 接触点会因为动作模糊而被遮住; 人物的左右位置有时候会因为切换镜头而互换; 空间关系不清晰; 武器和道具会从一到二变多; 地面、道具被砸坏以后又会修复。
先列几个最紧要的,其他问题目前大多数视频模型也还没解决,这里就不多列了。
我们人看到角色凶狠地打过去,脑子里就会自动补全速度、力道以及受击的反应。
而视频模型则需要更加具体的视觉信息:它需要知道拳头从哪个方向加速,碰到了对方哪个部位,以及对方在被碰到以后,会沿着什么方向失去平衡、撞到什么介质,以及环境的反应(比如可能会有碎屑和余波的烘托)。
怎么用这套Skill
我将这些我能够想到的一些规律都整理到了 Skill 里。后续调用这个 Skill,它问模型可以不选,默认就用 Seedance 那个就行,普遍适用。
选了以后还会问时长。另外,我们给它文字或参考图,再加一句关于场景、动作起始与结果的描述,或者告诉它希望角色怎么打就可以了。
实在没想清楚,像下面这样模模糊糊的描述也可以。(下面这个图很长,滑动查看全图)
↕️ 滑动查看长图
![]()
在生成模式下,每次会输出三组提示词方案。
这三组方案的差别大概就是“打得够不够快、够不够激烈”,具体会往什么方向发展、以及会有什么看点,都可以在方案小标题和注释的地方看到。这样,我们选择的时候先看方案和简介,大概知道是什么感觉了,然后再去进行三选一。
![]()
如果看完结果感觉打斗得还不够激烈,可以用两个关键词去加强,一个是直接跟它说“打斗得更激烈”,一个是“让提示词更高密度”。
目前里面有双人攻防、一人清场、人兽对决、法术对波、单人演武、环境突围和风格化工艺打斗七种主要骨架。
这里我所说的“骨架”,它只负责组织战局:角色怎么移动、怎么防守、以什么方式结束战斗。它会根据人物的身份、体型、武器和场景去进行设计,所以同一套 Skill,它也可以做出很多不同风格、不同场景的呈现。
这套提示词也会适应不同场景。比如在零重力场景里,它会加入更多漂浮和失重感描述。
另外,如果自己写了打斗提示词,也可以发给这个 Skill,让它帮忙检验,提建议但先不修改。比如可能会有一些连续性的断点问题,它也可能会发现,并且给我们一些建议。
![]()
提示词思路
这里关于提示词的原理我尽量长话短说,还是用图像的形式给大家呈现。
![]()
第一层是战斗目标。
每一场打斗都要有人想得到某样东西,也要有人负责阻止。
猫咪把电源线接入生命维持接口,清洁机器人要回收线缆;地铁站里的女孩要护住药包;沙漠巡行者要保住水芯筒。目标一旦清楚,角色为什么逼近、拉开、拖延和反击就有了依据。
当然,这个目标也可以就是打赢或者打着玩,不一定要抢东西或者得到什么。我们说清楚就好。
![]()
第二层是角色动作设计。
Skill 会分别给每个角色定义优势距离(比如弓箭手更适合远攻)、起手姿态、移动方式、主要攻击方式、防守习惯、终结动作。
敏捷型角色会换位、借力和绕侧,力量型角色会压迫空间、制造位移,远攻角色要选位、瞄准、管理弹药,还要处理被贴身后的反制。
这样多个出场角色才会像多个使用不同攻击模式的角色。猫用蹬舱壁和摆尾控制失重惯性,机器人用磁吸轮、卷轴和钳臂回收线缆;侦探依赖手电和空间判断,影犬依赖墙面投影和扑咬。动作符合角色的身份。
![]()
第三层是一攻一应。
这是整套 Skill 里我觉得最重要的规则。整个过程就是,谁发起、攻击哪个部位、接触还是落空、对方怎样回应、双方位置怎样变化、下一拍留下什么接口。
一拍里有动作、有回应、有位置变化,下一拍也能自然接上。模型接收到的是连续动作,画面就不容易出现双方各忙各的状态。
![]()
第四层是时间和节奏。
Seedance 使用连续的粗时间段,常见写法是 0 到 3 秒、3 到 7 秒、7 到 11 秒、11 到 15 秒这类。MiniMax-H3 会使用首尾相接的精确时间码,让每个镜头的动作、声音和切点更清楚。其他视频模型大家使用 Seedance 的提示词都可以,普遍适用。
Skill 还会强制首帧快速启动。0.3 秒内出现有效动作,1.5 秒前完成第一次接触,省掉站着对视和慢慢蓄势的时间,因为我是个急性子。要中段至少发生一次攻防转换,避免节奏不对,前三秒打完了,哦豁后面十秒都在摆造型。
最后一段默认回决出胜负,如果不需要决出胜负,或者要指定哪个角色赢,一定要记得在开始要求的时候指定。
![]()
第五层是力量和摄影机。
重要攻击梳理下来也可以是一套组合拳公式:预兆、加速、接触点、材质变化、受力方向、位移结果、余波。
光写“重重一拳”很抽象,写“拳头撞上前臂,镜头在接触点短震一次,对方肩膀向右后方偏转,鞋底擦过积水滑出半步”就有画面了。
摄影机位也有,贴地跟拍就加快速度,高位俯拍会交代角色的空间距离和环境,侧向中景会看清接触,快速追远负责呈现受击打和位移,极近特写会同时看到武器接触和人物表情。
每个镜头只承担一个主要任务,运镜就更有序一些,不会抢走动作。
![]()
最后一层是连续性锁定。
角色、服装、武器、道具、位置、运动方向和场景损伤破坏都要跨镜头一致。比如会要求墙面的裂纹要一直留到结束之类的。
这一层看起来有点琐碎,主要是做一个备注提醒的保险。AI 打斗的可信度要提升,还要关注画面有没有记住上一秒发生了什么。
![]()
局限与排错
写到这里,我还想诚实地和大家说,在顶级模型的加持下,可能很多情况下,提示词不那么详细也可以出不错的打斗结果。
比如下面两组视频,分别使用一句自然语言提示词和 Skill 生成的提示词,都是用 Seedance 2.5 生成的,时长 15 秒,分辨率 720P。
第一组的提示词只有一句话,“两个乐高人仔的战士在屋顶上打斗,背后是圆圆的满月。”电影感很强节奏也不错。
这个是上面的提示词作为关键词,用 Skill 生成的提示词再生成视频的效果。
滑动查看完整提示词
none
全片只有两个乐高人仔。A 的赤色围巾、黑色头盔、银色短刀固定。B 的深蓝披风、银灰头盔、黑色长枪固定。两件武器始终各一件,长度、材质和握法稳定。保持圆柱头、C 形手、方形躯干和铰接腿结构。人物动作符合积木关节范围,使用整段身体旋转、髋部铰接和手臂摆动完成闪避。满月保持完整圆形。屋面裂口、飞散瓦片和烟囱损伤持续保留。画面保持两名角色、两件武器、稳定面部印刷、稳定服装、稳定玩具比例。无流血、字幕和水印。但不得不说,很多时候视频模型还是会尽可能去减少这段时间区间里动作和运镜的变化。不折腾,也不容易出错,但会比较折中或者平淡。
提示词不够详细的时候,它们就会尽可能以一种更加稳妥、不那么激烈的方式去表现动作变化。这时候,详细的提示词就是能够让这个画面更生动,或者说是有更多的节奏变化。当然,出错几率也会增加。
Skill 不是万能的,该抽卡的时候还是要抽卡,可能越好的视频模型抽卡越少一点。
在使用提示词之前,一定要检查并顺一下思路。有可能会有一些细节交代得不够清楚,或者内容有多余,尤其是在开头和结尾,很容易多余出一些内容。
这里多说两句,遇到有 bug 的情况,接触不清的时间点就调整动作描述,镜头跳轴就调整机位描述,角色或武器漂移,就检查参考素材是否一致、细节是否充分。
大家看我前面呈现的视频也可以看出来。前面的所有视频我都是没有经过任何编辑处理的,都是原视频直出。如果大家发现这些视频里面有 bug,那也是大家在生成提示词、生成视频的时候,有可能出现的 bug。
小结
最后 Skill 链接在这里:
https冒号//github点com/irenerachel/fight-prompt-director复制链接让 Agent 比如 Codex 或者豆包工作安装即可。放链接很容易被腾腾小黑屋,不放又让大家难找,只能靠朋友们猛猛三连为阿真保驾护航了!感恩比心
做完这套 Skill 以后,我对 AI 动作视频的一点点小小心得是,模型也很需要导演式表达。
提示词中关于身体轨迹、受力方向、空间变化和运镜的表述,依然像套公式一样相对机械。
大家如果希望效果更杰出,也可以多看、多去感受优秀的导演是怎么去组织这种打斗场景上的节奏的。这能给大家带来更多领悟和经验。
这套 Skill 后续可能还会继续更新。我会把后续生成里遇到的新问题继续塞回失败诊断和验收规则中,让它慢慢长成一套更稳定的 AI 动作指导系统。
如果大家也在做 AI 打斗、动作分镜或者角色视频,欢迎分享你的经验和经历。如果今天的内容对大家有帮助,或者给大家带来了更多灵感,也期待大家有空多来看看阿真的更新,这对我真的很重要~~
马上99公益日,过去一年有不少朋友在阿真放的公益捐赠按钮支持过我,替毛孩子谢谢朋友们啦!最后,看到阿真三连位置那个小红花了吗,现在是腾讯99公益日期间,点击它一下,腾讯基金会就会捐赠 1 角钱啦!点滴都是爱!
下期见~
-封面OOC致歉
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.