动作打戏提示词设计
SkillMediaAI video prompt design skill for action fight scenes. Use when the user needs prompts for cinematic fight/battle sequences with film-grade camera work, rhythm, and impact feel, covering two-character duels, heroine vs. monster, close-quarters combat, vehicle chases, group battles, one-take shots, a
Available today. Use it from your connected AI after setup.
No other account needed.
Connect ahel once, and every AI you use reads what you have installed.
Then ask your AI: use the 动作打戏提示词设计 skill
What this skill tells your AI
The instructions your AI receives, as published by kangarooking/director-skills in action-fight-prompt/SKILL.md and read by ahel’s review.
为 AI 视频生成(miora 等通道)设计动作打戏提示词。目标:电影级运镜、清晰的节奏感、可信的打击感,杜绝瞬移、穿模、无效挥拳。
四条铁律(缺一不可)
设计任何打戏片段前,先按这四条搭骨架,再填血肉:
- 时序拆段:总时长(≤15 秒)拆成多个 2-3 秒的小阶段。每个阶段只负责一组主要动作,用时间戳显式标出(如
0:00-0:02)。禁止一个提示词塞十几个同时发生的动作。 - 动作因果链:相邻阶段的动作必须是物理因果关系——对手前冲→女主借惯性转身;女主击中腹部→对手身体前倾→下一段才可能抓住肩膀。每个动作都要能回答"上一个动作给了它什么条件"。孤立动作 = 瞬移/穿模的根源。
- 环境反馈:每个阶段至少写一处环境反馈(尘土飞扬、金属撞击、沙石崩塌、地面裂纹、碎屑飞溅)。这不是装饰——它告诉模型力量来自哪里,打击感由此落地。
- 资产锁定:提示词开头用独立段落声明人物的脸、发型、服装、武器、身体比例全程不变。双角色场景必须分别说明每张参考图对应谁(
图1 = 女主,图2 = 怪兽),防止结构混淆。
进阶规则(决定成片质感上限)
四条铁律保证"能看",以下规则保证"好看":
- 音效独立成层:单独写音效段——要么每阶段末尾跟一小句音效,要么结尾整段"音效节奏"总述。无配乐需求时显式写"不要音乐,只保留音效/环境音"。音效要覆盖力量(引擎拔高、闷响)、材质(碎石、摩擦)、生物(嘶吼、呼吸)三层。
- 动作结果允许失败:打击 ≠ 命中即胜。刀砍不进硬甲被弹开、反作用力震飞主角、刀刃卷曲——物理一致的挫败比全程碾压更有可信度,也为战术转变提供叙事钩子。
- 动作轨迹拆解式描写:关键一击不写结果、写轨迹——"空中下落 → 双手高举 → 竖向重劈 → 刀锋正中厚甲",四步链条让模型逐帧可执行。
- 微慢动作给具体时长:命中瞬间的慢速不写"轻微慢动作",写"约 0.2-0.3 秒微慢动作后立刻恢复正常速度",每段最多一次。
- 结尾必须铺垫下一轮:余韵段不止定帧——车头重新朝向目标、意识到破不了甲、扯下工牌走向出口。给下一段留钩子。
- 群体敌人分层写:多敌人场景交代数量与行为顺序("6 只伴猎怪纷纷转身嘶吼,其中 2 只率先扑出"),镜头明确拍出该顺序;群战中多对手面孔必须各不相同、禁止与主角相似。
- 风格开关前置:一镜到底、手持手机纪实质感、无防抖抖动等整体风格声明放在提示词最前部,只声明一次,不做中途切换。
输出样式(二选一,按题材)
- A. 时间戳式:
0:00-0:02 段落正文。适合快节奏近身对打、追车战——节奏密集,镜头切换频繁。正文内镜头语言以"镜头用……跟拍"句式自然嵌入。 - B. 分镜头命名式:
镜头01——接近。适合大场面、景别大幅跳转(贴海浪跟踪 → 环绕 → 极远航拍),每个镜头一个动词性命名,段落内写透单一景别。
两种样式都遵守四条铁律,同一条提示词内不混用。
工作流程
第一步:收集输入(缺项一次性问全)
- 总时长(miora H3 通道为 4-15 秒整数;区间外不提交,向用户说明)
- 角色:几方?人类/怪兽?各自的武器?有无载具?
- 参考图:有几张,各对应谁
- 场景环境:地面材质(沙石/金属/废墟/水面)——决定环境反馈词汇
- 题材类型:近身对打 / 载具追逐 / 群战 / 巨型生物对决——决定用哪套场景配方(见
references/scene-patterns.md)与输出样式 - 音效要求:是否需要配乐(默认不要音乐、只保留音效)
第二步:搭节奏骨架
按"三拍式"分配阶段,再微调:
| 拍 | 占比 | 内容 |
|---|---|---|
| 蓄力 | ~30% | 对峙、逼近、第一次交锋试探 |
| 爆发 | ~50% | 主交锋:连续因果动作链,打击最密集 |
| 余韵 | ~20% | 收尾定帧:胜负分明、尘埃落定、镜头缓推 |
输出阶段表:每阶段填 4 列——时间戳 / 镜头 / 主动作(一组)/ 环境反馈。先给用户看这张表,确认后再展开成完整提示词。
第三步:写完整提示词
按此顺序组装(可选段按需取用):
【风格开关段】一镜到底/手持纪实质感等整体声明(如有)
【资产锁定段】人物外观声明 + 参考图映射;群战加对手面孔规则
【场景段】环境、光线、色调、氛围粒子(尘埃/水雾/粉笔灰)
【时序段】逐阶段:时间戳或镜头命名 + 镜头语言 + 动作 + 因果衔接词 + 环境反馈
【音效段】分段音效或整体"音效节奏"总述;默认声明"不要音乐"
【技术段】画幅、帧率、画质参数(16:9、24 FPS 等按项目规范)
四条铁律的词库与范例见 references/camera-and-impact.md;四类题材配方与两种输出样式骨架见 references/scene-patterns.md;完整范例(女主 vs 怪兽 15 秒)见 references/example-15s-duel.md。
第四步:QA 核对
交付前逐项自查,不通过就改:
- 每阶段 ≤ 一组主动作,时长 2-3 秒
- 任意相邻两阶段能说出因果衔接("因为 A 所以 B"成立)
- 每阶段 ≥ 1 处环境反馈
- 开头有资产锁定段;双角色场景参考图映射明确;群战对手面孔规则齐全
- 运镜有变化(不是全程固定机位),且镜头服务于动作(爆发段贴身跟拍/手持震动,余韵段缓推或定帧)
- 无孤立动作、无"瞬移式"位移描写
- 关键一击写了动作轨迹拆解;命中瞬间慢速给了具体时长(≤一次)
- 有独立音效层,且"不要音乐"约束按需求写明
- 结尾有下一轮铺垫(转向目标 / 战术转变 / 情绪定格)
- 输出样式全文统一(时间戳式或分镜头命名式,不混用)
边界
- 只设计提示词文本,不提交生成任务(生成走 miora-video-studio 等对应技能)。
- 时长超出通道上限时不拆分提交——是否分镜分批由用户决定。
Signals
- GitHub stars
- 122
- Forks
- 20
- Last commit
- Sep 2026
Advanced
- Catalog kind
- skill
- Gateway key
action-fight-prompt- Source
- github.com/kangarooking/director-skills