坐标运镜与可视化分镜助手

SkillAI & models

Coordinate camera movement and visual storyboard assistant. Rewrites needs such as video, image-to-video, action storyboards, parkour chases, fight/impact scenes, camera following, and push/pull/pan/track shots into executable [L,T,W,H] coordinate camera prompts, and plans scene motion trajectory ov

Available today. Use it from your connected AI after setup.

Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.

Then ask your AI: use the 坐标运镜与可视化分镜助手 skill

What this skill tells your AI

The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/coordinate-camera-control-designer/SKILL.md and read by ahel’s review.

把镜头运动、角色位移、动作打击点和画面构图转成可执行的 [L,T,W,H] 坐标提示词,并用可视化资产帮助用户检查空间逻辑。适用于动作场面、跑酷追逐、打斗撞击、图生视频运镜控制、复杂镜头路线、九宫格分镜和视频生成前的运动规划。

本 Skill 的核心不是“写一段漂亮动作描述”,而是把动作意图拆成:主体框、相机关注框、目标框、事件框、速度曲线、场景路径、镜头关系和最终视频提示词。需要图像或视频资产时,按照已确认的规划简报完成,并把运行时路由留在 Skill 之外。

按需参考文档

执行本 Skill 时,根据用户任务类型按需读取 references/ 下的文档:

  • 当用户需要“坐标提示词 / [L,T,W,H] / bbox 运镜 / 高速打斗 / 追逐 / 冲刺 / 撞击点 / 主体框 / 目标框 / 镜头跟随坐标”时,先读取 references/tutorial-analysis.md。该文档用于提炼坐标格式、主体框、目标框、事件框、镜头跟随和高速动作可读性原则。
  • 当用户需要“场景运动轨迹总图 / 3×3 总分镜图 / 九宫格分镜 / 可视化分镜 / 逐 cut 子帧 / 干净场景参考图 / 视频生成前规划图”时,先读取 references/visual-storyboard-spec.md。该文档用于约束轨迹图、分镜图、规划层和最终视频参考图的分离规则。
  • 如果用户只要简短坐标提示词,不要求可视化图,可以只读取 references/tutorial-analysis.md。
  • 如果用户要求完整执行本 Skill,或同时需要坐标提示词、运动轨迹图、3×3 分镜图和视频生成提示词,两个参考文档都要读取。

适用边界

使用本 Skill 当用户需要:

  • 把“角色从 A 点到 B 点”“高速冲刺”“闪现攻击”“撞击飞出”“跑酷路线”等动作转成坐标控制提示词。
  • 为图生视频或文生视频准备可控的镜头运动提示词。
  • 生成场景运动轨迹总图,标出路线、坐标、事件点和镜头路径。
  • 生成单张 3×3 总分镜图,让 9 个 panel 对应 9 个 cut。
  • 检查动作空间、镜头跟随、速度曲线和物理连续性。

不要使用本 Skill 当用户只是要:

  • 普通单镜头视频生成,且不需要坐标控制。
  • 长篇剧本创作、短剧结构设计或广告策略。
  • 给现成视频加字幕、剪辑字幕或制作标题卡。

核心原则

  1. 坐标先行:每个关键动作都要有主体起点、目标点、事件点和相机关注区域。
  2. 人物坐标与相机坐标分离:subject_box 不等于 camera_focus。相机可以跟随、领先、落后、环绕、俯视或拉远。
  3. 速度必须可解释:不要只写“很快”,要写速度函数,例如 ease-in、ease-out、burst-stop、impact-freeze。
  4. 规划图与最终画面分离:路径图、分镜图、箭头、坐标框、速度曲线、cut 编号属于规划层;视频生成前应把它们转译成坐标化创作指令。
  5. 规划参考不可显性入画:最终视频提示词要明确禁止可见箭头、路线线条、坐标框、速度曲线、cut 编号、九宫格边框、草图辅助线和标注文字。
  6. 默认 16:9:除非用户另有要求,路径图、分镜图、干净场景参考和视频提示词按横版 16:9 组织。
  7. 模型选择保持灵活:需要生成图像或视频时,说明资产类型和质量目标。用户指定的模型兼容时优先采用,否则选择当前可用且可见能力相当的模型。
  8. 不要承诺固定 4K 可用性:可以把高分辨率作为质量目标;所选模型无法满足时,先说明限制并获得用户同意,再采用已确认的最佳质量。

坐标格式

使用归一化画面边界框描述主体或目标区域:

[L=左边距, T=上边距, W=宽度, H=高度]
  • L:目标框左边到画面左侧的比例,范围 0-1。
  • T:目标框顶部到画面顶部的比例,范围 0-1。
  • W:目标框宽度占画面宽度的比例。
  • H:目标框高度占画面高度的比例。
  • 坐标是二维画面区域,不是三维世界坐标。
  • 同一镜头内坐标要服务于清晰动作逻辑:起点、方向、现身位置、撞击点、结果。

STEP 1:整理基础动作导演提示词

先把用户原始需求整理成一段清晰的动作导演提示词,明确:

  • 主体是谁,是否有参考图或角色名。
  • 场景在哪里,主要空间物件是什么。
  • 主体从哪里开始,朝哪里运动。
  • 中途发生什么动作变化。
  • 最终结果是什么。
  • 动作情绪:爆发、压迫、轻盈、沉重、追逐、撞击、闪现等。

此阶段不需要精确坐标,重点是把动作因果写清楚。

STEP 2:拆解动作、空间和镜头

从基础动作提示词中提取:

  1. 主体引用:角色 A、角色 B、敌人、道具、上传参考图或画布节点。
  2. 场景空间:地面、墙体、障碍物、天空、远景目标、入口、出口。
  3. 主体初始框:主体出发时的 [L,T,W,H]。
  4. 运动目标框:主体冲向、看向、攻击或落入的 [L,T,W,H]。
  5. 关键事件框:撞击点、爆炸点、烟雾中心、踏墙点、落点等。
  6. 镜头关系:固定、跟随、前推、后拉、左摇、右摇、俯视跟随、环绕。
  7. 节奏时间:蓄力、消失、现身、命中、停顿、飞出。
  8. 速度曲线:急入缓出、缓入急出、匀速、先慢后快、先快后慢、变速爆发、升格慢动作、命中前冻结。
  9. 可读性目标:保证观众看清起点、方向、现身位置和攻击结果。

STEP 3:建立四层坐标体系

复杂动作必须先建立四层坐标体系,再写视频提示词:

subject_box: [start] -> [mid 可选] -> [end]
camera_focus: [start] -> [end]
camera_mode: follow / lead-follow / orbit / top-down-follow / low-angle-tilt-up / pull-back / push-in / dutch-shift
target_box / event_box: [...]
speed_curve: 类型 + 时间分配 + 速度变化

速度函数词库

  • linear:匀速,画面位移均匀。
  • ease-in:缓入急出,前段慢、后段突然加速。
  • ease-out:急入缓出,前段快、后段减速稳定。
  • ease-in-out:两端慢、中段最快。
  • burst-stop:爆发后急停。
  • stop-burst:急停后再爆发。
  • peak-mid:中间速度最高,两端回落。
  • impact-freeze:命中或闪避前短暂停顿。

STEP 4:输出坐标运镜分镜表

复杂动作拆成 cut,每个 cut 至少包含:

字段内容
Cut 编号C1、C2、C3……
镜头类型景别、机位、镜头关系
主体/事件谁在动,发生什么
坐标控制起点、目标点、事件点
镜头运动跟随、前推、后拉、甩镜、环绕等
节奏蓄力、爆发、定格、飞出等
速度曲线急入缓出、缓入急出、匀速、变速、升格、抽帧等
可视化要求这一 cut 在总分镜 panel 中必须画清什么

如果用户没有指定 cut 数,默认规划 9 个 cut,便于生成单张 3×3 总分镜图。若动作更短,可缩减为 3-6 个 cut;若用户明确要求逐 cut 子帧,再为每个 cut 拆 3×3 子帧。

STEP 5:生成场景运动轨迹总图

当用户要求“生成图”“画出来”“做分镜图”或完整执行本 Skill 时,先生成一张独立的场景运动轨迹总图。

创作简报:

任务类型:图像生成
用途:动作场景与运动轨迹总图
画幅:16:9
质量目标:高分辨率、信息清晰
内容:完整场景空间、角色初始位置、目标位置、撞击点、运动箭头、镜头运动箭头、cut 编号、坐标框标注和速度曲线标注
风格:导演分镜预演图 / 动作路线规划图;可以使用分层色块和颜色箭头提高可读性;不要做成最终电影海报
参考:如有用户上传角色、场景或风格参考,作为视觉参考传入

轨迹图是规划层,允许短标签、箭头、坐标框、路线、速度曲线和编号。

STEP 6:生成黑白线稿 3×3 总分镜图

默认生成单张 3×3 总分镜图。9 个 panel 对应完整路线中的 9 个 cut,而不是每个 cut 再拆一张九宫格。只有用户明确要求“每个 cut 单独拆动作子帧”时,才额外生成独立 3×3 子分镜。

创作简报:

任务类型:图像生成
用途:黑白线稿 3×3 总分镜图
画幅:16:9
布局:3×3,左上到右下依次为 C1-C9
风格:黑白线稿草图、铅笔分镜、粗略动画分镜;不要彩色、不要复杂上色
内容:每格对应路径图中的路线节点、场景物件、景别、机位和速度曲线;每格左上角只放短编号,可加极短动作标签
参考:必须参考前一步的路径规划逻辑,但不要把路径图直接当最终视频视觉参考

STEP 7:必要时生成干净场景参考图

如果后续要生成视频,且需要保持场景风格与物件布局一致,应生成一张“干净场景参考图”:

  • 同一场景、同一美术风格、同一主要物件布局。
  • 无箭头、无路线、无坐标、无光带、无编号、无速度图表、无分镜格、无说明文字。
  • 这张图可以作为视频视觉参考;路径图和分镜图不应作为视频视觉参考直传。

STEP 8:输出视频生成用坐标提示词

每个 cut 的视频提示词必须包含坐标控制层,不能退化成普通动作描述。

模板:

镜头类型:<景别 + 机位>
主体:<角色/物体/参考图说明>
subject_box: start [L=...,T=...,W=...,H=...] -> mid [L=...,T=...,W=...,H=...] -> end [L=...,T=...,W=...,H=...]
camera_focus: [L=...,T=...,W=...,H=...] -> [L=...,T=...,W=...,H=...]
camera_mode: <follow / lead-follow / orbit / top-down-follow / low-angle-tilt-up / pull-back / push-in / dutch-shift>
target_box: [L=...,T=...,W=...,H=...]
event_box: [L=...,T=...,W=...,H=...]
空间约束:ground / wall / sky / obstacle 等区域如何分布
节奏:<蓄力 X 秒 -> 爆发 X 秒 -> 现身/命中 X 秒 -> 停顿 X 秒>
speed_curve: <类型 + 时间分配 + 速度变化>
可读性:强调起点、方向、现身位置和动作结果清晰可见,避免全程模糊
隐藏参考规则:路径图和分镜图只用于理解路线、景别、机位、场景物件和节奏;最终画面禁止出现可见箭头、路线线条、坐标框、速度曲线、cut 编号、九宫格边框、草图辅助线、分镜纸张和标注文字
最终画面:只出现真实场景物件、角色动作、自然运动模糊、风切、烟尘或速度感

强制检查:如果视频提示词里没有 [L=...,T=...,W=...,H=...],就不是坐标运镜提示词,不能提交生成。

坐标估算规则

没有精确框选界面时,用九宫格估算:

  • 左上:[L=0.05,T=0.05,W=0.20,H=0.25]
  • 上中:[L=0.40,T=0.05,W=0.20,H=0.25]
  • 右上:[L=0.75,T=0.05,W=0.20,H=0.25]
  • 左中:[L=0.05,T=0.35,W=0.20,H=0.30]
  • 中央:[L=0.40,T=0.35,W=0.20,H=0.30]
  • 右中:[L=0.75,T=0.35,W=0.20,H=0.30]
  • 左下:[L=0.05,T=0.70,W=0.20,H=0.25]
  • 下中:[L=0.40,T=0.70,W=0.20,H=0.25]
  • 右下:[L=0.75,T=0.70,W=0.20,H=0.25]

近景主体通常 W/H 更大,远景主体通常 W/H 更小。目标点可用小框,主体可用较大框。

常用句式

高速冲刺

角色从 [L=0.72,T=0.58,W=0.12,H=0.30] 蓄力起跑,身体压低,短暂停顿后瞬间加速,朝 [L=0.12,T=0.28,W=0.08,H=0.22] 冲刺。侧面远景,摄像机高速跟随,路径上有烟尘和自然运动模糊,但保留清晰的起点、方向和终点。speed_curve: ease-in -> burst-stop。

闪现攻击

角色 A 在 [L=0.18,T=0.40,W=0.10,H=0.28] 短暂停顿后消失,下一瞬间现身到敌人侧面 [L=0.66,T=0.32,W=0.12,H=0.34],攻击命中点为 [L=0.58,T=0.38,W=0.08,H=0.16]。镜头先轻微后拉,再瞬间左摇跟上命中方向,命中前短暂定格。speed_curve: impact-freeze -> burst-stop。

主观追逐

低机位主观跟随镜头,地面区域保持在 [L=0,T=0.55,W=1,H=0.45],远处目标位于 [L=0.46,T=0.20,W=0.08,H=0.16]。摄像机沿画面中心线快速前推,路面碎石、风尘和速度感从两侧掠过,强调朝目标逼近。speed_curve: linear -> ease-in。

撞击与飞出

角色 A 从 [L=0.20,T=0.36,W=0.08,H=0.22] 冲向角色 B 的胸口 [L=0.62,T=0.30,W=0.10,H=0.24],撞击点锁定在 [L=0.66,T=0.38,W=0.07,H=0.12]。碰撞瞬间短暂停顿,随后角色 B 沿右上方向飞出到 [L=0.86,T=0.08,W=0.08,H=0.16],镜头瞬间后拉到远景。speed_curve: ease-in -> impact-freeze -> ease-out。

质量检查

交付前静默检查:

  1. 是否至少有一个主体框和一个目标框。
  2. 坐标值是否都在 0-1 范围内。
  3. W/H 是否与景别匹配:近景大、远景小。
  4. 起点、方向、现身位置、攻击结果是否清楚。
  5. 镜头运动是否绑定到 camera_focus,而不是只写“跟随”。
  6. 高速动作是否避免全程模糊,保留关键可读帧。
  7. 多主体时是否明确角色 A、角色 B 或对应参考图身份。
  8. 路径图是否是独立规划资产,不与分镜图混在同一张图。
  9. 3×3 总分镜图是否覆盖 C1-C9 的路线节点、场景物件、景别、相机机位和速度曲线。
  10. 视频提示词是否声明规划元素不显性入画。
  11. 视频提示词是否避免把带规划标注的路径图 / 分镜图作为视觉参考直传。
  12. 每个 cut 是否包含 subject_box、camera_focus、target_box 或 event_box。
  13. 是否区分人物坐标和相机坐标。
  14. 是否为每个 cut 标注了 camera_mode。
  15. 是否为每个 cut 标注了速度函数。
  16. 场景空间是否连续,避免随机跳场景。
  17. 动作物理是否可信:急刹有重心缓冲,踏墙是短暂借力,落地有膝盖缓冲和重心转移。
  18. 若声称一镜到底,相机路径是否物理连续,避免跳切、黑场、转场和机位瞬移。

常见错误

  • 只写“高速移动”,不写起点和终点。
  • 只输出文字坐标,不画轨迹图和分镜图。
  • 只写镜头跟随,不写跟随哪个主体或哪个 camera_focus。
  • 坐标框过大,导致目标不明确。
  • 坐标框过小,导致模型忽略主体完整姿态。
  • 所有动作都用同一个坐标,缺少运动轨迹。
  • 高速打斗全程模糊,观众看不清命中关系。
  • 九宫格每格只是重复构图,没有动作进展。
  • 运动轨迹图做成海报,缺少箭头、编号和坐标框。
  • 视频生成时没有声明规划参考不可显性入画。
  • 视频提示词退化成普通动作描述,丢掉 [L,T,W,H] 坐标层。
  • 只写人物坐标,不写相机坐标。
  • 只写速度数值,不写速度函数类型。
  • 场景物件顺序不符合真实路线。
  • 物理动作夸张成超能力,破坏可信度。

最终交付格式

完整交付应包含:

  1. 坐标运镜分镜表:每个 cut 的主体、坐标、镜头、节奏和速度曲线。
  2. 场景运动轨迹总图:独立规划图,展示全局场景、路线、坐标、事件点和镜头路径。
  3. 黑白线稿 3×3 总分镜图:默认单张,9 个 panel 对应 9 个 cut;只有用户明确要求逐 cut 子帧时,才额外交付每个 cut 的 3×3 子分镜。
  4. 视频生成提示词:每个 cut 一条可用于图生视频或文生视频的坐标控制提示词。
  5. 干净场景参考图:仅在准备进入视频生成且需要场景一致性时生成。

示例表格:

Cut主体/事件坐标控制镜头运动速度曲线九宫格重点
C1蓄力初始框轻微前推impact-freeze压低、蓄力、地面反馈
C2冲刺起点 → 目标高速跟随ease-in残影、烟尘、目标逼近
C3命中撞击点瞬间后拉/甩镜burst-stop定格、冲击、飞出

执行说明

  • 文本规划可以直接在对话中完成。
  • 路径图、黑白线稿分镜图和干净场景参考图应作为独立图像资产,按需要批量或顺序生成。
  • 制作视频时使用干净角色参考、干净场景参考或无标注首帧,并在创作简报中保留坐标控制层;不要把带箭头、坐标和编号的规划图当作视频视觉参考。
  • 需要合成、拼接或加入音频时,说明目标后期效果,不规定运行时路由或命令。
  • 如果用户只要“坐标提示词”,不要强制生成图像或视频;只交付坐标分镜表和可复制的视频提示词。

Signals

GitHub stars
26
Last commit
Sep 2026
Advanced
Item type
skill
Key
coordinate-camera-control-designer
Source
github.com/qxryz/workflowgenerator
坐标运镜与可视化分镜助手 (coordinate-camera-control-designer) · ahel