换装导演
SkillMediaDesigns "multiple-outfit collage first frame + outfit-change videos" for women, men, or pets, outputting locked parameters, image prompts, a full timeline, concise video prompts, and negative constraints. Use when the user mentions outfit-change direction, character or pet outfit changes, outfit col
Available today. Use it from your connected AI after setup.
No other account needed.
Connect ahel once, and every AI you use reads what you have installed.
Then ask your AI: use the 换装导演 skill
What this skill tells your AI
The instructions your AI receives, as published by liyue-aigc/outfit-director in skill/SKILL.md and read by ahel’s review.
目标
把一次换装需求转换为彼此联动的:
- 路由判定与参数锁定
- 拼贴首帧图片提示词
- 完整视频时间轴
- 可直接复制的精简视频提示词
- 负面提示词与强制约束
图片是视频的结构母图。视频必须继承主体身份、全部造型、侧边贴图位置、画面布局与摄影质感。
工作流程
- 先执行主体路由:女性、男性、宠物或混合合集;判断复杂、涉及宠物或混合合集时读取
references/subject-routes.md。 - 再执行视频路由:卡点换装或换装舞蹈。
- 锁定用户明确给出的参数;只补全低风险缺失项。
- 需要服装方案时读取
references/parameter-presets.md。 - 需要选择或改造转场时读取
references/transition-library.md。 - 生成首帧提示词,再依据首帧结构生成视频时间轴。
- 最后执行数量、时长、贴图消失、身份一致性检查。
不要重复询问已知信息。仅在主体类别、造型方向或互相冲突的高影响参数完全无法推断时,问一个简短问题。
主体路由
按以下优先级判定:
- 用户明确指定的主体类别
- 上传参考图中清晰可见的主体
- 用户文本中的角色、性别、物种或品种
- 均缺失时默认原创中国成年女性
女性路线
- 无参考图且未指定国籍 / 族裔外观时,默认原创中国成年女性,视觉年龄 22–28 岁,自然真实的东亚面部特征。
- 明确锁定脸型、五官、肤色、妆容、眼睛、发型、发色、身材比例与整体气质。
- 不使用服装或文化符号代替族裔外观,不自动生成欧美面孔。
男性路线
- 无参考图且未指定国籍 / 族裔外观时,默认原创中国成年男性,视觉年龄 22–30 岁,自然真实的东亚面部特征。
- 明确锁定脸型、五官、肤色、胡须状态、发型、发色、体型比例与整体气质。
- 服装和动作可阳光、都市、学院、商务、运动、国风或用户指定,不套用女性妆容与姿态模板。
宠物路线
- 锁定物种、品种或混种特征、成年/幼年阶段、体型、毛色、花纹、眼睛、耳形、口鼻、尾巴和项圈等识别锚点。
- 不写国籍、族裔、妆容或人类身材比例。
- 默认保持真实动物解剖与四足运动;除非用户明确要求,不拟人化站立或舞蹈。
- 服装必须适体、安全,不遮挡眼睛、鼻子、嘴巴,不束缚颈部、胸腔、四肢与尾巴。
- 宠物“舞蹈”默认解释为节拍化转圈、抬爪、侧步、坐立、歪头等自然动作组合。
混合合集路线
- 用户明确要求女性、男性与宠物合集时,分别生成独立子方案;不得把人物身份一致性强行跨主体套用。
- 每个子方案独立执行主体锚点、首帧、时间轴和负面约束。
- 未明确要求同框时,默认分成多个独立视频,避免一条视频中主体数量和造型路由冲突。
视频模式路由
模式 K|卡点换装
触发词:卡点、点击换装、贴纸飞入、快速变装、8 秒、9 秒、10 秒。
- 时长限定 8–10 秒;用户未指定具体值时使用 9 秒。
- 默认 5 套造型:中央初始造型 + 4 个侧边造型。
- 默认固定机位,优先保证换装因果与动作连续。
- 默认加入有清晰重拍的卡点背景音乐;必要转场音效可轻量叠加。用户说“仅背景音乐”时禁止额外音效。
- 用户明确指定 3–7 套造型时可调整数量与布局,但时长仍保持 8–10 秒。
- 默认完成点(9 秒):1.35、3.05、4.85、6.85 秒;最后至少保留 1.5 秒展示最终造型。
模式 D|15 秒换装舞蹈
触发词:换装舞蹈、跳舞、舞蹈编排、dance、15 秒。
- 时长固定 15 秒。
- 造型固定正好 7 套:中央初始造型 1 套 + 左侧 3 套 + 右侧 3 套。
- 中央主体必须全身站在画面中间,双脚活动区稳定,不漂移出中心区域。
- 左侧上 / 中 / 下各放 1 个完整主体贴图;右侧上 / 中 / 下各放 1 个完整主体贴图。
- 六个侧边贴图分别穿不同服装并采用不同舞蹈关键姿势;脸、发型、体型或宠物识别锚点始终一致。
- 默认激活顺序为左上 → 右上 → 左中 → 右中 → 左下 → 右下,以保持视觉平衡。
- 默认换装完成点为 2.0、4.1、6.3、8.5、10.8、13.0 秒;13.0–15.0 秒展示最终造型并完成收尾动作。
- 每次在舞蹈动作峰值换装,连续完成六次变装;不得切成七段彼此无关的独立动作。
- 默认只使用卡点背景音乐,不加点击声、飞入声或换装音效;用户明确要求时再添加。
- 默认固定正面全身机位;可轻微呼吸式推近,但不得影响七个主体的首帧识别和中央舞蹈连续性。
当“卡点”和“舞蹈”同时出现时:若用户强调连续舞蹈或 15 秒,选择模式 D;否则选择模式 K。用户明确要求两版时分别输出,不混成一条时间轴。
工作模式
直接生成
已有参考图、角色设定或足够服装信息时,直接输出完整结果,不重复提问。
参数推荐
用户说“原创推荐”“先给方案”“推荐几组”时,读取 references/parameter-presets.md,先输出 4–8 组差异明显的参数组合;用户选定后再生成完整提示词和脚本。
参考图提取
- 提取可见主体身份、年龄阶段、外貌或动物识别锚点、造型、位置、比例、朝向、背景和光线。
- 参考图优先于默认值;看不清的非核心细节可标记
系统补全。 - 不用文字模板覆盖图片中已经明确存在的设定。
换装机制改造
用户已有脚本而只想更换变装方式时,保留主体、服装、镜头、时长和布局,只替换触发与相应动作。先读取 references/transition-library.md;需要备选时提供 3–6 个方案。
参数锁定
用户明确给出的参数均为锁定参数,不得擅自替换、弱化或删除。只列本次真正使用的字段:
- 主体路线与基础身份
- 成年年龄感;宠物则写生命阶段
- 国籍 / 族裔外观;宠物则写物种 / 品种
- 外貌或动物识别锚点
- 发型、头饰、耳饰;宠物则写毛色、花纹、项圈
- 初始造型及其余全部造型
- 画幅、布局、背景、光线与主色系
- 视频模式、时长、比例、机位与运镜
- 动作基调、换装机制、完成卡点、声音与结尾动作
- 系统补全项
默认图片布局
卡点模式:五主体拼贴
- 中央:大型主体,约占画面宽度 55%–62%。
- 四个侧边贴图:左上、右上、左下、右下。
- 正好 5 个同一主体版本;中央最大,侧边明显更小。
舞蹈模式:七主体对称拼贴
- 中央:全身主体,约占画面宽度 42%–48%,完整露出头顶和双脚。
- 左侧:左上、左中、左下三个完整主体贴图。
- 右侧:右上、右中、右下三个完整主体贴图。
- 正好 7 个同一主体版本;侧边六个贴图不遮挡中央脸、手臂、腰胯与双脚活动区。
- 六个侧边造型和姿势均不同;左右视觉重量均衡。
通用硬规则:
- 侧边贴图必须沿真实身体或宠物轮廓裁切,不得使用矩形缩略图。
- 每个侧边贴图使用独立白色虚线或用户指定描边;中央主体不描边。
- 同一视频中的所有版本必须是同一主体,只改变服装、配饰和动作姿势。
- 人物必须全身完整;宠物必须完整保留耳、爪和尾巴。
首帧图片提示词
按此顺序编写:
- 画幅、摄影风格与主体路线
- 统一身份和识别锚点
- 明确“正好 5 个”或“正好 7 个”同一主体版本
- 中央主体的位置、构图、姿态与初始造型
- 每个侧边贴图的精确位置、姿态与对应造型
- 轮廓裁切和描边效果
- 背景、光线、镜头、皮肤 / 毛发、发丝与服装面料
- 主色系和画面气质
- 数量、完整肢体、身份一致性等硬限制
- 负面提示词
为视频兼容:姿势不得极端扭曲;头、肩、腰、手臂或宠物四肢结构清晰;服装边缘完整;中央姿势要给后续动作留空间。
默认换装机制
卡点拼贴默认使用“完整主体飞入重合”:
- 激活目标侧边贴图。
- 复制出相同的完整主体轮廓作为飞入副本。
- 原位置目标贴图在飞入启动的同一帧立即消失,原位留空,之后不再出现。
- 飞入副本沿斜线移动到中央并放大,描边始终贴合主体轮廓。
- 副本与中央主体的头、肩、腰和姿态对齐;宠物则对齐头、躯干与四肢支点。
- 对齐瞬间切换服装,飞入副本和描边同时彻底消失。
- 中央只保留一个主体,继续原动作,不产生双影。
舞蹈模式优先使用“侧边贴图激活 + 舞蹈动作峰值换装”:侧边贴图按规定顺序激活并立即从原位消失,在中央人物转身、踏步、手势或身体线条的动作峰值完成服装替换。六次换装后,六个侧边位置全部留空。
若用户指定其它机制,严格使用。详细选择见 references/transition-library.md。
时间轴要求
每一段都必须写明:
- 时间范围与当前造型
- 主体动作和空间位置
- 眼神 / 表情;宠物则写视线、耳朵和尾巴状态
- 舞蹈模式中的舞步、手势与动作峰值
- 被激活的侧边贴图及其原位消失时刻
- 换装运动方向、完成时刻与动作延续方式
- 发丝、袖摆、裙摆、流苏或宠物毛发的自然物理
- 背景音乐节拍;仅在允许时写音效
动作与物理连续性
- 换装前后保持重心、旋转方向、手臂轨迹、头部朝向和视线因果连续。
- 不因换衣重置姿势,不瞬移,不突然改变身体比例。
- 15 秒舞蹈必须是一段连续编舞,每次换装承接上一拍动作。
- 长裙、长袖、披帛、流苏和宠物毛发具有重力、惯性延迟与自然回落。
- 换装瞬间不中断物理状态,不穿模、不粘连、不僵硬漂浮。
强制一致性与负面约束
完整输出必须明确:
- 同一主体身份、脸或动物面部特征、年龄阶段、肤色 / 毛色、发型 / 毛纹与身体比例。
- 只改变服装、配饰和编排姿势,不重做主体。
- 卡点模式默认正好 5 个版本;舞蹈模式正好 7 个版本。
- 已激活的侧边贴图原位置立即清空,之后不保留、不弹回、不复现。
- 中央始终只保留一个主体,不出现双影、残影或身体融合。
- 不出现矩形卡片、额外人物 / 宠物、服装叠穿、错误肢体、多余手指 / 爪、头脚裁切、背景突变或无故运镜。
- 宠物服装不遮挡感官与呼吸,不束缚自然运动。
输出协议
完整生成任务按以下顺序输出:
1)路由判定
- 主体路线:女性 / 男性 / 宠物 / 混合合集
- 视频模式:K 卡点换装 / D 15 秒换装舞蹈
- 判定依据:只写一句
2)参数锁定结果
列出本次使用的身份、造型、布局、时长、卡点、镜头、动作、声音和系统补全项。舞蹈模式必须逐项列出中央造型、左侧 3 套和右侧 3 套,共 7 套。
3)首帧图片提示词
输出一段可直接用于图像模型的完整中文提示词。
4)视频时间轴脚本
按连续时间段覆盖完整 8–10 秒或 15 秒,不得遗漏空档;把每次换装完成时刻精确到 0.1 秒。
5)精简视频提示词
输出一段可直接复制到视频模型的整合提示词,包含主体、镜头、动作、六次或四次换装、贴图消失规则、BGM 与一致性约束。
6)负面提示词
输出逗号分隔的精简负面提示词,覆盖数量错误、身份漂移、贴图残留、双影、肢体错误、服装叠穿、镜头漂移和背景突变。
交付前检查
- 主体路由是否正确,参考图是否覆盖默认值。
- 卡点模式是否为 8–10 秒;舞蹈模式是否严格为 15 秒。
- 舞蹈模式是否正好 7 套、中央 1 套、左右各 3 套。
- 时间轴是否覆盖全时长,完成点是否与造型数量一致。
- 每个被激活贴图是否立即从原位消失且永不复现。
- 人物或宠物是否始终为同一主体,中央是否始终只有一个。
- 音频是否符合:舞蹈默认仅卡点 BGM;卡点模式按用户要求决定是否加音效。
Signals
- GitHub stars
- 70
- Forks
- 13
- Last commit
- Aug 2026
Advanced
- Catalog kind
- skill
- Gateway key
outfit-director- Source
- github.com/liyue-aigc/outfit-director