时装场景展示视频规划
SkillMediaPlans clothing references or outfit briefs into a reusable fashion showcase pipeline, covering apparel assets, scenes, storyboards, video, music, and assembly. Suitable for lookbooks and fashion short videos.
Available today. Use it from your connected AI after setup.
No other account needed.
Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.
Then ask your AI: use the 时装场景展示视频规划 skill
What this skill tells your AI
The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/fashion-scene-video-planner/SKILL.md and read by ahel’s review.
当用户希望把服装参考图、服装概念或穿搭需求整理成可重复执行的时装场景展示视频流程,而不是一次性 prompt 时,使用本 Skill。整个流程会先锁定 Final_Video_Spec,再做服装结构分析、分步确认服饰资产、场景选择、分镜绑定、六宫格分镜预览、单套 30 秒视频短片、BGM 与最终组装。
STEP 0:锁定最终规格
先创建 Final_Video_Spec.md,并在进入后续步骤前锁定以下内容:
- 片名 / 项目名
- 画幅比例
- 目标时长与时长意图
- 视觉风格基调
- 输出语言
- 拍摄路线:
Runway或Lifestyle
这一轮中,路线一旦锁定,后续步骤不得再重新判断。
路线锁定规则
根据服装类型与用户意图在此处直接判断路线:
- Runway:高定、礼服、晚装、概念服、机能风、秀场感强、表情克制、步态仪式化
- Lifestyle:休闲、街头、日常穿搭、保暖、民族/传统、自然互动感强
如果路线存在歧义,必须在这里解决,不要拖到后面的阶段再判断。
STEP 1:分析服装资产
如果用户提供服装图片或参考视频,先提取并整理结构化信息,供后续场景与镜头使用:
- 廓形:领口、袖型、裙摆或裤型
- 面料:质地、光泽、透明度、厚重感、垂坠性
- 色彩:主色、辅色、纹样色相与饱和度
- 动态物理:面料在运动中的摆动惯性、垂坠方式、反光特征
建议输出为结构化文本,便于后续阶段直接复用。
STEP 2:分阶段确认服装资产
每一步都要暂停,等待用户明确确认后才能继续。
STEP 2A:生成服装刀版三视图
先生成横版三格并排的技术平面图,仅包含正面 / 侧面 / 背面三视图。默认使用 NanoBanana Pro,分辨率 2K,除非用户明确要求别的图像模型。
规则:
- 不要模特
- 不要场景背景
- 只展示服装结构
- 强调缝线、开合、版型、图案与工艺细节
- 以 STEP 1 的服装分析作为锚点
生成后必须暂停,等待用户回复“确认”或提出修改意见。
STEP 2B:生成模特服饰卡
只有在刀版图确认后,才以刀版图为参考生成模特服饰卡。默认使用 NanoBanana Pro,分辨率 2K,除非用户明确要求别的图像模型。
规则:
- 横版宽幅
- 左侧为面部特写 / 半身肖像,用于观察骨相、妆容与发型
- 右侧为穿着服装的正面 / 侧面 / 背面全身三视图
- 保留服装垂坠、折叠与反光等物理质感
- 背景保持中性
多套服装或多角色时,按 A/B/C 顺序分别生成对应服饰卡。
生成后必须暂停,等待用户确认模特形象与面料还原度。
STEP 2C:仅用文字呈现场景候选
在模特服饰卡确认后,由 Planner 直接向用户输出 3 个场景候选方案,不调用任何工具。
每个方案都要包含:
- 场景类型
- 核心氛围
- 推荐光线方向 / 色温
- 与当前服装和路线的匹配理由
如果用户已经明确了自定义场景,就直接按用户描述执行,不再额外给候选。
生成候选后暂停,等待用户选择其一或提供自定义方向。
STEP 2D:生成空场景图
在场景方案确认后,为每个场景各生成一张空场景图。默认使用 NanoBanana Pro,分辨率 2K,除非用户明确要求别的图像模型。
规则:
- 不要人物
- 不要服装
- 只保留环境氛围
- 横版宽幅
- 保留光线、景深和留白需求
多场景时,每个场景单独生成一张锚点图。
生成后必须暂停,等待用户确认场景风格与光线基调。
STEP 3:设计故事板并绑定资产
STEP 3A:声明分镜契约
先写清 key_elements 与 shot 列表,再生成任何分镜预览图。
key_elements 必须包含:
- element character:面部特征、肤色、妆容、发型等必须与模特卡一致的可见身份信息
- element garment:廓形、面料、光泽、厚重感、关键结构、装饰与特殊纹理
- element scene:已确认的空间结构、主光方向、色温、对比度与留白逻辑
- element props:对画面有明显影响的饰品或道具
同时定义 shot 列表,包括景别策略、镜头运动与音频层需求。
STEP 3B:注册并绑定资产
在生成六宫格预览前,先把确认后的模特卡与场景图绑定到故事板元素。
规则:
- 将模特服饰卡绑定为
element character - 将每张空场景图绑定为对应的
element scene - 绑定未完成前不得进入预览图生成
STEP 3C:生成六宫格分镜预览图
使用已绑定的角色与场景资产,生成单张电影质感六宫格预览图。默认使用 NanoBanana Pro,分辨率 2K,除非用户明确要求别的图像模型。
规则:
- 竖版 9:16 构图
- 3 行 × 2 列
- 每格对应一个核心 shot 节拍
- 人物、服装、场景都要与 key_elements 保持一致
- 统一电影胶片质感
生成后必须暂停,等待用户确认构图、场景搭配与景别节奏。
STEP 4:生成视频
六宫格分镜确认后,生成一条完整的 30 秒时装短片。默认使用 MiniMax H3,除非用户明确要求别的视频模型。
规则:
- 以六宫格预览图作为主参考
- 继续沿用已绑定的服装、角色与场景资产
- 除非用户明确要求,否则不要拆成逐镜独立生成
- 一套服装对应一个独立视频单元
一轮原则
一轮 = 一套服装 + 一个场景 + 一套分镜 + 一条 30 秒视频。
如果用户后面只想更换场景,则从 STEP 2C 重新开始,并尽量沿用仍然适用的模特服饰卡。 如果用户后面只想更换服装,则从 STEP 2A 重新开始,完整重走一轮流程。
STEP 5:生成 BGM 并组装
先生成与服装风格匹配的 BGM,再进行最终组装。
- Runway:偏 chamber jazz、交响弦乐或高定感配乐
- Lifestyle:偏 nu-jazz、lo-fi hip-hop 或日常感配乐
- 民族/传统:可加入民族乐器的当代编曲
- 概念/机能:可用工业、极简或 dark ambient 质感
随后把视频与已确认的音乐及其他最终元素统一组装。
STEP 6:交付结果并询问下一轮
按轮次和服装名称清晰交付最终资产。每完成一轮后,主动询问用户是否需要更换场景或更换服装,继续下一轮创作。
一致性规则
- 不要在 STEP 0 之后重新判断 Runway / Lifestyle
- 不要在模特卡与场景绑定完成前生成故事板
- 不要跳过 STEP 2A、STEP 2B、STEP 2D、STEP 3C 的用户确认暂停
- 同一轮内的素材必须隔离,不能跨轮引用
- 如果有多套服装,必须按独立轮次处理,只有在用户要求合并时才在最终组装阶段统一处理
Signals
- GitHub stars
- 26
- Last commit
- Sep 2026
Advanced
- Item type
- skill
- Key
fashion-scene-video-planner- Source
- github.com/qxryz/workflowgenerator