中式传统动画短片

SkillDev tools

Turns myths, folklore, classical and cultural themes, ideas or scripts, into story, style, character/scene design, storyboard video, sound, compositing and review in the aesthetic spirit of Shanghai Animation Film Studio. Suited for ethnic-style animated short films; not for live-action editing, poste

Available today. Use it from your connected AI after setup.

Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.

Then ask your AI: use the 中式传统动画短片 skill

What this skill tells your AI

The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/chinese-traditional-animation-shortfilm/SKILL.md and read by ahel’s review.

用于把神话、民间、古典、寓言或文化题材的创意、剧本、参考图或粗略设想,制作成具有上海美术电影制片厂视觉语法的完整动画短片。默认方向是复古中国民族动画数字复兴风:工笔重彩人物、戏曲化姿态、敦煌飘带、青绿山水、平面赛璐珞分色、装饰性云火水纹与现代数字精修。这是分阶段的制作流程,不是单条提示词捷径。

第 1 步:收集输入与制作意图

提取并保留用户的主题、剧本、文化背景、角色、受众、时长、画幅、口语语言、画面文字、音频偏好和最终交付物。只有主题时,先提出紧凑故事,不把推断内容写成已确认锁定项。判断用户要完整短片、制作方案、故事板还是单项视觉资产;完整短片需形成制作意图,写明目的、时长、格式、基调、内容边界和确认节点。

第 2 步:扩展并确认故事

故事未固定时,提出一句话梗概、前提、主角与配角、场景、冲突、情绪弧线、视觉高潮、结尾画面和预计镜头数。每个配角都必须承担必要的因果或情感功能,明确出现镜头与退出边界,并始终服务主角;不得只为丰富画面而加人。保留用户原有文化词汇与文字。用户确认故事方向、结尾和范围前,不进入高成本资产生成。根据已确认的总时长与制作复杂度适配镜头数量和时长分配:简单事件使用更少镜头,把最长时段留给核心冲突或变化,并为结尾结果保留足够时间。先确定总时长,再反推镜头时长和动作密度,不要先写成长镜头再事后压缩。只有出现新的故事节拍、空间关系、人物动作或变化时才增加镜头。参考范围:简单的 15–30 秒作品可用 2–4 镜,中等复杂度用 4–7 镜,复杂作品用 7–12 镜;不得为了套模板而堆叠镜头。

第 3 步:判断并锁定视觉方向

提供以下分支并说明推荐依据:

  • 复古中国民族动画数字复兴风(默认):工笔重彩人物、戏曲化动作、敦煌飘带、青绿山水、装饰性云火水纹、平面赛璐珞分色、传统设色逻辑与现代数字精修。
  • 工笔重彩:更密的细线、华丽服饰与装饰,适合仪式、神话、战争和宏大场面。
  • 水墨:笔墨气韵、开阔山水、形体消融、哲思留白与诗意运动。

锁定分支、画幅、视觉时代、叙事基调、观众可见语言,以及用户确认的色彩或文字。若成片偏离,必须指出偏移并停止扩散,不能静默换风格。

默认分支须保持闭合线稿、结构化平面阴影、传统服装轮廓、领口与宽袖、层叠裙装或铠甲、冠饰、玉饰和象征纹样、戏曲化五官、建筑山水花卉亭桥与长卷式构图;用对角线、S 形、三角形和明确前中后景组织画面。云烟火水应是有设计的图案化形体,不是随机写实特效。

第 4 步:编写并确认制作方案文档

在设计或生成任何人物、场景、道具或其他资产前,先将完整制作方案整理为画布文档,并暂停等待用户确认。文档必须包含整体制作思路、制作意图、故事大纲、人物设计思路、场景与道具设计思路、视觉方向、时长、复杂度判断、自适应镜头数量、初步故事分镜、音频方向、连续性原则、交付定义和确认节点。分镜应选择能够清楚表达故事的最少镜头:简单视觉事件可以使用一个连续镜头或 2–4 个镜头;只有出现新的故事节拍、空间关系、人物动作或变化时才增加镜头。确认后的文档是后续所有资产和镜头的唯一依据。用户确认方案前,不得生成资产锚点或视频。

第 5 步:制作生产简报与风格圣经

根据已确认的制作方案,建立简明生产简报和可复用风格圣经。简报落实已批准的故事节拍、镜头语法、时长、画幅、音频模式和交付定义;风格圣经写明线条、人体与服装、表情、运动、设色、背景、自然元素、镜头、转场和禁止偏移规则。补充角色、地点、道具和声音的连续性规则。涉及具体文化内容时,区分用户提供的事实与创作补充,尊重敏感符号。

第 6 步:建立角色与身份系统

为每个重复出现的角色定义角色功能、年龄感、剪影、脸型五官、发型或头饰、服装层次、饰品、标志动作、情绪状态和动作边界。制作正面、侧面、背面三视图;仅在需要时补充表情或姿势图。若角色涉及变装,只生成每套服装穿在角色身上的状态视图,不生成脱下服装、未穿服装、去除服装或身体暴露的对照视图。建立角色—镜头映射,明确身份如何保持。群像应设计少量可区分的配角,不得反复复制主角。

第 7 步:建立场景与道具系统

为每个重要地点制作无人物场景设定,最好覆盖全景定场、中景、细节和纵深/气氛视图。凡使用建筑转场,必须先建立室内、门洞、廊道/门廊、立柱、外墙、庭院和道路的统一空间平面,并明确摄影机路径和视差;合页门必须绕真实门轴旋转,平移构件须有合理轨道,背景必须随镜头移动产生透视变化,不得冻结或瞬移。定义前景、中景、背景、远景层,建筑、地形、植物、天空、水面、云烟和图案化元素,以及可运动部分。为兵器、乐器、仪式物、交通工具、法器和文化关键物件制作设定图。每项资产都要有稳定名称、用途、所属角色或场景和复用关系。

第 8 步:规划分层场面与运动语法

把每个镜头当作动画舞台,而不是平面插画。为每镜写明层级顺序、遮挡物、主体层、环境反馈、视差、接触点和剪影可读性。动作密度必须可执行:单镜通常只承担一个主要动作或一个情绪转折,再配一至两个次要动作;若换装、取装备、上马、加速、制动和情绪收束争抢同一短镜头,必须拆镜,不得压缩成姿态跳变。动作必须从角色身份、身体机制、角色功能和已确认技能出发;每件武器或能力都要承担机动、格挡、控制、命中、反击或收势等明确功能。打斗必须完成“起势 → 攻击路径 → 接触点 → 对手受击反馈 → 反作用力 → 动作结果”闭环;攻击必须作用到对手本体、武器或明确攻击路径,不能只改变背景特效。写明命中部位、可见反馈、空间后果和动作余势。短镜头只安排一条清晰动作链:4–5 秒通常承载一个动作事件,6–8 秒承载一个事件加结果,9–12 秒最多安排两至三次有因果关联的接触。非打斗动作遵循“预备 → 发力/反应 → 完成 → 余势”:视线可先于头部,头部先于躯干,躯干带动四肢,手脚建立真实接触,头发、衣袖、枪穗、绑带和装备稍后收势。人物、动物、交通工具、服装和道具都要表现重量、支点、地面接触、阻力、惯性与恢复。动作按显现、定势、回眸、袖带跟随、道具动作、环境回应、情绪变化和收势设计。优先使用有关键姿势的手绘式分段运动、有限次级运动和图案化云火水循环,避免平滑 CG。不得出现无场景归属或无动机的镜头。

第 9 步:制作自适应分镜表与音频地图

建立包含镜头 ID、时间段、场景、角色、参考资产、景别、镜头、动作、情绪、转场、台词或旁白、音效、口型状态和连续性备注的分镜表。根据已确认时长和复杂度,选择能够清楚表达故事的最少镜头;简单视觉事件可以用一个连续镜头或少量连接镜头,不要为了增加行数而拆分一个动作。说话镜头尽量只绑定一位主说话者,其他角色用反应镜头或无口型停留。将音乐段落、旁白、对白、音效和留白映射到同一时间线。初始制作方案文档已经包含初步故事板和镜头数量判断。方案确认后,仅在需要生产细节时完善该表,不得静默改变已确认的故事范围或拓扑。

第 10 步:方案确认后生成全部资产锚点

只有用户确认制作方案,并明确确认输出分辨率、画幅以及工具支持时的画质/算力档位后,才枚举其中涉及的所有人物、地点、道具、生物、交通工具、服装变体、乐器、法术效果和重复出现的环境元素。这些输出锁定值必须在任何图像或视频生成前解决。若涉及变装,逐套服装都以“穿在角色身上的状态”列入并生成锚点,不得请求脱下服装或未穿服装的视图。任何正式分镜需要看见的资产,都必须在逐镜视频提示词定稿前生成或准备锚点图。按同类资产批量制作,并使用角色三视图、无人物场景设定、道具设定和代表性构图预览;不得因为某项只出现很短就省略。为每项资产分配稳定名称、复用关系和使用镜头。

第 11 步:完整资产锚点确认

将全部资产锚点交给用户确认。检查身份、剪影、服装结构、场景地理、道具设计、文化可读性、尺度和风格一致性;需要修改时只修复受影响的锚点。用户确认整套资产,或明确批准某个不可见/次要元素的例外后,才能继续。

第 12 步:制作资产计划与提示词合同

在任何图像或视频生成前,先让用户选择或确认输出分辨率,以及工具支持时的画质/算力档位,同时确认画幅和时长限制;这些值确认前不得生成。随后在视频生成前建立“镜头—资产”矩阵,并为每镜写提示词合同,明确角色、场景、道具、动作、镜头、时长、转场、音频行为和连续性不变量。写清每个参考的贡献,用户故事意图优先。相似静帧或参考资产可批量制作,但不要逐镜交替执行昂贵的图像和视频生成。缺失参考必须在依赖镜头运行前发现并修复。

执行级镜头合同

生视频前必须把每个镜头写成执行级合同,而不是文学化概述。每份镜头合同必须包含:镜头目标;每个参考资产及其具体贡献;第一帧状态;中间关键状态;最后一帧状态;空间布局;主体站位和朝向;前景/中景/背景/远景层级;遮挡与不可穿越关系;人物和道具动作链;摄影机起点、路径、速度和终点;环境反馈;声音与静默;与前后镜头的连续性;镜头级禁止事项;以及可观察的验收标准。只写“回眸”“入场”“变形”或“关门”等动作名称,不足以构成可执行提示词。

统一使用空间协议:写明画面左/中/右、上/中/下区域,前景/中景/背景/远景,主体相对位置、朝向、共同纵深轴、接触点、遮挡物,以及哪些元素可以或不可以互相穿越。每个运动道具都要绑定初始位置、方向、路径、速度变化、触发或受力原因、接触关系、遮挡规则和最终位置。建筑和机械结构要写明物理轴或轨道:合页构件绕真实门轴旋转,平移构件沿合理轨道运动,交通工具沿确定路线运动,不得从未定义的画面边缘随意入场。

每个重要动作或变化都按“初始状态 → 触发 → 发展 → 结果 → 收束”描述。每镜至少定义第一帧、动作分阶段时的一个中间关键状态,以及为下一镜头准备的最后一帧。使用带时间码的表格或分段时间轴,每个时间段至少写明画面构图、主体动作、道具动作、摄影机、环境和声音。详细度必须服务于空间、时间、因果和验收清晰度;不得用与当前镜头无关的装饰性形容词或无依据的故事节拍扩写提示词。

动作密度必须可执行:短镜通常只承载一个主要事件,以及不超过一至两个次要动作。参考标准:4–5 秒通常承载一个事件,6–8 秒承载一个事件及其结果,9–12 秒最多承载两至三个有因果关联的接触。人物动作需写明发起部位、身体传导顺序、方向、速度、停顿、终点和余势;特效需写明可见来源和因果链。如果动作在时间或空间上互相争抢,应在规划阶段拆镜,不要继续向一条提示词堆叠指令。

第 13 步:生成并验证参考图

按批次生成已确认的角色、场景和道具参考。检查身份、数量、服装结构、剪影、场景地理、文化可读性和风格一致性。能定点修复时优先修复现有参考,不要重启整套资产。关键角色或地点明显错误时,不得进入依赖它们的分镜视频生成。

第 14 步:编写并确认逐镜详细提示词

资产锚点确认后,为每个镜头编写可直接用于生视频的详细提示词。这是硬性确认闸门:必须把完整提示词文档展示给用户,并等待用户明确确认授权生成;此前对故事、方案、资产、风格或规格问题的回答都不能替代提示词确认。每条提示词必须保留已确认的镜头顺序,并写明全局连续性、参考角色、景别、镜头起点/路径/终点、人物动作、情绪变化、环境运动、转场、时长、音频行为,以及需要时的明确静音。将全部提示词、镜头—锚点矩阵和连续性检查表整理成一个画布文档。该提示词文档等待确认期间不得生成视频。

提示词确认与重生成闸门

完整的执行级镜头提示词文档是硬性用户确认闸门。用户此前对故事、制作方案、视觉风格、资产或输出规格的确认,都不能自动授权生成视频。详细提示词获得明确确认后,每次只生成一个镜头。生成后必须根据实际视频检查合同,并报告通过项、偏差项、失败项和“未观察到”项。检查后不得静默修改、重试、替换或重生成。应先提交具体失败的合同维度和最小修正方案,只有用户明确确认该修正后才能重生成。保留已通过的镜头,明确区分已接受、被替代、预览和淘汰版本;其他镜头失败时不得顺带重跑合格镜头。

每镜使用验收项检查构图、空间位置、动作顺序、时序、运动路径、连续性、物理接触、特效来源、音频和技术输出。“未观察到”不能算通过。失败统一归类为构图、空间、动作、时序、路径、连续性、物理机制、特效行为、音频或技术格式,并只修复受影响的最小单元。

第 15 步:提示词确认后生成分镜视频

视频默认使用 MiniMax H3。用户明确指定其他模型时,先核验该模型支持已确认的参考素材和输出参数,再遵循用户选择。提示词文档等待确认期间,不得生成、排队或重试任何分镜。只有用户明确确认逐镜详细提示词文档以及分辨率/画质锁定值后,才按故事板顺序生成分镜,只使用矩阵中已分配的角色、场景和道具参考。保持脸型五官、服装层次、饰品、飘带、道具、地点关系、图案化自然元素、口型状态和说话者绑定。镜头运动应适合绘画动画:平移、推进、定格式亮相、长卷式展开、动作匹配和克制视差。逐镜按合同验收;经过一次已确认的针对性修正仍失败时,改用其他兼容模型,不与同一模型反复死磕。

第 16 步:设计并生成声音

在录制或合成前先确认完整对白/旁白文字。根据文化背景匹配角色音色和发音。只有用户选择加入 BGM 后,才根据分支设计整片连续配乐;默认先保留场景环境声和动作音效,不生成非叙事 BGM。若后续确认加入音乐,应以整条成片时长制作一条连续音乐,不为每个镜头独立生成音乐。加入袖摆、飘带、脚步、兵器、水火、钟铃和环境运动等克制拟音,并在强调处保留留白。字幕不会因有旁白而自动生成,只有用户明确要求时才加入。

第 17 步:检查声音与音频连续性

将语音时长与分镜及总时长对照,检查发音、角色身份、音量、削波、点击声、呼吸残留、突兀截断和尾部噪声。好的录音优先通过裁切和短淡出修复;只在必要时重生成受影响句子。若时长明显超过镜头计划,应先改台词或镜头时序,不要用过快语速掩盖。

第 18 步:合成与混音

只合成已批准的分镜视频与音频。合成前记录每个镜头确切的已接受版本,不得静默混用淘汰版和确认版。先保留一份仅含环境声和动作音效的无配乐母版;可选 BGM 必须生成独立命名的衍生版,绝不能覆盖、替换或再次混入无配乐母版。按锁定分支使用硬切、动作匹配、飘带或云气遮罩、长卷展开、圆形遮罩和少量叠化。保持接缝连续,保留有意的停顿,并对齐对白、BGM、音效和留白;让连续环境声跨越镜头,必要时使用 J-cut、L-cut 或短音频交叉淡化,避免声音重新起拍。对白或关键动作出现时下压可选 BGM,避免重复音乐和重复音轨,不把临时或淘汰版本带入最终选择。仅在用户要求时增强画面,并放在艺术复核之后。

第 19 步:复核与修复

交付前执行结构化检查:

  • 故事:主题、因果、情绪弧线、结尾和文化尊重。
  • 风格:线条、赛璐珞层次、传统设计语言、设色逻辑,无泛二次元或写实偏移。
  • 连续性:角色身份、服装、道具、场景地理、尺度、运动方向和声音角色。
  • 动画:关键姿势可读、剪影稳定、镜头有动机,角色技能明确,攻击路径、接触点、受击反馈和反作用力清楚,无漂浮、融化、橡皮肢体或无意义运动。
  • 声音:语音干净、说话者正确、同步、环境声连续、动作音效有意图、可选 BGM 不割裂、无重复音乐或重复音轨。
  • 技术:时长、画幅、分辨率、文字可读、起承收完整、最终文件可用。

只记录影响交付的问题。按最小单元修复——提示词、参考图、镜头、台词或混音——再检查受影响的下游接缝。

第 20 步:最终交付

交付最终合成片,以及用户明确要求的辅助资产。若用户需要可复用制作包,保留生产简报、分镜表、风格圣经和复核记录作为项目文档。明确区分最终资产、预览和淘汰版本;确认每个最终媒体结果可用并已登记到项目工作区后再报告完成。

轻量请求旁路

若用户只要单个角色三视图、场景设定、道具图、故事板、提示词或一个短镜头,不强制执行完整短片流程,只运行相关的输入、风格锁定、按时长与复杂度适配镜头数量、资产锚点、提示词文档、生成和复核步骤,同时保留风格圣经与连续性规则。即使是轻量多镜头请求,也必须先确认锚点,再确认逐镜提示词文档,最后才生成视频。多个视频共享角色、地点或故事时,仍需完整的连续性流程。

失败与修正规则

失败后先判断问题属于内容、身份、构图、空间连续性、身体机制、动物机制、运动、时长、声音还是技术格式。先分析现有结果,再修复最小失败维度;若动作或转场合同发生变化,先更新可审核的提示词文档并重新取得用户确认,然后只重生成对应镜头。保留成功资产,只用实质性修正重做失败单元。不得为了方便生成而静默削弱锁定风格或删除必要的文化、角色特征。若缺少必需输入或用户要求真正冲突,暂停并提出最短决策问题。

执行、验收与重生成规则

  • 每个视频镜头都必须是执行级合同,明确空间布局、首帧/中间状态/尾帧、带时间码的动作、道具路径、摄影机路径、声音、禁止事项和验收项。
  • 短镜头只安排一个主要事件和不超过一至两个次要动作;互相争抢的动作应在规划阶段拆镜。
  • 每次只生成一个已确认的镜头。检查后报告实际通过项、失败项和“未观察到”项,不得静默改写或重生成。
  • 修正必须先指出具体失败维度和最小单元修改方案,并获得用户明确确认后才能重生成。保留成功输出并区分版本状态。
  • 提示词的详细度必须服务于空间、时间、因果或验收清晰度,不得添加无关装饰性文字。

关键规则

  • 图像和参考图使用平台当前可用能力;除非用户另选其他可用模型,视频默认调用 MiniMax H3。图像或视频生成前必须先让用户确认分辨率、画质/算力档位(工具支持时)、画幅和其他关键输出规格。
  • 默认方向是“复古中国民族动画数字复兴风”,不得替换为泛国风、普通二次元或写实摄影。
  • 画布制作方案文档(含整体思路、故事大纲、人物/场景设计思路、故事分镜、时长、复杂度与镜头数量)必须在资产生成前确认;完整资产锚点必须在逐镜提示词前确认;随后必须展示并明确确认完整提示词文档,才能生成任何视频。此前任何确认都不能替代最终提示词确认。
  • 每个重要角色、场景、道具、镜头、说话者和音频层都必须有明确归属或绑定;每个可见资产都必须在逐镜提示词定稿前拥有锚点。服装变体只能表现为角色穿着已批准的服装,不得生成脱衣或去除服装的视图。
  • 同类资产批量处理,保留已接受结果,只重试失败单元;已接受、已淘汰、无配乐母版和配乐衍生版必须分别命名,可选音乐版本不得覆盖保留环境声与动作音效的无配乐母版;批量部分失败时不得重跑成功单元,平台标记不可重提时停止相同重试并报告阻塞。
  • 打斗动作必须基于角色身份和技能,完成接触、受击、反作用力和结果闭环。
  • 场景音效与 BGM 分开决策:可保留环境声和动作音效,BGM 默认后置,合成后再询问用户是否加入贯穿全片的统一音乐。
  • 除非用户明确要求,字幕默认关闭。
  • 不用于真人实拍剪辑、普通海报、一般图生视频或无关视频风格。

Signals

GitHub stars
26
Last commit
Sep 2026
Advanced
Item type
skill
Key
chinese-traditional-animation-shortfilm
Source
github.com/qxryz/workflowgenerator