ahel is live on Product Hunt today. Upvote

Dramake

SkillAI & models

For Codex, Claude Code, WorkBuddy and other Agent Skills clients, turns a one-line idea, story synopsis, novel, copy, script, storyboard, or existing material into coherent, chainable, publishable AI short dramas and AI short films. Suitable for horizontal or vertical content on Douyin, Hongguan sho

Available today. Use it from your connected AI after setup.

Connect ahel once, and every AI you use reads what you have installed.

Then ask your AI: use the Dramake skill

What this skill tells your AI

The instructions your AI receives, as published by xixihhhh/ai-short-drama-skill in skills/dramake/SKILL.md and read by ahel’s review.

把短剧制作当成一条连续生产线,而不是一堆提示词。让没有编剧、导演或剪辑经验的用户,也能从一段文字开始,在明确的验收门禁下完成故事、剧本、分镜、生成、配音、剪辑和质检;让专业用户可以从任意阶段接管。

本 Skill 不绑定单一平台、网站、API 或 MCP,执行平台由用户选择。使用用户能合法访问并愿意使用的模型与执行入口;每次执行前核实当前参数、价格、素材上传与保存规则。

project-state.md 作为唯一生产状态机。提示词、接口参数和时间线都从已批准的创意状态与已检查的真实素材派生。

十条铁律

  1. 主角必须因果性改变结果,人、动物、产品或物体都不能只是装饰。
  2. 静音观看也应能理解主要因果与重点笑点;对白、字幕和群演笑声不能替代可见铺垫、原因、反应与揭晓。
  3. 模型支持时优先使用更少、更长的剧情段,但必须限制事件负载:段内可有多个节拍,不能让一个提示词同时承担多条高风险物理链、道具变种和无关任务。
  4. 未实际下载和验收上游素材,不得生成依赖其状态的下游段落。
  5. 锁定身份、材质、服装结构、轴线、道具、天气、湿度、光线和声音边界。
  6. 接触必须有接近、接触、施力、响应和稳定结果;拒绝穿模与不可能解剖。
  7. 默认不在视频里生成手机 UI、信件、价签、倒计时和关键文字;后期叠加。
  8. 原生对白可以解决口型,但每句必须锁定唯一说话者、可见嘴型与非说话者闭嘴状态;原生音乐不能自动解决终片混音。
  9. 技术干净不等于剧情能发;60–120 秒故事必须有贯穿全片的宏观因果链和有铺垫的主反转,并进行未读梗概的冷观众检查。
  10. 没有真实看过、听过或抽帧检查,就不得声称素材已通过。

从用户会什么开始

先判断用户输入深度,不要要求小白先学会专业术语:

  • **一句话/脑洞:**主动给出 2–3 个可拍方向,补齐主角、欲望、阻碍、升级与结果;
  • **故事/小说/文案:**抽取人物、关系、时间线、道具、秘密、转折与可视化动作;
  • **剧本:**检查因果、铺垫、反转、对白密度、场景数量和时长;
  • **分镜/提示词:**检查节拍、连续性、物理、文字风险和模型可执行性;
  • **已有素材/粗剪:**实际检查画面与声音,定位最小失败单元,不无故推倒重来。

再选任务深度:

  • **诊断/建议:**只分析,不生成、不付费;
  • **快速修复:**只修剧本、提示词、镜头、接缝、声线或混音的最小单元;
  • **生产包:**输出简报、剧本、母版、分镜、清单、提示词、费用与剪辑方案;
  • **执行/续作:**从当前已验收状态继续;
  • **完整制作:**从文字到发布执行整条状态机。

局部问题不得被强制重走整条流程。

选择内容形态与画幅

先选择当前交付的主形态,详见 format-routing.md

  • **15–45 秒独立小短片:**一个钩子、一次升级、一个回报;
  • **45–120 秒独立短片:**2–4 个剧情段,完成情绪或喜剧弧;
  • **1–4 分钟单元剧:**固定角色/世界规则,每集问题独立解决;
  • **1–4 分钟连续短剧:**单集目标与回报之外,还维护季线状态。

支持 9:1616:91:1 和自定义比例。记录发布渠道、画幅、主体安全区、字幕区、封面裁切区与交付编码。

需要横竖双版本时,共用剧情、人物、声线、道具与连续性母版,分别设计构图、景别、移动路线和安全区,分别验收。不得默认中心裁切或机械补边。

建立生产简报

使用 production-brief.md。从对话和素材推断安全默认值,只询问会实质改变结果的选择。

至少记录:

  • 原始文字与改编边界;
  • 渠道、画幅、时长、受众、语言和情绪承诺;
  • 人物、动物、产品、地点、参考素材与使用权;
  • 独立/单元/连续形式与内容配置;
  • 可用模型/执行入口和大致预算上限;
  • 对白策略:无对白、原生、参考音频、外部配音或混合;
  • 视觉介质:真人、写实宠物、动画、漫剧、UGC 或混合。

公开示例不得暴露密钥、签名链接、请求 ID、私人路径、真实脸/声音或私有参考素材。

先写故事,再写提示词

阅读 story-and-pacing.mddirecting-camera-and-pacing.md;喜剧、萌宠、拟人或动画化表演项目同时阅读 comedy-and-animated-performance.md。交付:

  1. 一句话观众承诺;
  2. 0–3 秒视觉钩子;
  3. 只属于该主角的动机;
  4. 可见目标与阻碍;
  5. 每 4–8 秒一次信息、行动、反应、关系或风险变化;
  6. 关系或状态变化;
  7. 有铺垫的回报/反转;
  8. 最后一记情绪、笑点、悬念或角色性动作。

60–120 秒喜剧先写 触发事件 → 主角误解/欲望 → 目标 → 主动选择 → 代价升级 → 主反转 → 后果/回收,再放局部笑点。触发优先由角色在生活流中亲历,而不是开场站定听完整段说明;每个笑点必须改变主线状态,并按 铺垫 → 可见原因 → 观众信息优势 → 反应停顿 → 揭晓 → 后果 验收。

每个剧情段定义 entry_state、可观察节拍和 exit_state。20–30 秒长段通常写 4–6 个节拍;10–12 秒对白段通常写 2–3 个节拍。持续加入呼吸、眨眼、视线、表情、物种合适的反应、道具互动与背景生活,不能让角色说完一句话后静止。

目标为 60–120 秒抖音高密度剧情时,启用对应预设:3 秒内出现明确冲突,10 秒内讲清即时目标,90 秒以 18–24 个有效节拍为起点,每 15–25 秒闭合一个微任务;约 30 秒连续配音场景包含多轮推进对话和 4–7 个可见动作/反应。一个固定宏观目标贯穿全片,换场必须有因果桥。有效节拍不等于切镜或生成请求,不得重新拆成碎片硬拼。

出现以下任一情况,生成前退回修改:

  • 删除主角仍不改变剧情;
  • 动机只靠台词解释;
  • 反转没有提前种下可见线索;
  • 人物反复表达同一个意思;
  • 地点、时间、目标或人物知识突然改变;
  • 冷观众无法说出目标、阻碍、选择和结果。

锁定内容配置、角色、风格和世界

阅读 content-profiles.md,选择一个主配置,必要时叠加专项规则。

为每个常驻人物/动物创建母版与 character-bible.md,记录身份、解剖、脸/身体比例、标记、服装结构、允许行为、禁止变异和声音。使用 identity-voice-and-reference-locks.md 为每个控制维度指定唯一权威参考,并为每个常驻说话人建立独立声线锚点。

在分镜前盘点所有重复、跨场景、剧情关键或带文字/Logo 的道具,为每件建立 prop-bible.md。先用用户选择并验证的高保真图像生成/编辑路线(可包括 GPT Image 类模型)固定中性光多视角几何、尺度、材质、连接件与状态;精确文字另建 text_plate_id,默认后期跟踪合成。每个镜头引用同一 prop_id + state_id + text_plate_id,不得让秤、印章、头盔、手机或包装跨幕重新设计。

真人项目锁定真实摄影、皮肤/毛发、实际服装材质、真实尺度、动机光和物理融合特效。动画项目锁定设计语法、线条、阴影、比例与运动语言。真人环境中的宠物可以选择自然写实、加强写实或“动画演员混合”:环境与材质写实,角色使用锁定的拟人姿势、表情库、蓄力、过冲、回稳和受控 squash/stretch;道具与接触仍服从真实连续性。不得把“动画夸张”当作穿模、瞬移或道具漂移的借口。阅读 style-and-medium-locks.mdcomedy-and-animated-performance.md

使用 continuity-ledger.csv 维护正式状态,每个验收段都要更新。

长小说、连续剧或跨集 IP 同时阅读 series-memory-and-source-adaptation.md,使用分层事实、人物知识、时间线与揭示状态,而不是把全文反复塞入提示词或依赖对话记忆。

多角色调度、真实地点、追逐、镜面、巨物、设施、复杂出入口或异常空间同时阅读 spatial-blocking-and-world-state.md。先锁地点锚点与连通关系,再写角色 start → path → end、机位、视线、遮挡、尺度和反射拓扑;提示词不得临时发明位置。

在高风险或强连续项目中,视频生成前阅读 previsualization-and-coverage.md:先做角色/地点/道具长期母版,再为关键剧情时刻试拍少量覆盖方案,最后只冻结真正会约束请求的首帧、尾帧或状态帧。简单反应镜头不强制做完整故事板;多角色、巨物尺度、镜面规则、真实地标、精确走位和关键接触不得跳过预演。

需要生成角色设定图、场景图、道具图或分镜图时,同时阅读 reference-graph-and-storyboard-images.md。把素材组织成有职责的依赖图,先验收一个构图母帧,再生成后续分镜;每个参考明确 controlsmust_not_transfer,多姿势拼版不得复制成额外角色。

设计生成段与剪辑节拍

阅读 generation-blocks-and-edit-beats.mddirecting-camera-and-pacing.md。模型稳定支持时使用 15–30 秒段;精确对白、复杂接触、高运动、变形或易漂移任务使用更短段。

每个长段必须有:

  • 3–6 个带时间的节拍;
  • 每个节拍一个主要动作或信息变化;
  • 需要时有 2–5 次有动机的内部切镜/视角变化;
  • 稳定的时间、地点和轴线范围;
  • 重复道具的 prop_id/state_id/text_plate_id 与唯一允许变化;
  • 精确物理事件的起点、控制输入、世界/屏幕向量、阶段序列和终态;
  • macro_goal_id、本段对主线的唯一推进,以及事件负载预算;
  • 喜剧段的笑点合同、视线/遮挡逻辑、反应角色和 0.6–1.0 秒结果停顿;
  • 钩子/碰撞/揭示/高潮需要时的单一 impact_role 与可见后果;
  • 末尾 0.5–0.8 秒仍有动作的剪辑余量;
  • 下一段能承接的明确退出动作。

每个外部接缝:

  • 支持时使用已验收尾帧,但同时提供身份/材质母版;
  • 保持屏幕方向与动作阶段;
  • 必要时重叠约 0.3–2 秒动作;
  • 用动作、遮挡、甩镜、前景经过、声音、视线或形状匹配过渡;
  • 不得同时无解释改变地点、动作、景别、方向、服装和天气。

详见 continuity-and-transitions.md

长段不是“把更多事情塞进一次请求”。每段优先一个主道具系统、一个高风险物理链和一个主要喜剧/情绪回报;若需要多个地点、食物种类、精确交接、多人轮流说话或多次道具状态变化,拆段或改用内部建立/峰值/后果镜头。

正式提示词必须从已批准状态编译,阅读 prompt-compiler.md。使用稳定的 场景上下文 → 参考职责 → 空间与首状态 → 镜头 → 时间节拍 → 表演/物理 → 灯光/声音 → MUST-HIT/终态 → 高损失负面约束 骨架,再按 T2V、首帧、首尾帧、R2V、续写、编辑或多镜头模式裁剪。付费前展示完整请求预览;任何影响画面或费用的 prompt、参数、参考或 schema 变化都会使旧确认失效。

按能力选模型

阅读 model-router.md,提交前核实当前入口。

  • **Wan 3 类长段:**优先测试 20–30 秒多节拍段、参考驱动多角色原生对白、减少外部接缝和 720p 经济/均衡任务;混合 R2V 与严格首尾帧二选一,重点查角色/声线绑定和后半段漂移。
  • **Seedance 2.5 类:**高价值对白、多图/视频/音频参考、参考声线、编辑、续写和修复。
  • **Seedance 2.0:**4–15 秒对白、动作和过渡。
  • **Seedance 2.0 Fast:**预演、覆盖、备选与经济档;严格验收后才可进入终片。
  • **MiniMax H3 类:**短时高运动、首尾帧控制和重点音画镜头。
  • **Kling 3 Omni 类:**元素绑定、多镜头内部编排和首尾关键帧桥接;先验收子镜头负载与内部切镜。
  • **高保真图像模型:**角色/地点/道具母版、覆盖方案和冻结关键帧;静态图通过后再进入运动生成。

这些只是起始假设,不是永久排名。实际接口暴露的能力高于品牌印象。

选择质量与付费授权

阅读 budget-and-quality.md,付费前建立费用计划。价格永远是项目配置,不写成永久事实。

  • **Sketch:**最低可用预演;
  • **Economy:**通常 720p、长段优先、定点修复;
  • **Balanced:**把强参考/音频模型用在真正提高通过率的段;
  • **Premium:**富多模态、参考音频、编辑/续写和选择性高分辨率;
  • **Hero Insert:**集中预算做钩子、高潮、复杂接触或情绪特写;
  • **Final Polish:**只放大和修复已验收素材。

授权另选 authorization-and-batch.md 中的 plan-onlysingle-testapproved-batchautopilot-with-cap。质量档不代表付费许可。用户已预先授权平台、上传规则、预算与重试上限时,不要逐条重复询问;触及边界必须停止。

正式执行同时阅读 production-operations-and-recovery.md,用 generation-jobs.csv 保存请求指纹、幂等键、任务状态、依赖、费用、恢复和候选谱系。超时先进入 unknown 并找回任务,不能把未知状态当失败后盲目重提;人工修改上游状态后,使受影响的确认和下游任务失效。

选择对白与声音路线

阅读 audio-and-dubbing.md,按场景选择,而不是整片盲目统一。

  • **无对白:**统一环境底、音乐结构与精选拟音;
  • **原生对白:**台词短、说话人明确,说话时有动作,之后有反应和下一节拍;
  • **参考音频:**每个常驻角色一条经授权的声线锚点,锁定语言、语速、音色与强度;
  • **外部配音:**使用口型工具,或通过反应、侧脸、远景、插镜和画外音保护可信度;
  • **混合:**保留好的原生英雄台词,旁白、电话声、环境、音乐与问题音频后期统一。

所有模式都要分轨。连续场景跨镜头保持房间底噪/雨声,使用 J/L cut,压低 BGM 避让对白,避免每次切画面都重启声音。

多人原生对白为每句记录 speaker_id、可见/画外声源、镜头中的嘴型主体、非说话者嘴部状态和轮次。工作人员讲规则时必须由工作人员本人可见开口,或明确使用有来源的广播/画外音;其他角色闭嘴并只做倾听反应。错人开口、声音串角色或非说话者同步嘴型为 P0,不得靠字幕解释。

门禁式生成顺序

  1. 验收故事和剧情段计划;
  2. 验收人物、风格、世界与道具母版;
  3. 先生成钩子段或最高风险段;
  4. 下载并直接检查真实输出;
  5. 30 秒段制作 12 帧接触表,至少看开头、25%、50%、75% 和结尾;
  6. 慢放检查接触峰值、穿模和物理;
  7. 有音频时转写并人工听;
  8. 用证据标记 acceptedrepairrejected
  9. 提取验收尾帧,更新连续性状态;
  10. 之后才解锁依赖段。

可并行:独立母版、音乐探索、声线、非依赖插镜与备选钩子。不可并行:尚未获得已验收父状态的连续剧情段。

物理与解剖门

阅读 physics-and-failure-modes.md。生成前列出可见 physical_contact_points,用符合主体解剖的动作原语。人手、动物爪、机器、液体、布料、车辆和魔法效果采用不同接触规则。

要求顺序:接近 → 接触 → 施力 → 响应 → 稳定结果

“倒车、转向、脱落、碰撞”必须编译成 physical_start_state → control_input → world/screen motion vectors → phase_sequence → physical_end_state。一个生成段只承担一个高风险精确物理事件;复杂事件拆成建立、峰值和后果镜头。提示词意图正确但画面实际方向错误,仍判失败。

拒绝身体/物体穿透、额外或缺失动物、不可能支撑、道具瞬移、手机方向反转、服装结构改变、无解释复位或因果不可见。

质检、修复与剪辑

使用 qa-report.mdqa-and-repair.md,分别运行:

  1. **剧情:**冷观众能复述目标 → 阻碍 → 选择/行动 → 结果;
  2. **身份/画风:**人物、动物、产品、服装、材质和介质保持母版;
  3. **物理/连续性:**接触、方向、状态和接缝可信;
  4. **声音:**对白、声线、响度、环境、BGM 和桥接连续。

喜剧/动画化表演另做静音验收:观众能指出笑点正常状态、可见原因、信息差、反应帧、揭晓和对主线的后果;角色在 15–30 秒段内有至少三个可区分表演状态。若只能靠台词说明“东西去了哪里”或“为什么好笑”,判为剧情/表演失败。

只修最小失败单元:局部缺陷用编辑,接缝问题用桥接/续写,身份/解剖/因果崩坏才重生,纯音频问题优先重混。不得用音乐掩盖剧情失败。

多个候选先过 MUST-HIT 二元门,再用 candidate-scorecard.csv 比较剧情、身份、空间、物理、表演、声音和可剪辑性;关键候选尽量盲化模型、种子、费用与生成顺序。评审者先负责发现和分级,创作/修复者再决定改法,避免同一轮为自己的结果辩护。

进入成片阶段阅读 editing-delivery-and-release.md,用 edit-timeline.csv 只装入已验收的真实可用区间,统一工作格式与交付配置,保留字幕/艺术字和音频分轨,并检查缺失媒体、时间线空洞、黑/冻/重复帧、响度、字幕安全区和横竖版本。生成完成不等于剪辑完成,上传成功不等于发布通过。

按任务范围交付

不要把完整制作包强加给局部请求。只创建下一步确实会读取或验证的文件:

  • **诊断/建议:**问题证据、优先级和最小修复;不生成空白 CSV 或生产目录。
  • **故事/剧本:**生产简报、剧情合同、剧本/节拍;只在身份、道具或季线确有连续性时建对应母版。
  • **分镜/生产包:**加入覆盖方案/冻结关键帧、生成段、剪辑节拍、参考权威、模型能力卡、费用与声音路线。
  • **执行:**加入请求预览与指纹、幂等键、任务/恢复记录、候选谱系、费用账本、真实输出、QA 证据、验收尾帧和连续性状态。
  • **成片/发布:**加入带来源链的正式时间线、媒体标准化、混音、字幕/艺术字、封面、编码与冷观众报告。

已有素材或上游状态已足够时复用,不为“流程完整”重复生成。统一命名:BLOCK_ID_vN.mp4_tail.png_contact_12.jpg_audio.wav_QA.md

证据边界

项目文档必须区分:

  • **文档能力:**从当前正式参数页或接口结构核实;
  • **实测结果:**特定模型、入口、日期与配置下观察到;
  • **创作偏好:**为当前故事主动选择;
  • **推断:**有可能但未经直接验证。

不得把动态价格、时长限制或模型质量写成永恒事实。

Signals

GitHub stars
20
Forks
3
Last commit
Aug 2026
Advanced
Catalog kind
skill
Gateway key
dramake
Source
github.com/xixihhhh/ai-short-drama-skill