教育科普讲解 — 极简线条涂鸦视频

SkillDev tools

Turns knowledge topics, textbooks, or course materials into minimalist stick-figure explainer videos, covering requirements analysis, narration, illustration, storyboarding, asset production, assembly, and staged confirmations. Not for classroom exercises or colorful children's cartoons.

Available today. Use it from your connected AI after setup.

Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.

Then ask your AI: use the 教育科普讲解 skill

What this skill tells your AI

The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/line-doodle-explainer-generator/SKILL.md and read by ahel’s review.

当用户想把知识点、教材摘录、课程材料或教育主题做成完整的科普讲解视频时使用这个 Skill。视觉风格固定为极简线条小人 + 信息图:线条、箭头、时间线、地图、对比框、标签与因果结构共同承担解释任务。

默认目标是完整成片。第一份交付物应是制作方案文本文件,用于后续媒体生成;需求理解和视频生成方案这两部分也可以先直接展示在聊天里快速对齐。除非用户明确只要方案,否则最终目标不是只停留在策划阶段。最终视频语言是单独的制作参数,必须跟随用户的明确要求。

STEP 0:先判断是否要追问还是直接继续

这个 Skill 采用逐步确认流程。写出第一版方案后,不要一次性完成整条流程;每个大步骤结束后都要让用户确认、修改或继续。

如果缺少的信息会改变整体结果,就先问清楚,例如:

  • 资料很长,但没有指定要讲哪一段;
  • 受众差异很大,比如儿童、学生、专家;
  • 用户要求直接做成片,但没有提供他明确提到的必要素材或参考;
  • 用户指定了时长、平台、声音或语言,但这些信息彼此冲突。

卡片弹窗规则

使用结构化选项确认步骤,不要只用开放式提问。选项必须:

  1. 推荐项放第一位;
  2. 只放 3-5 个相邻动作;
  3. 包含当前步骤的修改项;
  4. 包含继续下一步的选项;
  5. 如果界面支持自定义输入,保留自定义方向。

不要用“你学到了什么”这种课堂式问题来替代卡片。

步骤卡点规则

需求理解、视频生成方案、视频核心、讲解结构、口播脚本、图解系统、分镜、主视觉方向、素材与生产路线、媒体生成、合成、质检等每个大步骤结束后都要停下来给卡片。只有用户选了卡片或给出等价指令后才继续。

如果用户明确说“你决定”“自动继续”“不用每步问我”,那就减少确认,只在高成本节点确认:主视觉、分镜、视频生成、旁白/音频生成、最终合成。

STEP 1:需求理解

先把用户的简短请求转成清晰的创作简报。

需要四项:

  1. Topic|主题

    • 明确知识主题、人物、事件、概念、过程或问题。
    • 如果主题太宽,选一个适合默认时长的聚焦角度。
  2. Type|类型

    • 例如人物传记、历史背景、科学机制、概念解释、文化文学、流程说明、对比讲解等。
    • 类型决定结构、图解和节奏。
  3. Output Form|输出形式

    • 默认:60 秒、横屏 16:9 的科普讲解视频制作方案。
    • 说明当前交付物是方案文本、关键帧、旁白音频、视频片段还是最终成片。
    • 如果用户只说“做视频”但没给生产确认,先做方案文本,再给卡片继续媒体生成。
  4. Audience|受众

    • 默认:普通学习者 / 成人初学者。
    • 若用户指定儿童、学生、专家、职场观众或短视频观众,要调整语言深度。

这一部分要直接、面向创作者,不要写成课堂话术。

步骤结束卡片

写完需求理解后,先给卡片再继续:

  1. 按当前理解继续写视频生成方案。(推荐)
  2. 修改主题 / 角度。
  3. 修改受众层级。
  4. 修改输出形式、时长或平台。
  5. 自定义方向。

STEP 2:视频生成方案

在需求理解之后写视频生成方案,这一步确定脚本和分镜前的创意方向。

包含五项:

  1. Video Title|标题:短、清楚、适合封面,不要学术化。
  2. Video Summary|摘要:1-2 句说明视频要讲什么,以及观众为什么该看。
  3. Style Tone|风格语气:清晰、幽默、冷静、历史感、悬疑、温暖、严肃等,要和极简线条涂鸦风兼容。
  4. Color Plan|颜色计划:线条为主,配 1-2 个有含义的强调色,并说明用途。
  5. Pacing Level|节奏:slow / steady / medium-fast / fast。60 秒短视频通常默认 medium-fast。

步骤结束卡片

写完视频生成方案后,先给卡片再继续:

  1. 继续提炼视频核心。(推荐)
  2. 修改标题 / 摘要。
  3. 修改风格或颜色方案。
  4. 修改节奏、时长或标签密度。
  5. 自定义方向。

STEP 3:提炼视频核心

把内容压缩成一条可讲清的主线,不要什么都讲。

需要提炼:

  1. Core idea|核心观点
  2. Viewer promise|观众看完会懂什么
  3. 3-5 key points|关键点
  4. Confusion point|容易误解的地方
  5. Hook|开头钩子
  6. Takeaway|结尾记忆点

对源材料要做视频化压缩:

  • 保留中心解释;
  • 去掉枝节、脚注和过度技术细节,除非它们是核心;
  • 如果事实不确定,写成事实核查备注,不要当成确定事实。

步骤结束卡片

写完视频核心后,先给卡片再继续:

  1. 继续选择讲解结构。(推荐)
  2. 修改核心观点或观众承诺。
  3. 增减关键点。
  4. 修改钩子或结尾。
  5. 自定义方向。

STEP 4:选择讲解结构

只选一种主结构,除非主题必须混合。

可选结构:

  1. 问题先行
  2. 日常类比
  3. 时间线
  4. 因果链
  5. 问题-解决
  6. 纠正误解
  7. 从局部到整体
  8. 对比讲解

优先选能被视觉逻辑表达的结构:时间线、箭头、地图、前后对比、概念图、流程图和图标变化。

步骤结束卡片

选完结构后,先给卡片再继续:

  1. 继续写口播脚本。(推荐)
  2. 换一个结构。
  3. 把主结构和次级视觉逻辑结合。
  4. 简化解释路径。
  5. 自定义方向。

STEP 5:写口播脚本

口播是给视频说的,不是写文章。

规则:

  • 句子要短;
  • 必要术语先定义;
  • 有清晰的开头、中段和结尾;
  • 尽量先举具体例子,再讲抽象概念;
  • 避免教材腔;
  • 除非用户明确要求,不要用课堂提问式话术;
  • 结尾要有记忆点。

60 秒视频可按大致节奏组织:

  1. 0-6 秒:钩子
  2. 6-15 秒:背景
  3. 15-35 秒:核心机制
  4. 35-50 秒:意义
  5. 50-60 秒:总结

步骤结束卡片

写完口播后,先给卡片再继续:

  1. 继续设计图解系统。(推荐)
  2. 让脚本更短 / 更长。
  3. 改语气或受众层级。
  4. 修改钩子、例子或结尾。
  5. 自定义方向。

STEP 6:设计图解系统

在做分镜前,先统一重复使用的视觉语言。

需要包含:

  1. 主图解类型
  2. 核心图标
  3. 线条小人角色
  4. 屏幕标签
  5. 强调色逻辑
  6. 转场逻辑

图解系统要让视频在多镜头下依然保持统一。

步骤结束卡片

设计完图解系统后,先给卡片再继续:

  1. 继续制作分镜。(推荐)
  2. 修改主图解类型。
  3. 修改图标、标签或线条小人角色。
  4. 修改强调色或转场逻辑。
  5. 自定义方向。

STEP 7:制作分镜

分镜镜头数要根据视频时长 + 内容节奏动态决定,不要写死。大致参考:20-30 秒通常 2-4 镜,60 秒通常 5-8 镜,更长视频按内容段落增加。

每一镜至少写清:

  • 时间范围
  • 旁白段落
  • 镜头目的
  • 视觉动作
  • 屏幕标签
  • 图解 / 动画说明
  • 风格说明
  • 生成备注

分镜纪律:

  • 每个镜头只讲一个微观点;
  • 第一镜必须抓人,最后一镜必须收束;
  • 画面不必追着每句话跑;
  • 线条小人只在必要时用于说明尺度、对比或人的处境;
  • 标签要少而清楚。

步骤结束卡片

制作完分镜后,先给卡片再继续:

  1. 继续规划素材 / 生产路线。(推荐)
  2. 修改镜头数量或时长。
  3. 修改某些分镜行。
  4. 先生成分镜关键帧。
  5. 自定义方向。

STEP 8:规划素材与生产路线

如果用户要真正做视频,就把分镜转成可执行的生产计划。

素材清单

列出需要的素材:

  • 生产方案文本文件;
  • 1-3 张主视觉方向图;
  • 封面 / key visual;
  • 分镜关键帧;
  • 视频片段;
  • 旁白音频;
  • 可选 BGM;
  • 可选音效;
  • 最终成片默认包含字幕,除非用户明确不要;
  • 最终成片。

生产路线

根据用户需求选择实际路线:

  1. Plan-first route:先做方案文本,再推荐生成 1-3 张主视觉方向图。
  2. Main-visual route:先做主视觉图,确定整体风格、封面感、线条粗细、图标语言和颜色。
  3. Keyframe route:主视觉确认后再做分镜关键帧;如果用户要求,也可以直接按脚本做分镜帧。
  4. Narration-first route:先做旁白,再按语速反推镜头。
  5. Clip-first route:先逐镜做短视频片段,再合成。
  6. Full-production route:旁白、片段、可选 BGM 和最终合成一起做。

音频归属

避免重复声音:

  • 如果视频生成已经带旁白,就不要再重复做同样的 TTS;
  • 如果旁白是单独做的,视频片段里不要再塞同样的旁白;
  • BGM 只生成一次,不要每个镜头都做;
  • 关键帧转视频批次中,默认不要在单个视频片段生成时加入 BGM;必须等全部片段完成后,再询问用户是否需要在最终合成前生成 BGM。
  • 只有用户明确要求时才做字幕。

步骤结束卡片

规划完素材与生产路线后,先给卡片再继续:

  1. 创建 / 更新制作方案文本文件。(推荐)
  2. 修改素材清单或生产路线。
  3. 先生成 1-3 张主视觉方向图。
  4. 先生成旁白音频。
  5. 自定义方向。

STEP 9:写制作方案文本文件

默认策划交付物是一份制作方案文本文件。它应该足够完整,便于直接生产。到这一步时,方案文件不是可选项:前面已经展示过需求理解和视频生成方案,剩下的生产细节必须整理进该文档。最终回复要明确说明文档已创建或更新,然后再给下一步选项。

文档结构:

  1. 需求理解
  2. 视频生成方案
  3. 视频核心
  4. 口播脚本
  5. 图解系统
  6. 分镜脚本
  7. 主视觉方向计划
  8. 素材与生产计划
  9. 事实核查备注

不要把下一步卡片写进文档里。下一步选项只放在聊天回复里。

生成方案文档后,默认推荐下一步是:先生成 1-3 张主视觉方向图。只有在用户选择或确认主视觉后,才进入分镜关键帧或逐镜视频生成。不要在没有主视觉确认的情况下直接跳到关键帧,除非用户明确要求跳过主视觉。

步骤结束卡片

创建或更新方案文档后,在任何媒体生成前先给卡片:

  1. 生成 1-3 张主视觉方向图。(推荐)
  2. 修改制作方案文档。
  3. 先生成旁白音频。
  4. 跳过主视觉,直接生成分镜关键帧。
  5. 自定义方向。

STEP 10:固定视觉风格 — 极简线条涂鸦小人

除非用户明确要求切换,否则始终使用这一风格。

视觉身份固定为极简线条小人讲解动画:

  • 人物:4 头身到 4.5 头身的简化线条人物;表情极简,眼睛、眉毛、嘴都用最少线条表现;手部要简化,不画复杂手指。
  • 线条:中等粗细的深灰或柔黑描边,允许轻微手绘不规则感,所有人物、道具、图标和背景线条保持一致。
  • 颜色:低饱和、高明度扁平色;背景可用柔和灰绿、灰蓝、米白、暖白等;强调色只保留少量红、蓝、黄、棕、绿。
  • 明暗:只用平涂和简单块面,不要真实渐变、金属高光或发光效果。
  • 背景:避免纯白空场,除非该镜头就是图表;背景应简单、扁平、几何化,像手绘教学板。
  • 图标与道具:都要符号化、可读、线条统一。
  • 构图:优先清楚的二维正视 / 侧视、居中构图、对比布局、地图、时间线和图解板。
  • 动效感:像 12-15 fps 的轻动画,线条生长、图标弹入、人物轻微循环动作、镜头轻推或轻移,动作必须服务于解释逻辑。

避免:

  • 纯黑白、没有扁平色支持的空白涂鸦;
  • 2 头身 Q 版或真实 7 头身;
  • 儿童电视卡通感的彩色圆润场景;
  • 夸张表演、重口型、主持人式镜头;
  • 过密幻灯片文字;
  • 写实 3D、复杂透视、金属反光、电影感光效。

分屏规则:

  • 默认横屏 16:9,除非用户明确要求竖屏;
  • 只有教学逻辑真的需要对比时才用分屏;
  • 不要为了装饰而加中线;
  • 每个分屏区域都要足够大,能读清人物、图标、箭头和标签。

STEP 11:生成并合成媒体

制作媒体时:

  1. 保持所有片段同一比例;
  2. 保持线条、图标、标签和节奏统一;
  3. 当一致性很重要时先生成关键帧;
  4. 按分镜逐段生成视频片段;
  5. 优先使用 MiniMax H3,因为它的能力适合线条科普视频流程;用户指定其他模型且满足已确认要求时遵循其选择,H3 不可用或能力不符时说明差异并让用户选择等效方案;
  6. 旁白只生成一次;
  7. 关键帧转视频的片段默认不带 BGM;先把所有视频片段做完,等全部片段完成后,再询问用户是否需要生成 BGM,并且只生成一次;
  8. 合成最终视频时保持节奏清楚、不要重复音轨;
  9. 最终视频完成后,默认再生成匹配字幕,除非用户明确要求不要字幕;
  10. 确认最终产物是可用视频,而不只是方案。

生成片段时,要清楚描述图解逻辑:箭头、变形、时间线、地图、对比框、图标变化和线条小人角色。

关键帧到动效说明

在生成分镜关键帧之后、让用户生成视频片段之前,要先给每张关键帧一个简短运动计划。这是必须经过的中间解释步骤。

每张关键帧只需概括 1-3 条:

  • 动画效果:线条、图标、标签、箭头、地图路径或角色元素要怎么动;
  • 镜头 / 构图:静止、轻推、平移、滑动还是拉远;
  • 转场:它怎么接到下一镜,比如线路延伸、图标变形、面板擦除、展开、缩放或标签淡出。

说明要简洁、面向创作者,帮助用户理解静帧如何变成会动的线条涂鸦片段,不要写成密集的技术表。给完运动计划后,再弹出卡片让用户确认、修改某些镜头,或继续生成视频片段。

字幕生成

最终视频合成后,默认要生成字幕。字幕应以完整旁白 / 最终混音为主时钟,而不是用分镜时长估算。

规则:

  1. 把最终旁白 / 最终混音当作主时钟;如果有连续旁白文件,就直接用它,否则转写最终合成视频的音频;
  2. 先从整条音轨生成时间字幕,再按最终比例排版;
  3. 字幕要适合教育讲解视频:底部居中、清晰、高对比、最多两行、按自然短语分行;
  4. 除非用户明确要求每镜字幕,否则不要按镜头拆成多个字幕文件;
  5. 中文视频默认字幕也保持中文,除非用户要求双语或翻译字幕;
  6. 最终交付优先给字幕烧录视频,必要时也可额外提供字幕文件;
  7. 如果字幕对不齐,优先修字幕或修剪辑节奏,不要先拉伸旁白时长。

最终交付前,快速检查字幕是否与旁白同步、是否挡住关键图解标签、是否在目标平台上可读。

每批媒体后的结束卡片

每次媒体生成批次后,在进入下一批或最终合成前都要给卡片:

  1. 认可这些素材并继续下一步。(推荐)
  2. 重新生成部分素材。
  3. 在继续视频生成前先调整关键帧运动计划。
  4. 改变风格一致性规则后再继续。
  5. 自定义方向。

在最终合成前,再给一张卡片:

  1. 用已确认素材合成最终视频。(推荐)
  2. 先修改片段 / 旁白 / BGM。
  3. 导出无字幕版本。
  4. 只导出当前素材,不合成。
  5. 自定义方向。

STEP 12:质量检查

交付前检查:

  • 需求理解是否对应用户的主题、类型、输出形式和受众;
  • 视频生成方案是否有清楚的标题、摘要、风格、颜色和节奏;
  • 脚本是否准确、简洁、适合口播;
  • 每一镜是否都在讲一个新的微观点;
  • 风格是否仍是线条涂鸦 + 信息图,而不是圆润卡通或泛 MG;
  • 标签和关键词是否足够短、清楚;
  • 动效是否在揭示逻辑,而不是乱动;
  • 音频归属是否干净,没有重复旁白或冲突音乐;
  • 最终视频是否已经默认生成对应字幕,除非用户明确不要;
  • 字幕是否跟旁白对齐,是否遮挡关键标签;
  • 如果当前是在策划阶段,是否已经有制作方案文本文件;
  • 最终回复是否把用户引向制作,而不是课堂练习。

如果事实不确定,就写进事实核查备注。

交互与输出参考

  • 每个步骤边界都要读 references/interaction-cards.md;
  • 返回策划或媒体生产交付物前,读 references/output-format.md。

Signals

GitHub stars
26
Last commit
Sep 2026
Advanced
Item type
skill
Key
line-doodle-explainer-generator
Source
github.com/qxryz/workflowgenerator