Transcript B-roll Planner

SkillMedia

Turns verbatim transcripts, voiceover scripts, data-driven talk scripts, or knowledge-video scripts into a B-roll plan with a confirm-then-generate workflow. Use when the user provides a script, data table, screenshots, a logo, or reference material and needs semantic segmentation, shot selection, m

Available today. Use it from your connected AI after setup.

Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.

Then ask your AI: use the Transcript B-roll Planner skill

What this skill tells your AI

The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/transcript-broll-planner/SKILL.md and read by ahel’s review.

当用户已经有逐字稿、配音稿、数据型口播或知识视频脚本,希望把它整理成 B-roll 规划与生成流程时,使用这个 Skill。它适合知识类视频、讲解类视频、市场分析和逐字稿驱动的剪辑场景,核心是判断哪些内容保留为 A-roll,哪些内容需要视觉支持,哪些内容应该拆成独立副镜头,或作为连续长镜头中的视觉节拍。

输入

必需:

  • 一份逐字稿、配音稿或长度足够的讲稿,能够按语义拆分。

可选:

  • 现有素材、截图、Logo、UI 截屏、产品图、文档、地图、图表、数据表或其他参考素材。
  • 用户对比例、单镜头时长、连续一镜到底、风格方向、屏幕文字语言、目标生成模型、以及结果更偏写实还是更偏抽象的要求。

不要把这个 Skill 用在单张图片提示词、纯字幕导出、简单剪切,或无关的长篇剪辑任务上。

STEP 1:按语义拆分逐字稿

阅读逐字稿,按语义单元拆分,而不是只按标点切句。

每个单元判断应进入哪一类:

  • 保留为 A-roll
  • 作为证据支撑
  • 复用已有素材
  • 文字包装 / 动态字体
  • 纯视觉 B-roll

规则:

  • 尽量一镜只表达一个核心意思。
  • 宁可少而清楚,不要过度切碎脚本。
  • 如果用户要求连续一镜到底,就把所有语义单元设计成同一个连续运镜里的视觉节拍,而不是互相断开的镜头。
  • 如果一句话里包含必须精确的声明、数字、品牌名、法律文字、引用或任何不能出错的内容,就标记为证据或确定性处理,不要让自由生成去猜。
  • 如果逐字稿太弱,无法可靠拆分,先向用户索要完整脚本或更干净的逐字稿。

STEP 2:匹配模板路线

把每个语义单元匹配到下列最合适的模板族。

按内容类型选择最合适的模板族:

  • 结论、反转、金句 → kinetic statement
  • 概念、单一隐喻、核心主张 → concept hero
  • 已核实数字、比例、排名 → number impact
  • 论文、文章、报告、引用 → evidence excerpt 或 evidence desk
  • 流程、因果、工作步骤 → relation flow 或 chapter sequence
  • 对比、反差、前后变化 → split system comparison
  • 系统、组织、机制、分类树 → white diorama system、branching taxonomy network 或 technical mechanism explainer
  • 产品、零件、装配逻辑 → 3D product assembly
  • 地点、地图、供应链、全球分布 → geospatial intelligence map

规则:

  • 选最简单、但仍能清楚表达含义的模板。
  • 如果内容更适合证据或干净叠字,就不要硬套隐喻。
  • 如果一条内容里有多个互相打架的意思,就拆成多个镜头,或拆成连续一镜到底中的多个节拍。

STEP 3:识别缺失或必需素材

检查哪些镜头需要用户还没提供的素材。

常见缺失素材:

  • Logo 或品牌字标
  • 产品图片
  • App 或网页截图
  • 图表、论文、屏幕截图或原始数据表
  • 需要重复出场的人物或角色参考
  • 地图、示意图或技术图解
  • 必须逐字准确出现的文字

规则:

  • 在生成前先指出关键缺失项。
  • 不要编造事实、品牌卖点、引用、法律文字或来源。
  • 任何依赖精确文字的镜头,都必须由用户提供准确文本或可信来源。
  • 如果用户指定屏幕文字语言,所有屏幕文字都使用该语言;如果用户指定提示词语言,生成提示词使用用户要求的语言。
  • 默认视频模型是 MiniMax-H3。用户明确指定其他模型时,经过能力检查后遵循用户选择。

STEP 4:输出可审片的 B-roll 计划

生成镜头级或节拍级计划,供用户在真正出片前审阅。

每个计划项应包含:

  • 镜头或节拍编号
  • 对应的逐字稿段落
  • 模板族
  • 视觉目的
  • 所需素材
  • 屏幕文字限制与语言
  • 运镜与连续性说明
  • 是否应改用生成视频、来源证据或确定性制作方式,而不是自由生成

规则:

  • 每个镜头或节拍只保留一个核心语义。
  • 屏幕文字要短、清楚、可读。
  • 如果文字负载过重,就拆镜,或者把文字收回成更干净的视觉方案。
  • 当用户要求连续性时,必须明确说明上一段视觉形态如何自然变形成下一段。
  • 如果用户要求更精致、更写实或更连续,调整计划,但保持语义结构不变。

STEP 5:生成前先确认

计划完成后停住,等待用户确认镜头或提出修改。

在真正生成视频之前,必须先获得确认。

即使计划看起来很明显,也不要跳过这一步。

STEP 6:生成已批准镜头

用户确认后,只生成已批准的镜头或已批准的连续长镜头。

规则:

  • 能批量的类似工作尽量一起做。
  • 对共享同一主体、产品、数据系统或视觉世界的镜头,保持连续性。
  • 以审片计划作为镜头顺序、节拍顺序、运动连续性和素材需求的唯一依据。
  • 如果某个镜头失败,只针对缺失或被拒的部分重试一次,不要整套重来;仍失败则切换 MiniMax-H3 或其他可用模型,不要反复重试同一模型。
  • 生成结果要整理好,便于后续复审和修改。

STEP 7:交付计划与素材

把最终 B-roll 计划、已生成镜头和缺失素材说明一起交付,方便用户立即审阅。

这个 Skill 最适合逐字稿驱动的 B-roll 规划和确认后生成流程,不适合纯字幕翻译、简单剪切、长篇剧本写作,或无关的品牌工作流。

Signals

GitHub stars
26
Last commit
Sep 2026
Advanced
Item type
skill
Key
transcript-broll-planner
Source
github.com/qxryz/workflowgenerator