Transcript B-roll Planner
SkillMediaTurns verbatim transcripts, voiceover scripts, data-driven talk scripts, or knowledge-video scripts into a B-roll plan with a confirm-then-generate workflow. Use when the user provides a script, data table, screenshots, a logo, or reference material and needs semantic segmentation, shot selection, m
Available today. Use it from your connected AI after setup.
No other account needed.
Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.
Then ask your AI: use the Transcript B-roll Planner skill
What this skill tells your AI
The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/transcript-broll-planner/SKILL.md and read by ahel’s review.
当用户已经有逐字稿、配音稿、数据型口播或知识视频脚本,希望把它整理成 B-roll 规划与生成流程时,使用这个 Skill。它适合知识类视频、讲解类视频、市场分析和逐字稿驱动的剪辑场景,核心是判断哪些内容保留为 A-roll,哪些内容需要视觉支持,哪些内容应该拆成独立副镜头,或作为连续长镜头中的视觉节拍。
输入
必需:
- 一份逐字稿、配音稿或长度足够的讲稿,能够按语义拆分。
可选:
- 现有素材、截图、Logo、UI 截屏、产品图、文档、地图、图表、数据表或其他参考素材。
- 用户对比例、单镜头时长、连续一镜到底、风格方向、屏幕文字语言、目标生成模型、以及结果更偏写实还是更偏抽象的要求。
不要把这个 Skill 用在单张图片提示词、纯字幕导出、简单剪切,或无关的长篇剪辑任务上。
STEP 1:按语义拆分逐字稿
阅读逐字稿,按语义单元拆分,而不是只按标点切句。
每个单元判断应进入哪一类:
- 保留为 A-roll
- 作为证据支撑
- 复用已有素材
- 文字包装 / 动态字体
- 纯视觉 B-roll
规则:
- 尽量一镜只表达一个核心意思。
- 宁可少而清楚,不要过度切碎脚本。
- 如果用户要求连续一镜到底,就把所有语义单元设计成同一个连续运镜里的视觉节拍,而不是互相断开的镜头。
- 如果一句话里包含必须精确的声明、数字、品牌名、法律文字、引用或任何不能出错的内容,就标记为证据或确定性处理,不要让自由生成去猜。
- 如果逐字稿太弱,无法可靠拆分,先向用户索要完整脚本或更干净的逐字稿。
STEP 2:匹配模板路线
把每个语义单元匹配到下列最合适的模板族。
按内容类型选择最合适的模板族:
- 结论、反转、金句 → kinetic statement
- 概念、单一隐喻、核心主张 → concept hero
- 已核实数字、比例、排名 → number impact
- 论文、文章、报告、引用 → evidence excerpt 或 evidence desk
- 流程、因果、工作步骤 → relation flow 或 chapter sequence
- 对比、反差、前后变化 → split system comparison
- 系统、组织、机制、分类树 → white diorama system、branching taxonomy network 或 technical mechanism explainer
- 产品、零件、装配逻辑 → 3D product assembly
- 地点、地图、供应链、全球分布 → geospatial intelligence map
规则:
- 选最简单、但仍能清楚表达含义的模板。
- 如果内容更适合证据或干净叠字,就不要硬套隐喻。
- 如果一条内容里有多个互相打架的意思,就拆成多个镜头,或拆成连续一镜到底中的多个节拍。
STEP 3:识别缺失或必需素材
检查哪些镜头需要用户还没提供的素材。
常见缺失素材:
- Logo 或品牌字标
- 产品图片
- App 或网页截图
- 图表、论文、屏幕截图或原始数据表
- 需要重复出场的人物或角色参考
- 地图、示意图或技术图解
- 必须逐字准确出现的文字
规则:
- 在生成前先指出关键缺失项。
- 不要编造事实、品牌卖点、引用、法律文字或来源。
- 任何依赖精确文字的镜头,都必须由用户提供准确文本或可信来源。
- 如果用户指定屏幕文字语言,所有屏幕文字都使用该语言;如果用户指定提示词语言,生成提示词使用用户要求的语言。
- 默认视频模型是 MiniMax-H3。用户明确指定其他模型时,经过能力检查后遵循用户选择。
STEP 4:输出可审片的 B-roll 计划
生成镜头级或节拍级计划,供用户在真正出片前审阅。
每个计划项应包含:
- 镜头或节拍编号
- 对应的逐字稿段落
- 模板族
- 视觉目的
- 所需素材
- 屏幕文字限制与语言
- 运镜与连续性说明
- 是否应改用生成视频、来源证据或确定性制作方式,而不是自由生成
规则:
- 每个镜头或节拍只保留一个核心语义。
- 屏幕文字要短、清楚、可读。
- 如果文字负载过重,就拆镜,或者把文字收回成更干净的视觉方案。
- 当用户要求连续性时,必须明确说明上一段视觉形态如何自然变形成下一段。
- 如果用户要求更精致、更写实或更连续,调整计划,但保持语义结构不变。
STEP 5:生成前先确认
计划完成后停住,等待用户确认镜头或提出修改。
在真正生成视频之前,必须先获得确认。
即使计划看起来很明显,也不要跳过这一步。
STEP 6:生成已批准镜头
用户确认后,只生成已批准的镜头或已批准的连续长镜头。
规则:
- 能批量的类似工作尽量一起做。
- 对共享同一主体、产品、数据系统或视觉世界的镜头,保持连续性。
- 以审片计划作为镜头顺序、节拍顺序、运动连续性和素材需求的唯一依据。
- 如果某个镜头失败,只针对缺失或被拒的部分重试一次,不要整套重来;仍失败则切换 MiniMax-H3 或其他可用模型,不要反复重试同一模型。
- 生成结果要整理好,便于后续复审和修改。
STEP 7:交付计划与素材
把最终 B-roll 计划、已生成镜头和缺失素材说明一起交付,方便用户立即审阅。
这个 Skill 最适合逐字稿驱动的 B-roll 规划和确认后生成流程,不适合纯字幕翻译、简单剪切、长篇剧本写作,或无关的品牌工作流。
Signals
- GitHub stars
- 26
- Last commit
- Sep 2026
Advanced
- Item type
- skill
- Key
transcript-broll-planner- Source
- github.com/qxryz/workflowgenerator