第一人称 FPV Tour
SkillMediaGenerates scene-first FPV one-take fly-through videos from user-uploaded characters and scenes. Suited for showcasing architecture, coastlines, scenic areas, interiors, product spaces, game scenes, or event venues, with the uploaded character serving as a continuous flight-path guide rather than a c
Available today. Use it from your connected AI after setup.
No other account needed.
Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.
Then ask your AI: use the 第一人称 FPV Tour skill
What this skill tells your AI
The instructions your AI receives, as published by qxryz/workflowgenerator in skills/library/fpv-tour-video-generator/SKILL.md and read by ahel’s review.
使用此 Skill 将用户上传的角色和场景转化为沉浸式第一人称 FPV 飞行展示视频。用户图片用于锚定角色、产品、建筑、景观、车辆或空间外观;可选参考视频只用于提取运镜风格、速度、节奏、海拔变化和转场能量。如果用户同时上传角色和场景,默认把角色作为像纸飞机或轻量飞行化身一样的飞行主角,镜头跟随或追拍它穿过场景。
角色 + 场景参考硬规则:角色图只提供飞行主角的外观、身份与朝向,不继承角色图里的背景、光线、色调、质感、机位、屋顶/窗边环境或情绪。场景图完全定义最终世界、光线、色调、质感、氛围和空间布局。
FPV 输出硬规则:只要模型时长允许,必须按一镜到底的连续飞行动线规划和写 Prompt。避免硬切、蒙太奇、频繁切镜、反复重置机位或不连续跳转。最终应像一个不断线的 FPV 跟飞/追拍镜头,速度、方向、海拔和朝向都要连续交接。
角色朝向与展示硬规则:当用户上传角色时,默认保持角色面朝飞行方向。主视角应以背后/后侧方第一视角跟飞为主。如果需要展示角色,把展示放在路线中段或后半段,用一次短暂且不断惯性的摇镜/绕行/顺势超越,从背后转到正面或前侧方,让用户顺带看见角色正面,然后必须自然回到背后第一视角跟飞并以背后跟飞收尾。这个展示必须保持向前运动惯性,不能像切镜、停顿、原地旋转、机位重置或角色特写展示。除非用户明确要求,否则角色不能倒着飞。如果没有上传角色、只有默认纸飞机作为飞行主体,则不需要做角色正面展示,保持纸飞机路线干净向前。
场景优先规则:当有角色时,场景仍是主视觉主体,角色只是动线引导物/乘客。飞行路线应优先展示环境、空间深度、海岸/建筑/水面/地形和空间推进;角色展示只能是顺带、轻微、自然嵌入的,不要刻意推近做角色特写、英雄展示或强行前景压场,除非用户明确要求角色主导展示。只有场景真的有水面、海岸或低矮边界时,才安排贴水掠飞;没有合适水域就用穿缝、侧倾、俯冲、近距离擦过等路线几何替代。
角色持续性与镜头纪律规则:当角色作为飞行动线引导物时,除非用户明确要求镜头甩开角色,否则角色必须在路线中持续可见,包括最后几秒,不能结尾突然消失。不要使用没有飞行动机的随意推镜、拉镜、变焦感运动或焦点切换。视觉冲击力应来自空间 FPV 运动:近距离擦过、贴水掠飞、侧倾、俯冲、穿缝、强视差、近距离建筑掠过、水花和海拔变化,而不是随机推拉镜头。
规划前必问项:在进入分镜规划前,必须先询问用户视频时长,再询问目标画幅比例。时长是独立必填项,因为它会影响路线设计、节奏,以及是一镜到底还是拆分多段。画幅选项包括 16:9、9:16、1:1 或平台自定义。发布/投放市场不是必问项,只有当用户需要平台特定交付,或平台会显著影响裁切和路线设计时才补问。
STEP 1: 收集输入与意图
先识别用户提供的参考素材:
- 主体或场景图片:角色、建筑、室内、景观、车辆、产品、活动空间或路线环境。如果一张图是角色、另一张图是环境,默认角色为飞行主角,环境为飞行路线空间。
- 可选多角度图片:作为同一主体或同一环境的一致性补充。
- 可选运镜参考视频:仅作为飞行风格、速度、节奏、海拔变化和转场参考。
- 用户偏好:视频时长、画幅比例、可选发布/投放市场、路线风格、难度等级,以及必须展示的位置或穿越点。时长和画幅比例是进入规划前必须确认的用户信息;市场/平台不是必问项。
如果用户没有提供任何视觉参考,先要求上传至少一张主体或场景图片,再进入规划。如果缺少时长或画幅比例,先询问确认,不要直接默认。只有平台会影响裁切或交付时才询问市场/平台。
STEP 2: 分析参考素材
在规划前分析每个上传素材,并判断:
- 主体类型:飞行角色、人物、建筑、景观、车辆、产品、室内空间、混合场景或其他。对于扁平插画角色,默认把设计处理为类似纸飞机的轻量飞行化身,除非用户要求其他形态。
- 空间深度:前景、中景、背景,以及空间是否支持真实飞行移动。
- 可穿越结构:门、拱、窗、走廊、缝隙、桥、楼梯、巷道、树木、岩石、家具开口、车辆内部或其他飞行门洞。
- 空间风险:纯色背景、平面海报感、尺度不清、不可能穿越的通道或被遮挡路线。
- 光线方向和时间氛围。
- 多图冲突时的视觉锚点优先级。角色 + 场景任务必须拆开贡献:角色图 = 只取主角外观、身份与朝向;场景图 = 环境、光线、色调、质感和氛围。
如果用户上传多张图片,先为每张图分配角色:主图、环境参考、主体近景、多角度补充或仅风格参考,并整合成统一场景分析。
如果图片之间存在明显光线或时间段冲突,暂停并询问用户以哪张作为标准。如果主体模糊或不可识别,要求用户上传更清晰的图片。如果图片缺少空间深度,提示用户替换为包含真实背景/环境的图片,或改用景观/建筑场景。
如果上传了参考视频,只提取运动信号:镜头路径、速度、节奏、海拔变化、倾斜角度、环绕方向、加速度模式和转场时机。不要让参考视频污染用户上传主体或场景的外观。
STEP 3: 检测画幅、风格与难度
除非用户明确指定,否则使用默认规则。
画幅与市场/平台:
- 进入规划前必须询问用户确认画幅比例;只有平台会影响裁切或交付时才询问发布/投放市场。
- 缺失时提供简洁选项:16:9 横屏、9:16 竖屏、1:1 方屏或平台自定义。
- 用户确认竖屏、抖音、Reels、TikTok、Shorts 或短视频平台时使用 9:16。
- 用户确认横屏、YouTube、官网首屏、提案展示、电影感展示或横向大屏时使用 16:9。
- 图片本身的横竖只能作为推荐依据,不能覆盖用户确认的画幅比例。
风格预设:
- 用户明确指定时优先:低空掠飞、高空俯冲、螺旋环绕、高速穿梭、窄缝穿越或混合 FPV tour。
- 用户未指定时按主体类型自动匹配:
- 飞行角色或人物:角色跟飞 FPV,采用纸飞机式滑翔、追拍构图、侧向环绕,并保证身份可读。
- 建筑:高空俯冲进入近距离穿越展示。
- 景观:贴近地形的低空掠飞。
- 车辆:高速穿梭、近距离擦过和揭示式环绕。
- 室内或场馆:窄缝穿越与走廊飞行。
- 产品:微型 FPV 环绕与近距离掠过,除非用户要求风格化,否则避免不合理无人机尺度。
难度等级:
- 简单:2–3 个主要动作,速度平滑,少量高风险缝隙,方向稳定。
- 标准:3–5 个动作,一个标志性穿越或环绕,中等速度变化。
- 高难度:快速加速、穿缝、侧倾/滚转、海拔俯冲、近距离擦过和复杂转场,同时保持主体可读。
STEP 4: 规划飞行轨迹分镜
设计一条一镜到底的连续飞行动线。分镜不能是蒙太奇,必须包含:
- 仅当时长超过单段模型限制时才规划分段;否则默认一个不中断镜头,无硬切。
- 起点与终点。
- 海拔变化。
- 关键镜头动作:跟随、追拍、超越、侧向环绕、俯冲、掠飞、上升、侧倾、穿越、揭示、甩镜、后撤或英雄悬停。有上传角色时,可在中段或后半段加入一次不破坏惯性的背后到正面/前侧方短暂展示,然后回到背后第一视角跟飞;没有上传角色时不做这个展示。只有场景支持水面、海岸或低矮边界时,才安排贴水掠飞;不要每次都强行加入。
- 必须展示的场景地标或主体特征。
- 光线方向、色调、材质质感和氛围完全继承场景图。
- 速度曲线:加速、减速、停顿和最终稳定,不能硬切、重置机位、随意推镜或随意拉镜。冲击力来自路线几何和贴近感,不来自变焦式运动。
- 安全与可读性提示:有上传角色时保持其朝向飞行方向,并且持续可见到结尾,但不要强行做角色推近;默认让场景做主视觉,避免把角色降级成标牌或场景装饰;除非用户明确要求超现实穿体,否则避免穿过主体本身。
每个生成视频片段不超过 15 秒。如果用户要求超过 15 秒,将路线拆成多个可衔接片段,并提前说明之后会拼接成片。
STEP 5: 暂停并等待用户确认
视频生成前,向用户展示简洁飞行路线摘要:
- 视频时长和画幅比例。
- 风格预设和难度等级。
- 按顺序排列的飞行动作。
- 海拔变化。
- 关键穿越点、跟飞距离、追拍角度、环绕半径、是否在中后段顺带看一下角色正面,以及如何回到背后第一视角跟飞收尾。
- 光线/时间标准;当角色图和场景图分开时,明确以场景图为唯一标准。
等待用户确认或修改。可接受的修改包括调整环绕半径、增加门洞穿越、降低飞行高度、放慢俯冲、移除高风险缝隙或改成竖屏输出。
未确认前不要生成最终视频。
STEP 6: 编写生成 Prompt
为每个片段编写 Prompt,保留用户上传主体和场景身份,只描述该片段所需的 FPV 镜头行为。有角色时必须明确写出角色是飞行主角,镜头跟随、追拍或环绕它;不要把角色描述成标志、道具、Logo 或背景装饰。
每个 Prompt 应包含:
- FPV 穿越机第一视角语言;如果有飞行主角,则使用角色跟飞 FPV 语言。
- 本片段的明确路线,使用近距离擦过、侧倾、俯冲、穿缝、强视差、贴水掠飞等路线几何制造冲击,而不是随意推拉镜头。
- 速度、海拔、侧倾、滚转和稳定方式。
- 一镜到底连续性:无蒙太奇、无硬切、无反复重置机位;如使用角色展示,必须是在中段或后半段顺势摇镜/超越/弧线绕行,短暂展示正面或前侧方,仍以场景为主,并且最终回到背后第一视角跟飞;如必须多段生成,每段之间也要保持方向、速度、海拔和运动交接。
- 主体和场景保真要求,包括保持上传角色作为飞行角色可读而不是场景装饰、保持角色面朝飞行方向、持续可见到最后几秒,并在需要场景优先时把角色展示压低到顺带级别。
- 光线、色调、质感和氛围一致性全部来自场景图;忽略角色图的背景与调色。
- 输出画幅和时长。
避免把用户场景替换成通用山地、城市、森林或素材库航拍。场景图定义最终世界、色调、光线、质感和氛围;角色图只定义飞行主角外观;Prompt 定义路线。
STEP 7: 生成视频素材
根据确认后的分镜和参考素材生成各片段。图片作为主体/场景锚点,可选视频作为运镜风格参考。默认模型是 MiniMax-H3;如果用户明确指定其他模型,经过能力检查后遵循用户选择。将角色图和场景图作为参考,并在有角色时围绕飞行角色追拍/跟飞路线写 Prompt。每个片段保持在所选模型支持的时长范围内,最长不超过 15 秒。
如果片段失败、主体丢失、结尾角色消失、角色朝向错误或依赖随意推拉镜头,改用更明确的角色持续可见、面朝飞行方向、路线驱动冲击、近距离穿越/侧倾/俯冲设计,或更简单的穿越约束后针对性重试一次;仍失败则切换 MiniMax-H3 或其他可用模型,不要反复重试同一模型。如果角色过于抢镜,降低角色展示权重,转为场景优先。如果窄缝穿越失败,用近距离擦过或揭示式环绕替代,不强行执行不可能路径。
STEP 8: 合成最终输出
如果路线由多个片段组成,按分镜顺序拼接。保持方向、速度、海拔、光线、色调、质感和运动交接连续。避免突兀切换;除非用户明确要求蒙太奇,否则 FPV Tour 应读作一条连续飞行镜头。
最终交付应包括:
- 拼接后的 FPV Tour 视频。
- 如有分段生成,保留各独立片段,方便后续局部修改。
- 简短路线摘要,便于用户提出定点调整。
Signals
- GitHub stars
- 26
- Last commit
- Sep 2026
Advanced
- Item type
- skill
- Key
fpv-tour-video-generator- Source
- github.com/qxryz/workflowgenerator