第一人称 FPV 穿越视角
将创作草稿带入工作台;多阶段流程供参考,不会自动执行或扣费。
以 FPV 穿越机第一人称视角为核心,模拟俯冲、贴地穿隙、螺旋环绕、急速穿梭等动态运镜。
流程正文保留原始中文。模板提及的模型不等同于本站已接入模型;实际可用模型与积分以工作台显示为准。
完整创作流程
1. 流程规划
工作流阶段与依赖关系:
- 分析参考素材 → resource_prepare_and_analyze:识别主体类型(人物 / 建筑 / 风景 / 车辆)、空间纵深、光源方向、可穿越结构(门洞、拱桥、建筑缝隙等)。若用户上传多张图片,先判断各图角色(主图 / 环境图 / 多角度参考),整合为统一分析结果后再进入下一步;若各图光线/时段存在明显冲突,暂停告知用户并询问以哪张为准。若用户上传了参考视频,同步提取运镜风格、速度节奏与高度变化序列,作为飞行轨迹设计的补充参考;图片与视频同时上传时,图片提供主体/场景外观锚点,视频提供运镜风格信号,两者互补整合后再进入下一步。
- 规划轨迹分镜 → storyboard_designer:根据分析结果,按主体类型选用对应轨迹规则库,设计连续飞行路径的分镜序列。
- 暂停确认:分镜完成后向用户展示飞行轨迹概要(高度变化、关键动作、光线方向),等待用户确认或提出微调(如"把环绕半径改为3米"、"增加一次穿门动作"),再进入生成阶段。
- 生成视频素材 → media_generator:以参考图为视觉基础生成各段FPV视频,每段不超过15秒。
- 合成输出 → video_assembler:若分段生成,按飞行轨迹顺序无缝拼接,保持运动连贯性。
依赖顺序: 2→1;3→2;4→3;5→4。
关于时长: Flova当前视频生成单段最长15秒。若用户要求超过15秒,将轨迹拆分为多段生成后无缝拼接,并向用户说明。
风格预设检测: 若用户明确指定「低空贴地」「高空俯冲」「螺旋环绕」「急速穿梭」其中一种风格,在分镜规划阶段直接调用对应风格参数库(见分镜设计);若未指定,根据主体类型自动匹配默认风格(人物→螺旋环绕 / 建筑→高空俯冲 / 风景→低空贴地 / 车辆→急速穿梭)。
难度档位检测: 若用户明确指定「简单」「标准」「高难度」其中一档,在分镜规划与提示词阶段调用对应复杂度参数(见分镜设计);若未指定,默认使用「标准」档。难度档位与风格预设正交,可自由组合(如"高空俯冲 × 简单"或"急速穿梭 × 高难度")。
竖屏模式检测: 若用户明确提及"竖屏"、"抖音"、"Reels"、"9:16"或"短视频平台",或上传的参考图本身为竖向构图(高>宽),将画幅锁定为 9:16,并在分镜规划阶段自动启用竖屏运镜规则库(见分镜设计)。若未明确说明,默认使用横屏 16:9。
异常处理:
- 图片主体模糊无法识别:告知用户"请上传主体更清晰的图片"。
- 图片缺乏空间纵深(如纯色背景):建议用户"更换含背景/环境的图片,或选择风景/建筑类场景"。