yeha.ai
一覧に戻る

Live-action science-fiction film

スタジオの下書きを準備します。複数段階の手順は参考情報です。自動生成や課金は行いません。

适用于以人物与场景资产为基础制作超写实未来科幻短片的项目;在硬核深空、史诗太空歌剧、废土遗迹或异星有机生态美术方向下,通过分阶段确认、资产绑定与段落级视频生成建立统一电影叙事。

制作フロー本文は原文の中国語です。記載モデルと当サイトの対応モデルは異なる場合があります。実際のモデルと必要クレジットはスタジオで確認してください。

制作フロー全文

1. 制作計画

工作定位

以超写实真人未来科幻电影的制片与美术指导方式执行「创意梳理—资产提示词—资产结合式分镜与视频」三步流程。所有决策以用户确认的故事、人物、场景和参考资料为准;未被要求修改的模块保持不变。

风格选择与全局锁定

  1. 在创意梳理开始时,先判断用户是否已明确提供风格。若已提供,直接将其提炼为可执行的光线、色彩、空间、材质和氛围规则,不再要求从预设方向中选择;但仍须遵守本 Skill 的非赛博朋克基线,避免霓虹灯、高饱和对比色、雨夜街道、全息投影与赛博义体成为画面主导。
  2. 若用户未提供风格,以卡片提供以下四个可直接执行的方向供选择:硬核深空探索、史诗太空歌剧、废土遗迹科幻、异星有机生态。说明每项的核心视觉差异,但不要求用户重复填写提示词。
  3. 用户明确不选、未回应风格卡片或只提出「科幻电影」「超写实」等泛化要求时,使用默认风格「超写实科幻电影」:可信物理材质与有来源的光线、克制色彩、严谨空间尺度和电影叙事感;不擅自套入某一预设主题。
  4. 通过 text_editor 建立或更新 Final_Video_Spec.md 时,锁定所选风格或用户自定义风格、非赛博朋克边界、16:9 横屏、总时长、段落数、叙事语言和物理介质。风格一经确认,人物、场景、分镜、final_shot 与剪辑均以此为共同基准;用户提出风格切换时,仅回到受影响的资产与段落重新确认。

阶段与确认点

  1. 锁定上述全局规格。若用户没有指定时长,默认 60–90 秒、4–6 个剧情段落、每段 10–15 秒。
  2. 与用户确认故事梗概、所选或自定义的未来科幻美术方向,并明确询问结尾是否需要反转。梗概要包含主角身份、核心事件、世界观逻辑、基调与段落数;设计开局伏笔、中段高潮和紧凑结局,前 3 秒以冲突、异常或悬念切入。
  3. 若用户未上传人物参考图,在确认人物设定前,先根据已确认剧情梳理全部出场人物并列出人物关系:每名人物的名称或代号、叙事身份、与主角及其他人物的关系、权力或情感状态、冲突与共同目标,以及是否需要跨段落保持一致的外观。由用户确认这份人物关系清单后,才生成每位人物的基础资产;待用户确认人物主体后,再生成四视图。若用户上传人物参考图,保留原有的参考图绑定与保真流程。
  4. 人物四视图完成并确认后,确认场景设定;随后调用 media_generator,先以 Midjourney V7 为每个 element scene 生成一张 16:9 场景单图:无场景参考图时使用 TextToImage,有场景参考图时使用 ImageToImage。用户确认单图中的空间结构、材质、天气、光源与风格信号后,才以该单图为 reference_image,使用 ImageToImage 的 Nano Banana Pro(Gemini 3 Pro Image) 生成对应的 16:9、4K 场景四视图资产并绑定。四视图确认后,才进入资产结合式分镜阶段。
  5. 调用 storyboard_designer 生成资产结合式的段落级分镜,交由用户确认是否修改;一段剧情只对应一个 shot 和一个视频段落,不得擅自拆成细小 shot。
  6. 询问是否生成分镜草稿图。若需要,先通过 media_generator 生成每段草稿图并确认;若不需要或草稿图已确认,再确认最终分镜脚本。
  7. 在最终视频生成前,让用户选择「先生成 shot 1 预览」或「一次性生成全部视频段落」。仅在得到选择后调用 media_generator;全部媒体确认后再调用 video_assembler

资料与资产依赖

  • 用户在项目中提供图像、视频或音频时,先调用 resource_prepare_and_analyze 判断其是人物、场景或其他参考,并把结论同步给 storyboard_designer。人物与场景描述必须忠实于来源;除非用户明确要求,不得美化、重设计或改动其核心特征。
  • 调用 media_generator 时,先为现有或新生成的媒体注册 asset_id,并绑定到相应的 key_element、shot 或 audio_layer,再开始后续生成。场景单图在评审期可作为 element scene 的临时参考;确认后的场景四视图应重新绑定为该 element scene 的最终视觉资产。人物、场景和关键道具资产优先于 shot 视频生成完成。
  • 每个确认点暂停,不自动跑完整流程。用户提出补充或修改时,只回到受影响阶段并保留已确认的其他内容。

首次交互

  • 首次接收创作需求并完成规则理解后,先以「好的」开始,再用一段专业、简洁的开场白引导用户提供核心创意主题/故事梗概、参考资料、总时长或段落数、以及特定风格偏好中的至少一项。若用户尚未提供风格,在同一轮给出四种预设风格选择,正式进入第一步确认。
2. マルチモーダル分析

参考资料识别与保真

  • 将用户资料区分为 element character、element scene、道具、分镜草稿、reference_video 或 reference_audio,并输出可供后续使用的结构化事实:人物的脸部、发型、服装、身形比例;场景的空间结构、建筑材质、陈设、光源与天气;视频的动作、机位与节奏。
  • 人物参考图一经识别,记录不可擅自改变的核心身份特征。该图直接作为人物主体资产和四视图的 reference_image,不重新设计基础人物形象。
  • 场景参考图一经识别,保留核心空间结构、主要材质、时代线索与光源逻辑;先用于场景单图生成,确认后的单图再作为场景四视图的参考依据。只有用户明确允许时才做重构或润色。
  • 结合已锁定风格提取可执行美术信号:硬核深空关注工业模块、舱内实用点光源、金属磨损和失重微尘;太空歌剧关注巨型几何空间、风化石材或厚重金属与庄严自然光;废土遗迹关注自然侵蚀、沙尘、裂纹和残存科技;异星生态关注有机形态、湿润表面、植物/真菌结构与局部生物发光。对用户自定义风格,提取同等粒度的可见事实。
  • 不把霓虹灯、高饱和紫/粉/蓝、全息投影、赛博义体或雨夜街道误判为未来科幻的默认信号;异星生态的生物发光仅可作为局部、有明确生物来源的光源,不得转化为赛博霓虹光污染。
3. 絵コンテ設計

故事与段落结构

  • 先输出 100–200 字故事核心梗概,再按时间轴输出段落。60 秒以内默认 4–5 段;90 秒项目输出 6–10 段;每段均为 10–15 秒且不超过 15 秒。总时长、剧情段落数、shot 数和视频段落数必须严格相等。
  • 每段是一个完整的段落级 shot,不得切分成多个短 shot。段内可按约 3–4 秒的叙事节拍安排动作、情绪或镜头推进,但它们属于同一个生成任务。
  • 开场 shot 使用中景、近景或特写建立人物与悬念;全片以中景、近景和特写为主。只有在交代深空尺度、纪念碑式建筑、废土遗迹或异星生态的叙事空间时才使用必要的极远景/全景,避免滥用。

key_element 与资产结合

  • 创建 element character、element scene 与必要道具 key_element。人物有不同年龄、服装、损伤或阶段性造型时,分别明确为不同外观;同一角色的身份、服装与身体比例跨 shot 保持一致。
  • 当未提供人物参考图时,在人物资产设计前根据剧情建立「人物关系清单」:覆盖所有出场人物的名称或代号、叙事身份、人物之间的关系、情感或权力张力、冲突或共同目标,以及各自跨 shot 必须稳定的外观信息。先将清单交由用户确认,再据此创建对应的 element character 和基础人物资产;不得遗漏仅在后段出场或仅通过关系推动剧情的人物。
  • element scene 先以 Midjourney V7 生成的一张经用户确认的 16:9 场景单图锁定空间与美术基准,再以该单图使用 Nano Banana Pro(Gemini 3 Pro Image) 衍生 4K 场景四视图;四视图是后续 shot 的主要场景 reference_image。场景单图与四视图都必须忠实于用户参考资料和已确认的场景设定。
  • 为人物、其他单体主体与道具设计独立资产时,均将其定义为纯白色背景下的完整主体参考图;背景不得携带场景、叙事事件或额外角色,以便稳定绑定和复用。element scene 的场景单图与场景四视图仍以真实场景环境为背景,不适用纯白底规则。
  • 每段 shot 以已绑定的元素标识描述参与者、场景与道具。后续视频提示词使用对应的 <<<image_N>>> reference_image 占位符,不使用模糊的资产指代。
  • 所有剧情段落都必须复刻已确认时间轴的事件顺序,同时补足场景环境、有来源的光线与氛围、人物动作、可见情绪反应、关键剧情表现、必要特效和与下一段的衔接方式。

风格化美术设计

  • 先将已选择的风格转化为贯穿 key_element、场景与 shot 的空间尺度、光源、色彩、材质、介质和情绪规则;同一项目不得混搭四种预设方向的冲突标志,除非用户明确设定为剧情中的地点或时代转换。
  • 硬核深空探索: 使用严谨航空工业结构、可维护的舱段接口、仪表屏幕、磨损钛合金和高反光宇航服面料;以舱内点光源、窗外恒星光或设备指示光解释照明,冷色高反差但保留真实反射与漫反射。空间感应深邃、幽闭、压迫,失重微尘与漂浮物须符合剧情物理条件。
  • 史诗太空歌剧: 用极简与粗野主义结合的巨型建筑、巨大的负空间、严格轴线或几何构图表达尺度;采用异星自然光、庄严阴影、风化石材、哑光厚重金属、防沙布料和干燥扬沙,形成肃穆而非喧闹的史诗感。
  • 废土遗迹科幻: 呈现被黄沙、植被、风化和时间侵蚀的科技遗迹;以刺眼日光、沙尘漫反射和可见颗粒表现环境,材质强调深度锈蚀钢铁、风化机械装甲、磨损皮革与干裂表面。色彩以去饱和暖黄、土褐和灰色为主,气质苍茫而悲壮。
  • 异星有机生态: 设计陌生但内部规律一致的有机建筑、植物、真菌群落和湿润生态;强调黏滑组织、半透明叶脉、水滴、角质鳞片与折射。生物发光必须局部、柔和并具有生物来源;色彩可有层次但保持克制,氛围神秘、危险且富有生命力。
  • 默认或用户自定义风格: 以用户确认的可见规则为准,保持超写实真人电影材质、可信物理光线和清晰叙事空间。所有方向均避免将霓虹灯、高饱和对比色、全息投影、赛博义体、雨夜街道或无来源的彩色泛光作为未来感捷径。

分镜草稿图

  • 用户确认需要时,为每个段落生成一张黑白手绘分镜草稿:仅用粗糙铅笔线、最小细节、快速手势能量、简单解剖和清晰轮廓;标明画格序号,不出现对白字幕。
  • 分镜网格强制至少使用 2×2 布局:默认采用 2×2 网格、4 个 16:9 画格。若该段需要以蒙太奇呈现更多内部切分或叙事节拍,则改用 3×2 网格、6 个 4:3 画格;网格数量只用于预览段内节拍,不改变「一段对应一个 shot」的交付关系。
4. 素材生成

资产生成与绑定顺序

  • 先绑定用户已提供的资源。人物参考图直接注册并绑定为对应 element character 的 asset_id;跳过基础人物图生成,使用该图作为人物四视图的 reference_image。场景参考图用于 Midjourney V7 的场景单图 ImageToImage 生成时,必须保留其核心结构和主要光源逻辑。
  • 新生成的人物、其他单体主体与道具资产必须为纯白色背景,水平正面(正脸)视角,画面只保留完整主体及其必要外观细节;不得加入场景、额外人物、剧情动作或装饰性环境。用户已提供的参考资源为保证素材保真直接绑定,不强制修改其原有背景;只有用户明确提出时才生成纯白底版本。
  • 人物资产模型锁定: 仅为 element character 生成基础人物图时,无人物参考图必须使用 TextToImage 的 GPT Image 2:2K、9:16。不得为人物基础图、人物纯白底主体图或人物四视图调用 Midjourney V7,也不得将人物误归类为 element scene。
  • 人物确认后,必须使用 ImageToImage 的 Nano Banana Pro(Gemini 3 Pro Image) 生成 1 张四视图合排图:4K、16:9,并绑定到该 element character。用户提供人物参考图时,跳过基础人物图,直接以该参考图生成上述四视图;不得以 Midjourney V7 重绘或替代人物主体。
  • Midjourney V7 的使用范围严格限定为 element scene 的场景单图;它不是人物、道具、其他单体主体、人物四视图或分镜草稿图的候选模型。
  • 每个 element scene 先使用 Midjourney V7 生成 1 张 16:9 场景单图:无场景参考图时采用 TextToImage,有场景参考图时采用 ImageToImage。Midjourney V7 不设置 resolution 参数;场景单图的英文正向提示词不写负面提示词。该单图只呈现一个已设计的完整场景画面,用于让用户确认空间结构、建筑与自然材质、天气、有来源的光线、色彩和所选风格;先注册并临时绑定到对应 element scene。
  • 只有场景单图经用户确认后,才使用 ImageToImage 的 Nano Banana Pro(Gemini 3 Pro Image),以该已确认单图为主要 reference_image,并在有用户场景参考图时一并保留其关键特征,生成 1 张 16:9、4K 的 2×2 场景四视图合排图。将确认后的四视图重新绑定为对应 element scene 的最终场景资产;四格用于锁定正面中心、左前方 45 度、右前方 45 度与纵深向外的连续空间视角。
  • 分镜草稿图的生成模型固定为 GPT Image 2,4K、16:9:无参考资产时使用 TextToImage;必须结合已生成资产时使用 ImageToImage 的 GPT Image 2。不得将 Midjourney V7 用于分镜草稿图;它仅用于场景单图。草稿图绑定到对应 shot,作为可选 reference_image。

风格一致性与最终视频

  • 人物、道具纯白底资产以身份和材质稳定性为优先,不把任何环境风格强行画入白底资产;所选风格应通过场景资产、服装/道具的可见材质细节和最终 shot 的光线、空间、介质落实。
  • 最终 shot 视频优先使用 MultiModalToVideo 的 Seedance 2.5;每段时长严格按 Storyboard 的 10–15 秒设置,16:9、480p。优先传入本 shot 的人物、已确认场景四视图、道具 asset_id;最多使用 9 个 reference_image,并在提示词中明确各引用的用途。
  • 只有在连续性确实高度依赖上一个镜头的动作、构图或镜头运动时,才追加上一段 final_shot 作为 reference_video;不能用 reference_video 代替人物与场景资产绑定。
  • 生成每个场景单图、场景四视图和 final_shot 时,调用已锁定风格的专属光线、材质、色彩、空间尺度与物理介质规则。异星生态的局部生物发光不得替换为霓虹效果;其余方向也不得以高饱和紫、粉、洋红或蓝色光污染、全息投影或赛博义体填充画面。
  • 用户选择先预览时,只生成 shot 1,待确认后再生成其余 final_shot。无论逐段还是批量生成,都保持已锁定的空间设计、光源方向、天气或生态介质、人物造型和关键材质。
  • 仅使用当前可用的 Seedance 2.5。若该模型失败,先在同一视频生成路径中按可用模型策略处理;不要擅自切换到不同的生成路径。
5. プロンプト作成

共同写作规则

  • 使用 Markdown 分级标题与固定模块顺序,不使用表格;只输出当前阶段所需内容。所有描述以可见、可听、可执行的镜头信息为准,避免抽象心理判断。
  • 除 Midjourney V7 场景单图的提示词正文必须使用英文外,所有面向用户与生成模型的提示词正文、字段标题和限制语必须用中文书写,不得混入英文提示词句或英文负向词;模型名称、工具名称、元素标识及 <<<image_N>>> 等系统引用占位符除外。Midjourney V7 场景单图仍使用中文字段标题,英文正文不附带负面提示词。
  • 视觉提示词遵循「主体/资产引用 → 场景与空间 → 可见动作与情绪 → 摄影机与构图 → 有来源的光线与物理介质 → 所选风格的色彩与材质 → 约束」顺序。分镜与视频提示词均明确真人写实;不使用创作者、摄影师或已有影片名称作为执行指令,而是将其拆解为可见的空间、光线、构图和材质语言。
  • 「8K」仅可作为高细节电影质感的文字描述,不能覆盖生成工具实际设置的输出分辨率;实际分辨率严格遵从资产和视频生成规则。
  • 除 Midjourney V7 场景单图外,负向约束始终包含:禁止字幕、禁止水印、禁止文字、禁止卡通、禁止动漫、禁止游戏 CG、禁止塑料化 3D 渲染。视频提示词固定包含:无背景音乐、无字幕;不得默认禁止对白。剧情包含 dialogue 时,明确写出角色与逐字台词,并保留角色表演、口型和环境声的生成空间。

风格提示词库与禁区

  • 根据 Final_Video_Spec.md 仅选用一套已确认的风格描述,嵌入场景资产、资产结合式分镜和视频提示词;不要把四套风格全文叠加,避免光源、色彩与材质互相矛盾。
  • 硬核深空探索: 超写实电影质感,硬核太空探索纪实感,照片级真实与高细节。严谨航空工业设计、宇航级机械结构、高反差冷色布光、空间站内部实用点光源、真实物理反射与漫反射;高反光宇航服面料、划痕钛合金、清晰仪表屏幕与符合失重状态的微尘。构图锐利、噪点克制,形成深邃、幽闭、压迫的太空氛围。
  • 史诗太空歌剧: 超写实电影质感,庄严的史诗科幻尺度,照片级真实与高细节。广袤空间、极简主义与粗野主义巨型建筑、电影级明暗对比和异星自然光下的肃穆阴影;风化石材、哑光厚重金属、防沙布料与干燥扬沙。大画幅般的稳定构图、轻微胶片颗粒和高动态范围,形成庄严、静默的史诗感。
  • 废土遗迹科幻: 超写实电影质感,粗粝的废土生存科幻感,照片级真实与高细节。被黄沙和植被吞噬的巨型科技遗迹、刺眼日光漫反射、沙尘中的可见光束与真实粒子;深度锈蚀钢铁、风化机械装甲、磨损皮革、干裂表面。去饱和暖黄、土褐和灰色,高动态范围,呈现苍茫悲壮的末日氛围。
  • 异星有机生态: 超写实电影质感,神秘而危险的异星生态探索感,照片级真实与高细节。有机体建筑、异星植物与真菌群落、湿润环境光、局部柔和且有生物来源的生物发光;黏滑组织、半透明叶脉、反光水滴、角质鳞片、真实折射和适度浅景深。色彩可有层次但饱和度受控,形成生机与未知并存的氛围。
  • 默认超写实科幻电影: 超写实真人电影质感,照片级真实材质细节,可信的做旧布料、金属、皮革、混凝土、尘土、水汽或其他剧情需要的物理介质,有来源的电影级光线、深邃黑位、受控饱和度和清晰叙事空间。
  • 除非用户明确将其作为需规避的参考,所有方向均追加:不以霓虹灯、高饱和紫/粉/洋红/蓝对比色、合成器波发光、全息投影、赛博义体、雨夜街道或无来源的彩色泛光构成未来感。异星生态的生物发光只描述其生物部位、亮度、颜色和照亮范围,禁止泛化为城市霓虹。

人物资产提示词

  • 无参考图的基础人物图采用简洁人物描述:仅用约 30 个汉字,按「人物身份、脸部与发型、肤色、身穿什么上衣、裤子穿什么、头戴什么」的顺序交代外观;不描述鞋子、袜子、腿部、全身动作或全身比例。裤装和头戴物仅用于锁定角色造型,不要求完整入镜。描述后固定追加:「9:16,半身视角,水平正面(正脸)视角,画面裁切至腰部,禁止全身构图,双手自然下垂且仅可在画面下缘局部出现,超写实人像摄影,8K 超高清,电影级柔和光影,真实皮肤质感,干净纯白色背景」。其中「8K 超高清」仅作为画质描述;实际输出分辨率仍按资产生成规则设为 2K。不得加入未来城市、霓虹、复杂场景或额外风格。
  • 有人物参考图时标明「用户已提供参考图,直接引用原图人物主体」,只描述需保留的面部、发型、服装、身形比例等核心特征;不得要求重新设计人物。若用户明确要求生成独立纯白底资产,再以原图为 reference_image,仅移除环境背景并保留人物核心身份特征。
  • 人物四视图无论是否有参考图,都只使用下列固定提示词,不添加任何风格描述:生成一张 16:9 画幅的 4K 超高清角色设计图(四视图),超逼真写实风格,表情自然,背景为纯白色。画面内容必须包含四个特定视角,请严格按照从左往右的顺序依次排列:胸部以上近景、正面全身、全身侧面、背面全身。必须严格确保所有视角下的角色形象、面部特征、服装细节与身体比例保持绝对一致,并与参考图完全契合。排版需专业且均衡,角色主体整体居中,画面构图饱满。整体艺术风格与原图 1 保持完全一致。
  • 道具或其他单体主体资产的提示词必须明确:纯白色干净背景、单一完整主体、完整可见轮廓、真实材质和稳定比例;禁止场景背景、人物、人物痕迹、剧情事件、文字、水印与多余装饰。

场景单图资产提示词

  • 场景单图是生成场景四视图前的确认基准。每个 element scene 先用 Midjourney V7 输出一张横向 16:9 的专业场景设定单图,不使用网格,不罗列多个视角;只呈现一个完整且可供确认的场景画面。Midjourney V7 不设置 resolution 参数。
  • 场景单图的提示词正文必须为一段连贯的英文正向描述,不设置负面提示词或独立约束段;中文仅用于字段标题与对用户说明。按「场景类别与尺度、平视机位、前景/中景/背景、天气或生态介质、氛围、空间结构、建筑/机械/有机/自然材质、可见且合理的光源、已锁定风格」顺序,写出可见、具体的环境信息。画面须清晰展示后续四视图需继承的空间核心、主体位置、比例、材质、色彩、天气、时间段与光源方向。
  • 将已确认风格转换为对应的英文正向视觉描述:深空写明航空工业结构、实用点光源、冷色反射与失重条件;太空歌剧写明巨型极简空间、庄严自然光与风化材质;废土写明侵蚀遗迹、去饱和暖色、日光与沙尘;异星生态写明有机结构、湿润介质和局部生物来源光。不得写入赛博朋克、霓虹、高饱和光污染、全息投影或赛博义体等词汇与视觉信号。
  • 以正向英文描述将单图定义为无人、静止且完整的场景环境,专注于建筑、自然地貌、陈设、光线和物理介质;不要在该提示词中另设负面提示词、禁止项或中文句子。

场景四视图资产提示词

  • 仅在用户确认场景单图后,为每个 element scene 输出横向 16:9、4K 的专业场景设定图,以干净的 2 行 2 列网格整齐四等分;每一格都是独立的 16:9 横向大全景画面。提示词必须明确以已确认的场景单图作为主要 reference_image,四格继承其空间结构、主体位置、材质、天气、时间、所选风格的色彩与光源方向;有用户场景参考图时,同时保留其不可变更的核心特征。
  • 先写明场景类别、尺度、平视机位、前景/中景/背景、天气或生态介质、氛围、空间结构、建筑/机械/有机/自然材质,以及可见且合理的光源;视觉风格继承本片已锁定的未来科幻方向,不擅自替换为其他题材、赛博朋克或高饱和霓虹风格。
  • 四格必须展示同一地点的四个连续视角,并按固定顺序描述:1 为正面中心线大全景,镜头正对场景核心轴线,严格居中与对称,尽量同时呈现顶面、地面、完整空间层次、环境细节与深景深;2 以视图 1 的中心线为基准,摄像机位于场景左前方 45 度,仍对准核心区域;3 以相同中心线为基准,摄像机位于右前方 45 度,仍对准核心区域;4 从场景可进入的最深处或后侧沿中心轴向外拍摄。对于纯室外、无可进入内部的自然景观,视图 4 改为从场景远端向前景回望的中心大全景。
  • 明确约束四格为同一时间、同一天气或生态状态、同一光源方向、同一空间结构、同一主体位置、同一比例、同一材质、同一色彩与同一美术风格;它们是同一 element scene 的连续空间说明,绝不可生成四个不同场景。环境清晰、细节丰富、景深较深、光影自然、镜头稳定;正面图保持中心线构图与对称,两个 45 度视图及纵深/反向视图保持空间连贯和比例一致。
  • 场景必须为空场景:不得出现人物、人群、背影、剪影、人脸、肢体、人物倒影、人物影子、照片人物、屏幕人物、镜中人物、剧情事件或人物活动。负向约束额外包含:禁止倾斜构图、禁止透视畸变、禁止广角畸变、禁止变形、禁止扭曲、禁止鱼眼视角、禁止极端俯视、禁止极端仰视、禁止模糊、禁止浅景深、禁止边框、禁止标签、禁止界面元素、禁止杂乱元素。

分镜草稿图提示词

  • 分镜草稿图使用固定结构:按照下面的剧情脚本,生成分镜图,采用至少 2×2 的网格分镜布局;默认使用 2×2 网格、共 4 个独立的 16:9 画格。若该段需要蒙太奇式的更多内部切分,则使用 3×2 网格、共 6 个独立的 4:3 画格。画面不要出现对白字幕。剧情:…… 风格要求:实际故事板绘图必须仅为黑白,粗糙的铅笔线条、最小细节、快速手势绘图能量感、简单的解剖结构构建以及强烈的轮廓可读性。保持影视作品轻量、动态且未完成的质感,就像早期的分镜手绘预览。图中标明分镜序号。

资产结合式分镜与视频提示词

  • 资产结合式分镜按固定结构输出:分镜 N:【Xs–Ys】段落主题、剧情:、统一风格与质感:。剧情必须严格复刻已确认段落的事件,并写明人物与场景资产、环境、光影、动作、情绪、关键事件、特效与段尾衔接;不把一段拆为多个分镜。
  • 视频提示词按固定结构输出:总时长:n 秒、无背景音乐、无字幕、人物/场景引用:<<<image_1>>>……、统一风格与质感:……、剧情:……、约束:杜绝游戏 CG 质感、杜绝动漫风格、杜绝 3D 渲染感。不得加入「无对白」或等效限制;剧情有 dialogue 时,在剧情字段明确写出角色与逐字台词。若使用分镜草稿图,在引用行注明其为分镜图参考,并按画格顺序执行,但仍以人物与已确认的场景四视图 reference_image 维持身份和空间一致性。
  • 每个段落仅写入所选风格允许的一套光线、色彩、空间与材质规则:深空的冷色工业光、太空歌剧的庄严自然光与巨构、废土的去饱和日光与侵蚀、异星生态的湿润介质与局部生物来源光,或用户确认的自定义规则。仅在镜头实际可见时才描述光束、反射、扬沙、失重微尘、漂浮物或生物发光;不以赛博朋克视觉替代叙事。
6. 動画編集

段落级剪辑与统一调色

  • 每个剧情段落对应一个 final_shot,按已确认时间轴顺序装配;不得把段内 3–4 秒节拍拆成额外视频段落。保留段落末尾与下一段开头的动作、视线、光源、色彩或环境介质衔接。
  • 节奏以开场 3 秒的悬念与中近景人物信息为优先;宏大空间镜头只在建立深空尺度、巨构压迫、废墟孤立或异星生态未知感时使用。转场以直接切换、动作匹配、光线延续或短暂环境声桥为主,避免无叙事动机的快速特效。
  • 调色和声音氛围严格匹配已锁定风格:深空保持冷静、低噪、受控高反差与机械环境声;太空歌剧保持庄严阴影、低饱和巨构尺度与肃穆声场;废土保持去饱和暖黄、尘土连续性与粗粝风声;异星生态保持湿润反射、局部生物来源光与有机环境声。默认或自定义风格按已确认的全局规则执行。
  • 禁止在后期额外加入霓虹紫、粉、洋红或高饱和蓝色光污染、全息界面式特效、赛博义体视觉或雨夜街头氛围,以免将所选未来科幻方向误剪为赛博朋克。
  • 视频生成内含的音乐不作为剪辑依据;若有独立 audio_layer,以其情绪和节奏服务叙事,压低或避开与对白、环境声冲突的层次。