Christopher Nolan-inspired film
Prepare a studio draft. Multi-stage instructions are references; this does not run or charge for generation.
适用于非线性叙事、双时间线或多时间层结构的故事短片创作。以诺兰导演风格为核心,覆盖叙事结构设计、视觉圣经、角色系统、分镜生成、视频合成全流程,使用 Seedance 2.5(分辨率 480p) 生成镜头视频。
Workflow text is preserved in its original Chinese. Referenced models may differ from those available here. Check the studio for supported models and actual credit quotes.
Complete workflow
1. Planning
创作流程
第一阶段
故事解析
提取:主角、核心目标、核心冲突、时间结构、关键道具。
完成后暂停确认。
第二阶段
时间结构设计
自动选择:A-线性叙事、B-双时间线、C-三时间线、D-倒叙结构、E-莫比乌斯结构(结尾回到开头)。
完成后暂停确认。
第三阶段
视觉圣经生成
定义:建筑风格、光影规则、色彩系统、镜头系统、服装系统。
完成后暂停确认。
第四阶段
角色设计
每个角色生成:身份、缺陷、恐惧、执念、谎言、真相。
将片名、时长、画幅、年代、语言、主要角色、视觉风格、主要故事写入Final_Video_Spec.md。
完成后暂停确认。
第五阶段
关键画面生成 -> storyboard_designer 后接 media_generator
包括:角色图、场景图、关键道具、叙事符号等 key elements;
完成后暂停确认。
第六阶段
分镜设计 -> storyboard_designer
生成完整镜头表。
如果分镜中写入对白,必须标明说话者、对白原文、声音来源和所属镜头;不要只把对白写进画面描述。
完成后暂停确认。
第七阶段
视频生成 -> media_generator
必须用户确认后执行。
第八阶段
旁白 -> media_generator
诺兰式纪录片式口吻。
第九阶段
音效 -> media_generator
实景化设计。
第十阶段
音乐 -> media_generator
汉斯季默方向。
第十一阶段
成片合成 -> video_assembler
2. Multimodal analysis
对参考素材做诺兰式归纳,重点判断它适合承担哪类功能:信息、线索、真相、情感执念、空间压迫或时间连接媒介。
3. Storyboard design
色彩系统
现实层
冷灰、钢蓝、黑色、混凝土色。
记忆层
暖黄、琥珀、褪色棕。
危机层
深蓝、黑色、高反差。
真相层
纯白、强光、极简色彩。
场景设计规则
优先场景:地铁、高楼、停车场、酒店、仓库、机场、办公楼、隧道、桥梁、废弃工业区、太空舱、实验室、发射基地、档案室、雷达站。
避免:魔幻森林、二次元空间、夸张幻想世界。
道具系统
每个核心道具必须承担剧情功能(例如:手表、钥匙、录音机、日记本、戒指、照片、子弹、文件夹、电波记录、发射图纸、宇航服部件)。
规则:第一次出现是信息,第二次出现是线索,第三次出现是真相。
构图系统
建筑压迫
人物很小,建筑巨大,体现命运感。
中央孤立
人物位于中心,周围留白,体现孤独。
几何秩序
重复结构:走廊、楼梯、桥梁、隧道、舱门、控制台、天线阵列。
信息隐藏
前景、中景、背景同时存在信息。
镜头系统
N-01
静止观察:角色自行进入画面。
N-02
长焦推进:逐渐逼近真相。
N-03
IMAX广角建立:强调空间规模。
N-04
圆周运动:体现认知变化。
N-05
时间切换:相同构图,不同时间。
N-06
交叉剪辑:多时间线并行。
N-07
时间膨胀:慢动作,情绪高潮。
N-08
主观意识镜头:记忆、梦境、幻觉。
旁白风格
简洁、冷静、哲学化。
示例:“人们总以为时间在向前走。”、“事实上,改变我们的往往不是时间。”、“而是某个被忽略的决定。”
音乐风格
参考:汉斯·季默、《星际穿越》、《盗梦空间》、《信条》。
特征:持续低频、钟表节奏、管风琴、弦乐推进、逐层堆叠。
禁止抒情歌曲,禁止流行音乐。
结尾规则
诺兰式结尾必须满足其一:真相反转、身份反转、时间反转、认知反转、开头结尾闭环。观众离开后仍持续思考,而不是立即获得答案。
4. Media generation
人物形象图:同一角色跨年龄、跨时间线出现时,先生成一张主身份参考图;后续年龄版本或状态变化版本优先使用已确认角色图作为 identity reference / ImageToImage 参考,不要用独立 TextToImage 重新发明面孔。
final_shot 视频:优先使用 **MultiModalToVideo + Seedance 2.5(分辨率 480p),依据最新 Storyboard、key elements、角色/场景/道具参考图生成镜头视频。
旁白与对白:优先使用 MiniMax 生成独立音频资产,并绑定到 Storyboard 中对应的旁白轨道、对白轨道或具体镜头。
音乐:优先使用 Suno 生成背景音乐。
依据最新 Storyboard 生成镜头视频。每个镜头优先绑定对应角色、场景、关键道具和叙事符号,保持双线或多线叙事中的空间、年代、服装和道具连续性。
5. Prompt writing
图片 Prompt 规则(TextToImage / ImageToImage)
写法原则: 用导演视角简洁描述画面——主体 + 场景环境 + 光影色调 + 构图语言,一段连贯自然语言,不加分节标题。只写镜头可见的内容,不写动机或背景故事。
诺兰式构图词汇(按需选用):
- 建筑压迫:tiny figure dwarfed by brutalist concrete structure, fate-laden scale
- 中央孤立:subject centered, vast negative space on both sides, existential isolation
- 几何秩序:repeating corridor / stairwell / tunnel / antenna array perspective, geometric symmetry
- 信息分层:foreground detail, midground action, background clue, all in focus
色调锚定(对应 Storyboard 色彩系统):
- 现实层:cold grey, steel blue, concrete texture, desaturated
- 记忆层:warm amber, faded sepia, soft halation
- 危机层:deep navy, crushed blacks, high contrast
- 真相层:overexposed white, minimal palette, clinical light
key_element 角色图固定格式: 生成横向双联排——左:紧凑胸像(面孔、肤色、发线锁定);右:全身(服装、配件、姿态)。例:side-by-side reference sheet, left: tight shoulder portrait, right: full body, same lighting, white neutral background
负向词(角色/场景图通用): no fantasy elements, no cartoon, no neon colors, no lens flare, no watermark, no text overlay
视频 Prompt 规则(MultiModalToVideo / Seedance 2.5(分辨率 480p))
参考图占位: 每个角色/场景/道具用 <<<image_1>>>、<<<image_2>>> 等按序绑定,在 prompt 开头声明对应关系,例:<<<image_1>>> is [角色名], <<<image_2>>> is [场景名]。
运动堆叠顺序(固定结构):
镜头运动 → 主体动作(含表情/肢体节拍) → 空间/环境变化 → 音频注解
诺兰镜头语言映射(对照 Storyboard 镜头系统):
- N-01 静止观察:static locked-off camera, subject enters frame from left/right
- N-02 长焦推进:slow telephoto push-in, subject gradually fills frame
- N-03 IMAX 广角建立:ultra-wide establishing shot, expansive architectural scale
- N-04 圆周运动:slow 360-degree orbit around subject, shifting perspective
- N-05 时间切换:same framing, lighting shifts from warm amber to cold grey
- N-07 时间膨胀:extreme slow motion, heightened emotional intensity
- N-08 主观意识:subjective POV, soft focus edges, memory-like quality
6. Video assembly
轨道优先级
对白 > 旁白 > SFX > BGM。混音决策以此顺序让位:低优先级轨道不得遮蔽高优先级轨道的清晰度。
对白轨
- 默认打开 final_shot 的视频原声;若同一帧已有独立对白音频资产,优先使用后者,关闭对应 final_shot 原声,避免重复叠加。
- 对白区间(前后各扩展 0.2s 保护区)内,SFX 轨整体压低至 −12 dB;BGM 轨压低至 −18 dB;对白结束后 0.5s 内平滑恢复原电平。
旁白轨(VO)
- 旁白与对白同帧时:旁白轨压低至 −8 dB,对白优先;对白结束后旁白恢复正常电平,过渡时间 0.3s。
- 旁白与 BGM 同时出现时:BGM 压低至 −14 dB,旁白结束后 1s 内平滑恢复。
- 旁白淡入 / 淡出:默认 0.5s,用于段落衔接,避免硬切。
SFX 轨
- SFX 为实景化设计,服务于空间感与节奏感,不做情绪渲染。
- 非对白区间内,SFX 电平参考 BGM 上方 +3 dB 以保持存在感,但不超过 −6 dBFS。
- 同帧存在多个 SFX 层时,只保留叙事功能最强的一层为主 SFX,其余侧 SFX 压低 6 dB。
BGM 轨
- 汉斯·季默方向:低频持续、逐层堆叠;BGM 整体基准电平 −20 dB,高潮段可升至 −14 dB,但对白 / 旁白保护区内必须退回基准。
- 场景切换处优先用 BGM 节奏点对齐剪辑点,强化时间感。
- 片尾:BGM 淡出时长不少于 3s,与画面黑场同步收尾。
整体节奏
- 剪辑点默认对齐 BGM 节拍或旁白停顿;危机层镜头可短于 3s,其余镜头建议 5–12s 以维持诺兰式沉浸节奏。
- 多时间线交叉段落(N-06 交叉剪辑)中,音效和 BGM 跟随画面时间线切换,不跨线混用同一 SFX 资产。