LEGO-style short
스튜디오 초안을 준비합니다. 여러 단계의 지침은 참고용이며 자동 생성이나 과금은 하지 않습니다.
适用于 LEGO Minifigure 风格动画短片创作。将用户创意(一句话/故事梗概/完整剧本)转化为可执行的完整动画方案,使用 GPT Image 2 生成角色与场景 key element 图像,Seedance 2.5(分辨率 480p) 生成镜头视频,支持多里程碑确认流程。
제작 흐름 본문은 중국어 원문입니다. 언급된 모델과 이 사이트의 지원 모델은 다를 수 있습니다. 실제 모델과 크레딧은 스튜디오에서 확인하세요.
전체 제작 흐름
1. 제작 기획
工作流阶段与里程碑确认:
- 分析用户输入(主题、角色、场景、冲突、情绪、目标受众),通过 reply_to_user 向用户呈现分析摘要,等待确认后继续。
- 生成剧本(Logline:主角 + 目标 + 阻碍 + 风险;三幕式结构:建立问题 → 冲突升级 → 高潮与结局),通过 reply_to_user 展示,等待确认。
- 建立 Final_Video_Spec.md(片名、时长意图、画幅比例、风格锁定为"LEGO Minifigure 动画"、对白语言)→ text_editor。
- 设计故事板(key elements:角色 + 场景;镜头列表;音频层)→ storyboard_designer;完成后展示,等待确认。
- 扫描当前上下文中用户已提供的素材(图像、音频等),通过 media_generator 将匹配素材绑定到对应 Storyboard 槽位;对尚无素材的 key element,生成角色参考图与场景参考图 → media_generator;完成后展示,等待确认。
- 逐镜头生成视频 → media_generator;完成后展示,等待确认。
- 生成所有音频层(对白旁白 / BGM)→ media_generator;完成后展示,等待确认。
- 最终剪辑合成 → video_assembler。
依赖关系: 3→1,2;4→3;5→4;6→5;7→4;8→5,6,7。
里程碑确认规则: 每个主要阶段完成后必须暂停,向用户展示成果并等待确认,不得自动连续执行完整流程。
2. 멀티모달 분석
若用户提供参考素材,分析并提取以下信息供后续阶段使用:
- 文字素材(剧本、故事大纲):提取主题、角色列表及外观描述、主要场景、冲突节点、情绪曲线。
- 图像素材(角色参考图、场景概念图):提取角色造型特征(发型、服装配色、配件)、场景构成要素,确保后续 key element 描述与之一致,不得矛盾。
输出结构化文字摘要,供 Storyboard Designer 和 Media Generator 使用。
3. 스토리보드 설계
Key Element 设计规则:
- 角色(element character): 必须使用 LEGO Minifigure 比例与风格;禁止真人、写实或 Anime 比例角色。每个角色详细记录:发型颜色与款式、服装配色与图案、配件、面部印刷细节,确保跨镜头外观一致。若角色在剧情中存在多个造型(如时间跨度、变装),逐一列出各造型描述。
- 场景(element scene): 所有场景元素(建筑、道路、家具、车辆、树木、水体)必须符合 LEGO 积木搭建逻辑,使用积木几何造型,避免有机曲线结构。标注场景中关键道具或动作发生区域的位置关系。
Shot 设计规则:
- 将镜头组织为 Sequence(序列)→ Shot Group(镜头组)→ Shot(单镜头)三层结构。每个 Shot Group 时长 8–30 秒,含 6–16 个镜头,围绕一个剧情目标展开。
- 每个 Shot 必须包含:
- 景别: ECU / CU / MCU / MS / MLS / LS / ELS
- 运镜: Static / Push In / Pull Out / Pan / Tilt / Tracking / Orbit / Handheld
- 角色动作: 仅可视化动作(如"拿起咖啡杯"、"转头看向电脑");禁止不可视化描述(如"陷入思考"、"感到痛苦")
- 对白(dialogue): 写出角色的完整台词原文
- 音效标注: 环境音、动作音、转场音
- 镜头语言服务剧情逻辑,避免无叙事目的的炫技运镜。
- 禁止在镜头描述中设计任何画面内字幕或浮现文字(如"画面中心浮现大字:……");字幕处理统一交由后期合成阶段负责,不在 Shot 层级规划。
音频层(Audio Layers)设计:
- BGM: 全片至少一条 BGM 轨道,标注音乐风格、情绪、节奏及起止区间;若片中有明显情绪转折点,可分段设计多条 BGM 轨。
- 环境音 / 动作音效: 在对应 Shot 的音效字段标注(如积木碰撞声、脚步声、城市环境音)。
- 旁白 VO(可选): 若有旁白驱动叙事,设计为独立 audio_layer(type: narration),记录 narration_speaker_profile(如"[沉稳男声,叙述语气]")及完整脚本,并标注对应镜头区间。
4. 미디어 생성
Key Element 图像生成:
- 使用 TextToImage,推荐模型 GPT Image 2,分辨率 2K。
- 角色参考图:每个角色生成一张横版拼排的 character turnaround sheet,包含正面、侧面、背面、表情图。
- 场景参考图:根据剧情需要输出白天版、夜晚版及关键动作版。
- 若用户已上传角色或场景素材,直接注册 asset_id 并绑定到对应 key element,不重复生成。
镜头视频生成:
- 使用 MultiModalToVideo,推荐模型 Seedance 2.5,分辨率 480p,单次生成时长不超过 30s。
- 每个 Shot 的参考输入:
- 该镜头涉及的所有角色 element 图像 + 场景 element 图像(必须)。
- 前一 Shot 视频作为 reference_video(可选,仅当与前镜头连续性极强时使用,通常跳过)。
音频生成:
- 对白 / 旁白(narration):使用 text to narration,推荐模型 MiniMax Speech 2.8 HD;若有 key_element_audio 绑定,用于保持角色音色一致。
- BGM:使用 text_to_instrumental,推荐模型 Suno 5(提示词中避免出现知名艺术家名字)。
5. 프롬프트 작성
图像提示词(TextToImage — GPT Image 2):
角色参考图(turnaround sheet)模板:
LEGO Minifigure, official LEGO style, ABS plastic material, movie quality, character turnaround sheet, front view / side view / back view / expression sheet, studio lighting, high detail, [角色外观:发型颜色与款式、服装配色与图案、配件、面部印刷细节]
场景参考图模板:
LEGO environment, brick-built architecture, cinematic lighting, movie quality, high detail, official LEGO style, [景别], [时段:daytime / night / golden hour], [场景构成描述:建筑布局、道路、关键道具位置]
- 所有描述限于镜头可见内容;禁止心理状态或叙事意图类词汇。
- 角色图优先锁定跨镜头一致的外观细节(发型、服装颜色、配件),避免画面内出现无关文字。
视频提示词(MultiModalToVideo — Seedance 2.5(分辨率 480p)):
提示词结构:主体描述 → 动作节拍(叙事顺序) → 场景与环境 → 景别 + 运镜 → 光效 → LEGO 风格锚定
- 使用占位符 <<<image_1>>>, <<<image_2>>>, … 绑定角色与场景参考图,并说明各图对应角色/场景。
- 动作描述具体到肢体部位与幅度,按叙事时序列出多个动作节拍;不使用"0–3s / 3–6s"等绝对时间分割。
- 对白使用 {台词原文} 标记,音效使用 <音效描述> 标记(Seedance 2.5 格式)。
- 固定 negative 标注:no subtitles;若该 Shot 有独立旁白轨,加 no music。