Cinematic food short
스튜디오 초안을 준비합니다. 여러 단계의 지침은 참고용이며 자동 생성이나 과금은 하지 않습니다.
适用于美食主题的视频创作,使用模型:Nano Banana 2 + Seedance 2.5(分辨率 480p)
제작 흐름 본문은 중국어 원문입니다. 언급된 모델과 이 사이트의 지원 모델은 다를 수 있습니다. 실제 모델과 크레딧은 스튜디오에서 확인하세요.
전체 제작 흐름
1. 제작 기획
执行导演统筹协议:
核心原则: 极致还原“舌尖上的中国”视听风格。允许不上传图片(若无图,则基于文字描述生成视觉基因)。
- 视觉基因解构 (Food DNA Analysis):调用 multimodal_analyze_tool。解析/反推美食美学规范(色泽、纹理、烟火气、明暗比 6:3:1)以及物理交互潜力。如果有上传的图片,则注册一个资产 - media_generator。
- 创意挖掘与剧情概括:提供 3 个一句话剧情方向(如:食材溯源风、极致烹饪细节风、人文情感故事风),引导用户确定方案。
- 全局分镜成表 (Global Storyboard Table):根据方案设计每 30s 一个分镜。
- 分镜内节奏节奏逻辑:前 3s 一个视觉重点(食材微距/热气升腾),后 7s 一个高潮(油脂迸发/慢动作入水)。
- 强制暂停点 1:必须先输出详细的分镜表(每表 1000 字,含 10-24 个镜头),并将分镜内容输入到 reply_to_user 的 json 与用户确认,暂停并等待用户确认。
- 编写 Final_Video_Spec.md:标题、类型、比例(16:9 或 9:16)、时长、模型偏好(Seedance 2.5(分辨率 480p))。→ text_editor。
- 分镜注册与资产匹配 (Storyboard & Asset Registration):将确认的分镜表完整注册为故事板镜头(Shot)。
- 资产生成 (Asset Generation):根据分镜生成食材、厨具、环境的 2K 图像,并生成旁白声纹参考。→ media_generator。
- 强制暂停点 2(新增):资产生成完成后(展示生成的食材/场景图及声纹),必须强制停止,等待用户确认资产满意后,方可回复“开启视频生成”。
- 提示词构建 (Prompt Engineering):严格按【万能公式】生成视频提示词,确保 10-24 个镜头逻辑完整融入。→ write_the_prompt。
- Seedance 2.5 动力生成**:调用 MultiModalToVideo,参考注册资产生成视频,分辨率 480p。
- 时间线合成 (Timeline Integration):调用 video_assembler。打开视频轨音量,实时对齐旁白。
依赖关系: 2→1; 3→2; 5→3; 6→5; 7→6; 8→7; 9→8。
2. 멀티모달 분석
- 食材逆向工程:分析食材的物理属性(成熟度、油脂比例、组织纤维、水分张力)。
- 烟火气潜力分析:评估热气、雾气、溅射液体、明火、火花的动态轨迹及光影折射逻辑。
- 色彩控制铁律:锁定“舌尖风”色调——温暖、深邃、有机。主色(食材本色)、辅色(环境灰/木色)、强调色(光源暖黄色)。
- 输出要求:输出 1000 词以上的 JSON,包含 material_reconstruction(针对肉类、果蔬、液体的 PBR 描述)和 technique_reconstruction(微距摄影、慢动作拍摄规格)。
3. 스토리보드 설계
**1. 节奏与情绪控场:**每个分镜30s,其中包括
- 前3s 视觉重点:如食材切开的横截面特写、调料落入锅中的瞬间、热气在镜头前滑过的折射。
- 后7s 叙事高潮:大范围摇臂运镜展现丰收/盛宴全景、食物在慢动作下发生物理形变(如爆浆、热气喷薄)、角色品尝时的微表情特写。
2. 格式与无缝转场:
- 字数要求:每 30s 分镜表约 1000 字,包含 10-24 个切镜。
- 转场严禁:严禁黑白场/叠化。必须使用动势匹配(如:勺子搅动的旋转动势衔接盘子摆动的动势)或物理遮挡(如:升腾的烟雾遮住镜头切换至下一场景)。
- 禁语词库:禁用:破裂、分割、破碎、裂缝、切割、爆破、碎片(除非是描述自然的食材处理,如切片,但动作需轻柔流畅)。
3. 音频规划:
- 人文旁白:在 audio_layers 中设计厚重、缓慢、磁性的男声配音。
- 物理音效:精准标注<滋滋声>;<清脆切菜声>;<咕嘟沸腾声>;。
4. 미디어 생성
-
食材资产 (Element Asset):
- 使用 TextToImage 或 ImageToImage 生成 2K 食材/菜品图。
- 视觉要求:极致的食欲感。光影必须有层次,阴影处细节丰富,高光处有湿润感。
- 模型:Nano Banana 2。
-
视频生成 (MultiModalToVideo):
- 模型:Seedance 2.5(分辨率 480p)。
- 核心执行:将 30s 的分镜表视为一个连续任务。提示词必须涵盖从微距到中景的连贯运动,严禁出现动作中断或抽搐。
- 动态一致性:食材在 30s 内的状态变化必须符合物理规律(如:蔬菜从生变熟的色泽变化)。
5. 프롬프트 작성
核心美术提示词铁律:
语言:全中文描述 + 英文物理参数。
- 结构化公式:[镜头编号/景别] + [运镜术语] + [食材动态细节/物理反馈] + [烟火气/环境交互] + [视听节奏点]。
- 美食美学参数:
- Lighting: Backlighting for steam (逆光热气), Subsurface scattering for meat (肉类次表面散射), Warmer color temperature (暖色温).
- Texture: High gloss grease (高亮油脂), Crispy texture detail (酥脆纹理), Organic micro-details (有机微观细节).
- 转场指令:明确标注 “从[镜头A]通过[烟雾遮挡/动势跟随]无缝衔接至[镜头B]”。
- 负向约束:no plastic look, no artificial light, no text, no logo.
6. 동영상 조립
- 强制质检:确保 30s 内的 5-12 个微镜头逻辑连贯。
- 音视频对齐:开启视频轨音量。将视频中的物理音效点与画面动作严丝合缝对齐。
- 色彩校验:确保全片风格呈现“舌尖风”人文暖调。