yeha.ai
목록으로

Twelve-shot jewelry advertising vlog

스튜디오 초안을 준비합니다. 여러 단계의 지침은 참고용이며 자동 생성이나 과금은 하지 않습니다.

输入模特/首饰/环境/品牌参考图,按固定12镜头叙事逻辑,自动生成一支影视风格首饰广告短视频。

제작 흐름 본문은 중국어 원문입니다. 언급된 모델과 이 사이트의 지원 모델은 다를 수 있습니다. 실제 모델과 크레딧은 스튜디오에서 확인하세요.

전체 제작 흐름

1. 제작 기획

[planner]* 启动时必须询问用户(在执行任何步骤前):*

*"请问您希望输出的视频比例是?
A. 9:16 竖屏(适合小红书/抖音/Reels)
B. 16:9 横屏(适合YouTube/品牌官网)"
等待用户回答后,将比例写入 Final_Video_Spec.md,全流程沿用。

输入说明:

用户可上传1至多张参考图,按以下类别分组。未提供某类别时,对应元素由AI根据
已有参考图风格自行推断生成。
类别标签说明[Character_Input]模特参考图(可多张,含不同角度/造型)[Jewelry_Input]首饰参考图(可多张,含细节/佩戴状态)[Environment_Input]环境参考图(可多张,含建筑/街景/室内)[Brand_Input]品牌参考图(可多张,含logo/slogan/视觉调性)

流程步骤:

  1. 询问用户以下两项配置,写入 Final_Video_Spec.md → text_editor

    ① 视频比例:
    A. 9:16 竖屏(适合小红书/抖音/Reels)
    B. 16:9 横屏(适合YouTube/品牌官网)
    ② 每个镜头生成的候选视频数量:
    A. 按照Skill原有设定,每个镜头生成 3个候选版本(生成后逐镜筛选,效果最优,积分消耗较多)
    B. 每个镜头生成 1个版本(节约积分,生成速度快)
    将选择写入 Final_Video_Spec.md,字段:shot_candidates(值为 3 或 1)

  2. 分类分析所有输入图,提取各类别的视觉特征 → multimodal_analyze_tool
    • 环境条件判断*:若未检测到 [Environment_Input],立即询问:*

      "未检测到环境参考图。请选择环境设计方式:
      A. 我来描述:请输入您的环境风格需求(风格/城市/光线/色调等)
      B. Flova自动设计:基于角色与首饰参考图自动推断并扩展环境"
      等待用户回应,将结果写入 Final_Video_Spec.md 作为 [Environment_Ref] 来源

  3. 按固定12镜头叙事逻辑生成故事板,所有内容从输入图提取,不套用固定场景描述
    storyboard_designer
    • 若已提供 [Brand_Input],同步询问013镜头背景方案(三选一):

      A. 纯黑背景 + logo居中
      B. 品牌色调低饱和纯色背景(推荐高级感)
      C. 由Flova设计带logo的创意收尾帧
      将选择写入 Final_Video_Spec.md

    • ⏸ 暂停,等待用户确认故事板及013方案(若适用)
  4. Elements图像生成(角色三视图 + 首饰细节图 + 环境参考渲染图)→ media_generator
    • ⏸ 暂停,等待用户确认角色、首饰与环境元素还原度
  5. A类关键帧图像生成(每个A类镜头,参考步骤4 elements图)→ media_generator
    • ⏸ 暂停,等待用户确认
  6. A类镜头视频生成(每个A类镜头1/3个候选版本)→ media_generator
  7. B类镜头图像+视频生成(006/007/008,基于步骤4环境elements;含013若适用)→ media_generator
    • 条件性暂停:若 shot_candidates = 3,暂停并等待用户逐镜头筛选( 引导用户点赞)所有候选版本(A类+B类+013);若 shot_candidates = 1,直接进入下一步,无需筛选。
  8. 背景音乐生成 → media_generator
  9. 最终剪辑合成 → video_assembler

依赖关系: 1优先;2→1;3→2;4→3;5→4;6→5;7→4,3;8→3;9→6,7,8
注: 用户已提供某类别图片时,直接绑定为该类别参考;未提供时由AI基于已有参考推断。

未提供 [Brand_Input] 时,013镜头自动跳过,不进入故事板与生成流程。*

2. 멀티모달 분석

输入图分类分析规范

对用户上传的每一类参考图分别进行分析。严禁主观解读或美化,只做客观特征提取。
提取结果作为后续所有分区的内容依据。

[Character_Input] · 人物特征提取

  • 面部:脸型、五官比例、眼型、唇色、妆容风格
  • 发型:长度、颜色(自然光下)、质感(直/波浪/卷)、发际线
  • 肤色:色阶描述(冷白/米白/小麦/深色)
  • 体型:肩宽、颈部比例、整体身型
  • 服装(如图中可见):颜色、款式、面料质感
  • 多张图时:提取共同特征,记录不同造型差异(如 Look 1 / Look 2)

[Jewelry_Input] · 首饰特征提取

  • 种类:项链/耳环/戒指/手链/其他
  • 主体形态:吊坠/主石形状、尺寸(相对人体比例估算)
  • 材质:金属色泽(银/黄金/玫瑰金)、表面工艺(镜面/磨砂/镶嵌/雕刻)
  • 链条/结构:链型、链长、搭扣细节
  • 佩戴状态(如有):位置、与服装/肤色的搭配关系
  • 多张图时:提取不同角度下的细节,建立完整的首饰视觉档案

[Environment_Input] · 环境视觉语言提取

  • 建筑风格:现代/复古/工业/热带/极简/其他
  • 空间类型:室外街道/室内商业/自然户外/混合
  • 色彩基调:主色调、光线色温(暖/冷/中性)
  • 光线特征:直射日光/漫射光/内透光/背光
  • 纵深感:空间是否有明显纵深层次(前景/中景/背景关系)
  • 可识别元素:路牌、植物、材质纹理、窗框、地面细节等
  • 多张图时:归纳共同视觉调性,记录可用于不同镜头类型的场景特征

[Brand_Input] · 品牌视觉提取

  • 品牌名称/Slogan 文字(精确提取,不可改写)
  • Logo形态与色彩
  • 品牌色系
  • 整体调性关键词(奢华/轻奢/自然/极简/等)
  • 可用于环境镜头的品牌视觉元素(橱窗/包装/标识牌等)

输出格式:按四类分别输出结构化文本,每项单独一行。
未提供某类别时,注明"未提供,后续由AI根据已有参考推断"。

3. 스토리보드 설계

## 固定12镜头叙事逻辑模板
核心原则: 本模板只规定每个镜头的景别、叙事位置、情绪功能和影像技法。
所有内容(人物外形、首饰款式、环境风貌、品牌元素)均从输入图提取,
不套用固定的场景、服装或道具描述。

关键元素定义

分析完输入图后,按以下格式定义本次项目的关键元素:
[Character_Main]

来源:[Character_Input]
提取内容:面部特征、发型、肤色、体型、造型(若有多套造型,注明 Look 1/Look 2)

**[Jewelry_Hero]

来源:[Jewelry_Input]
提取内容:首饰完整视觉档案(形态、材质、细节、佩戴状态)

**[Environment_Ref]

来源:[Environment_Input]
提取内容:本次项目的环境基调、光线特征、可用场景层次

**[Brand_Ref]

来源:[Brand_Input](若未提供则为空)
提取内容:品牌文字、Logo、品牌视觉元素*

12镜头列表

叙事结构:局部悬念 → 人物建立 → 情绪爆发 → 呼吸转场 → 再现收束 → 离场
001 — ECU · 首饰局部特写(A类)
景别:极近景,身体局部(锁骨/手/耳颈)。面部上半(眼睛、额头)不入画。根据首饰类型,面部仅出现一小部分。例如,对于项链,聚焦于面部下半部分至胸口区域。
内容:[Jewelry_Hero] 作为画面核心,[Character_Main] 身体局部入画提供皮肤/服装质感
构图:角色面部朝向:完全侧脸(Full Profile)。身体角度:四分之三转体(Three-Quarter) 躯干相对于镜头有约四分之三的旋转偏折,整体略微侧向/背离镜头,与侧脸方向一致,形成从面部到胸口的流畅斜线构图。当首饰是戒指、手镯这些类型时,仅展现手部。
运动:镜头以首饰挂坠为中心支点,沿弧形轨迹缓慢横向移动,模拟摄影师手持相机围绕主体做弧线位移。整体运动幅度克制,属于「微环绕」,非大角度旋转。景深保持稳定:运动过程中主体(项链挂坠)始终维持对焦,浅景深背景持续虚化。
功能:感官引入,悬念建立,产品首次曝光
提取依据:首饰形态与佩戴方式来自 [Jewelry_Input]
002 — MS · 环境站姿(A类)
景别:中景,腰部以上,半身。角色面部:四分之三侧面(3/4 Profile),脸朝向画面一侧,非完全正脸也非全侧脸,介于两者之间,表情自然。身体躯干基本正对镜头,与面部朝向形成轻微扭转感,姿态放松自然。
内容:[Character_Main] 在 [Environment_Ref] 对应的环境氛围中自然站立或行走,
[Jewelry_Hero] 可见但非焦点,人物与环境形成真实共存感。
构图:角色位于画面一侧,不居中。环境沿着透视汇聚线(Leading Lines)向画面纵深延伸,赋予画面强烈的空间纵深感。浅景深,角色清晰,远端背景轻微虚化。首饰清晰可见,视觉层次分明。
光线:环境侧光从画面一侧上方打入,在角色发丝与肩部形成柔和的轮廓光。环境光影层次丰富,整体氛围有质感。
运动:镜头以平稳、匀速的方式运动。当角色向镜头方向走来(向前行走),镜头同步向后退让,两者速度基本匹配。角色前进速度与镜头后退速度接近平衡,画面景别在整个片段中维持在中景(MS)→ 中近景(MCU) 的相对稳定区间。
功能:人物与场景建立
提取依据:背景环境视觉语言来自 [Environment_Input]
003 — 低角度CU · 动态细节(A类)
景别:地面或极低视角,[Character_Main] 局部(腿/脚/手)。展现角色腿脚时,画面截取地面至小腿下段区域,仅呈现脚部、鞋子与服装小腿区域,为身体局部极近特写。
内容:环境地面细节(地砖/落花/草地/落叶/环境/地面,取决于[Environment_Input])
与 [Character_Main] 局部动态同框,轻微运动模糊
运动:镜头从极低角度(虫视 Worm's-Eye View)以平稳、有节奏感的方式向后移动(Dolly Out),镜头后退速度与角色向前行走的步伐速度精准匹配,形成「脚步迎面而来 × 镜头同步退让」的动态平衡。运动模糊(Motion Blur),动感真实。运动平稳、有节律,与步伐韵律同步,无明显抖动。
功能:行进感,在地氛围
提取依据:地面质感与环境细节来自 [Environment_Input]
004 — MCU · 光晕情绪帧(A类)
景别:中近景,肩部以上侧面。画面截取肩部至头顶区域,呈现角色肩颈、侧脸与发丝,为上半身特写。面部朝向:完全侧脸(Full Profile) ,角色面部朝向画面侧方,呈现标准正侧面——鼻梁、嘴唇、下巴的侧面轮廓清晰,眼眸微闭或半闭,神情迷离空灵,非正对镜头。身体角度:四分之三转体(3/4 Rotation) 躯干相对于镜头有约四分之三的旋转角度,与侧脸朝向保持一致,颈部延伸线与肩部弧度自然流畅。极浅景深,角色轮廓与发丝为焦点,背景完全虚化,前景有若有若无的虚化遮挡物。
内容:[Character_Main] 侧脸,画面叠加暖色光晕(物理遮挡或光泄漏),轻微运动模糊
光线色调参照 [Environment_Input] 的光线特征延伸处理
光线:光源来自角色身后偏上方,强光打出清晰的发丝轮廓光(Rim Light)。光晕(Halo):光源周围形成明显的光晕,包裹角色头部与肩部,营造近乎梦幻的视觉氛围。镜头光斑(Lens Flare):逆光触发横向或放射状的镜头光晕/光斑,增强电影感与自然感。光泄漏(Light Leak):画面边缘有轻微的光泄漏效果,进一步强化光线的物理真实感。
运动:轻微手持晃动
功能:情绪爆发,电影感最强帧
005 — MS · 逆光剪影(A类)
景别:中景,背对镜头。角色虚焦前景(Out-of-Focus Foreground),角色身体呈现为虚化的前景剪影,位于画面一侧边缘。虚焦处理使角色退为环境叙事的「框架元素」,而非视觉主体,角色姿态隐约可见为站立状,背部或侧背对镜头。
内容:[Character_Main] 背影轮廓(面部特征不需要),以 [Environment_Ref] 的
自然环境元素(植被/天空/光源)形成散景背景,逆光欠曝
构图:采用肩上构图(Over-the-Shoulder)逻辑,角色虚焦前景占据画面一侧或一角,视觉重心引导至实焦的背景,强烈的透视纵深感。
光线:从画面侧面/斜前方打入,形成光影分界,提升画面戏剧张力,画面层次丰富。
运动:微动态,电影运镜,画面靠植被轻摆与光束营造「活的静止」感。
功能:情绪顶点,去个体化
提取依据:背景散景的色调与植被类型来自 [Environment_Input]
006 — ECU · 环境微距(B类)
景别:极近景,纯环境细节,无人物
内容:从 [Environment_Input] 中提取的代表性材质或自然元素(植物/纹理/水面/
玻璃/砖墙),极浅景深,全画面虚化
运动:电影运镜,手持质感,赋予画面自然的呼吸感与真实在场感。
功能:强制呼吸,叙事减速
提取依据:微距对象来自 [Environment_Input] 中的材质特征
007 — LS · 纯环境空镜(B类)
景别:全景,纯场景,无人物
内容:从 [Environment_Input] 中提取最具代表性的建筑或空间全貌,
突出环境的纵深感与光线特征
运动:电影运镜
功能:场景转场,叙事呼吸
提取依据:建筑风格与空间全貌来自 [Environment_Input]
008 — MS · 人物/环境叙事帧(B类)
景别:复合景别(Composite Framing) 画面采用前景虚焦人物 × 背景实焦长景的复合结构——前景角色以MCU近距离存在,但背景呈现为全景(LS)规模的纵深空间,两者形成景深上的强烈对比。
内容:以 [Environment_Ref] 提取的空间元素为主体(可以是橱窗/拱廊/庭院/走廊/
任何具有纵深的空间),[Character_Main] 作为虚焦前景存在
构图:角色存在方式:虚焦前景框架元素(Out-of-Focus Foreground),角色位于画面一侧三分之一处,仅呈现头部、颈部与上肩区域,角色细节模糊,服务于「环境叙事」而非「人物叙事」。角色有一定的轮廓光,为虚焦剪影增添质感。
运动:电影运镜
功能:场所标定,环境叙事
提取依据:空间类型与构图层次来自 [Environment_Input]
009 — FS · 全身造型帧(A类)
景别:全身景,头顶至鞋。人物位于画面一侧三分线位置,另一侧留白展现环境深度。
内容:[Character_Main] 在 [Environment_Ref] 场景中完整呈现,
造型可完整读取,[Jewelry_Hero] 清晰可辨
运动:呈现角色慢步走动的动态,体态轻盈自然,视线看向画面一侧光源处(避开镜头),电影运镜。
功能:造型信息完整呈现,全片最"可读"的人物帧
010 — MCU · 首饰+面部,焦在首饰(A类)⭐核心广告帧
景别:中近景,面部下半至胸口,面部朝向画面一侧,呈标准正侧面,视线投向镜头外,非直视镜头,神情沉静内敛。身体姿态亦呈侧面站立,与面部朝向一致,重心自然分布,无明显倾斜,站姿松弛且有气质。
内容:[Jewelry_Hero] 为对焦主体,呈现工艺细节;
[Character_Main] 面部下半部分在焦平面内可见;
侧光在首饰金属/宝石面形成高光反射点
运动:缓慢推进(Slow Dolly-in),有机手持微抖动(Organic Handheld Micro-movement),赋予画面自然的呼吸感。随镜头运动光影斑驳纹路在角色身上的位移会更加明显,进一步强化光与肌肤的互动叙事。
功能:产品信息植入,面孔揭示前最高注意力帧
011 — CU · 面孔正面特写(A类)
景别:近景,胸部以上,面部为核心
内容:[Character_Main] 正面或略低头,发丝轻扫面部,
[Jewelry_Hero] 可见,眼神自然,非刻意对镜头pose
运动:极缓慢推进(Slow Dolly-in / Push-in) 镜头以极度克制、匀速的节奏缓慢向前推进,沿镜轴方向逐步靠近角色面部,随着推进过程「人物揭示」的情感张力持续升温,亲密感逐帧加深。镜头动态包括且不限于角色呈现自然的「生命感」微动态、发丝飘动与斑驳投影位移(Hair Sway & Dappled Shadow Shift)、光晕与镜头光斑波动(Halo & Lens Flare Fluctuation)、首饰闪烁(Jewelry Glint)、在方向性强光下产生局部镜面反光的首饰细微闪烁(Specular Glint)等。
功能:人物揭示,情感高潮,与001首尾呼应
012 — LS · 背影离场(A类)
景别:全景,[Character_Main] 虚焦前景,背景实焦。人物全身镜头(Full Shot / LS),根据环境,人物位于居中或镜头一侧。
内容:[Character_Main] 背对镜头走向 [Environment_Ref] 场景纵深,
背景环境元素(路牌/建筑/光源)保持实焦
运动:人物行进,电影运镜,
功能:开放式结尾,与001首尾呼应
013 — 品牌标识帧(条件性 · 仅当提供 [Brand_Input] 时生成)
景别:平面图形构图,无透视,无景深
内容:[Brand_Ref] 品牌logo居中,背景方案由用户在故事板确认时选择:*

  • 方案A · 纯黑*:纯黑背景(#000000),logo以原色或白色呈现,极简高冷*
  • 方案B · 品牌色调*:从 [Brand_Input] 提取主色调,降低饱和度(S ≤ 20%),作为纯色背景;logo以高对比度色值居中呈现;推荐高级感低饱和配色*
  • 方案C · Flova创意设计*:由Flova AI基于 [Brand_Input] 自由设计带logo的高端品牌收尾帧,生成3个候选版本供用户选择;风格参照全片色调:cinematic, high-end jewelry brand, editorial*
    运动:静帧,或黑场淡入(Fade in from black)
    时长:3-4秒
    功能:品牌收尾,强化品牌记忆,全片收束
    条件:未提供 [Brand_Input] 时自动跳过,不纳入故事板与生成流程*

音频设计

BGM_Main
类型:ambient cinematic,无歌词
情绪弧:开篇舒缓 → 004-005升温 → 006-008平静 → 011-012渐弱
色调参照 [Environment_Input] 的整体氛围(暖/冷/热带/都市)匹配音乐风格*

4. 미디어 생성

## 生成模型与参考规范

Elements图像生成(步骤4 · 所有镜头生成前置)

人物元素 [Character_Main]
工具:TextToImage → Nano Banana 2(Gemini 3.1 Flash Image),2K
直接以 [Character_Input] 中的参考图作为生成依据
生成全身三视图(头顶至鞋,Full Body):正面 / 侧面 / 背面
核验:面部特征、发型、肤色、服装、体型与输入图一致
首饰元素 [Jewelry_Hero]
工具:ImageToImage → Nano Banana 2(Gemini 3.1 Flash Image),2K
直接以 [Jewelry_Input] 中的参考图作为生成依据
生成:正面特写 / 佩戴于人体状态图
核验:金属光泽、吊坠形态、工艺细节与输入图完全一致
环境元素 [Environment_Ref]
工具:TextToImage → Nano Banana 2(Gemini 3.1 Flash Image),2K
来源:*

  • 若用户提供 [Environment_Input]:直接以参考图为依据,生成代表性场景渲染图(空景 + 带人物占位)
  • 若用户选择「A · 我来描述」:以用户文字描述为提示词生成
  • 若用户选择「B · Flova自动设计」:基于 [Character_Main] 与 [Jewelry_Hero] 风格特征自动推断环境氛围,生成3个候选方案供用户选择
    生成:代表性空景全景 / 中景 / 纵深构图(各1张,作为B类镜头与A类背景共用参考)
    核验:色调、光线方向、建筑风格与整体叙事调性匹配

A类关键帧图像生成

工具:ImageToImage → Nano Banana 2(Gemini 3.1 Flash Image),2K
每个A类镜头参考图同时包含:*

  1. [Character_Main] 元素图(正面或侧面,取决于镜头角度)
  2. [Jewelry_Hero] 元素图
  3. [Environment_Input] 中与该镜头场景最匹配的参考图
  4. 同场景中前序镜头的关键帧(维持连贯性)
    010镜头额外要求:[Jewelry_Hero] 处于实焦位置,金属/宝石面有可见高光点*

B类镜头图像生成

工具:TextToImage → Nano Banana 2,2K
以 [Environment_Input] 和/或 [Brand_Input] 作为直接参考:*

  • 006:以 [Environment_Input] 中的材质/植物细节参考图为依据,生成极浅景深微距,手持电影运镜
  • 007:以 [Environment_Input] 的全景参考图为依据,生成无人物纯环境空镜,电影运镜
  • 008:以 [Environment_Input] 的空间参考图为主体,[Character_Main] 作虚焦前景(三分之一位置),背景实焦纵深长景,电影运镜

用户已提供满意库存图的B类镜头,直接绑定,跳过生成。*
013镜头生成(条件性,需 [Brand_Input])
根据用户在故事板确认时选定的方案执行:
方案A · 纯黑
工具:text_editor 输出纯色图层规格
背景:#000000,logo以原色或白色居中,尺寸为画面宽度的30-40%
输出:静态图像帧,后续在 video_assembler 叠加淡入效果
方案B · 品牌色调
工具:TextToImage → Nano Banana 2,2K
从 [Brand_Input] 提取主色调,指定饱和度 S ≤ 20%,输出纯色背景
logo居中,以高对比度色值呈现(通常为深色背景配浅logo,或浅色配深logo)
生成1个版本,若不满意可调整色值重试
方案C · Flova创意设计
工具:TextToImage → Nano Banana 2,2K
以 [Brand_Input] 作为直接参考,AI自由设计带logo的高端品牌收尾帧
风格标签:cinematic, high-end jewelry brand, editorial, minimal, luxury
生成3个候选版本供用户选择*

  • ⏸ 暂停,等待用户从3个候选中选定

视频生成

工具:MultiModalToVideo → Kling 3.0 Omni,1080p
比例:根据 Final_Video_Spec.md 中用户选择(9:16 或 16:9)
每个镜头同时参考:[Character_Main] 元素图 + 该镜头关键帧图
每镜头候选版本数量:读取 Final_Video_Spec.md 中的 shot_candidates 字段:

  • shot_candidates = 3:每镜头生成 3个候选版本,流程结束后统一暂停供用户逐镜筛选
  • shot_candidates = 1:每镜头生成 1个版本,直接进入下一步,无需筛选环节
    时长设定:*
  • 001 / 006 / 008 / 012:3-4秒
  • 002 / 003 / 005 / 007 / 009 / 011:4-5秒
  • 004 / 010:3秒

音乐生成

工具:text_to_instrumental → Suno 5
风格标签:依据 [Environment_Input] 提取的环境调性推断,
基准为 ambient cinematic, no lyrics, no percussion
时长:与最终视频总时长匹配

5. 프롬프트 작성

视觉铁律与Prompt规范

核心美学原则:半遮半现

全片持续回避直给——面孔被发丝遮挡、主体被虚焦、人物被光晕淹没。
这种策略制造贯穿始终的观看欲望,是本Skill的核心美学。

全片严禁:

  • 人物直视镜头并摆出明显广告pose
  • 人工感妆容或过度磨皮
  • 背景虚化到完全无法辨认场景
  • 字幕、logo叠加、水印(no subtitles, no watermark, no text overlay)
  • 任何配乐音效(no music, no sound effects)

Prompt结构(图像与视频通用)

[风格标签] + [主体描述] + [镜头语言] + [光影色彩] + [质感情绪] + [负向提示词]

全片统一风格标签:
cinematic film still, analog photography, 35mm film grain,
editorial fashion photography, natural candid moment

光影色彩:
从 [Environment_Input] 提取色温与光线方向,转化为prompt语言。
基准描述:
natural side lighting, [环境色温描述], low contrast highlights,
visible skin texture, no harsh flash, no studio lighting

例:若 [Environment_Input] 为热带正午强光 →
harsh tropical noon side light, warm ivory and amber tones
例:若 [Environment_Input] 为室内柔光 →
soft diffused interior light, cool neutral tones, window-lit

镜头语言(按镜头类型)

001 / 010 · ECU特写类:
macro lens, f/1.4 extreme shallow depth of field,
soft bokeh, jewelry/accessory catchlight visible

002 / 007 / 009 · MS中景类:
50mm lens, slight foreground obstruction,
environmental context from reference, natural atmosphere

005 · 剪影类:
strong backlight, silhouette, underexposed -1.5 stops,
swirly bokeh background, female figure outline only

003 · 低角度类:
ground level POV, extreme low angle, environmental ground details foreground,
legs in slight motion blur

004 · 情绪类:
anamorphic lens flare, warm light leak, slight motion blur,
optical aberration, side profile, hand-held feel

012 · 背影远景类:
focus on background environment, subject defocused foreground,
woman walking away, rear view, depth leading lines

010核心广告帧专属补充

jewelry/accessory in sharp focus as hero element,
product as primary subject, face partially visible below chin,
metal/stone surface catchlight, product structure clearly defined,
skin softly lit, face not fully revealed

材质还原关键词(依据 [Jewelry_Input] 选用)

  • 银色金属:sterling silver, cool metallic sheen, mirror polish
  • 黄金:18k gold, warm metallic glow, polished surface
  • 玫瑰金:rose gold, warm pink metallic tone
  • 宝石镶嵌:pavé setting, gemstone sparkle, point light reflections
  • 皮革/织物:leather texture, fabric weave detail, matte surface

Kling 3.0 Omni 参考图引用格式

<<<image_1>>> [Character_Main 正面元素图]
<<<image_2>>> [该镜头关键帧图]

运动描述规范:

  • 静帧:camera static, subtle natural movement only (hair, breath, fabric)
  • 推镜:slow imperceptible dolly push in
  • 严禁使用 zoom,一律替换为 dolly 或 tracking shot
6. 동영상 조립

剪辑规范

镜头顺序(固定不可调换)

001 → 002 → 003 → 004 → 005 → 006 → 007 → 008 → 009 → 010 → 011 → 012 → 013(条件性)

时间线规格

  • 总时长:60-75秒(含013时延长至63-79秒)
  • 画面比例:由 Final_Video_Spec.md 中用户选择决定(9:16 或 16:9)
  • 帧率:24fps

转场规范

衔接方式时长001→002直切—002→003直切—003→004直切,节拍点对齐—004→005叠化 dissolve0.5秒005→006叠化 dissolve0.8秒006→007直切—007→008直切—008→009直切—009→010直切,节拍点对齐—010→011直切—011→012叠化 dissolve,渐出1秒012→013渐黑至纯黑(fade to black)1.5秒,仅当013存在

013结尾:淡出至黑(fade out),0.8秒

原则:001-004节奏紧;004-008叠化放缓;009-012重新收紧后渐弱收尾;013独立收束,与前片留有黑场间隔。

音频轨道规范

  • 视频轨道全部静音(mute all video audio tracks)
  • BGM_Main 置于独立音频轨道
  • BGM音量:-12dB,末尾3秒渐出(fade out)
  • 严禁叠加其他音效,除非用户明确要求旁白

输出规格

  • 格式:MP4,H.264
  • 分辨率:
    • 9:16 → 1080 × 1920
    • 16:9 → 1920 × 1080
  • 码率:≥ 8Mbps