yeha.ai
목록으로

Animated typography advertisement

스튜디오 초안을 준비합니다. 여러 단계의 지침은 참고용이며 자동 생성이나 과금은 하지 않습니다.

用于字体品牌广告、动态字体展示、拉片复刻及字体视觉创作。使用模型:Minimax H3。

제작 흐름 본문은 중국어 원문입니다. 언급된 모델과 이 사이트의 지원 모델은 다를 수 있습니다. 실제 모델과 크레딧은 스튜디오에서 확인하세요.

전체 제작 흐름

1. 제작 기획

01|Skill定位

本 Skill 用于:

  • 字体品牌广告
  • 动态字体展示
  • 字库宣传片
  • 字体视觉实验
  • 字体×人物时尚广告
  • 字体×空间广告
  • 参考视频逐帧拉片复刻
  • 已有脚本的字体视频设计
  • 指定字体的炫酷视觉创作
    字体与品牌字标始终是核心视觉产品。
    所有人物、空间、构图、镜头、材质、灯光、字体动效、声音、转场均服务于:字体展示、字形辨识、品牌识别、视觉记忆。

02|主任务类型

正式制作之前先判断属于哪一类。
A|拉片复刻
用户提供视频,要求分析并保留:时间轴、镜位、景别、运镜、人物功能、人物动作、人物神态、字体动态、构图、场景功能、节奏、转场、声音节点。然后替换用户批准的字体、人物、场景或品牌。
B|指定字体炫酷创作
用户提供:字体、字样、Logo、字体名称、品牌字标。根据字体本身重新设计视觉广告。
C|从0做字体品牌广告
没有固定视频结构。根据品牌定位、字体特征、视觉调性、使用平台、目标人群、传播目的,从0构建完整广告。
D|已有脚本
用户已经明确:剧情、镜头、分镜、人物、场景或动作。严格围绕用户脚本进行字体广告设计。

03|正式生成前强制需求确认

不得一上来直接跑图或跑视频。先检查当前对话中已经明确了哪些信息。

  • 已经明确:不重复提问。
  • 没有明确:必须询问。
    优先确认以下内容:
    ①任务类型
    A 拉片复刻 / B 指定字体炫酷创作 / C 从0创作 / D 已有完整脚本
    ②字体/品牌资产
    确认:品牌名、字体名、最终展示文字、大小写、标点、空格、断行、Logo与文字关系、是否提供字体文件/PNG/SVG
    ③场景方向
    如果没有明确,提供:A|极简黑色高级影棚 / B|纯白未来空间 / C|未来科技建筑 / D|Fashion Film时尚空间 / E|城市实景 / F|艺术装置空间 / G|自然户外 / H|自定义
    ④人物需求
    L0|无人物 / L1|人物共存 / L2|人物轻互动 / L3|人物强互动
    ⑤人物类型
    仅有人物时确认:年龄、性别视觉特征、人种/外貌方向、发型、妆容、服装、人物气质
    若用户已上传人物参考图:优先使用用户人物资产,不重新随机设计人物。
    ⑥视觉风格
    可选:高级极简、先锋时尚、未来科技、超现实艺术、电影感、奢侈品广告、工业机械、复古未来、潮流年轻化、自定义
    ⑦总时长
    5s / 10s / 15s / 30s / 45s / 60s / 自定义
    ⑧画幅
    9:16 / 16:9 / 1:1 / 4:3 / 跟随已有视频 / 自定义
    ⑨声音
    无BGM / 电子节奏 / 时尚广告音乐 / 电影氛围 / 未来科技 / 只要拟音 / 自定义

04|第一道确认门:模型确认

这是强制门禁。
任何正式的人物提示词、场景提示词、关键帧提示词、首帧提示词、尾帧提示词、字体视觉图提示词、视频提示词,在针对具体生成模型进行正式编写之前,都先确认目标模型。
一|图像模型确认
只要需要:人物图、人物四宫格、场景图、首帧、尾帧、关键帧、字体视觉图,必须先确认:"本次图像素材适配哪个图像模型?"
可提供:

  • A|Nano Banana Pro (Gemini 3 Pro Image)(官方推荐首选,文字渲染与多图布局能力最强)
  • B|Nano Banana 2 (Gemini 3.1 Flash Image)
  • C|GPT Image 2
  • D|Seedream 5.0 Pro
  • E|Seedream 4.5
  • F|Midjourney V7
  • G|其他
  • H|请推荐,但先让我确认
    用户未确认图像模型:可以分析素材、设计方向、规划资产。但正式模型适配版图像提示词应先等待模型确认。
    二|视频模型确认
    只要需要正式视频提示词,必须确认:"本次视频适配哪个视频模型?"
    可提供:
  • A|Seedance 2.0
  • B|Seedance 2.0 Fast
  • C|Seedance 2.0 Mini
  • D|Seedance 2.5
  • E|Kling 3.0 Omni
  • F|MiniMax H3
  • G|Gemini Omni Flash
  • H|其他
  • I|请推荐,但先让我确认
    模型未确认:不得擅自用默认模型替用户制作最终适配版Prompt。

05|模型确认不能等同于生成授权

用户选择了 Nano Banana Pro、Seedance 2.5、Kling 3.0 Omni、Midjourney V7,只代表:"按这个模型写Prompt"。不代表:"允许立即执行生成"。
模型确认后下一步仍然必须:先写Prompt → 给用户看 → 等待用户确认 → 再执行。

06|第二道确认门:提示词确认

所有提示词写完后必须先给用户审核。包括:字体视觉资产提示词、人物四宫格提示词、场景提示词、首帧提示词、尾帧提示词、关键帧提示词、视频提示词。
必须等待用户明确表达以下之一,才允许进入真正生成:

  • "确认"
  • "这个可以"
  • "提示词没问题"
  • "开始跑"
  • "可以跑图"
  • "可以跑视频"
  • "按这版生成"
    如果用户说以下之一,则视为当前Prompt未通过,必须修改后重新提交用户确认:
  • "优化一下"
  • "重新写"
  • "再改一下"
  • "感觉不够好"
  • "人物再细一点"
  • "场景换一下"

07|Prompt修改后原确认自动失效

如果用户已经确认Prompt,随后Prompt又发生以下任何实质修改,则之前的确认失效:

  • 人物、场景、字体、镜头、动作、时长、模型、画幅、材质、光线、关键微表情
    修改后的新Prompt必须重新确认。不得使用旧确认直接执行新Prompt。

08|图片和视频分别确认

图片确认不能自动代表视频确认。
例如:用户确认人物四宫格提示词,只能允许生成人物四宫格,不能因此直接生成视频。
同理:用户确认场景提示词,只代表允许跑场景图。视频提示词仍需单独审核。

09|人物资产强制规则

只要最终视频出现主要人物,无论视频 5s、10s、15s、30s,以及人物是否跨镜头、跨段、只出现一次,都必须独立输出人物设定资产。
多人:@人物A / @人物B / @人物C
人物资产只描述:年龄、五官、脸型、肤色、皮肤纹理、发际线、发型、妆容、身材比例、上装、下装、鞋袜、眼镜、固定配饰
人物资产禁止写:剧情、场景、走路、动作、手势、视线变化、神态变化、微表情、台词、字体互动、镜头、声音
人物动态全部进入视频时间轴。

10|独立场景资产强制纯空景

只要提前单独输出 @场景S1 / @场景S2 / @场景S3,则该资产必须是:纯空景静态环境。
场景资产不承担:人物、字体、品牌、剧情、动作功能。
场景正文只能描述:
①空间结构 — 室内/室外、地面、墙面、顶面、层高、通道、台阶、开口、建筑关系、前后纵深
②固定环境材料 — 金属、石材、玻璃、木材、混凝土、镜面材料、墙体、地面材料、固定装饰结构
③固定空间陈设 — 仅环境本身不可分割的静态陈设,例如:柱体、固定框架、门窗、灯带、空白屏幕、固定装置结构
④静态环境光 — 自然光方向、固定灯光方向、色温、明暗层次、阴影软硬、环境反射、体积光
⑤色彩与空气 — 主色、辅助色、黑位、饱和度、空气通透度、雾感、湿度、空间氛围
场景资产中绝对不能出现:

  • 人物、模特、人体、人物剪影、人像海报、人物倒影、人物影子
  • 字体、字母、品牌文字、Logo、字标、字幕
  • 产品主体、包装主体、品牌展示物
    也不能出现动态内容:人物进入、字体升起、字体飞过、碎裂、重组、走动、触碰、动画、剧情行为
    场景档不能写:推进、后撤、环绕、摇移、平移、变焦、切镜。
    场景档不能写:BGM、环境拟音、声音节拍。
    重要:以上"禁止人物、禁止字体"等只是Skill控制规则。真正输出给图像模型的场景Prompt正文,不要机械写"无人物""无人""无字体""不要Logo""clean plate""禁止人物"等负面命令。最终场景Prompt正文只写正向的静态空间本身。
    例如:
    【@场景S1|深黑镜面影棚】
    深黑色无边界影棚空间,弧形无缝背景与高光黑色地面自然衔接,侧墙和后景边界逐渐隐没在深黑层次中;顶部窄幅冷白固定灯带形成克制的纵向明暗过渡,两侧低亮度轮廓灯勾勒空间边缘,高光黑色地面保持低亮度镜面反射,空气中存在极轻薄雾,整体空旷、冷峻、纯净。

11|总时长≥30s资产分离

只要完整项目 ≥30.00s,则强制资产化。
有主要人物:输出独立人物四宫格。所有主要场景:分别输出纯空景。
例如:@场景S1|黑色镜面影棚 / @场景S2|未来白色大厅 / @场景S3|金属艺术空间
之后视频Prompt使用 @人物A / @场景S1 / @字体A 等简写。

12|<30s场景规则

<30s项目:如果场景只使用一次、不跨段、不需要保持严格一致,可以直接融合进视频Prompt。
如果跨段、重复使用、需要多次生成保持一致、用户要求提前生成场景,则必须单独输出纯空景资产。

13|参考视频只用于分析

用户要求拉片、逐帧、1:1、复刻时:完整参考视频仅在分析阶段使用。
可以用于:抽帧、时间码、人物分析、字体分析、构图分析、运镜分析、光线分析、节奏分析、声音分析
但正式视频生成Prompt的【输入资产】不得包含完整参考视频。也不得告诉用户"把参考视频上传进视频生成模型"。

14|最终视频Prompt去参考化

最终视频Prompt禁止写:参考视频、参考原视频、参考原片、原视频、原片、复刻、与参考一致、按参考视频、照着原片、保持原片构图、参考人物表情、参考原运镜、和原视频一样
全部转换成:具体构图 + 具体动作 + 具体眼神 + 具体微表情 + 具体字体运动 + 具体摄影运动 + 具体光线 + 具体声音。

15|模型分段

  • Seedance 2.0 / Seedance 2.0 Fast / Seedance 2.0 Mini:4—15s/段。
  • Seedance 2.5:4—30s/段。
  • MiniMax H3:4—15s/段。
  • Kling 3.0 Omni:3—15s/段。
  • Gemini Omni Flash:3—10s/段。
  • 未指定模型:不得进入最终视频Prompt适配阶段。

16|分段原则

优先切在:动作完成、字体完整识别、满屏字面、黑场、遮挡完成、强音效落点、人物动作收束、自然停顿
不得为了满足时长:删除剧情、删除镜头、强行加速、缩短关键品牌识别

17|全局视频规格与工具路由

阶段0|建立全局规格
需求确认后、正式故事板设计前,通过 text_editor 建立 Final_Video_Spec.md,锁定:项目标题、任务类型、字体/品牌资产、场景方向、人物等级与类型、视觉风格、总时长、画幅、声音方向、已确认图像模型、已确认视频模型。后续所有阶段以此为共享锚点。
阶段A|拉片分析(仅拉片复刻任务)

  1. 调用 resource_prepare_and_analyze 对参考视频做逐帧拉片分析,输出结构化分析结果。
    阶段B|确认需求
  2. 判断任务类型。
  3. 确认字体、场景、人物和互动、风格、时长、画幅、声音。
  4. 建立 Final_Video_Spec.md → text_editor
    阶段C|确认模型
  5. 有图像资产需求:先确认图像模型。
  6. 有视频需求:先确认视频模型。
  7. 更新 Final_Video_Spec.md 写入已确认模型 → text_editor
    阶段D|设计故事板
  8. 针对已确认模型设计正式执行版故事板 → storyboard_designer
    阶段E|写Prompt
  9. 写字体资产。
  10. 写人物资产。
  11. 如需独立场景,写纯空景Prompt。
  12. 写关键帧Prompt。
  13. 写视频Prompt。
    阶段F|用户审核Prompt
  14. 把Prompt完整交给用户。
  15. 等待用户确认。
  16. 用户要求修改则继续修改。
  17. 修改后再次确认。
    阶段G|执行生成
  18. 图像Prompt明确通过后才跑图 → media_generator
  19. 视频Prompt明确通过后才跑视频 → media_generator
    阶段H|装配
  20. 所有媒体就绪后,执行最终装配 → video_assembler
    阶段I|质量检查
  21. 按质量检查清单逐项核验(见第18节)。
    依赖关系: 阶段A(如有)→ 阶段B → 阶段C → 阶段D → 阶段E → 阶段F → 阶段G → 阶段H → 阶段I。
    任何一步未完成:禁止越级执行。

18|暂停点

不要一次性跑完整个流程。在以下里程碑暂停并向用户确认后再继续:

  • Final_Video_Spec.md 锁定后
  • 故事板完成后
  • 模型确认后
  • Prompt全部写完并展示后
  • 图像生成完成后
  • 视频生成完成后
  • 最终装配完成后
    使用卡片或回复邀请用户审核。

19|质量检查

生成与装配完成后逐项核验:

  • 需求:是否确认?
  • 图像模型:是否确认?
  • 视频模型:是否确认?
  • 人物Prompt:是否确认?
  • 场景Prompt:是否确认?
  • 视频Prompt:是否确认?
  • 场景:是否是真正空景?是否误出现人物、字体、Logo、产品主体、动作、运镜?
  • Prompt:是否还有参考视频、原片、复刻等词?
  • 人物:是否换脸?是否眼神空洞?是否面部僵硬?是否动作过载?
  • 字体:是否准确?是否乱码?是否变形?是否信息过载?
  • 模型:单段是否超限?

20|执行授权范围

用户只授权哪一部分,就只执行哪一部分。

  • 用户只确认人物Prompt:只执行人物生成。
  • 用户只确认场景Prompt:只执行场景生成。
  • 用户只确认视频Prompt:只执行视频生成。
  • 生成结果返修时再次遵守相同确认流程。
2. 멀티모달 분석

01|分析目的

拉片不是为了在最终Prompt里写"和这个视频一样",而是为了把视频转换成模型可以独立执行的具体镜头语言。

02|拉片触发

用户提出拉片、逐帧、1:1、还原、复刻时:必须读取视频并分析。

03|元数据

记录:总时长、分辨率、画幅、FPS、总帧数、音轨长度

04|时间码

至少每0.25s分析一次。
以下加密到逐帧:字体变形、快速擦屏、人物动作、表情变化、字体冲屏、碎裂、重组、遮挡、转场

05|镜头

记录:开始时间、结束时间、起始景别、结束景别、人物位置、字体位置、机位高度、摄影机移动、速度曲线、对焦、转场

06|人物

分析:动作、重心、视线目标、焦点距离、眼球微扫视、回焦、眨眼、上下眼睑、眉间、鼻翼、呼吸、嘴唇、口角、下颌、头颈、肩颈、步态、衣摆惯性
人物状态按:活体基线 → 刺激触发 → 微表情峰值 → 自然恢复。

07|字体

记录:精确文字、大小写、标点、字重、字宽、字距、占屏、2D/3D、厚度、倒角、材质、反射、初始位置、目标位置、路径、速度、碎裂、重组、识别帧

08|场景分析

只分析环境本身:空间结构、材料、固定陈设、静态光、色彩、空间深度
如果后续需要生成独立场景资产:从这一步提取出纯空景描述。不得把分析到的人物和字体写入场景资产。

09|声音

记录:BPM、节拍、低频、whoosh、裂纹、冲击、吸附、静音、尾响

10|转译规则

分析"人物很高级"——最终不得只写高级。要转成:人物瞳孔聚焦镜头中距离焦点,上眼睑略压低,下眼睑保持轻微专注张力,双唇自然闭合,下颌保持克制基础张力,呼吸轻而平稳。
分析"字体高速冲屏"——转成:完整立体字沿镜头光轴先缓慢启动,随后迅速加速向摄影机推进,透视尺寸连续扩大,最终字面完全超过画框形成满屏遮挡。
分析"镜头拉远"——转成:摄影机从人物眼部极近景沿镜头光轴连续后撤,在约2秒内依次露出面部、肩颈、胸像和完整全身。

11|正式Prompt前检查

必须能明确回答:谁?在哪里?做什么?看哪里?字体在哪里?字体怎么动?摄影机怎么动?光怎么变化?声音什么时候响?最后停在哪里?
回答不清:继续分析,不进入正式Prompt。

3. 스토리보드 설계

01|故事板必须在需求和模型确认后设计正式执行版

模型确认前:可以做方向草案。
模型确认后:才能做针对该模型的正式执行故事板与Prompt。

02|基本结构

按项目需要组合:建立品牌世界 → 字体第一次出现 → 字体运动展示 → 人物/字体互动 → 视觉升级 → 高潮 → 完整品牌识别 → 片尾锁定
不强制全部使用。

03|人物等级

  • L0:无人物。
  • L1:人物共存,只做尺度和品牌气质。
  • L2:视线、步态、光扫、反射、短暂遮挡。
  • L3:触碰、推动、控制、穿越、包围、动作触发。

04|人物活体

人物先建立:看哪里 + 呼吸 + 眼睑 + 下颌 + 身体重心,再接受视觉刺激。

05|微表情

每个短时间内:1个主反应 + 1—2个辅助反应。禁止五官同时乱动。

06|眼神

必须明确目标:镜头、字体、图标、人物、空间远点。

07|视线动作

眼球先定位 → 短暂停顿 → 头部晚0.1—0.3s补偿1—3度 → 回焦。

08|人物和字体空间

明确:谁前谁后;遮挡多久;人物安全距离;字体什么时候完整识别。

09|镜头复杂度

单个镜头优先:1个人物核心动作 + 1个字体核心动作 + 1个主要运镜。

10|弱模型

如果模型理解能力弱:优先减少人物动作、字体动作、镜头动作、粒子、材质变化、微表情数量。
先保:人物 → 字体 → 核心动作 → 镜头 → 关键表情 → 装饰效果。

11|故事板完成后不自动执行

故事板完成 → 继续写Prompt。Prompt完成 → 交用户确认。用户确认 → 才能执行。

4. 미디어 생성

01|媒体生成总原则

所有媒体:先确认模型 → 再写Prompt → 再确认Prompt → 再生成。
没有Prompt确认:不执行。

02|字体视觉资产

严格字体项目可输出:【@字体A|字体视觉资产档】
包含:品牌名称、精确展示文字、大小写、标点、字体参考、字重、字宽、字距、特殊结构、颜色、材质、允许动态、禁止变化

03|人物资产

只要出现主要人物:必须输出人物四宫格(强制规则见 planner 第09节)。
【@人物A|人物形象四宫格设定图提示词】
9:16人物设定版。

  • 左上:正面头肩。
  • 右上:三分之四或侧面头肩。
  • 左下:正面全身。
  • 右下:背面全身。
    四格同一人物。完整锁定:年龄、五官、肤色、皮肤、发型、妆容、身材、服装、鞋袜、配饰。

04|人物图执行门禁

先确认:图像模型。然后输出:人物Prompt。随后询问用户:"人物设定Prompt是否确认?" 用户确认后:才能生成人物。

05|纯空景资产

提前需要生成场景:必须生成纯空景(强制规则见 planner 第10节)。
标题:@场景S1|XXX
场景Prompt正文:只写正向环境。
注意:禁项规则属于Skill控制层,最终Prompt正文不要堆"无人物、无字体、禁止Logo"等负面句。

06|场景图执行门禁

  1. 确认图像模型。
  2. 输出纯空景Prompt。
  3. 给用户确认。
  4. 用户明确说"场景Prompt确认,可以跑"才允许执行场景生成。

07|首帧/尾帧/关键帧

同样执行:确认图像模型 → Prompt → 用户确认 → 生成。

08|视频

执行:确认视频模型 → 视频Prompt → 用户确认 → 跑视频。

09|资产顺序

≥30s:

  • A|字体资产
  • B|人物资产
  • C|场景S1
  • D|场景S2
  • E|场景S3
  • F|首尾帧/关键帧(需要时)
  • G|视频Prompt 01
  • H|视频Prompt 02……
  • I|衔接锚点
  • J|用户确认
  • K|执行

10|禁止自动连续执行

不得出现:刚生成人物图 → 自动生成场景 → 自动跑视频 这种链式执行。
每个阶段按用户确认范围执行:

  • 用户只确认人物:只执行人物。
  • 用户只确认场景:只执行场景。
  • 用户只确认视频:只执行视频。

11|生成工具与模型映射

图像资产(人物四宫格、场景图、首帧/尾帧/关键帧、字体视觉图)

  • 首次生成使用 TextToImage;需要跨图一致性或多参考融合时使用 ImageToImage
  • 可选模型:Nano Banana Pro (Gemini 3 Pro Image)(推荐首选)、Nano Banana 2 (Gemini 3.1 Flash Image)、GPT Image 2、Seedream 5.0 Pro、Seedream 4.5、Midjourney V7。
  • 推荐分辨率:2K(除非用户或视觉路径明确要求其他)。
    视频镜头
  • 优先使用 MultiModalToVideo(支持图像/视频/音频多模态参考,最适合字体广告中人物+场景+字体多参考的视频生成)。
  • 可选模型:Seedance 2.5、Seedance 2.0、Seedance 2.0 Fast、Seedance 2.0 Mini、Kling 3.0 Omni、MiniMax H3、Gemini Omni Flash。
  • 推荐分辨率:720p(除非用户明确要求更高)。
    音频(BGM/拟音/旁白)
  • BGM:按需使用 text_to_instrumental 或 lyrics_to_song。
  • 旁白/VO:使用 TextToSpeech(默认 MiniMax Speech 2.8 HD,中文可用 Doubao,英文可用 ElevenLabs v3)。
  • 多角色对话/声音设计:使用 MultiModalToAudio(Seed Audio 1.0)。

12|Asset Binding Contract

  • 遵循当前 manage_item_assets 合约,使用 Storyboard 中的实际目标 ID;不在 Skill 中定义独立 ID 模板。
  • 目标 Storyboard 锚点存在后、任何生成引用该资产前,先调用 query_assets_info 查询。如果所需绑定缺失,调用 manage_item_assets 写入完整绑定数组(保留已有绑定),然后重新查询验证。
  • 每个绑定从资产的实际用途、计划 Storyboard 位置和 manage_item_assets 合约解析。计划位置优先于术语规范化;不得仅从媒体标签推断绑定类型或角色。
  • 如果一个资产服务多种用途,在完整 asset_bindings 数组中保留所有适用绑定。
  • 字体视觉资产、人物四宫格、场景空景图生成后,注册 asset_id 并绑定到对应 Storyboard 元素。
  • 视频镜头生成引用人物/场景/字体资产时,确保对应 asset_id 已绑定且验证通过。

13|失败返修

  • 人物错误:减少同时动作。
  • 眼神错误:只保留视线锚点 + 一个眼睑变化 + 呼吸。
  • 字体错误:减少同时字体变化,使用字体图或首尾帧锁定。
  • 镜头错误:每段只保留一个核心运镜。
  • 互动错误:拆成接近 → 接触 → 反馈。
  • 场景错误:重新单独生成纯空景,不要在场景生成阶段加入人物和字体。
5. 프롬프트 작성

01|Prompt工作流

正式Prompt必须经过:导演分析 → 模型确认 → 镜头编译 → Prompt草案 → 用户确认 → 执行。

02|模型确认发生在Prompt适配之前

不能先默认用Seedance写完,再问用户用什么模型。
正确:先问模型 → 再按模型能力写Prompt。

03|Prompt完成必须停下来

Prompt写完以后:禁止自动继续执行。必须明确展示给用户确认。

04|确认语

  • 图像Prompt之后:"以上为【图像模型名称】适配版Prompt,请先确认。你确认这版没问题后我再执行生成。"
  • 场景Prompt之后:"以上为纯空景场景Prompt,请确认空间、材质、光线和氛围是否正确。你确认后我再按已选图像模型生成场景。"
  • 视频Prompt之后:"以上为【视频模型名称】适配版视频Prompt,请先确认。你确认没有问题后我再跑视频。"

05|模型确认与Prompt确认是两件事

选择模型 ≠ 批准Prompt。
批准Prompt ≠ 批准其他媒介Prompt。

06|执行编译

内部复杂分析不能原样复制进最终Prompt。
最终Prompt优先写:主体 + 起始状态 + 动作 + 镜头 + 字体 + 关键人物反应 + 结束状态。

07|抽象词转译

"高级感"不是最终动作指令。"活体基线"不是模型动作指令。"微表情峰值"不是最终Prompt词。必须转成可见画面。

08|弱模型模式

弱模型:

  • 句子更短
  • 变量更少
  • 因果更清楚
  • 动作更原子化
  • 负面词更少
  • 时间节点更明确

09|信息优先级

  • P0:人物身份+字体准确。
  • P1:核心动作。
  • P2:构图+镜头。
  • P3:关键眼神+表情。
  • P4:字体特效。
  • P5:装饰细节。
    弱模型优先:P0—P3。

10|单镜头

尽量只包含:1个人物主动作 + 1个字体主动作 + 1个摄影机主动作。

11|人物表情压缩

内部可分析很多五官。最终短镜头只挑2—4个最关键变化。
例如:人物先看镜头;巨大字体从右侧靠近时,瞳孔先向右移动约2度,上眼睑轻收,头部晚约0.15秒向右微转1度;字体离开后重新回焦镜头并轻轻呼气。

12|动作原子化

看向目标 → 抬手 → 靠近 → 减速 → 触碰 → 字体响应 → 手放松 → 回焦。

13|生成设置

每段Prompt开头:【生成设置】
可以写:目标时长、已确认模型、已确认画幅、输入资产、声音、核心视觉
输入资产只写真正用于该任务的:@人物A / @场景S1 / @字体A / 首帧 / 尾帧 / 图片。不写完整参考视频。

14|场景@规则

已经单独输出场景:视频里写 @场景S1。不重复完整空间Prompt。
但:动态光线变化、人物动作、字体动作、镜头运动仍写在视频Prompt。

15|人物@规则

独立人物资产后:使用 @人物A。但继续详细写:动作、视线、关键微表情、身体重心。

16|去参考化

最终视频Prompt不得出现:参考视频、原视频、参考原片、原片、复刻、照着参考、和原片一样、保持参考效果。

17|负面控制

Skill内部保留完整质检规则。
最终模型Prompt:仅根据当前镜头保留3—6个最危险负面问题。避免几十条负面要求淹没主指令。

18|Prompt修改规则

Prompt修改后:重新发给用户。必须重新确认。未经重新确认:不得执行。

19|最终Prompt标准

短。准。具体。时间明确。动作明确。方向明确。因果明确。结束状态明确。

6. 동영상 조립

01|声音

  • 字体落位:低频冲击。
  • 冲屏:whoosh。
  • 碎裂:硬质裂纹+碎片飞散。
  • 重组:反向吸附。
  • 框线:电子click。
  • 人物触碰:接触瞬间短促电子音。
  • 片尾:音乐减法+短尾响。

02|分段

优先在以下位置切段:字面满屏、黑场、遮挡、动作完成、字体完整识别、声音强落点

03|段间锚点

明确:

  • 人物位置
  • 人物姿态
  • 视线
  • 身体重心
  • 字体状态
  • 镜头尺度
  • 光线
  • 运动方向
    不得只写"延续上一段"。