Animated typography advertisement
스튜디오 초안을 준비합니다. 여러 단계의 지침은 참고용이며 자동 생성이나 과금은 하지 않습니다.
用于字体品牌广告、动态字体展示、拉片复刻及字体视觉创作。使用模型:Minimax H3。
제작 흐름 본문은 중국어 원문입니다. 언급된 모델과 이 사이트의 지원 모델은 다를 수 있습니다. 실제 모델과 크레딧은 스튜디오에서 확인하세요.
전체 제작 흐름
1. 제작 기획
01|Skill定位
本 Skill 用于:
- 字体品牌广告
- 动态字体展示
- 字库宣传片
- 字体视觉实验
- 字体×人物时尚广告
- 字体×空间广告
- 参考视频逐帧拉片复刻
- 已有脚本的字体视频设计
- 指定字体的炫酷视觉创作
字体与品牌字标始终是核心视觉产品。
所有人物、空间、构图、镜头、材质、灯光、字体动效、声音、转场均服务于:字体展示、字形辨识、品牌识别、视觉记忆。
02|主任务类型
正式制作之前先判断属于哪一类。
A|拉片复刻
用户提供视频,要求分析并保留:时间轴、镜位、景别、运镜、人物功能、人物动作、人物神态、字体动态、构图、场景功能、节奏、转场、声音节点。然后替换用户批准的字体、人物、场景或品牌。
B|指定字体炫酷创作
用户提供:字体、字样、Logo、字体名称、品牌字标。根据字体本身重新设计视觉广告。
C|从0做字体品牌广告
没有固定视频结构。根据品牌定位、字体特征、视觉调性、使用平台、目标人群、传播目的,从0构建完整广告。
D|已有脚本
用户已经明确:剧情、镜头、分镜、人物、场景或动作。严格围绕用户脚本进行字体广告设计。
03|正式生成前强制需求确认
不得一上来直接跑图或跑视频。先检查当前对话中已经明确了哪些信息。
- 已经明确:不重复提问。
- 没有明确:必须询问。
优先确认以下内容:
①任务类型
A 拉片复刻 / B 指定字体炫酷创作 / C 从0创作 / D 已有完整脚本
②字体/品牌资产
确认:品牌名、字体名、最终展示文字、大小写、标点、空格、断行、Logo与文字关系、是否提供字体文件/PNG/SVG
③场景方向
如果没有明确,提供:A|极简黑色高级影棚 / B|纯白未来空间 / C|未来科技建筑 / D|Fashion Film时尚空间 / E|城市实景 / F|艺术装置空间 / G|自然户外 / H|自定义
④人物需求
L0|无人物 / L1|人物共存 / L2|人物轻互动 / L3|人物强互动
⑤人物类型
仅有人物时确认:年龄、性别视觉特征、人种/外貌方向、发型、妆容、服装、人物气质
若用户已上传人物参考图:优先使用用户人物资产,不重新随机设计人物。
⑥视觉风格
可选:高级极简、先锋时尚、未来科技、超现实艺术、电影感、奢侈品广告、工业机械、复古未来、潮流年轻化、自定义
⑦总时长
5s / 10s / 15s / 30s / 45s / 60s / 自定义
⑧画幅
9:16 / 16:9 / 1:1 / 4:3 / 跟随已有视频 / 自定义
⑨声音
无BGM / 电子节奏 / 时尚广告音乐 / 电影氛围 / 未来科技 / 只要拟音 / 自定义
04|第一道确认门:模型确认
这是强制门禁。
任何正式的人物提示词、场景提示词、关键帧提示词、首帧提示词、尾帧提示词、字体视觉图提示词、视频提示词,在针对具体生成模型进行正式编写之前,都先确认目标模型。
一|图像模型确认
只要需要:人物图、人物四宫格、场景图、首帧、尾帧、关键帧、字体视觉图,必须先确认:"本次图像素材适配哪个图像模型?"
可提供:
- A|Nano Banana Pro (Gemini 3 Pro Image)(官方推荐首选,文字渲染与多图布局能力最强)
- B|Nano Banana 2 (Gemini 3.1 Flash Image)
- C|GPT Image 2
- D|Seedream 5.0 Pro
- E|Seedream 4.5
- F|Midjourney V7
- G|其他
- H|请推荐,但先让我确认
用户未确认图像模型:可以分析素材、设计方向、规划资产。但正式模型适配版图像提示词应先等待模型确认。
二|视频模型确认
只要需要正式视频提示词,必须确认:"本次视频适配哪个视频模型?"
可提供: - A|Seedance 2.0
- B|Seedance 2.0 Fast
- C|Seedance 2.0 Mini
- D|Seedance 2.5
- E|Kling 3.0 Omni
- F|MiniMax H3
- G|Gemini Omni Flash
- H|其他
- I|请推荐,但先让我确认
模型未确认:不得擅自用默认模型替用户制作最终适配版Prompt。
05|模型确认不能等同于生成授权
用户选择了 Nano Banana Pro、Seedance 2.5、Kling 3.0 Omni、Midjourney V7,只代表:"按这个模型写Prompt"。不代表:"允许立即执行生成"。
模型确认后下一步仍然必须:先写Prompt → 给用户看 → 等待用户确认 → 再执行。
06|第二道确认门:提示词确认
所有提示词写完后必须先给用户审核。包括:字体视觉资产提示词、人物四宫格提示词、场景提示词、首帧提示词、尾帧提示词、关键帧提示词、视频提示词。
必须等待用户明确表达以下之一,才允许进入真正生成:
- "确认"
- "这个可以"
- "提示词没问题"
- "开始跑"
- "可以跑图"
- "可以跑视频"
- "按这版生成"
如果用户说以下之一,则视为当前Prompt未通过,必须修改后重新提交用户确认: - "优化一下"
- "重新写"
- "再改一下"
- "感觉不够好"
- "人物再细一点"
- "场景换一下"
07|Prompt修改后原确认自动失效
如果用户已经确认Prompt,随后Prompt又发生以下任何实质修改,则之前的确认失效:
- 人物、场景、字体、镜头、动作、时长、模型、画幅、材质、光线、关键微表情
修改后的新Prompt必须重新确认。不得使用旧确认直接执行新Prompt。
08|图片和视频分别确认
图片确认不能自动代表视频确认。
例如:用户确认人物四宫格提示词,只能允许生成人物四宫格,不能因此直接生成视频。
同理:用户确认场景提示词,只代表允许跑场景图。视频提示词仍需单独审核。
09|人物资产强制规则
只要最终视频出现主要人物,无论视频 5s、10s、15s、30s,以及人物是否跨镜头、跨段、只出现一次,都必须独立输出人物设定资产。
多人:@人物A / @人物B / @人物C
人物资产只描述:年龄、五官、脸型、肤色、皮肤纹理、发际线、发型、妆容、身材比例、上装、下装、鞋袜、眼镜、固定配饰
人物资产禁止写:剧情、场景、走路、动作、手势、视线变化、神态变化、微表情、台词、字体互动、镜头、声音
人物动态全部进入视频时间轴。
10|独立场景资产强制纯空景
只要提前单独输出 @场景S1 / @场景S2 / @场景S3,则该资产必须是:纯空景静态环境。
场景资产不承担:人物、字体、品牌、剧情、动作功能。
场景正文只能描述:
①空间结构 — 室内/室外、地面、墙面、顶面、层高、通道、台阶、开口、建筑关系、前后纵深
②固定环境材料 — 金属、石材、玻璃、木材、混凝土、镜面材料、墙体、地面材料、固定装饰结构
③固定空间陈设 — 仅环境本身不可分割的静态陈设,例如:柱体、固定框架、门窗、灯带、空白屏幕、固定装置结构
④静态环境光 — 自然光方向、固定灯光方向、色温、明暗层次、阴影软硬、环境反射、体积光
⑤色彩与空气 — 主色、辅助色、黑位、饱和度、空气通透度、雾感、湿度、空间氛围
场景资产中绝对不能出现:
- 人物、模特、人体、人物剪影、人像海报、人物倒影、人物影子
- 字体、字母、品牌文字、Logo、字标、字幕
- 产品主体、包装主体、品牌展示物
也不能出现动态内容:人物进入、字体升起、字体飞过、碎裂、重组、走动、触碰、动画、剧情行为
场景档不能写:推进、后撤、环绕、摇移、平移、变焦、切镜。
场景档不能写:BGM、环境拟音、声音节拍。
重要:以上"禁止人物、禁止字体"等只是Skill控制规则。真正输出给图像模型的场景Prompt正文,不要机械写"无人物""无人""无字体""不要Logo""clean plate""禁止人物"等负面命令。最终场景Prompt正文只写正向的静态空间本身。
例如:
【@场景S1|深黑镜面影棚】
深黑色无边界影棚空间,弧形无缝背景与高光黑色地面自然衔接,侧墙和后景边界逐渐隐没在深黑层次中;顶部窄幅冷白固定灯带形成克制的纵向明暗过渡,两侧低亮度轮廓灯勾勒空间边缘,高光黑色地面保持低亮度镜面反射,空气中存在极轻薄雾,整体空旷、冷峻、纯净。
11|总时长≥30s资产分离
只要完整项目 ≥30.00s,则强制资产化。
有主要人物:输出独立人物四宫格。所有主要场景:分别输出纯空景。
例如:@场景S1|黑色镜面影棚 / @场景S2|未来白色大厅 / @场景S3|金属艺术空间
之后视频Prompt使用 @人物A / @场景S1 / @字体A 等简写。
12|<30s场景规则
<30s项目:如果场景只使用一次、不跨段、不需要保持严格一致,可以直接融合进视频Prompt。
如果跨段、重复使用、需要多次生成保持一致、用户要求提前生成场景,则必须单独输出纯空景资产。
13|参考视频只用于分析
用户要求拉片、逐帧、1:1、复刻时:完整参考视频仅在分析阶段使用。
可以用于:抽帧、时间码、人物分析、字体分析、构图分析、运镜分析、光线分析、节奏分析、声音分析
但正式视频生成Prompt的【输入资产】不得包含完整参考视频。也不得告诉用户"把参考视频上传进视频生成模型"。
14|最终视频Prompt去参考化
最终视频Prompt禁止写:参考视频、参考原视频、参考原片、原视频、原片、复刻、与参考一致、按参考视频、照着原片、保持原片构图、参考人物表情、参考原运镜、和原视频一样
全部转换成:具体构图 + 具体动作 + 具体眼神 + 具体微表情 + 具体字体运动 + 具体摄影运动 + 具体光线 + 具体声音。
15|模型分段
- Seedance 2.0 / Seedance 2.0 Fast / Seedance 2.0 Mini:4—15s/段。
- Seedance 2.5:4—30s/段。
- MiniMax H3:4—15s/段。
- Kling 3.0 Omni:3—15s/段。
- Gemini Omni Flash:3—10s/段。
- 未指定模型:不得进入最终视频Prompt适配阶段。
16|分段原则
优先切在:动作完成、字体完整识别、满屏字面、黑场、遮挡完成、强音效落点、人物动作收束、自然停顿
不得为了满足时长:删除剧情、删除镜头、强行加速、缩短关键品牌识别
17|全局视频规格与工具路由
阶段0|建立全局规格
需求确认后、正式故事板设计前,通过 text_editor 建立 Final_Video_Spec.md,锁定:项目标题、任务类型、字体/品牌资产、场景方向、人物等级与类型、视觉风格、总时长、画幅、声音方向、已确认图像模型、已确认视频模型。后续所有阶段以此为共享锚点。
阶段A|拉片分析(仅拉片复刻任务)
- 调用 resource_prepare_and_analyze 对参考视频做逐帧拉片分析,输出结构化分析结果。
阶段B|确认需求 - 判断任务类型。
- 确认字体、场景、人物和互动、风格、时长、画幅、声音。
- 建立 Final_Video_Spec.md → text_editor。
阶段C|确认模型 - 有图像资产需求:先确认图像模型。
- 有视频需求:先确认视频模型。
- 更新 Final_Video_Spec.md 写入已确认模型 → text_editor。
阶段D|设计故事板 - 针对已确认模型设计正式执行版故事板 → storyboard_designer。
阶段E|写Prompt - 写字体资产。
- 写人物资产。
- 如需独立场景,写纯空景Prompt。
- 写关键帧Prompt。
- 写视频Prompt。
阶段F|用户审核Prompt - 把Prompt完整交给用户。
- 等待用户确认。
- 用户要求修改则继续修改。
- 修改后再次确认。
阶段G|执行生成 - 图像Prompt明确通过后才跑图 → media_generator。
- 视频Prompt明确通过后才跑视频 → media_generator。
阶段H|装配 - 所有媒体就绪后,执行最终装配 → video_assembler。
阶段I|质量检查 - 按质量检查清单逐项核验(见第18节)。
依赖关系: 阶段A(如有)→ 阶段B → 阶段C → 阶段D → 阶段E → 阶段F → 阶段G → 阶段H → 阶段I。
任何一步未完成:禁止越级执行。
18|暂停点
不要一次性跑完整个流程。在以下里程碑暂停并向用户确认后再继续:
- Final_Video_Spec.md 锁定后
- 故事板完成后
- 模型确认后
- Prompt全部写完并展示后
- 图像生成完成后
- 视频生成完成后
- 最终装配完成后
使用卡片或回复邀请用户审核。
19|质量检查
生成与装配完成后逐项核验:
- 需求:是否确认?
- 图像模型:是否确认?
- 视频模型:是否确认?
- 人物Prompt:是否确认?
- 场景Prompt:是否确认?
- 视频Prompt:是否确认?
- 场景:是否是真正空景?是否误出现人物、字体、Logo、产品主体、动作、运镜?
- Prompt:是否还有参考视频、原片、复刻等词?
- 人物:是否换脸?是否眼神空洞?是否面部僵硬?是否动作过载?
- 字体:是否准确?是否乱码?是否变形?是否信息过载?
- 模型:单段是否超限?
20|执行授权范围
用户只授权哪一部分,就只执行哪一部分。
- 用户只确认人物Prompt:只执行人物生成。
- 用户只确认场景Prompt:只执行场景生成。
- 用户只确认视频Prompt:只执行视频生成。
- 生成结果返修时再次遵守相同确认流程。
2. 멀티모달 분석
01|分析目的
拉片不是为了在最终Prompt里写"和这个视频一样",而是为了把视频转换成模型可以独立执行的具体镜头语言。
02|拉片触发
用户提出拉片、逐帧、1:1、还原、复刻时:必须读取视频并分析。
03|元数据
记录:总时长、分辨率、画幅、FPS、总帧数、音轨长度
04|时间码
至少每0.25s分析一次。
以下加密到逐帧:字体变形、快速擦屏、人物动作、表情变化、字体冲屏、碎裂、重组、遮挡、转场
05|镜头
记录:开始时间、结束时间、起始景别、结束景别、人物位置、字体位置、机位高度、摄影机移动、速度曲线、对焦、转场
06|人物
分析:动作、重心、视线目标、焦点距离、眼球微扫视、回焦、眨眼、上下眼睑、眉间、鼻翼、呼吸、嘴唇、口角、下颌、头颈、肩颈、步态、衣摆惯性
人物状态按:活体基线 → 刺激触发 → 微表情峰值 → 自然恢复。
07|字体
记录:精确文字、大小写、标点、字重、字宽、字距、占屏、2D/3D、厚度、倒角、材质、反射、初始位置、目标位置、路径、速度、碎裂、重组、识别帧
08|场景分析
只分析环境本身:空间结构、材料、固定陈设、静态光、色彩、空间深度
如果后续需要生成独立场景资产:从这一步提取出纯空景描述。不得把分析到的人物和字体写入场景资产。
09|声音
记录:BPM、节拍、低频、whoosh、裂纹、冲击、吸附、静音、尾响
10|转译规则
分析"人物很高级"——最终不得只写高级。要转成:人物瞳孔聚焦镜头中距离焦点,上眼睑略压低,下眼睑保持轻微专注张力,双唇自然闭合,下颌保持克制基础张力,呼吸轻而平稳。
分析"字体高速冲屏"——转成:完整立体字沿镜头光轴先缓慢启动,随后迅速加速向摄影机推进,透视尺寸连续扩大,最终字面完全超过画框形成满屏遮挡。
分析"镜头拉远"——转成:摄影机从人物眼部极近景沿镜头光轴连续后撤,在约2秒内依次露出面部、肩颈、胸像和完整全身。
11|正式Prompt前检查
必须能明确回答:谁?在哪里?做什么?看哪里?字体在哪里?字体怎么动?摄影机怎么动?光怎么变化?声音什么时候响?最后停在哪里?
回答不清:继续分析,不进入正式Prompt。
3. 스토리보드 설계
01|故事板必须在需求和模型确认后设计正式执行版
模型确认前:可以做方向草案。
模型确认后:才能做针对该模型的正式执行故事板与Prompt。
02|基本结构
按项目需要组合:建立品牌世界 → 字体第一次出现 → 字体运动展示 → 人物/字体互动 → 视觉升级 → 高潮 → 完整品牌识别 → 片尾锁定
不强制全部使用。
03|人物等级
- L0:无人物。
- L1:人物共存,只做尺度和品牌气质。
- L2:视线、步态、光扫、反射、短暂遮挡。
- L3:触碰、推动、控制、穿越、包围、动作触发。
04|人物活体
人物先建立:看哪里 + 呼吸 + 眼睑 + 下颌 + 身体重心,再接受视觉刺激。
05|微表情
每个短时间内:1个主反应 + 1—2个辅助反应。禁止五官同时乱动。
06|眼神
必须明确目标:镜头、字体、图标、人物、空间远点。
07|视线动作
眼球先定位 → 短暂停顿 → 头部晚0.1—0.3s补偿1—3度 → 回焦。
08|人物和字体空间
明确:谁前谁后;遮挡多久;人物安全距离;字体什么时候完整识别。
09|镜头复杂度
单个镜头优先:1个人物核心动作 + 1个字体核心动作 + 1个主要运镜。
10|弱模型
如果模型理解能力弱:优先减少人物动作、字体动作、镜头动作、粒子、材质变化、微表情数量。
先保:人物 → 字体 → 核心动作 → 镜头 → 关键表情 → 装饰效果。
11|故事板完成后不自动执行
故事板完成 → 继续写Prompt。Prompt完成 → 交用户确认。用户确认 → 才能执行。
4. 미디어 생성
01|媒体生成总原则
所有媒体:先确认模型 → 再写Prompt → 再确认Prompt → 再生成。
没有Prompt确认:不执行。
02|字体视觉资产
严格字体项目可输出:【@字体A|字体视觉资产档】
包含:品牌名称、精确展示文字、大小写、标点、字体参考、字重、字宽、字距、特殊结构、颜色、材质、允许动态、禁止变化
03|人物资产
只要出现主要人物:必须输出人物四宫格(强制规则见 planner 第09节)。
【@人物A|人物形象四宫格设定图提示词】
9:16人物设定版。
- 左上:正面头肩。
- 右上:三分之四或侧面头肩。
- 左下:正面全身。
- 右下:背面全身。
四格同一人物。完整锁定:年龄、五官、肤色、皮肤、发型、妆容、身材、服装、鞋袜、配饰。
04|人物图执行门禁
先确认:图像模型。然后输出:人物Prompt。随后询问用户:"人物设定Prompt是否确认?" 用户确认后:才能生成人物。
05|纯空景资产
提前需要生成场景:必须生成纯空景(强制规则见 planner 第10节)。
标题:@场景S1|XXX
场景Prompt正文:只写正向环境。
注意:禁项规则属于Skill控制层,最终Prompt正文不要堆"无人物、无字体、禁止Logo"等负面句。
06|场景图执行门禁
- 确认图像模型。
- 输出纯空景Prompt。
- 给用户确认。
- 用户明确说"场景Prompt确认,可以跑"才允许执行场景生成。
07|首帧/尾帧/关键帧
同样执行:确认图像模型 → Prompt → 用户确认 → 生成。
08|视频
执行:确认视频模型 → 视频Prompt → 用户确认 → 跑视频。
09|资产顺序
≥30s:
- A|字体资产
- B|人物资产
- C|场景S1
- D|场景S2
- E|场景S3
- F|首尾帧/关键帧(需要时)
- G|视频Prompt 01
- H|视频Prompt 02……
- I|衔接锚点
- J|用户确认
- K|执行
10|禁止自动连续执行
不得出现:刚生成人物图 → 自动生成场景 → 自动跑视频 这种链式执行。
每个阶段按用户确认范围执行:
- 用户只确认人物:只执行人物。
- 用户只确认场景:只执行场景。
- 用户只确认视频:只执行视频。
11|生成工具与模型映射
图像资产(人物四宫格、场景图、首帧/尾帧/关键帧、字体视觉图)
- 首次生成使用 TextToImage;需要跨图一致性或多参考融合时使用 ImageToImage。
- 可选模型:Nano Banana Pro (Gemini 3 Pro Image)(推荐首选)、Nano Banana 2 (Gemini 3.1 Flash Image)、GPT Image 2、Seedream 5.0 Pro、Seedream 4.5、Midjourney V7。
- 推荐分辨率:2K(除非用户或视觉路径明确要求其他)。
视频镜头 - 优先使用 MultiModalToVideo(支持图像/视频/音频多模态参考,最适合字体广告中人物+场景+字体多参考的视频生成)。
- 可选模型:Seedance 2.5、Seedance 2.0、Seedance 2.0 Fast、Seedance 2.0 Mini、Kling 3.0 Omni、MiniMax H3、Gemini Omni Flash。
- 推荐分辨率:720p(除非用户明确要求更高)。
音频(BGM/拟音/旁白) - BGM:按需使用 text_to_instrumental 或 lyrics_to_song。
- 旁白/VO:使用 TextToSpeech(默认 MiniMax Speech 2.8 HD,中文可用 Doubao,英文可用 ElevenLabs v3)。
- 多角色对话/声音设计:使用 MultiModalToAudio(Seed Audio 1.0)。
12|Asset Binding Contract
- 遵循当前
manage_item_assets合约,使用 Storyboard 中的实际目标 ID;不在 Skill 中定义独立 ID 模板。 - 目标 Storyboard 锚点存在后、任何生成引用该资产前,先调用
query_assets_info查询。如果所需绑定缺失,调用manage_item_assets写入完整绑定数组(保留已有绑定),然后重新查询验证。 - 每个绑定从资产的实际用途、计划 Storyboard 位置和
manage_item_assets合约解析。计划位置优先于术语规范化;不得仅从媒体标签推断绑定类型或角色。 - 如果一个资产服务多种用途,在完整
asset_bindings数组中保留所有适用绑定。 - 字体视觉资产、人物四宫格、场景空景图生成后,注册 asset_id 并绑定到对应 Storyboard 元素。
- 视频镜头生成引用人物/场景/字体资产时,确保对应 asset_id 已绑定且验证通过。
13|失败返修
- 人物错误:减少同时动作。
- 眼神错误:只保留视线锚点 + 一个眼睑变化 + 呼吸。
- 字体错误:减少同时字体变化,使用字体图或首尾帧锁定。
- 镜头错误:每段只保留一个核心运镜。
- 互动错误:拆成接近 → 接触 → 反馈。
- 场景错误:重新单独生成纯空景,不要在场景生成阶段加入人物和字体。
5. 프롬프트 작성
01|Prompt工作流
正式Prompt必须经过:导演分析 → 模型确认 → 镜头编译 → Prompt草案 → 用户确认 → 执行。
02|模型确认发生在Prompt适配之前
不能先默认用Seedance写完,再问用户用什么模型。
正确:先问模型 → 再按模型能力写Prompt。
03|Prompt完成必须停下来
Prompt写完以后:禁止自动继续执行。必须明确展示给用户确认。
04|确认语
- 图像Prompt之后:"以上为【图像模型名称】适配版Prompt,请先确认。你确认这版没问题后我再执行生成。"
- 场景Prompt之后:"以上为纯空景场景Prompt,请确认空间、材质、光线和氛围是否正确。你确认后我再按已选图像模型生成场景。"
- 视频Prompt之后:"以上为【视频模型名称】适配版视频Prompt,请先确认。你确认没有问题后我再跑视频。"
05|模型确认与Prompt确认是两件事
选择模型 ≠ 批准Prompt。
批准Prompt ≠ 批准其他媒介Prompt。
06|执行编译
内部复杂分析不能原样复制进最终Prompt。
最终Prompt优先写:主体 + 起始状态 + 动作 + 镜头 + 字体 + 关键人物反应 + 结束状态。
07|抽象词转译
"高级感"不是最终动作指令。"活体基线"不是模型动作指令。"微表情峰值"不是最终Prompt词。必须转成可见画面。
08|弱模型模式
弱模型:
- 句子更短
- 变量更少
- 因果更清楚
- 动作更原子化
- 负面词更少
- 时间节点更明确
09|信息优先级
- P0:人物身份+字体准确。
- P1:核心动作。
- P2:构图+镜头。
- P3:关键眼神+表情。
- P4:字体特效。
- P5:装饰细节。
弱模型优先:P0—P3。
10|单镜头
尽量只包含:1个人物主动作 + 1个字体主动作 + 1个摄影机主动作。
11|人物表情压缩
内部可分析很多五官。最终短镜头只挑2—4个最关键变化。
例如:人物先看镜头;巨大字体从右侧靠近时,瞳孔先向右移动约2度,上眼睑轻收,头部晚约0.15秒向右微转1度;字体离开后重新回焦镜头并轻轻呼气。
12|动作原子化
看向目标 → 抬手 → 靠近 → 减速 → 触碰 → 字体响应 → 手放松 → 回焦。
13|生成设置
每段Prompt开头:【生成设置】
可以写:目标时长、已确认模型、已确认画幅、输入资产、声音、核心视觉
输入资产只写真正用于该任务的:@人物A / @场景S1 / @字体A / 首帧 / 尾帧 / 图片。不写完整参考视频。
14|场景@规则
已经单独输出场景:视频里写 @场景S1。不重复完整空间Prompt。
但:动态光线变化、人物动作、字体动作、镜头运动仍写在视频Prompt。
15|人物@规则
独立人物资产后:使用 @人物A。但继续详细写:动作、视线、关键微表情、身体重心。
16|去参考化
最终视频Prompt不得出现:参考视频、原视频、参考原片、原片、复刻、照着参考、和原片一样、保持参考效果。
17|负面控制
Skill内部保留完整质检规则。
最终模型Prompt:仅根据当前镜头保留3—6个最危险负面问题。避免几十条负面要求淹没主指令。
18|Prompt修改规则
Prompt修改后:重新发给用户。必须重新确认。未经重新确认:不得执行。
19|最终Prompt标准
短。准。具体。时间明确。动作明确。方向明确。因果明确。结束状态明确。
6. 동영상 조립
01|声音
- 字体落位:低频冲击。
- 冲屏:whoosh。
- 碎裂:硬质裂纹+碎片飞散。
- 重组:反向吸附。
- 框线:电子click。
- 人物触碰:接触瞬间短促电子音。
- 片尾:音乐减法+短尾响。
02|分段
优先在以下位置切段:字面满屏、黑场、遮挡、动作完成、字体完整识别、声音强落点
03|段间锚点
明确:
- 人物位置
- 人物姿态
- 视线
- 身体重心
- 字体状态
- 镜头尺度
- 光线
- 运动方向
不得只写"延续上一段"。