本文只讲《白骨岭·第二道影子》一个故事,从故事骨架、身份资产、叙事段落、故事板、关键帧、图生视频提示词到剪辑执行单完整走一遍。
先看最终效果定义
片名:《白骨岭·第二道影子》
形式:20~30 秒、16:9、原创东方奇幻预告片。用画面、环境声、旁白和字幕叙事,第一次不把口型同步设为门槛。
故事钩子:
悟空在白骨岭看见一个赶路人。人只有一个,地上却有两道影子。
最终交付:
- 角色、场景和关键道具资产;
- 2 个叙事段落的故事板;
- 6 张高质量关键帧;
- 3~6 个真正需要运动的视频镜头;
- 一支带声音、字幕和基础调色的 20~30 秒 MP4。
当前效果状态:
| 项目 | 状态 | 说明 |
|---|---|---|
| 故事与钩子 | 已锁定 | “一个人,两道影子”能在静音状态下复述 |
| 角色与场景文字设定 | 已完成 | 悟空、赶路人、白骨岭和三个道具已有提示词 |
| 角色/场景真实图片 | 已完成 | A001~A006 共 6 个角色、场景和道具资产已生成并验收 |
| 故事板与关键帧 | 已完成 | B01、B02 故事板及 S01~S06 关键帧已生成并验收 |
| 视频镜头 | 已完成 | S01~S06 共 6 个图生视频镜头已生成并进入最终剪辑 |
| 最终成片 | 已完成 | 25 秒、1920×1080、24fps,含环境声、中文旁白、字幕和尾卡 |
本项目只借用公版《西游记》的角色与世界观,不复刻具体电视剧、电影、游戏的演员脸、服装、镜头、音乐和美术设定。
实际资产目录:白骨岭-第二道影子(本地源文件)。图片与文本只存放在该项目目录;本教材直接链接目标目录文件,不在 Obsidian/iCloud 目录创建软链接或保存副本。
本案例中的全部静态图片均由 gpt-image-2 生成,附件文件名统一使用模型简写后缀 -gptImg2。S01~S03 视频由 MiniMax Hailuo 2.3 生成,S04~S06 分别由 Seedance 2 Mini、Seedance 2 Fast 和 Seedance 2 生成;视频文件名保留对应模型简写。
一条完整流程
不调用模型:这是流程示意。
写清 20~30 秒故事
→ 锁定角色、场景和道具资产
→ 拆成两个叙事段落并设计接缝
→ 画低成本故事板
→ 生成 6 张高质量关键帧
→ 每镜只写一个主要运动
→ 检查相邻镜头连续性
→ 剪辑、声音、字幕和成片
首帧决定人物、构图、光线和风格;视频生成主要负责“接下来怎样动”。关键帧有错脸、坏手、错误武器或矛盾光向时,不进入视频。
模型调用地图
| 步骤 | 调用模型 | 输入 | 输出 |
|---|---|---|---|
| 1. 故事骨架 | 📝 文本模型 | 创意和时长 | 五行故事骨架 |
| 2. 角色、场景、道具资产 | 🖼 生图模型 | 资产提示词;有参考图时一并上传 | 三视图、空场景、道具图 |
| 3. 叙事段落与接缝 | 📝 文本模型 | 锁定故事和资产清单 | 段落表、接缝卡 |
| 4. 故事板与关键帧 | 🖼 生图模型 | 身份源、场景源、基础提示词、镜头增量 | 故事板、关键帧图片 |
| 5. 镜头运动 | 🎬 视频模型 | 对应关键帧、运动基础提示词、镜头增量 | 单镜头视频 |
| 6. 剪辑执行单 | 📝 文本模型 | 已通过的镜头说明 | 时间线、声音和字幕方案 |
| 6. 实际剪辑 | 剪辑软件,不调用生成模型 | 已通过的视频、声音、字幕 | 最终 MP4 |
下面每个可复制提示词前都会再次标明调用模型。示例输出、资产记录、时间线和效果记录只是结果或记录模板,不发送给生图、视频模型。
1. 先把故事压缩成四句话
复制下面这段,让 AI 先输出可拍的故事骨架:
调用模型:📝 文本模型
请为一支 20~30 秒、16:9 的原创东方奇幻 AI 漫剧写一个最小故事骨架。
固定创意:孙悟空在白骨岭看见一个背竹篓的普通赶路人。人只有一个,地上却有两道影子。悟空不能立刻开打,他先观察并确认异常,最后握紧金箍棒留下悬念。
要求:
1. 只写一个钩子、一个目标、一个障碍、一个转折和一个结尾;
2. 删除台词后,仍能靠画面看懂“人—两道影子—悟空发现—准备出手”;
3. 不增加唐僧、八戒、沙僧、打斗、变身或新地点;
4. 不复刻任何现有电视剧、电影、游戏的具体造型、镜头和台词;
5. 最后只输出五行:钩子、目标、障碍、转折、结尾。
本案例锁定后的结果:
不调用模型:这是上一个文本提示词的示例输出。
钩子:白骨岭上,一个赶路人有两道影子。
目标:悟空要在不惊动师父的情况下确认对方身份。
障碍:对方的外表、声音和脚步都与常人无异。
转折:风停时,第二道影子仍在移动。
结尾:悟空握紧金箍棒——“妖气藏得住,影子藏不住。”
生成结果文件:01-故事骨架.md(本地源文件)
删掉台词后,观众仍能靠“人—两道影子—悟空发现—准备出手”复述故事,才进入视觉制作。
2. 先建资产,再做镜头
不要逐镜重新生成角色和场景。先得到稳定的角色、空场景和道具资产,再让每张关键帧引用同一批身份源。
先按参数筛选生图模型
下面是复现或后续生成时使用的推荐参数,不反推已有示例图片当时的原生生成参数。提示词描述画面,比例、分辨率、参考图数量和生成数量在模型设置面板或 API 参数中填写。
不调用模型:这是生图模型的基础设置参数。
生成数量:每个资产或镜头每次 1 张,只重做失败项
测试质量:标准
正式质量:高质量或模型可用的最高档
3:4 测试分辨率:约 1024×1365
3:4 正式分辨率:优先 1536×2048;不支持时选择最高可用的 3:4 竖图
1:1 测试分辨率:1024×1024
1:1 正式分辨率:优先 2048×2048;不支持时选择最高可用方图
16:9 测试分辨率:1280×720
16:9 正式分辨率:优先 1920×1080;不支持时选择最高可用的 16:9 横图
输出格式:优先 PNG;模型只输出 JPEG 或 WebP 时保留原文件
色彩:优先 sRGB;模型不开放色彩空间选项时使用默认值
文字与水印:关闭
固定种子:同一角色或同组镜头优先使用;模型不支持时忽略
选择模型时按制作阶段检查:
| 制作阶段 | 本项目最低要求 | 不满足时怎么处理 |
|---|---|---|
| 第一批角色、场景、道具 | 支持文生图,并支持 3:4、1:1、16:9 | 可换模型分别生成,但必须通过资产验收 |
| 故事板 | 至少能同时上传 3 张参考图,并支持 16:9 | 只能作为草图测试,不能直接锁定身份与场景 |
| 正式关键帧 | 至少能同时上传 4 张参考图,能保持角色、场景和道具身份 | 不用于正式关键帧;高分辨率不能弥补角色漂移 |
| 图片修复 | 支持参考图编辑或局部重绘 | 不能用文生图整张重抽代替单点修复 |
模型原生只支持较低分辨率时,可以在图片通过身份和构图验收后再放大,但必须把“原生分辨率”和“后期输出分辨率”分开记录。多参考图的身份保持能力比单纯分辨率更重要。
选择前可复制这张登记卡:
不调用模型:这是模型参数记录模板。
模型名称:
是否支持文生图:
是否支持参考图编辑:
最多可上传参考图数量:
是否支持局部重绘:
可选比例:
可选原生分辨率:
是否支持固定种子:
是否强制水印:
单张成本或消耗额度:
角色身份保持测试结果:
结论:可用于正式关键帧 / 只适合资产或故事板测试 / 不适合本项目
第一批资产
| ID | 类型 | 资产 | 用途 | 直接失败条件 |
|---|---|---|---|---|
| A001 | 角色 | 悟空标准三视图 | 全片身份锚点 | 5 个身份锚点缺失、三视图不是同一角色 |
| A002 | 角色 | 赶路人标准三视图 | 两个叙事段落的人物锚点 | 妖化、出现第二个人或多余肢体 |
| A003 | 场景 | 白骨岭空场景 | 全片空间与光线锚点 | 出现人物、人影、现代物品或空间不可拍 |
| A004 | 道具 | 黑铁金箍棒 | 悟空动作与细节镜头 | 结构、颜色或两端环纹错误 |
| A005 | 道具 | 旧竹篓 | 赶路人身份与接缝 | 出现人物、手或现代材料 |
| A006 | 道具 | 暗红旧经幡 | 色彩与风向锚点 | 出现可读文字、品牌标志或错误鲜艳红色 |
“第二道影子”是赶路人在特定镜头里的异常状态,不单独做成第二个角色,避免模型把一个人变成两个人。
🖼 生图|A001 悟空标准三视图
- 瘦削敏捷的石猴体态,琥珀棕短毛;
- 窄长金色箍环,额前中央有一处细小缺口;
- 暗红短袍,外覆黑金小片甲,右肩有旧磨损;
- 黑铁金箍棒,两端暗金环纹;
- 金褐色眼睛,警觉但不过分凶狠。
直接复制:
调用模型:🖼 生图模型
参数增量:文生图;无参考图;3:4;测试约 1024×1365、正式优先 1536×2048;生成 1 张;高质量。
原创东方奇幻电影角色标准三视图,不参考任何现有电视剧、电影、游戏或演员造型。设计孙悟空:瘦削敏捷的石猴体态,琥珀棕短毛,窄长金色箍环且额前中央有一处细小缺口,暗红短袍,外覆黑金小片甲,右肩有旧磨损,黑铁金箍棒两端带暗金环纹,金褐色眼睛,警觉而克制。输出同一角色正面、左侧面和背面,身体比例、脸、毛色、箍环、服装、右肩磨损和金箍棒完全一致。中性站姿,纯白背景,均匀设定稿光线,写实东方奇幻电影角色设计,3:4。不要动作特效、场景、文字、品牌标志、额外人物、重复身体或多余肢体。
生成结果:

验收:可用。三视图身份一致,箍环、暗红衣甲和黑铁棒锚点清楚;体态比文字设定略结实。
🖼 生图|A002 赶路人标准三视图
调用模型:🖼 生图模型
参数增量:文生图;无参考图;3:4;测试约 1024×1365、正式优先 1536×2048;生成 1 张;高质量。
原创东方奇幻电影角色标准三视图。设计一名普通中年山民赶路人:清瘦但健康,风吹日晒的自然肤色,黑灰头发在脑后简单束起,穿旧靛青粗布短褂、灰褐长裤和磨损草鞋,背一只旧竹篓,神态疲惫、安静、没有攻击性。
输出同一角色的正面、左侧面和背面,脸、年龄、发型、衣服、鞋和竹篓完全一致。中性站姿,纯白背景,均匀设定稿光线,写实东方奇幻电影角色设计,3:4。
角色外表必须完全像普通人,不妖化;不要骨骼、尖牙、发光眼、第二道影子、第二个人、文字、品牌标志、动作特效、重复身体或多余肢体。
生成结果:

验收:可用。普通人身份明确,三视图一致,发髻、旧靛青短褂、草鞋和竹篓锚点清楚。
🖼 生图|A003 白骨岭空场景
调用模型:🖼 生图模型
参数增量:文生图;无参考图;16:9;测试 1280×720、正式优先 1920×1080;生成 1 张;高质量。
原创东方奇幻电影空场景设定:白骨岭山道,灰白岩石形成狭窄弯道,三棵枯黑树构成前中后景,薄而贴地的冷雾沿山道流动,一小段暗红旧经幡挂在右侧枯枝上。阴天傍晚,冷月从左后方被云层部分遮挡,主色为蓝灰与骨白,暗红只占很小面积。山道要能清楚容纳前后两个人物并留下地面影子区域,写实东方奇幻电影概念图,35mm 镜头,16:9。不要人物、人影、肖像、路人、身体部位、骷髅堆、墓碑、建筑、现代物品、文字或品牌标志。
生成结果:

验收:可用。空场景成立,山道可容纳前后两人,影子区域、冷月、枯树、薄雾和暗红经幡锚点清楚。
🖼 生图|A004 黑铁金箍棒
调用模型:🖼 生图模型
参数增量:文生图;无参考图;1:1;测试 1024×1024、正式优先 2048×2048;生成 1 张;高质量。
原创东方奇幻电影道具设定:一根细长而有重量感的黑铁长棍,棍身深灰黑,表面有克制的锻造纹理,两端各有三道暗金环纹,边缘有少量长期使用留下的磨损,比例适合瘦削敏捷的石猴战士双手使用。
单独完整横向展示,中性深灰背景,柔和侧光强调黑铁与暗金材质,写实电影道具摄影,1:1。不要人物、手、文字、品牌标志、火焰、发光符文、额外刀刃、额外配件或变形结构。
生成结果:

验收:可用。黑铁材质、细长结构和两端各三道暗金环纹清楚。
🖼 生图|A005 旧竹篓
调用模型:🖼 生图模型
参数增量:文生图;无参考图;1:1;测试 1024×1024、正式优先 2048×2048;生成 1 张;高质量。
原创东方古代山民道具设定:一只使用多年的旧竹篓,细竹条手工编织,椭圆开口、底部略窄,两条暗棕色旧布肩带,局部竹条颜色变深并有轻微磨损,但结构完整。
单独完整展示,中性暖灰背景,柔和侧光,写实电影道具摄影,1:1。不要人物、手、食物、武器、文字、品牌标志、现代塑料或额外装饰。
生成结果:

验收:可用。竹编、椭圆开口、略窄底部和两条旧肩带完整。
🖼 生图|A006 暗红旧经幡
调用模型:🖼 生图模型
参数增量:文生图;无参考图;1:1;测试 1024×1024、正式优先 2048×2048;生成 1 张;高质量。
原创东方奇幻电影场景道具:一条窄长的暗红旧布幡,低饱和深红色,布边磨损并有两处自然撕裂,颜色因风雨略微褪去,表面没有任何可读文字、符号或品牌标志。
单独完整展示,中性灰背景,轻微侧风让布料形状清楚,柔和侧光,写实电影道具摄影,1:1。不要人物、手、旗杆、金色图案、发光效果、现代材质或额外配件。
生成结果:

验收:可用。低饱和暗红、旧布纤维和两处自然撕裂清楚,无可读文字。
生成顺序
- 先生成 A001 悟空和 A003 白骨岭两张低成本样张;
- 样张先检查角色方向、画风、画幅和场景锚点;
- 任一失败先改身份卡或提示词,不继续批量;
- 样张通过后,再生成 A002、A004~A006;
- 每个资产单独生成和验收,只重做失败项;
- 所有通过资产登记后,再进入故事板。
资产记录:
不调用模型:这是生成后的记录模板。
资产 ID:
文件:
完整提示词:
比例与清晰度:
身份源:
可见问题:
状态:可用 / 需修改 / 受阻
使用镜头:
3. 拆成两个叙事段落,并把接缝单独设计
这里的“叙事段落”就是一个有明确进入状态、事件和退出状态的故事单元。
复制下面这段,让 AI 把已经锁定的故事拆成可衔接的段落:
调用模型:📝 文本模型
请把下面这个 20~30 秒东方奇幻故事拆成两个连续的叙事段落,并设计两个段落之间的接缝。
故事:孙悟空在白骨岭看见一个背旧竹篓的普通赶路人。赶路人只有一个,地上却有一道人影和一道细长的非人影。悟空先停步观察,发现第二道影子逆着雾移动,随后侧身挡路并缓慢握紧黑铁金箍棒,结尾留下悬念。
固定资产:孙悟空、赶路人、白骨岭山道、黑铁金箍棒、旧竹篓、暗红旧经幡。不得增加角色、地点、变身、打斗或新道具。
要求:
1. B01 用 0~15 秒完成“进入白骨岭—停步—看见两道影子”;
2. B02 用 15~30 秒完成“确认异常—挡住山道—握棒留悬念”;
3. 每段都写进入状态、本段事件和退出状态;
4. 单独写一张 B01→B02 接缝卡,包含缝合方式、前段结尾、后段开头和必须继承的光向、影子方向、雾方向、人物站位;
5. 保持冷月从左后方照来,雾从右向左移动,第二道影子从右下伸向左上;
6. 删除台词后,画面顺序仍然能看懂。
只输出:两个段落的表格,以及一张接缝卡。
本案例锁定后的结果:
| 段落 | 时间 | 进入状态 | 本段事件 | 退出状态 |
|---|---|---|---|---|
| B01 发现异常 | 0~15s | 悟空与赶路人相距较远,风与雾正常移动 | 悟空停步,地面出现两道影子 | 人不动,第二道影子逆着雾移动 |
| B02 识破并准备出手 | 15~30s | 继承第二道影子的方向与冷月光 | 悟空确认异常,手握金箍棒 | 悟空抬眼,影子伸长,留下悬念 |
接缝卡:
不调用模型:这是上一个文本提示词的示例输出。
B01 → B02
缝合方式:影子特写对位切。
前段结尾:第二道细长影子逆着雾移动,方向从右下伸向左上。
后段开头:悟空瞳孔内先出现同方向影子反射,再切到眼部近景。
必须继承:冷月来自左后方、影子方向、雾的移动方向、悟空站位。
生成结果文件:02-叙事段落与接缝.md(本地源文件)
4. 先画故事板,再生成 6 张关键帧
每个叙事段落先画 6~8 格低成本故事板,只检查顺序、景别、朝向、站位和接缝。再从全部格子里选 6 个真正承载叙事的画面做高质量关键帧。
使用方式:先复制一次故事板基础提示词,再追加 B01 或 B02 的增量提示词。
本组调用模型:🖼 生图模型
参数增量:多参考图生图;输入图 1 悟空、输入图 2 赶路人、输入图 3 白骨岭;16:9;测试 1280×720、正式优先 1920×1080;B01、B02 各生成 1 张;高质量;两张保持同一质量档与种子策略。
🖼 生图|故事板基础提示词
使用输入图 1 作为孙悟空唯一身份源,输入图 2 作为赶路人唯一身份源,输入图 3 作为白骨岭唯一场景参考。生成一张横向 8 格黑白线稿故事板,画幅 16:9,每格边界清楚,按从左到右、从上到下阅读。
只检查镜头顺序、景别、人物朝向、站位、光向和接缝。冷月始终来自左后方,雾从右向左移动,第二道影子从右下伸向左上。每格只出现一个悟空和一个赶路人;保持角色服装、道具和场景锚点一致。不要妖化、打斗、变身、文字、对白框、品牌标志、额外人物或额外肢体。
🖼 生图|B01 发现异常故事板
【故事板增量 B01|发现异常】
1. 白骨岭山道大远景,悟空从左下进入,赶路人在右上远处;
2. 悟空沿山道向前两步;
3. 侧后方中近景,悟空突然停步;
4. 悟空右耳轻抬,视线转向赶路人;
5. 低机位切到赶路人双脚;
6. 地面出现一道人影和一道细长非人影;
7. 赶路人身体不动,雾从右向左移动;
8. 第二道影子逆着雾、从右下向左上移动,作为段落结尾。
生成结果:

验收:可用。8 格顺序完整,低机位脚部和“两道影子”钩子清楚;第 7 格雾方向表现偏弱。
🖼 生图|B02 识破并准备出手故事板
【故事板增量 B02|识破并准备出手】
1. 继承上一段结尾,地面第二道细长影子从右下伸向左上;
2. 对位切到悟空瞳孔内同方向的影子反射;
3. 悟空眼部近景,额前箍环缺口清楚;
4. 悟空侧身转向山道中央;
5. 低机位中景,悟空挡住赶路人的去路;
6. 悟空右手缓慢握住身后的黑铁金箍棒;
7. 赶路人仍背对镜头、没有变身,暗红旧经幡轻动一次;
8. 悟空正面近景抬眼,棒端进入画面下缘,背后第二道影子伸长,留下悬念。
生成结果:

验收:可用作故事板。8 格叙事顺序成立;眼中影子和握棒姿势较概念化,因此没有直接作为最终关键帧使用。
从两张故事板中锁定以下 6 个关键帧:
| 镜头 | 时长 | 关键帧 | 观众必须看懂什么 |
|---|---|---|---|
| S01 | 3s | 大远景略高机位;悟空从左下进入,赶路人在右上远处,枯树分隔二人 | 地点和两人距离 |
| S02 | 3s | 中近景侧后方;悟空停步,右耳微抬,手尚未碰金箍棒 | 他听见异常 |
| S03 | 4s | 低机位地面特写;赶路人双脚停住,地上出现一道人影和一道细长非人影 | 异常被看见 |
| S04 | 3~4s | 悟空眼部特写;瞳孔反射两道影子,箍环缺口可见 | 他完成识破 |
| S05 | 5s | 中景低机位;悟空侧身挡住山道,缓慢握棒,赶路人背对镜头 | 冲突即将发生 |
| S06 | 4s | 近景正面;悟空抬眼,棒端进入下缘,背后第二道影子伸长 | 留下悬念 |
关键帧缩成小图后,人物朝向、月光方向、影子方向、武器位置和画面轴线不能互相打架。
上传顺序固定为:输入图 1 悟空、输入图 2 赶路人、输入图 3 白骨岭、输入图 4 黑铁金箍棒。先复制一次关键帧基础提示词,再追加 S01~S06 中的一条增量提示词。
本组调用模型:🖼 生图模型
参数增量:多参考图生图;输入图 1 悟空、输入图 2 赶路人、输入图 3 白骨岭、输入图 4 黑铁金箍棒;16:9;测试 1280×720、正式优先 1920×1080;S01~S06 每次单独生成 1 张;高质量;六张保持同一质量档与种子策略。
🖼 生图|关键帧基础提示词
使用输入图 1~4 作为唯一身份与场景参考;按当前镜头只显示需要的角色和道具。保持悟空的脸、琥珀棕短毛、箍环缺口、暗红短袍、黑金小片甲和右肩磨损一致;保持赶路人的脸、旧靛青粗布短褂、灰褐长裤、草鞋和旧竹篓一致;保持黑铁金箍棒结构一致。
原创东方奇幻写实电影风格,蓝灰与骨白为主色,暗红只作小面积强调,冷月始终来自左后方,雾从右向左移动,第二道影子从右下伸向左上,克制光效,16:9。每镜最多一个悟空和一个赶路人。不要妖化、打斗、变身、文字、品牌标志、现代物品、错误武器、额外人物或多余肢体。
🖼 生图|S01 白骨岭建立镜头
【关键帧增量 S01】略高机位大远景,35mm。狭窄弯曲的灰白山道从左下延伸到右上;悟空从左下刚进入,赶路人在右上远处背着旧竹篓前行。三棵枯黑树在前中后景分隔二人,右侧枯枝上有一小段暗红旧经幡,地面保留清楚的影子区域。
生成结果:

验收:可用。地点、人物距离和左下至右上的空间关系清楚;悟空持棒姿态略主动,但本镜不承担握棒节点。
🖼 生图|S02 悟空停步
【关键帧增量 S02】从悟空右后侧拍摄的中近景,50mm。悟空在山道左侧突然停步,身体朝向山道深处,右耳轻微抬起,眼睛看向远处赶路人;右手自然垂下,尚未触碰金箍棒。赶路人只作为右上远处的轻微虚化背景。浅景深,但悟空的脸、箍环缺口和右肩磨损清楚。
生成结果:

验收:可用。停步回望、右手远离金箍棒、远处赶路人和空间轴线均成立。
🖼 生图|S03 一个人,两道影子
【关键帧增量 S03】贴近地面的低机位特写,50mm,只拍赶路人的磨损草鞋、裤脚、山道地面和影子。双脚停住,画面只有一双人类脚。地面同时出现一道正常人影和一道更细、更长的非人影;两道影子都从右下向左上延伸,第二道稍微偏离。异常只存在于地面,不得变成第二个人或实体怪物。
生成结果:

验收:可用。单点修复后只有一双脚,正常人影与细长非人影清楚分开,异常始终贴地。
🖼 生图|S04 悟空识破
【关键帧增量 S04】悟空双眼和额头的极近特写,85mm。金褐色眼睛锐利但克制,额前箍环中央缺口清楚,毛发纹理自然。两只瞳孔内只反射同一个赶路人脚下的一道人影和一道细长非人影,方向从右下伸向左上。不要发光眼、夸张怒吼、第二张脸、错误反射或多余眼睛。
生成结果:

验收:可用。角色身份、箍环锚点和克制表情稳定;瞳孔反射较小,主要作为 S03 后的识破反应镜头。
🖼 生图|S05 挡路握棒
【关键帧增量 S05】中景低机位,35mm。悟空从左侧侧身挡在山道中央,身体朝向右上方赶路人,右手刚握住身后的黑铁金箍棒,尚未挥动。赶路人在右侧背对镜头,背着旧竹篓,保持普通人外表。暗红旧经幡位于两人之间的背景层。不要挥棒或打斗。
生成结果:

验收:可用。挡路关系、赶路人背对、竹篓、经幡以及“握住但未挥动”清楚。
🖼 生图|S06 悬念结尾
【关键帧增量 S06】悟空正面近景,50mm,位于中央略偏左,抬眼直视画外赶路人,表情警觉、克制。金箍棒一端从画面下缘进入但不遮脸。赶路人只在远处背景背对镜头,仍是普通人;脚下第二道细长非人影穿过雾向左上方明显伸长,并始终贴在地面。不要变身、打斗或发光特效。
生成结果:

验收:可用。悟空身份、棒端、远处赶路人和贴地第二道影子同时成立,适合作为悬念结尾。
用 S03 理解关键帧的“定格原理”
这里的“定格”不是定格动画,也不是让整段视频完全不动。它的意思是:先把一个故事瞬间做成正确的静态图片,锁定人物、场景、构图和异常状态,再让视频模型只负责这个瞬间之后的少量运动。
三个概念不要混在一起:
| 概念 | 作用 | 是否是最终画面 |
|---|---|---|
| 故事板 | 草拟镜头顺序、景别和站位 | 不是,允许画得粗糙 |
| 关键帧 | 定格一个必须正确的故事瞬间,作为图生视频首帧 | 是,必须达到正式画面质量 |
| 剪辑定格 | 让一张静态图在时间线上停留几秒,可加轻微推近 | 是一种低成本成片方法 |
以本故事的 S03“一个人,两道影子”为例:

这张关键帧先定格了 5 件事:
- 画面中只有一个赶路人;
- 正常人影与第二道细长非人影同时存在;
- 两道影子都贴在地面,方向从右下伸向左上;
- 第二道影子不是第二个人或实体怪物;
- 冷月、贴地雾、山道机位和赶路人站位已经确定。
进入视频模型后,不再让它重新设计赶路人、白骨岭和两道影子的初始状态,只增加一个事件:
使用这张关键帧作为完全一致的首帧。赶路人、机位、冷月光、山道、正常人影和第二道影子的初始位置保持不变。固定低机位,赶路人与双脚完全静止,正常人影保持不动,只有第二道细长的非人影逆着雾缓慢移动。影子始终贴在地面,不能变成第二个人或实体怪物。连续单镜头,不切镜。
可以把它理解成:
故事板决定“拍哪一刻”
→ 关键帧把这一刻定格正确
→ 视频模型只补“下一秒怎样动”
→ 剪辑决定这张图停多久、在哪里切走
如果静态关键帧已经出现第二个人、影子离开地面或影子方向错误,视频模型只会把错误动起来。因此先定格正确,再生成运动,是 AI 漫剧保持一致性的核心。
有些镜头甚至不必生成视频。例如悟空眼部特写,可以直接把关键帧放进剪辑时间线停留 2~3 秒,再加 3%~5% 的缓慢推近和环境声。这是“剪辑定格”,不是图生视频。
5. 图生视频只写“怎样动”
不要在视频提示词里重新描述角色长相和整张画面。一次只安排一个主要人物动作、一个镜头动作和最多一个环境动作。
把对应的 S01~S06 关键帧作为首帧上传。先复制一次运动基础提示词,再追加对应镜头的一条增量提示词。
本组调用模型:🎬 图生视频模型。不要发送给生图模型。
先按参数筛选视频模型
提示词负责描述“怎样动”,时长、比例、分辨率等内容优先在模型的设置面板或 API 参数中填写,不要反复塞进提示词。
这组镜头的基础参数只设置一次:
不调用模型:这是视频模型的设置参数。
生成方式:图生视频
输入方式:单张关键帧作为首帧
生成时长:每镜 5 秒
画面比例:16:9 横屏
测试分辨率:1280×720(720p)
正式分辨率:优先 1920×1080(1080p);模型不支持时选择最高可用的 16:9 分辨率
帧率:优先 24fps;模型不开放帧率选项时使用默认值
生成数量:每次 1 条
声音:关闭,不要求模型生成对白、音效或音乐
运动强度:低;S05 可提高到中低
镜头模式:连续单镜头,不自动切镜
最终 MP4 仍按 1920×1080、16:9、24fps 导出。模型只支持 720p 时可以先完成练习和镜头验收,再在剪辑阶段统一放大;不要把剪辑导出分辨率误写成模型原生生成分辨率。
选择模型时先检查下面 4 个硬条件:
| 参数 | 本项目最低要求 | 不满足时怎么处理 |
|---|---|---|
| 生成方式 | 支持单图作为首帧的图生视频 | 只有文生视频时不用于本项目正式镜头 |
| 时长 | 单次至少生成 5 秒 | 只提供 10 秒时仍可用,但生成后裁掉多余部分 |
| 比例 | 支持 16:9 横屏 | 只有竖屏或方图时换模型,避免二次扩图破坏构图 |
| 分辨率 | 最低 1280×720;优先 1920×1080 | 只支持 720p 时标记“后期需放大” |
帧率不是硬门槛:模型若固定输出 25fps 或 30fps,可以在剪辑时统一到 24fps。尾帧控制、运镜控制、固定种子和原生音频都是加分项,不是本案例的必需条件。
模型选择前可复制这张登记卡,对比候选模型:
不调用模型:这是模型参数记录模板。
模型名称:
是否支持图生视频:
是否支持首帧输入:
可选时长:
可选比例:
可选分辨率:
可选帧率:
是否支持运镜控制:
是否支持尾帧:
是否会强制生成声音或水印:
单次生成成本或额度:
结论:可用于正式镜头 / 只适合低成本测试 / 不适合本项目
六个镜头的参数增量
基础参数保持不变,每个镜头只改下表中的项目。目标保留时长是最后剪进成片的长度,生成时长是提交给视频模型的长度。
| 镜头 | 输入首帧 | 生成时长 | 目标保留时长 | 机位与运动强度 | 生成策略 |
|---|---|---|---|---|---|
| S01 | S01 关键帧 | 5s | 3s | 极慢推近;低 | 正式生成 |
| S02 | S02 关键帧 | 5s | 3s | 固定机位;低 | 优先测试角色稳定性 |
| S03 | S03 关键帧 | 5s | 4s | 固定低机位;低 | 正式生成 |
| S04 | S04 关键帧 | 5s | 3s | 极慢推近;极低 | 可不生成,用静态图后期推近 |
| S05 | S05 关键帧 | 5s | 5s | 轻微推近;中低 | 正式生成 |
| S06 | S06 关键帧 | 5s | 4s | 固定机位;低 | 正式生成 |
🎬 视频|运动基础提示词
使用上传的关键帧作为完全一致的首帧。保持原有角色身份、脸、服装、道具、构图、镜头轴线、影子方向和冷月光不变。全镜只使用一种摄像机运动、一个主要人物动作,以及最多一个环境动作。不要切镜,不要增加角色,不要变形,不要文字。保持克制、写实、连续的单镜头运动。
🎬 视频|S01 缓慢进入山道
参数增量:S01 首帧;生成 5s,成片保留 3s;16:9;测试 720p、正式优先 1080p;极慢推近、低运动强度。
【视频增量 S01】摄像机沿山道非常缓慢地向前推进。悟空谨慎地走两步,然后逐渐减速。贴地薄雾从右向左轻轻流动。远处赶路人几乎保持静止。
实际生成记录:
调用模型:MiniMax Hailuo 2.3
模型简写:minmaxH3
输入首帧:S01-关键帧-白骨岭建立镜头-gptImg2.png
提交提示词:上方“运动基础提示词”+“视频增量 S01”
实际文件:S01-关键帧-白骨岭建立镜头-minmaxH3.mp4
实际时长:5.184 秒
实际分辨率:1344×768
实际帧率:24fps
编码:H.264 视频+AAC 音频
内容验收:已进入最终成片;最终抽帧检查通过
生成结果视频:
直接打开视频:S01-关键帧-白骨岭建立镜头-minmaxH3.mp4
说明:该镜头已进入最终成片;人物、山道、薄雾和缓慢推进在最终抽帧检查中可用。
🎬 视频|S02 停步倾听
参数增量:S02 首帧;生成 5s,成片保留 3s;16:9;测试 720p、正式优先 1080p;固定机位、低运动强度。
【视频增量 S02】固定机位。悟空完全停住,只有右耳轻动一次,视线转向远处赶路人。衣服在冷风中轻微摆动。右手始终不接触金箍棒。
实际生成记录:MiniMax Hailuo 2.3(minmaxH3);5.184 秒;1344×768;24fps;H.264 视频+AAC 音频。已进入最终成片。
直接打开视频:S02-关键帧-悟空停步倾听-minmaxH3.mp4
🎬 视频|S03 第二道影子移动
参数增量:S03 首帧;生成 5s,成片保留 4s;16:9;测试 720p、正式优先 1080p;固定低机位、低运动强度。
【视频增量 S03】固定低机位。赶路人与双脚完全静止,正常人影保持不动,只有第二道细长的非人影逆着雾缓慢移动。影子必须始终贴在地面上,不能变成第二个人或实体怪物。
实际生成记录:MiniMax Hailuo 2.3(minimaxH3);5.184 秒;1344×768;24fps;H.264 视频+AAC 音频。两道影子清楚,已进入最终成片。
直接打开视频:S03-关键帧-一个人两道影子-gptImg2-minimaxH3.mp4
🎬 视频|S04 眼神确认
参数增量:S04 首帧;生成 5s,成片保留 3s;16:9;测试 720p、正式优先 1080p;极慢推近、极低运动强度。预算不足时跳过视频生成,在剪辑中对静态关键帧做慢推近。
【视频增量 S04】摄像机只进行一次非常缓慢的眼部推近。悟空的视线从左向右移动一次,然后定住。瞳孔内反射的第二道影子轻微移动。嘴部不要运动,眼睛不要发光。
实际生成记录:Seedance 2 Mini(seedance2Mini);5.088 秒;1280×720;24fps;H.264 视频+AAC 音频。已进入最终成片。
直接打开视频:S04-关键帧-悟空识破-seedance2Mini.mp4
🎬 视频|S05 侧身握棒
参数增量:S05 首帧;生成 5s,成片保留 5s;16:9;测试 720p、正式优先 1080p;轻微推近、中低运动强度。
【视频增量 S05】低机位,摄像机只进行一次轻微缓慢的推近。悟空小幅转动上身,右手握紧身后的金箍棒,但不挥动。赶路人背对镜头并保持静止。破损的暗红旧经幡随风摆动一次。不要打斗,不要变身。
实际生成记录:Seedance 2 Fast(seedance2Fast);5.088 秒;1280×720;24fps;H.264 视频+AAC 音频。已进入最终成片。
直接打开视频:S05-关键帧-挡路握棒-seedance2Fast.mp4
🎬 视频|S06 抬眼留悬念
参数增量:S06 首帧;生成 5s,成片保留 4s;16:9;测试 720p、正式优先 1080p;固定机位、低运动强度。
【视频增量 S06】固定机位。悟空缓慢抬眼看向赶路人,同时金箍棒一端进入画面下缘。他身后只有第二道细长影子穿过贴地薄雾逐渐伸长。赶路人始终保持普通人外表,不发生变身。
实际生成记录:Seedance 2(seedance2);5.062 秒;1280×720;24fps;H.264 视频+AAC 音频。字幕与中文旁白已落位并进入最终成片。
直接打开视频:S06-关键帧-悬念结尾-seedance2.mp4
低成本顺序:先做 S02 的锁定机位,确认角色不会漂;再做 S03 和 S05 的主体动作;最后补 S01 和 S06。S04 可以先用静态关键帧在剪辑里轻推近。
6. 剪辑把镜头变成故事
复制下面这段,让 AI 先把已经通过的镜头整理成可执行的剪辑单:
调用模型:📝 文本模型。它只生成剪辑方案,不会生成或剪出视频。
请把下面 6 个已经生成并通过验收的 AI 漫剧镜头,整理成一份 25 秒剪辑执行单。
S01:白骨岭大远景,悟空进入山道。
S02:悟空停步,耳朵轻动并看向赶路人。
S03:赶路人脚下出现第二道影子,第二道影子逆着雾移动。
S04:悟空眼部特写,瞳孔反射两道影子。
S05:悟空侧身挡路,缓慢握住金箍棒。
S06:悟空抬眼,第二道影子伸长。
要求:
1. 输出每个镜头的起止时间、画面动作、转场、环境声、重点音效、旁白或字幕;
2. 总时长控制在 25 秒左右;
3. S03→S04 使用影子反射对位切,其余镜头优先硬切;
4. 旁白只保留一句:“妖气藏得住,影子藏不住。”;
5. 不增加新剧情、新角色或解释性长字幕;
6. 最后给出一条统一色温、响度和字幕样式的检查项。
只输出按时间排序的剪辑执行单。
生成结果文件:03-剪辑执行单.md(本地源文件)
建议时间线:
不调用模型:按这份时间线在剪辑软件中手动执行。
00:00–00:03 S01,风声 + 低频环境音
00:03–00:06 S02,环境声突然收窄
00:06–00:10 S03,加入很轻的骨节摩擦声
00:10–00:13 S04,眼部视频镜头 + 一次心跳
00:13–00:18 S05,金属轻响,不用大爆炸音效
00:18–00:22 S06,旁白:“妖气藏得住,影子藏不住。”
00:22–00:25 黑场片名,可选
先统一镜头方向、色温和声音,再考虑特效。字幕只承担台词,不重复解释画面已经讲清楚的信息。
最终成片
实际输出:25.000 秒;1920×1080;24fps;H.264 视频+AAC 双声道音频(48kHz);含环境声、中文旁白、字幕和片名尾卡。
直接打开成片:白骨岭-第二道影子-完整成片-配音版.mp4

音频版权与来源记录:音频来源.md(本地源文件)。
技术核验:全片无异常黑场;旁白片段综合响度约 -19.13 LUFS、峰值 -3.00 dBTP;文件 SHA-256 为 1289218f2095f7bfcf94a41fa6b5cfaded28f0f21ece775f950320ce22e95d67。
失败时怎么修
| 可见问题 | 下一轮只改什么 |
|---|---|
| 角色跨图变化 | 继续引用同一身份图和 3~5 个身份锚点,不重新文生角色 |
| 人物融化或多余肢体 | 换干净首帧,只保留一个小动作,缩短镜头 |
| 视频自动乱切 | 只保留一个事件,明确“连续单镜头,不切镜” |
| 摄像机乱飞 | 固定机位 / 横摇 / 轨道移动 / 推近只选一个 |
| 相邻镜头接不上 | 用上一镜尾帧作为下一镜参考,只修朝向、姿势、光线或道具中的一个问题 |
| 第二道影子变成第二个人 | 把影子写成地面视觉状态,继续锁定赶路人数量为一 |
| 场景很满但故事不清 | 删除骷髅、墓碑和无关粒子,只保留山道、枯树、雾和经幡锚点 |
| 连续两次修复仍失败 | 降低动作难度,改用静态关键帧、剪辑运动或声音完成叙事 |
🖼 生图|图片失败修复
把失败图片、对应身份源与下面这段一起提交,一次只修一个问题。
调用模型:🖼 生图或图像编辑模型
参数增量:参考图编辑或局部重绘;同时上传失败图片和相关身份源;保持失败图的原比例、原生分辨率与种子;生成 1 张;一次只修一个问题。
输入图片是当前失败结果,相关角色身份源、场景源和道具源是不可改变的参考。
客观问题:画面中可以直接看到____。
本轮唯一修改:____。
必须保持:角色脸、服装、道具、场景、构图、机位、光向、影子方向和其他已经正确的内容完全不变。
禁止新增:角色、肢体、道具、文字、品牌标志或未要求的画面内容。
只修复已经指出的问题,不重新设计整张图片。
🎬 视频|视频失败修复
把原始关键帧继续作为首帧,只重新生成失败的视频镜头。
调用模型:🎬 图生视频模型
使用上传的关键帧作为完全一致的首帧。当前视频存在这个可见问题:____。
本轮只修复:____。
必须保持:角色身份、脸、服装、道具、构图、镜头轴线、光线、影子方向、时长,以及所有已经正确的运动完全不变。
禁止增加:切镜、新角色、新肢体、变形、文字,以及未要求的摄像机运动或人物动作。
只重新生成这一个镜头,只保留一个主要动作,并保持连续单镜头运动。
最终只按成片效果验收
| 维度 | 分值 | 通过问题 |
|---|---|---|
| 故事清楚 | 15 | 20~30 秒内是否看懂钩子、异常、发现和决定 |
| 角色一致性 | 20 | 脸、毛色、头饰、服装和武器是否稳定 |
| 场景与色彩 | 10 | 地点、月光、雾和色彩是否统一并服务情绪 |
| 主体运动 | 15 | 动作是否简单、完整、无融化和多余肢体 |
| 镜头运动 | 10 | 机位和运动是否明确、克制、服务叙事 |
| 连续性 | 20 | 朝向、光线、位置、道具和动作是否可衔接 |
| 剪辑与声音 | 10 | 节奏、环境声、旁白和字幕是否互相支持 |
成片总分达到 80,角色一致性至少 16/20,连续性至少 16/20,且存在可播放 MP4,才算完成。
效果记录
不调用模型:这是每次生成后的记录模板。
项目:白骨岭·第二道影子
当前阶段:资产 / 故事板 / 关键帧 / 视频镜头 / 剪辑 / 成片
输入与身份源:
完整提示词:
图片模型:
图片生成参数:方式____;参考图数量____;比例____;原生分辨率____;质量档____;种子____
视频模型:
视频生成参数:时长____;比例____;原生分辨率____;帧率____;运动强度____
目标保留时长:
单次成本或消耗额度:
输出附件:
可见问题:
保留结果:
需要重做:
下一轮只改:
状态:可用 / 需修改 / 受阻
最终 MP4:____
本案例实际结果:成片。最终文件为 白骨岭-第二道影子-完整成片-配音版.mp4。
返回:00-课程总览|另一个独立案例:03-AI漫剧案例-雨夜站台|另一条主线:01-AI电商生图