用 Codex 制作一致性 AI 动画:5 步工作流,角色不再漂移(附完整项目文件结构)
很多人做 AI 视频,第一步就是把故事复制给模型,然后期待它直接生成一条完整短片。结果通常只有一个:角色前后长得不一样、镜头接不上、画风越跑越偏。
这篇教程不用这种方法。我们把「故事 → 剧本分镜 → 提示词 → 参考图 → 视频」拆成一条有文件的流水线:用 Codex 拆解任务、产出分镜和两组提示词,用即梦 Seedance 图生视频。照着 5 步走,一段约 30 秒、8 镜头的二维手绘动漫短片,也能保持角色一致。
先看结论:5 步工作流——① 故事放进
input/article.md→ ② Codex 产出剧本与分镜 → ③ 拆出「图片 Prompt」和「视频 Prompt」两类提示词 → ④ 先生成一张张参考图 → ⑤ 用「参考图 + 对应视频 Prompt」逐镜头生成视频。核心一句话:图片 Prompt 决定「画面是什么」,视频 Prompt 决定「画面怎么动」,两者分开喂,角色才不会漂移。

目录:
- 准备工具
- 为什么「一次性生成」会翻车
- 先认识项目结构
- 第 1 步:把故事放进 input/article.md
- 第 2 步:先生成剧本和分镜
- 第 3 步:分别生成图片 Prompt 和视频 Prompt
- 第 4 步:先生成 8 张参考图
- 第 5 步:参考图 + 对应 Prompt 生成视频
- 最后检查并输出
- 踩坑提示
- 常见问题
准备工具
- Codex(OpenAI):读故事、写剧本分镜、产出两组提示词。需要一个有 Codex 额度的 ChatGPT 账号(额度怎么选见 Codex 额度对比,充值见文末)。
- 即梦(Seedance):图生视频,让每一张参考图动起来。
- 本文各步骤可直接复制的 Prompt。
为什么「一次性生成」会翻车
很多人做 AI 视频,第一步就是把故事复制给模型,然后期待它直接生成一条完整短片。这种方式很容易出现三个问题:角色不一致、镜头不连续、风格不断漂移。
问题不在模型,而在分工。让一个模型同时管「故事、分镜、画面、动作」,它必然顾此失彼。所以这篇换了一种方法:先建立一个完整的项目文件结构,再分别生成故事、分镜、参考图和视频——每一步只做一件事。
先认识项目结构
这是整个方法的地基。目录树:
project/
│
├── input/
│ └── article.md
│
├── script/
│ ├── story-analysis.md
│ ├── screenplay.md
│ └── storyboard.md
│
├── prompts/
│ ├── image-prompts.md
│ └── video-prompts.md
│
├── images/
│ ├── scene01.png
│ ├── scene02.png
│ ├── scene03.png
│ ├── scene04.png
│ ├── scene05.png
│ ├── scene06.png
│ ├── scene07.png
│ └── scene08.png
│
├── videos/
│
└── output/
└── final.mp4
这个结构的意义,是把「故事、分镜、画面、视频」拆成不同阶段。AI 不再一次性完成所有工作,而是每一步只负责一件事,每件事都有文件可查、可改、可复用。

第 1 步:把故事放进 input/article.md
在 input/article.md 中放入原始故事。这个文件是整个项目的输入,它不直接拿去生成视频,而是交给 Codex 进行拆解。

然后给 Codex 这一句关键 Prompt:
读取 ./input/article.md。
请将它改编成一部约 30 秒、8 个镜头的原创二维手绘动漫短片。
先不要生成图片或视频,只完成:
故事分析、角色设定、场景设计、情绪曲线和分镜规划。
第 2 步:先生成剧本和分镜
这一步不是为了写一篇漂亮的剧本,而是为了让后面的图片和视频有统一依据。Codex 会在 script/ 下生成三个文件:
script/
├── story-analysis.md
├── screenplay.md
└── storyboard.mdstory-analysis.md:故事、角色、情绪和视觉主题screenplay.md:30 秒内每个镜头发生什么storyboard.md:景别、构图、镜头运动和时间变化

第 3 步:分别生成图片 Prompt 和视频 Prompt
这是整个教程的认知重点:图片 Prompt 和视频 Prompt 不能混在一起。
image-prompts.md 负责画面本身:
- 角色长相
- 服装
- 场景
- 构图
- 风格
- 光线
- 负面限制
video-prompts.md 只负责动起来的部分:
- 人物动作
- 风铃摆动
- 头发和裙摆
- 小猫动作
- 镜头移动
- 禁止角色漂移和真人化
一句话区分:图片 Prompt 决定「画面是什么」,视频 Prompt 决定「画面怎么动」。


第 4 步:先生成 8 张参考图
按顺序生成 images/scene01.png 到 scene08.png。不要直接让 Seedance 根据故事自由发挥——先把每一个镜头固定成参考图片,再让视频模型只负责让图片动起来。

第 5 步:参考图 + 对应 Prompt 生成视频
这是整个方法的核心:每一张参考图只配自己那个镜头的视频 Prompt。
scene01.png + Scene 01 video prompt
scene02.png + Scene 02 video prompt
scene03.png + Scene 03 video prompt
...
scene08.png + Scene 08 video prompt
在即梦 Seedance 里选择图生视频,把参考图和对应的视频 Prompt 放进去。可以逐镜头生成 8 个片段再合成,也可以让 Codex 帮你把流程串成一条完整视频。
原理就一句话:
Source Image 决定人物和画风,Video Prompt 只负责动作和镜头。 两者分开喂,可以显著减少角色漂移、服装变化和风格失控。
最后检查并输出
生成的视频片段放进 videos/,确认无误的成片放到 output/final.mp4。

导出前检查四件事:
- 角色是否一致
- 镜头是否连续
- 是否保持二维动漫
- 是否有真人化或 3D 化
这个流程的重点,不是让 AI 一次生成整部电影,而是把复杂任务拆成一组可以检查、修改和复用的文件。
踩坑提示
- Codex 额度:图片和任务生成比对话更快耗尽额度,失败时先查剩余配额,别反复重试。
- 参考图决定上限:8 张参考图风格统一,成片才不会乱;参考图一旦漂了,后面怎么调都救不回来。
- 视频 Prompt 别写长相:只写动作和镜头,重复描述角色长相反而会让模型改画风。
- 一次只做一件事:给 Codex 的指令越短、分工越明确,产出越稳定。
常见问题
这篇和上一篇「Codex 生成图片 + Seedance 图生视频」教程有什么区别?
Codex 是必须的吗?可以用其它 AI 代替吗?
按步骤做了,角色还是会漂移 / 画面不一致,怎么办?
Codex 额度不够,生成时反复提示额度不足怎么办?
结尾
如果你也想用 AI 制作短片,建议不要从「帮我生成一个视频」开始。先创建一个项目文件夹:让故事进入 input,让分镜进入 script,让提示词进入 prompts,让画面进入 images,让视频进入 videos,最后只把确认过的成片放进 output。
当文件结构清楚之后,AI 视频就不再是一场随机抽卡,而是一条可以重复执行的制作流程。
需要 Codex 额度?查看 Codex 充值专题页,了解支持套餐、支付方式和到账流程。
关于作者
UPGPTs 团队 专注 ChatGPT、Claude、Grok、Codex 等 AI 工具的中文保姆级教程,每一步都有截图。更多教程见 UPGPTs 教程中心,使用问题可查 常见问题,或通过 联系我们 页面留言。
相关阅读
- 用 Codex 生成图片 + Seedance 图生视频:天上宫阙国风大片教程 — 单张图生成单段视频的入门版
- ChatGPT Codex App 使用教程 — 新用户上手 Codex 全流程
- Codex 接入视觉功能教程 — 给 Codex 加上眼睛
- Codex 额度对比:Plus / Business / Pro 一张表 — 四种套餐额度完整对比
