用 Codex 做一致性 AI 动画:5 步工作流,角色不再漂移
做 AI 动画最头疼的角色漂移,很多人以为是模型不行。跑了 8 个镜头我发现,问题不在模型,在分工。
这篇教程,就是把分工落到实处:把「故事 → 剧本分镜 → 提示词 → 参考图 → 视频」拆成一条有文件的流水线,用 Codex 拆解任务、产出分镜和两组提示词,用即梦 Seedance 图生视频。照着 5 步走,一段约 30 秒、8 镜头的二维手绘动漫短片,也能保持角色一致。
先看结论:5 步工作流——① 故事放进
input/article.md→ ② Codex 产出剧本与分镜 → ③ 拆出「图片 Prompt」和「视频 Prompt」两类提示词 → ④ 先生成一张张参考图 → ⑤ 用「参考图 + 对应视频 Prompt」逐镜头生成视频。图片 Prompt 决定「画面是什么」,视频 Prompt 决定「画面怎么动」,两者分开喂,角色才不会漂移。

准备工具
- Codex(OpenAI):读故事、写剧本分镜、产出两组提示词。需要一个有 Codex 额度的 ChatGPT 账号。
- 即梦(Seedance):图生视频,让每一张参考图动起来。
- 本文各步骤可直接复制的 Prompt。
为什么「一次性生成」会翻车
把故事、分镜、画面、动作一起丢给模型,让它一口气生成一条成片——最容易出现三个问题:角色不一致、镜头不连续、风格不断漂移。
真正的问题在分工,跟模型好坏无关。让一个模型同时管「故事、分镜、画面、动作」,它必然顾此失彼。所以这篇换了一种方法:先建立一个完整的项目文件结构,再把故事、分镜、参考图和视频分开生成。
先认识项目结构
这是整个方法的地基。目录树如下:
project/
│
├── input/
│ └── article.md
│
├── script/
│ ├── story-analysis.md
│ ├── screenplay.md
│ └── storyboard.md
│
├── prompts/
│ ├── image-prompts.md
│ └── video-prompts.md
│
├── images/
│ ├── scene01.png
│ ├── scene02.png
│ ├── scene03.png
│ ├── scene04.png
│ ├── scene05.png
│ ├── scene06.png
│ ├── scene07.png
│ └── scene08.png
│
├── videos/
│
└── output/
└── final.mp4

这个结构的意义,是把「故事、分镜、画面、视频」拆成不同阶段。AI 不再一次性完成所有工作,而是每一步只负责一件事,每件事都有文件可查、可改、可复用。

第 1 步:把故事放进 input/article.md
在 input/article.md 中放入原始故事。这个文件是整个项目的输入,它不直接拿去生成视频,而是交给 Codex 进行拆解。

然后给 Codex 这一句关键 Prompt:
读取 ./input/article.md。
请将它改编成一部约 30 秒、8 个镜头的原创二维手绘动漫短片。
先不要生成图片或视频,只完成:
故事分析、角色设定、场景设计、情绪曲线和分镜规划。

第 2 步:先生成剧本和分镜
这一步的剧本不用漂亮,关键是让后面的图片和视频有一个统一依据。Codex 会在 script/ 下生成三个文件:
script/
├── story-analysis.md
├── screenplay.md
└── storyboard.md
story-analysis.md:故事、角色、情绪和视觉主题screenplay.md:30 秒内每个镜头发生什么storyboard.md:景别、构图、镜头运动和时间变化

第 3 步:分别生成图片 Prompt 和视频 Prompt
这是整个教程的认知重点:图片 Prompt 和视频 Prompt 不能混在一起。
image-prompts.md 负责画面本身:
- 角色长相
- 服装
- 场景
- 构图
- 风格
- 光线
- 负面限制
video-prompts.md 只负责动起来的部分:
- 人物动作
- 风铃摆动
- 头发和裙摆
- 小猫动作
- 镜头移动
- 禁止角色漂移和真人化
图片 Prompt 决定「画面是什么」,视频 Prompt 决定「画面怎么动」。这就是两者的分工。


第 4 步:先生成 8 张参考图
按顺序生成 images/scene01.png 到 scene08.png。不要直接让 Seedance 根据故事自由发挥——先把每一个镜头固定成参考图片,再让视频模型只负责让图片动起来。

第 5 步:参考图 + 对应 Prompt 生成视频
这是整个方法的核心:每一张参考图只配自己那个镜头的视频 Prompt。
scene01.png + Scene 01 video prompt
scene02.png + Scene 02 video prompt
scene03.png + Scene 03 video prompt
...
scene08.png + Scene 08 video prompt

在即梦 Seedance 里选择图生视频,把参考图和对应的视频 Prompt 放进去。可以逐镜头生成 8 个片段再合成,也可以让 Codex 帮你把流程串成一条完整视频。
原理不复杂:
Source Image 决定人物和画风,Video Prompt 只负责动作和镜头。 两者分开喂,可以显著减少角色漂移、服装变化和风格失控。
最后检查并输出
生成的视频片段放进 videos/,确认无误的成片放到 output/final.mp4。

导出前检查四件事:
- 角色是否一致 — 8 个镜头中人物长相、服装无突变
- 镜头是否连续 — 相邻镜头景别、运动方向衔接自然
- 是否保持二维动漫 — 全程手绘风格,无 3D 渲染痕迹
- 是否有真人化或 3D 化 — 画面无写实面孔或立体模型感
这套流程的重点在「拆」:把「一次生成整部电影」的任务,拆成一组可以检查、修改、复用的文件。
踩坑提示
- Codex 额度:图片和任务生成比对话更快耗尽额度,失败时先查剩余配额,别反复重试。
- 参考图决定上限:8 张参考图风格统一,成片才不会乱;参考图一旦漂了,后面怎么调都救不回来。
- 视频 Prompt 别写长相:只写动作和镜头,重复描述角色长相反而会让模型改画风。
- 指令越短、分工越明确,产出越稳定:别一次让 Codex 干很多事。
常见问题
Q:这篇和上一篇「Codex 生成图片 + Seedance 图生视频」教程有什么区别?
A:上一篇是单张图片生成单段视频(天上宫阙国风大片);这篇是带完整故事线、多镜头的二维手绘动漫短片。核心区别在文件结构:把故事、剧本、分镜、提示词、参考图拆成独立文件逐镜头控制,从而解决长视频里的角色漂移和风格失控。
Q:Codex 是必须的吗?可以用其它 AI 代替吗?
A:核心思路是把任务拆成可检查的文件,只要能做到「读文件 → 产出结构化文档」的 AI(Codex、Claude 等)都可以。本文以 Codex 为例,因为它读写项目文件的能力最直接;视频生成环节用即梦 Seedance 图生视频。
Q:按步骤做了,角色还是会漂移 / 画面不一致,怎么办?
A:按优先级排查——① 先确认 8 张参考图本身风格统一,参考图决定成片上限;② 视频 Prompt 只描述动作和镜头,不要重复描述长相和服装;③ Seedance 图生视频务必绑定对应的 Source Image;④ 给 Codex 更短的指令和更明确的分工,一次只做一件事。
Q:Codex 额度不够,生成时反复提示额度不足怎么办?
A:Codex 有每日额度,图片和任务生成比普通对话更快耗尽。失败时先确认当前套餐剩余额度,别反复重试;可以等次日恢复,或升级套餐获取更高额度。
结尾
如果你也想用 AI 制作短片,建议不要从「帮我生成一个视频」开始。先创建一个项目文件夹:故事放进 input,分镜放进 script,提示词放进 prompts;画面进 images、视频进 videos,最后只把确认过的成片放进 output。
文件结构清楚之后,做 AI 视频就不靠运气了——它是一条可以重复执行的流程,每一步都有文件可查。
葡萄城是专业的软件开发技术和低代码平台提供商,聚焦软件开发技术,以“赋能开发者”为使命,致力于通过表格控件、低代码和BI等各类软件开发工具和服务,一站式满足开发者需求,帮助企业提升开发效率并创新开发模式。
更多推荐


所有评论(0)