把确认后的分镜当作视觉约定,再设计这些画面状态之间的运动。
作者:Sonya,MkAnime 内容贡献者 · 发布于 2026 年 8 月 8 日
说明:我参与 MkAnime 的内容工作,本文会介绍其 GPT Image2 to Video 工具。文章借助 AI 完成整理与编辑,并由我依据 2026 年 8 月 8 日的实际产品流程核对。
将分镜图片转成视频,需要为每个画格或视觉节拍分配明确职责,定义它们之间的动作,合理使用时长,保护人物与场景连续性,并确定最后一帧。
分镜展示的是几个选定状态;视频还需要说明如何从一个状态走到下一个状态。

本文从分镜已经完成的阶段开始。如果故事节点、景别和画格顺序尚未确定,可先阅读脚本转动漫分镜工作流。
看已确认的分镜如何变成 15 秒序列
这张原创分镜在生成动作前,就把两名角色、世界设定、五个段落、运镜方案和结尾展示出来。成片可以直接对照这些决定检查,而不只是在回看提示词。

分镜就是交接依据:角色锚点、镜头顺序和高风险动作在生成前都清晰可见。
成片保留了计划中的反应、世界揭示、喜剧段落、追逐和传送门结尾。
如果想查看这个案例从提示词、分镜审核到成片检查的完整记录,可以继续阅读15 秒动漫工作流案例。
第一步:动画化之前审核分镜
先检查五个方面:
- **故事逻辑:**每格是否改变了动作、信息或情绪?前后因果是否能被理解?
- **人物连续性:**脸、发型、服装、色彩、配饰、比例和左右细节是否一致?
- **空间连续性:**运动方向、门窗与道具位置、机位高度和透视是否兼容?
- **光线与环境:**时间、主光方向、天气、反射和背景人群是否连续?
- **文字与图层:**对话框、标签和标题区应保持静止、预先删除,还是在生成后添加?
重要文字通常在剪辑阶段处理更安全。
如果素材是漫画页或墨线画格,可先按照漫画分格动画工作流处理文字、边框、线稿和网点,再加入动作。
第二步:每个节拍只承担一个职责
| 节拍 | 职责 | 可见变化 |
|---|---|---|
| 1. 建立 | 交代地点、人物和当前状态 | 快递员进入空站台 |
| 2. 触发 | 引入需要回应的事件 | 警示灯闪烁 |
| 3. 行动 | 展示决定性的身体动作 | 快递员接住滑动的车票 |
| 4. 含义 | 展示事件带来的信息 | 快递员读到目的地 |
| 5. 结束 | 形成可衔接的画面 | 列车到站并开门 |
两个节拍职责相同,可以合并或强化差异;一个画格包含三个独立动作时,应先拆开。
第三步:按故事权重分配时长
15 秒序列可以从下面的分配开始:
| 节拍 | 时间 | 原因 |
|---|---|---|
| 建立 | 0–3 秒 | 观众需要辨认地点和主体 |
| 触发 | 3–5 秒 | 呈现一个清楚事件 |
| 行动 | 5–9 秒 | 身体动作需要时间展开 |
| 含义 | 9–12 秒 | 表情、道具或信息需要可读 |
| 结束 | 12–15 秒 | 镜头抵达终点并停留 |
这是一种剪辑规划,并不代表生成可以精确到每一帧。若 15 秒内有八个主要事件,应删减内容或拆成多个片段。
第四步:写清两个状态之间的动作
分镜 A:快递员站在空站台右侧。
分镜 B:快递员在画面中央跪下,手里拿着车票。
缺失的过渡可以这样写:
列车警示灯亮起。车票从左侧滑向站台边缘。快递员发现车票,从右向中央跨两步,跪下,并在车票越过警戒线前用左手接住。
通用公式:
触发 → 主体反应 → 空间路径 → 接触或决定 → 稳定状态
需要可直接用于生成的身份、动作、镜头、次要运动和结束状态写法时,可参考动漫图片转视频提示词模板。
第五步:保持统一的镜头语言
一段短序列可以限制在一组简单机位:建立环境的广角、跟随主要动作的稳定镜头、展示含义的近景,以及结束用的广角或中景。
运动方向重要时,要直接写出:
快递员从右侧入画,向左移动接近车票。在列车出现在背景之前,始终保持从右向左的方向。
两人场景还要固定双方位置,除非画面清楚展示越轴过程。
第六步:编写分镜转视频交接说明
Create a [DURATION]-second original anime sequence guided by the approved storyboard.
CONTINUITY: Preserve [CHARACTER IDENTITY ANCHORS], [LOCATION GEOGRAPHY], [PALETTE], [LIGHT DIRECTION], [PROPS], and [SCREEN DIRECTION] across every beat.
BEAT 1 — ESTABLISH: [OPENING COMPOSITION AND STATE].
BEAT 2 — TRIGGER: [VISIBLE EVENT THAT CAUSES A RESPONSE].
BEAT 3 — ACTION: [ORDERED MOVEMENT, PATH, CONTACT, AND ENDPOINT].
BEAT 4 — MEANING: [FACE, PROP, OR INFORMATION THE VIEWER MUST READ].
BEAT 5 — FINISH: [FINAL COMPOSITION AND HOLD].
CAMERA LANGUAGE: [LIMITED SET OF SHOT SIZES AND MOVES].
SECONDARY MOTION: [ENVIRONMENTAL RESPONSES CAUSED BY THE MAIN ACTION].
AVOID: [IDENTITY DRIFT, GEOGRAPHY CHANGE, REVERSED DIRECTION, EXTRA BEATS, UNWANTED TEXT, OR UNRELATED CUTAWAYS].
这个模板只补充“时间如何发生”,视觉设计仍以已批准分镜为准。
实例:最后一张车票
Create a 15-second original 2D cel-shaded anime sequence guided by the approved wide storyboard.
Continuity: preserve the same adult courier in every beat—angular face, short silver hair with a red clip on the left, rust cropped jacket, dark collar, black shoulder strap from right shoulder to left hip. Preserve the elevated station, blue dawn palette, wet platform, warning line, tunnel position, and warm train design.
0–3 seconds, establish: wide view. The courier enters from the right and walks left along the empty platform. Fixed camera with a gentle push.
3–5 seconds, trigger: the warning light flashes twice. A paper ticket slides from the left toward the platform edge.
5–9 seconds, action: the courier notices the ticket, crosses two steps from right to center, kneels, and catches it with the left hand before it reaches the warning line. One stable lateral follow, no orbit.
9–12 seconds, meaning: medium close-up. The courier reads the ticket, looks toward the tunnel, and tightens the bag strap. Warm light begins to appear behind the right shoulder.
12–15 seconds, finish: wide view. The train arrives and the doors open. End with the courier standing beside the warm doorway, ticket visible in the left hand. Hold briefly.
Secondary motion: the jacket hem and one loose paper respond after the train enters; wet reflections brighten. No extra character, costume change, reversed strap, moving station architecture, unreadable sign, title card, or unrelated cutaway.
这个例子不让模型猜测每格分镜的用途,而是明确说明各个可见状态之间如何连接。
一张分镜还是多张镜头分镜
以下情况可以使用一张宽幅分镜:序列较短、场景与人物稳定、动作只有一条因果链,或成片只是探索性参考。
以下情况适合拆分:多人动作重叠、场景变化、关键情绪需要更强控制、重要道具接触持续出错,或故事节拍超过时长承载能力。拆开的镜头可以在更完整的 AI 动漫视频工作流中组合。
分类审核生成结果
| 检查项 | 问题 |
|---|---|
| 节拍覆盖 | 每个必要的故事职责是否出现? |
| 连续性 | 身份、服装、道具、地点和光线是否保留? |
| 方向 | 运动和视线是否容易理解? |
| 过渡 | 新状态是否有可见原因? |
| 镜头 | 运镜是在解释内容,还是只做装饰? |
| 终点 | 最终构图是否到位并停稳? |
单个节拍失败时,只重写该节拍的触发、路径或终点;整段连续性失败时,简化分镜或拆成独立镜头。角色相关问题可参考角色一致性指南。
在 MkAnime 中从故事生成分镜和视频
MkAnime 的 GPT Image2 to Video 工具把规划顺序放在一个流程中:
- 输入短故事并选择视觉风格;
- 生成宽幅分镜图片;
- 审核或重新生成分镜;
- 依据确认后的分镜创建 15 秒视频。

第 1 步:编写故事和视觉约束。

第 2 步:检查角色、世界、运镜方案和五镜头序列。

第 3 步:生成视频并检查完整序列。
公开工具会在流程内部生成分镜。已有大量素材的较大项目,也可以用本文方法判断每个镜头需要携带哪些视觉上下文。
常见问题
一张分镜图片可以变成完整视频吗?
人物、地点和动作链较紧凑时,可以指导一段短序列。复杂场景更适合拆成多个分镜或镜头级生成。
每格应该分到相同时间吗?
不需要。应按故事职责分配时间,身体动作和可读的情绪变化通常比简单触发需要更多时间。
如何保持运动方向?
写清入画方向、移动方向、人物位置和关键视线。在画面明确越轴或重置空间关系前,保持方向稳定。
分镜中的人物细节不一致怎么办?
先修正分镜,再生成视频。运动会放大发型、服装、配饰和比例中的小差异。
能保留对话框和字幕吗?
重要文字在运动中可能变形。可以预留干净的文字安全区,或在视频确认后通过剪辑添加。
总结
分镜是一组已经确认的视觉状态。可用的视频说明需要补充这些状态之间的触发、路径、接触、镜头职责、连续性规则和结束停留。每个节拍只有一个职责时,分镜就会真正成为制作计划。