跳到主要内容
返回博客

2026年8月8日

动漫图片转视频提示词:7 个动作模板

用 7 个可直接套用的动漫图片转视频提示词模板,清楚描述人物动作、打斗、固定镜头、推进、循环、漫画动效与分镜视频。

描述看得见的变化,只给镜头一个职责,并以可检查的构图结束。

作者:Sonya,MkAnime 内容贡献者 · 发布于 2026 年 8 月 8 日

说明:我参与 MkAnime 的内容工作,本文会介绍其 GPT Image2 to Video 工具。文章借助 AI 完成整理与编辑,并由我依据 2026 年 8 月 8 日的实际流程核对示例与产品信息。

有效的动漫图片转视频提示词,需要说明:哪些特征必须保持、哪些内容会变化、镜头如何观察变化、环境怎样响应,以及镜头最终停在哪里。

可以使用这个公式:

身份 + 起始状态 + 动作链 + 镜头 + 次要运动 + 结束状态 + 排除项

“电影感、动态、高质量”等风格词仍有作用,但无法代替动作设计。

如果源图片还没有准备好,可先按照以镜头为核心的动漫图片转视频工作流,检查构图、身份锚点、空间深度、镜头职责和预期结尾。

按人物、动作、镜头和结尾组织的动漫图片转视频提示词

看动作指令如何变成可见的镜头

这张生成的荔枝分镜在成片前写明了运动、动作、镜头、景别、声音和结束状态。下面每个提示词模板,都是为了把这类决定说清楚。

包含运动、动作、镜头、景别、声音和五个定时段落的荔枝分镜

分镜把动作语言转成五个可检查的段落。

成片依次呈现计划中的慢推、行走、微距细节、人物看向镜头和产品结尾。

七段式提示词结构

1. 身份锚点

记录动作中必须保留的细节:脸部和年龄感、发型轮廓与左右特征、服装结构和色块、身体比例、标志性配饰。挑出三个最容易检查的锚点。

2. 起始状态

说明开场景别、人物位置和姿态,并与源图保持一致:

从稳定中景开始。成年快递员站在站台雨棚下,左手扶着包带,望向昏暗隧道。

3. 动作链

按因果顺序写:

警示灯闪烁。快递员转头看去,拉紧包带,退离站台边缘;列车灯出现时停住。

触发事件让动作有原因,终点防止动作无意义地延续。

4. 镜头职责

从固定、推进、拉远、跟随、摇摄、俯仰或短弧线中选一个核心职责。

5. 次要运动

只加入一到两个小反应,例如发梢跟随转头、衣摆受到气流影响、光源进入后反射变化。

6. 结束状态

像写静态画面一样描述最后一帧,包括景别、姿势、目光、道具、光线和背景关系,并要求短暂停留。

7. 排除项

列出具体冲突:不要额外人物、重复配饰、镜头环绕、不可读招牌、字幕或标志、脸部与服装变化。系统没有单独负面提示词输入框时,也可以写在主提示词中。

通用模板

Create a [DURATION]-second original [ANIME VISUAL DIRECTION] shot.

IDENTITY: Preserve [FACE, HAIR, OUTFIT, PALETTE, BODY, AND SIGNATURE DETAILS]. Treat [THREE ANCHORS] as fixed.
START: Begin from [SHOT SIZE, ANGLE, SUBJECT POSITION, POSE, PROP POSITION, AND ENVIRONMENT].
ACTION: [VISIBLE TRIGGER]. The subject [PRIMARY ACTION], then [SUPPORTING ACTION], and finishes by [END OF ACTION].
CAMERA: [ONE CAMERA ROLE, SPEED, AND ENDPOINT]. Keep [HORIZON / FRAMING] stable.
SECONDARY MOTION: [ONE OR TWO ENVIRONMENTAL RESPONSES] after the main action.
END: Finish on [SHOT SIZE, POSE, GAZE, PROP POSITION, LIGHT, AND BACKGROUND]. Hold briefly.
FINISH: [LINEWORK, SHADING, COLOR, DEPTH, MOTION TREATMENT, AND LIGHT].
AVOID: [UNWANTED PEOPLE, CAMERA MOVES, IDENTITY CHANGES, TEXT, OR STYLE CONFLICTS].

模板 1:克制的人物表演

Create an 8-second original 2D cel-shaded anime performance. Preserve the adult radio host’s oval face, chin-length black bob, copper hair clip on the right, cream cardigan, navy shirt, and silver field recorder.

Begin in a locked medium close-up inside a quiet studio before dawn. A red signal light turns on. The host glances toward it, takes a slow breath, touches the recorder with the right hand, and forms a small determined smile.

Camera: locked tripod, fixed horizon and framing, no zoom, pan, orbit, or cut. End with the host looking directly past camera, hand resting on the recorder. No subtitles, extra people, duplicated recorder, face drift, or moving background equipment.

适合脸部身份和细微情绪比大幅运动更重要的场景。

模板 2:一个清晰的动作节拍

Create a 7-second 2D anime action shot with two original adult rivals on a rain-dark rooftop. Character A steps forward and swings once. Character B shifts left, blocks once, and slides back one step.

Camera: one short lateral track following the contact, then hold. Rain and coat hems respond after the impact. No extra fighters, repeated attacks, spinning camera, duplicated weapons, broken hands, or cutaways.

一次接近、一次接触和一次反应,通常比在短片里塞入整场战斗更易读。

模板 3:固定镜头,只让主体运动

Locked tripod camera at eye level. Fixed 16:9 composition, fixed horizon, fixed focal length, no zoom, no pan, no tilt, no orbit, no handheld shake, and no cut.

Only the character’s eyes move toward the rain, the chest rises with one breath, the left hand closes a book, and two loose hair strands settle. The room and background perspective remain still. End on the original composition and hold.

如果镜头仍漂移,减少主体动作,并删除 “cinematic sweep”“dynamic perspective”等暗示大幅运镜的词。

模板 4:用缓慢推进完成揭示

Create a 9-second anime mystery shot. Begin in a medium shot of an adult courier holding a sealed parcel in a dim train carriage. A quiet knock comes from inside. The courier looks down, loosens the clasp, and a narrow blue light appears through the seam.

Camera: one slow centered push from medium shot to close-up; no orbit, no pan, no cut. End when the blue light reaches the courier’s eyes. Hold for one beat.

镜头在答案完全揭开前结束,推进动作只服务于悬念。

模板 5:动漫动态海报循环

Create a seamless 6-second anime motion-poster loop. Camera remains fixed. Lantern light travels clockwise, the dancer’s coat hem lifts and returns, two paper charms rotate once, and a reflection passes across the mask.

End exactly on the opening pose, lantern brightness, and charm orientation. No readable text, logo, camera move, crowd, costume change, or new objects.

标题最好在剪辑阶段添加,避免生成画面中的文字变形。

模板 6:漫画风格图片动效

Create an 8-second original comic-style animation from the approved rights-cleared illustration. Preserve the ink contours, cream-black-red palette, halftone shadows, panel border, and the adult detective’s face and trench coat.

The camera makes a slow 8% push. Rain strokes move in the background, one red reflection passes across the glasses, and the speech-balloon area remains empty and stable. No repainting into 3D, photorealism, added dialogue, warped border, or extra fingers.

更完整的素材处理方法见漫画分格动画指南。

模板 7:分镜引导的 15 秒序列

Create a 15-second original 2D cel-shaded anime sequence guided by the approved wide storyboard. Preserve the same courier, station, palette, and train design across every beat.

Beat 1: wide station view; the courier enters as the warning light flashes.
Beat 2: medium action; the courier catches a sliding ticket.
Beat 3: close performance; the courier reads it and looks toward the tunnel.
Beat 4: wide ending; the train arrives and warm light crosses the platform.

Maintain screen direction and cause-and-effect order. End beside the open train door. No new character, costume change, reversed strap, unreadable sign, or unrelated cutaway.

用分镜指导视频动作和构图

如何写有效的负面约束

问题类型可使用的约束
身份脸部漂移、发长改变、配饰换边、服装变色
肢体多余手指、手部粘连、重复肢体、错误接触
镜头意外环绕、随机变焦、地平线倾斜、手持抖动
构图手部被裁、道具丢失、新主体、背景重排
风格写实化、3D 重绘、线稿丢失、纹理被替换
文字字幕、标志、水印、乱码招牌、变形对话框

“不要低质量”缺少可执行标准;“不要新增人物、不要镜头环绕、红色发夹不要换到右侧”更容易检查。

重新生成前先诊断提示词

结果问题首先修改的提示词部分
脸部或服装发生变化减少身体和镜头运动;强化三个身份锚点
镜头意外移动指定锁定机位;删除“动态运镜”等形容词
动作不清楚把动作链缩减为“触发 → 动作 → 结束”
背景压过主体只保留一种环境反应,删除其余效果
镜头始终没有停稳重写结束状态,并增加短暂停留
漫画画风变成 3D明确线条、色板、网点、纹理和不需要的重绘方式

保留上一次结果。每次只修改一个模块,再对照同一类问题比较。

在 MkAnime 工作流中使用提示词

MkAnime 的 GPT Image2 to Video 工具从短故事开始,先生成宽幅分镜图,再依据分镜制作 15 秒视频。提示词应让故事主体、可见触发、动作顺序和结束状态能够被转换成分镜。

在生成分镜前编写简短动漫故事提示词

使用 GPT Image 2 提示词库处理静态画面构图与视觉参考;需要解决时间和动作时使用本文结构;完整分镜到视频流程可继续阅读分镜图片转视频工作流。

常见问题

图片转视频提示词应该包含什么?

身份锚点、开场构图、动作链、一个镜头职责、一到两个次要运动、结束构图、视觉效果和具体排除项。

需要描述每一帧吗?

不需要。说明动作逻辑和关键状态即可。多个不同构图应使用分镜或拆成独立镜头。

怎样保持动漫风格?

写出可见特征,例如干净线稿、简洁赛璐璐阴影、有限色板、网点纹理或水彩边缘,并单独保护角色设计。

图片转视频适合写哪些负面提示词?

优先写可以核对的错误,例如不要新增人物、不要镜头环绕、不要左右配饰互换、不要字幕乱码,也不要把 2D 线稿重绘成 3D。

提示词能保证镜头稳定和人物一致吗?

不能保证。准确语言可以减少歧义、建立检查标准,生成结果仍需审核和有控制地迭代。

总结

动漫图片转视频提示词是一份动作约定:说明什么必须保持、什么会变化、镜头如何配合、环境怎样响应,以及画面最终停在哪里。先做好一个清晰动作,再让每个新增细节承担明确职责。

制作我的第一部漫剧

从灵感到分镜,快速创作你的故事