AI动漫生成器提示指南:角色、场景、镜头与动作
一个有效的AI动漫提示更接近于制作笔记,而非一堆风格词汇。它告诉模型谁在场、哪些元素必须保持可识别、发生了什么、镜头如何构图,以及哪些视觉决策最为重要。
同一角色在不同阶段需要不同的提示层级。设计提示定义身份。场景提示将身份置于世界中。视频提示引导随时间的变化。将三者混入一个不受控制的段落中,是导致角色漂移和镜头视觉杂乱常见的原因。
本指南为您提供了一套可复用的系统,适用于静态图像、角色设定表、故事板帧以及短篇动漫视频。
从图像的任务开始
在撰写视觉细节之前,请先对输出进行分类:
- 角色概念: 探索外貌与性格。
- 规范角色卡: 记录稳定身份。
- 表情或姿势研究:在保留设计的同时改变表现效果。
- 故事板画面: 清晰传达场景布局与镜头运用。
- 主视觉: 优先考虑冲击力、氛围和营销构图。
- 视频起始帧: 必须保留动画效果并留出运动空间。
戏剧性的海报提示通常不是好的角色表提示。拥挤的插画图像往往不是图像转视频的良好起始帧。提示应针对制作任务,而非模糊的“质量”概念。
三层提示系统
保持三层分离,这样你就能在不重写所有内容的情况下修改其中一层。
第一层:规范身份
这描述了稳定的特质:
成年女性,身材紧实健美,宽卵形脸,暖棕色皮肤,深陷的灰色 眼睛,短而紧密卷曲的黑发,配有一个铜色发环,苔绿色短发 实用外套、奶油色高领衬衫、炭灰色工装裤、黄色夹扣手套 左臀部,黄铜音叉盒横跨背部。
使用具体的形状、位置和材料。“美丽”、“酷”和“高度细节化”无法确立独特性。
### 第二层:场景与表演
这因镜头而异:
```text
她跪在一个破裂的气象传感器旁,戴着手套的一只手贴在上面倾听。 金属。她的表情专注但不安。风将外套吹向屏幕右侧。
### 第三层:摄像头与视觉处理
这告诉模型观众如何看待该事件:
```text
中景低角度拍摄,35毫米视角,主体位于左侧三分之一处,风暴塔 她身后可见,凉爽的阴天光线中带有一道狭窄的暖色反光,干净的动漫风格 制作艺术,克制赛璐珞着色,无文字。
完整的提示词变得可编辑,因为身份、动作和电影摄影有明确的界限。
## 撰写有力的动漫角色提示词
### 描述装饰前的轮廓
观众通过身体比例、发型轮廓、外衣和标志性物品来远距离识别角色。选择一到两个强烈的剪影设计:
- 窄身三角披肩;
- 超大圆形袖口与紧凑靴筒;
- 长外套在硬质装备包周围裂开;
- 圆顶头盔搭配方形工作服;
- 不对称护肩和低侧编织。
不要添加十二个同等重要的配件。视觉层次让设计令人难忘。
### 用结构术语定义面部
有用的详细信息包括:
- 脸型;
- 眼睛形状和间距;
- 眉毛重量;
- 鼻子治疗;
- 嘴型;
- 年龄展示;
- 区别标记和确切位置。
示例:
```text
心形脸,间距较宽的琥珀色下垂眼,浓密的直眉,短鼻, 不对称的小微笑,左眉外侧有一道浅色疤痕。
### 像搭配服装一样构建服装,而不是像情绪板一样
从内到外的状态层:
```text
黑色修身打底衫,无袖象牙色裹身束腰外衣,以三颗错位搭扣闭合, 靛蓝色短款夹克,搭配立体肩部设计、宽幅工装腰带、锥形裤, 哑光银色护趾踝靴。
然后命名材料和状态:拉绒棉、漆面皮革、透明乙烯基、划痕钢、褪色刺绣、雨水浸暗的织物。
### 使用受控调色板
选择主色、辅色和强调色:
```text
主色调为炭黑色,辅以低饱和度的靛蓝色,少量铜色点缀仅限于 发圈、腰带扣和工具手柄。
“多彩”赋予模型将注意力分散到各处的权限。
## 动漫场景提示词公式
使用此顺序:
```text
[规范身份锚点] [当前动作与情绪] [位置及相关属性] [景别与摄影角度] [构图与深度] [照明与调色板] [动漫渲染方法] [连续性与排除说明]
示例:
```text
身穿黄色防水外套、肩部带有黑色补丁的短发铁路快递员, 手持一个扁平的金属公文箱。她在破损的车站时钟下稍作停留,环顾四周 朝着一条空荡荡的轨道,尽量不露出恐惧。雨后的废弃高架站台, 紫色标志倒映在水洼中。中景平视镜头,快递员位于右侧三分之一处, 铁轨延伸至深邃的背景。蓝调时刻的光线中,黄色外套是唯一的暖色点缀, 干净的电影感动漫画面,精确的建筑结构,克制的赛璐珞着色。保留面部, 皮毛花纹、外壳形状以及从左到右的屏幕方向。无人群、文字或特效。
## 提示摄影与构图
镜头语言应解决叙事问题。
### 镜头尺寸
- **极广:** 世界、孤立、规模。
- **广泛:** 身体动作与地理。
- **媒介:** 手势与关系。
- **特写:** 反应与决策。
- **插入:** 对象信息。
### 角度
- **视线水平:** 中性观察。
- **低角度:** 权威、威胁或规模。
- **高角度:** 脆弱性或空间清晰度。
- **过肩镜头:** 关系与视角。
- **自上而下:** 模式、策略或分离。
### 镜头语言
你不需要精确的电影知识,但透视线索会有所帮助:
- 宽广视角,营造环境深度感;
- 自然的角色场景视角;
- 压缩长焦感,适合拥挤的层次;
- 仅在背景细节不重要时使用浅景深。
不要写“广角镜头,特写肖像”。解决这个矛盾。
## 阐释形态的灯光提示词
名称来源、方向、硬度及颜色关系:
```text
屏幕左侧洒入的柔和冷光,面庞下方摆放着温暖的台灯,整体氛围沉稳克制 下巴下方的阴影,背景比主体暗一档。
动漫提示受益于简化的光照层次。过多的霓虹色、发光、火花和边缘光会使场景扁平化为强度相等的装饰。
## 将静态提示转化为视频提示
不要对整个图像进行动画处理。指导一个短暂的节拍。
添加:
1. 起始状态;
2. 主要操作;
3. 摄像机运动;
4. 环境响应;
5. 最终状态;
6. 不变量。
示例:
```text
从提供的画面开始,信使听到雾中传来火车的声音。她转过身 她的眼睛先动,然后微微转动头部,并握紧了公文包。 镜头缓慢推进。来自看不见的火车的气流拂动她的衣摆和松散的 头发朝向屏幕右侧。她保持着最后的警惕姿势。保留面部、发型、黄色 外套、外壳、平台布局和屏幕方向。一个连续镜头,没有新人物出现。
每个片段使用一个动作节拍。将下一个故事节拍生成为另一个镜头,而不是要求一个提示生成完整场景。
## 负面提示与约束
负面指令在简短且优先级明确时效果最佳:
```text
无额外字符、文字、标志、裁剪的脚部、重复的配件、极端鱼眼效果, 或面部有浓重的光泽。
将它们与正方向配对:
```text
全身及鞋履可见,两只手清晰可读,简洁的摄影棚背景。
无休止的排除列表会消耗注意力,并引入你本不需要的概念。
## 五个可直接改编的动漫提示模板
### 标准角色表
```text
[identity],中立站姿,正面、侧面和背面视图,两张面部特写, 服装层次与标志性道具分开展示,比例与色调保持一致, 干净的动画制作表,均匀的摄影棚灯光,纯色背景,无文字或特效。
### 情感特写
```text
[面部和发型锚点],[特定情绪变化],平视特写,目光方向 朝向[物体/人物],柔和的定向光,安静的背景形状,精确的发际线 以及眼距,克制型动漫赛璐珞着色,无美颜滤镜或装饰性粒子。
### 双人对话
```text
[角色A锚点] 面对 [角色B锚点] 横跨 [空间物体],中景双人镜头, 清晰的眼神线条和可读的手势,A在隐瞒信息而B在等待,平衡的深度。 有动感的室内灯光,保持高度差和屏幕方向,无第三方角色。
### 操作设置
```text
[身份],攻击前压低身体,武器只拔出一半,对手在外侧 画框,广角镜头,脚部可见,轮廓鲜明,摄像机略低于腰部高度, 风吹动织物在动作方向后的效果,受抑制的能量效应,尚未产生冲击。
### 定场镜头
```text
[地点身份],[时间和天气],一个小角色正在执行[简单动作], 极宽构图,包含前景、中景和背景,建筑风格 逻辑、受控调色板、电影感动漫背景艺术,无文字或人群重复。
## 使用 Elser AI 进行动漫工作流
[Elser AI](https://www.elser.ai/zh/) 融合了动漫风格图像生成、原创角色创作、漫画分镜以及图像转视频工具。如需创作原创角色,可使用 [OC Maker](https://www.elser.ai/zh/zh/oc-maker) 将文字描述与年龄、体型、发型、眼睛、服装、材质及配饰等控制选项相结合。还可选配参考图像来引导姿势或轮廓。
严谨的工作流程是:
1. 生成探索性的角色设计;
2. 选择一个规范版本;
3. 创建一套中立的全身体态与表情集;
4. 使用相同的身份锚定构建故事板框架;
5. 仅动画展示已批准的图像;
6. 将生成的片段与标准参考进行对比;
7. 每次只修改一个变量。
生成器不能取代艺术指导。其价值在于让受控迭代变得更快。
## 提示词为何失败
### 优先级过多
提示要求复杂的服装、拥挤的背景、三种力量、极致的镜头、精致的灯光和精确的文字。决定拍摄的目的,并降低其他一切的重要性。
### 个性是无形的
“自信而友善”或许不会改变像素。将其转化为姿态、目光、手势、衣着打理以及与物品的互动。
### 身份随场景变换
规范描述不稳定,或设计依赖于通用特征。创建一个简短的身份块并完全复用。
### 风格请求仅为品牌或艺术家名称
描述媒介、线条、形状、阴影、调色板和光线。不要要求完全模仿在世艺术家。
### 视频提示描述了一张海报
动画需要动词、序列、时机和物理。保持视觉描述简短,直接引导变化。
## 常见问题解答
### AI动漫提示词应该多长?
足够长以解决重要的歧义。聚焦于80-180个单词通常比一页重复的形容词更能提供控制力,但复杂场景可能需要结构化段落。
### 我是否应该在每个提示中都包含“动漫风格”?
在模型或所选风格尚未确定处理方式时使用。添加更多有用的属性,如干净的成片美术、克制的赛璐珞着色、图形化阴影或绘画感背景。
### 如何保持同一个动漫角色?
使用规范参考,复用稳定的身份块,将身份与场景指令分离,尽量减少同时变更,并将每个输出与已批准的设计进行比较。
### 我应该使用负面提示吗?
使用简短列表处理高影响力问题。积极的组合指令通常比数十条排除规则更有用。
### 我可以使用参考图片吗?
是的,只要您拥有使用它们的权利。请标注该图像是用于指导身份、姿势、服装、构图还是风格;不应期望一张参考图能控制所有方面。
### 这些提示词可以用于动漫视频吗?
使用身份和场景图层制作起始帧,然后编写一个单独的运动提示,定义动作、镜头、时间和连续性。
## 结论
强大的[AI动漫](https://www.elser.ai/zh/ai-anime-generator)提示词是模块化的。构建一个稳定的身份,将其置于特定动作中,并利用镜头与光线来阐明故事。对于视频,需明确开场画面之后的变化。当结果不理想时,应修改出问题的层级,而非重写整个概念。




