AI动漫生成器提示指南:角色、场景、镜头与动作

来源: Elser AI

一个有效的AI动漫提示更接近于制作笔记,而非一堆风格词汇。它告诉模型谁在场、哪些元素必须保持可识别、发生了什么、镜头如何构图,以及哪些视觉决策最为重要。

同一角色在不同阶段需要不同的提示层级。设计提示定义身份。场景提示将身份置于世界中。视频提示引导随时间的变化。将三者混入一个不受控制的段落中,是导致角色漂移和镜头视觉杂乱常见的原因。

本指南为您提供了一套可复用的系统,适用于静态图像、角色设定表、故事板帧以及短篇动漫视频。

从图像的任务开始

在撰写视觉细节之前,请先对输出进行分类:

  • 角色概念: 探索外貌与性格。
  • 规范角色卡: 记录稳定身份。
  • 表情或姿势研究:在保留设计的同时改变表现效果。
  • 故事板画面: 清晰传达场景布局与镜头运用。
  • 主视觉: 优先考虑冲击力、氛围和营销构图。
  • 视频起始帧: 必须保留动画效果并留出运动空间。

戏剧性的海报提示通常不是好的角色表提示。拥挤的插画图像往往不是图像转视频的良好起始帧。提示应针对制作任务,而非模糊的“质量”概念。

三层提示系统

保持三层分离,这样你就能在不重写所有内容的情况下修改其中一层。

第一层:规范身份

这描述了稳定的特质:

成年女性,身材紧实健美,宽卵形脸,暖棕色皮肤,深陷的灰色 眼睛,短而紧密卷曲的黑发,配有一个铜色发环,苔绿色短发 实用外套、奶油色高领衬衫、炭灰色工装裤、黄色夹扣手套 左臀部,黄铜音叉盒横跨背部。


使用具体的形状、位置和材料。“美丽”、“酷”和“高度细节化”无法确立独特性。

### 第二层:场景与表演

这因镜头而异:

```text

她跪在一个破裂的气象传感器旁,戴着手套的一只手贴在上面倾听。 金属。她的表情专注但不安。风将外套吹向屏幕右侧。


### 第三层:摄像头与视觉处理

这告诉模型观众如何看待该事件:

```text

中景低角度拍摄,35毫米视角,主体位于左侧三分之一处,风暴塔 她身后可见,凉爽的阴天光线中带有一道狭窄的暖色反光,干净的动漫风格 制作艺术,克制赛璐珞着色,无文字。


完整的提示词变得可编辑,因为身份、动作和电影摄影有明确的界限。

## 撰写有力的动漫角色提示词

### 描述装饰前的轮廓

观众通过身体比例、发型轮廓、外衣和标志性物品来远距离识别角色。选择一到两个强烈的剪影设计:

- 窄身三角披肩;
- 超大圆形袖口与紧凑靴筒;
- 长外套在硬质装备包周围裂开;
- 圆顶头盔搭配方形工作服;
- 不对称护肩和低侧编织。

不要添加十二个同等重要的配件。视觉层次让设计令人难忘。

### 用结构术语定义面部

有用的详细信息包括:

- 脸型;
- 眼睛形状和间距;
- 眉毛重量;
- 鼻子治疗;
- 嘴型;
- 年龄展示;
- 区别标记和确切位置。

示例:

```text

心形脸,间距较宽的琥珀色下垂眼,浓密的直眉,短鼻, 不对称的小微笑,左眉外侧有一道浅色疤痕。


### 像搭配服装一样构建服装,而不是像情绪板一样

从内到外的状态层:

```text

黑色修身打底衫,无袖象牙色裹身束腰外衣,以三颗错位搭扣闭合, 靛蓝色短款夹克,搭配立体肩部设计、宽幅工装腰带、锥形裤, 哑光银色护趾踝靴。


然后命名材料和状态:拉绒棉、漆面皮革、透明乙烯基、划痕钢、褪色刺绣、雨水浸暗的织物。

### 使用受控调色板

选择主色、辅色和强调色:

```text

主色调为炭黑色,辅以低饱和度的靛蓝色,少量铜色点缀仅限于 发圈、腰带扣和工具手柄。


“多彩”赋予模型将注意力分散到各处的权限。

## 动漫场景提示词公式

使用此顺序:

```text

[规范身份锚点] [当前动作与情绪] [位置及相关属性] [景别与摄影角度] [构图与深度] [照明与调色板] [动漫渲染方法] [连续性与排除说明]


示例:

```text

身穿黄色防水外套、肩部带有黑色补丁的短发铁路快递员, 手持一个扁平的金属公文箱。她在破损的车站时钟下稍作停留,环顾四周 朝着一条空荡荡的轨道,尽量不露出恐惧。雨后的废弃高架站台, 紫色标志倒映在水洼中。中景平视镜头,快递员位于右侧三分之一处, 铁轨延伸至深邃的背景。蓝调时刻的光线中,黄色外套是唯一的暖色点缀, 干净的电影感动漫画面,精确的建筑结构,克制的赛璐珞着色。保留面部, 皮毛花纹、外壳形状以及从左到右的屏幕方向。无人群、文字或特效。


## 提示摄影与构图

镜头语言应解决叙事问题。

### 镜头尺寸

- **极广:** 世界、孤立、规模。
- **广泛:** 身体动作与地理。
- **媒介:** 手势与关系。
- **特写:** 反应与决策。
- **插入:** 对象信息。

### 角度

- **视线水平:** 中性观察。
- **低角度:** 权威、威胁或规模。
- **高角度:** 脆弱性或空间清晰度。
- **过肩镜头:** 关系与视角。
- **自上而下:** 模式、策略或分离。

### 镜头语言

你不需要精确的电影知识,但透视线索会有所帮助:

- 宽广视角,营造环境深度感;
- 自然的角色场景视角;
- 压缩长焦感,适合拥挤的层次;
- 仅在背景细节不重要时使用浅景深。

不要写“广角镜头,特写肖像”。解决这个矛盾。

## 阐释形态的灯光提示词

名称来源、方向、硬度及颜色关系:

```text

屏幕左侧洒入的柔和冷光,面庞下方摆放着温暖的台灯,整体氛围沉稳克制 下巴下方的阴影,背景比主体暗一档。


动漫提示受益于简化的光照层次。过多的霓虹色、发光、火花和边缘光会使场景扁平化为强度相等的装饰。

## 将静态提示转化为视频提示

不要对整个图像进行动画处理。指导一个短暂的节拍。

添加:

1. 起始状态;
2. 主要操作;
3. 摄像机运动;
4. 环境响应;
5. 最终状态;
6. 不变量。

示例:

```text

从提供的画面开始,信使听到雾中传来火车的声音。她转过身 她的眼睛先动,然后微微转动头部,并握紧了公文包。 镜头缓慢推进。来自看不见的火车的气流拂动她的衣摆和松散的 头发朝向屏幕右侧。她保持着最后的警惕姿势。保留面部、发型、黄色 外套、外壳、平台布局和屏幕方向。一个连续镜头,没有新人物出现。


每个片段使用一个动作节拍。将下一个故事节拍生成为另一个镜头,而不是要求一个提示生成完整场景。

## 负面提示与约束

负面指令在简短且优先级明确时效果最佳:

```text

无额外字符、文字、标志、裁剪的脚部、重复的配件、极端鱼眼效果, 或面部有浓重的光泽。


将它们与正方向配对:

```text

全身及鞋履可见,两只手清晰可读,简洁的摄影棚背景。


无休止的排除列表会消耗注意力,并引入你本不需要的概念。

## 五个可直接改编的动漫提示模板

### 标准角色表

```text

[identity],中立站姿,正面、侧面和背面视图,两张面部特写, 服装层次与标志性道具分开展示,比例与色调保持一致, 干净的动画制作表,均匀的摄影棚灯光,纯色背景,无文字或特效。


### 情感特写

```text

[面部和发型锚点],[特定情绪变化],平视特写,目光方向 朝向[物体/人物],柔和的定向光,安静的背景形状,精确的发际线 以及眼距,克制型动漫赛璐珞着色,无美颜滤镜或装饰性粒子。


### 双人对话

```text

[角色A锚点] 面对 [角色B锚点] 横跨 [空间物体],中景双人镜头, 清晰的眼神线条和可读的手势,A在隐瞒信息而B在等待,平衡的深度。 有动感的室内灯光,保持高度差和屏幕方向,无第三方角色。


### 操作设置

```text

[身份],攻击前压低身体,武器只拔出一半,对手在外侧 画框,广角镜头,脚部可见,轮廓鲜明,摄像机略低于腰部高度, 风吹动织物在动作方向后的效果,受抑制的能量效应,尚未产生冲击。


### 定场镜头

```text

[地点身份],[时间和天气],一个小角色正在执行[简单动作], 极宽构图,包含前景、中景和背景,建筑风格 逻辑、受控调色板、电影感动漫背景艺术,无文字或人群重复。


## 使用 Elser AI 进行动漫工作流

[Elser AI](https://www.elser.ai/zh/) 融合了动漫风格图像生成、原创角色创作、漫画分镜以及图像转视频工具。如需创作原创角色,可使用 [OC Maker](https://www.elser.ai/zh/zh/oc-maker) 将文字描述与年龄、体型、发型、眼睛、服装、材质及配饰等控制选项相结合。还可选配参考图像来引导姿势或轮廓。

严谨的工作流程是:

1. 生成探索性的角色设计;
2. 选择一个规范版本;
3. 创建一套中立的全身体态与表情集;
4. 使用相同的身份锚定构建故事板框架;
5. 仅动画展示已批准的图像;
6. 将生成的片段与标准参考进行对比;
7. 每次只修改一个变量。

生成器不能取代艺术指导。其价值在于让受控迭代变得更快。

## 提示词为何失败

### 优先级过多

提示要求复杂的服装、拥挤的背景、三种力量、极致的镜头、精致的灯光和精确的文字。决定拍摄的目的,并降低其他一切的重要性。

### 个性是无形的

“自信而友善”或许不会改变像素。将其转化为姿态、目光、手势、衣着打理以及与物品的互动。

### 身份随场景变换

规范描述不稳定,或设计依赖于通用特征。创建一个简短的身份块并完全复用。

### 风格请求仅为品牌或艺术家名称

描述媒介、线条、形状、阴影、调色板和光线。不要要求完全模仿在世艺术家。

### 视频提示描述了一张海报

动画需要动词、序列、时机和物理。保持视觉描述简短,直接引导变化。

## 常见问题解答

### AI动漫提示词应该多长?

足够长以解决重要的歧义。聚焦于80-180个单词通常比一页重复的形容词更能提供控制力,但复杂场景可能需要结构化段落。

### 我是否应该在每个提示中都包含“动漫风格”?

在模型或所选风格尚未确定处理方式时使用。添加更多有用的属性,如干净的成片美术、克制的赛璐珞着色、图形化阴影或绘画感背景。

### 如何保持同一个动漫角色?

使用规范参考,复用稳定的身份块,将身份与场景指令分离,尽量减少同时变更,并将每个输出与已批准的设计进行比较。

### 我应该使用负面提示吗?

使用简短列表处理高影响力问题。积极的组合指令通常比数十条排除规则更有用。

### 我可以使用参考图片吗?

是的,只要您拥有使用它们的权利。请标注该图像是用于指导身份、姿势、服装、构图还是风格;不应期望一张参考图能控制所有方面。

### 这些提示词可以用于动漫视频吗?

使用身份和场景图层制作起始帧,然后编写一个单独的运动提示,定义动作、镜头、时间和连续性。

## 结论

强大的[AI动漫](https://www.elser.ai/zh/ai-anime-generator)提示词是模块化的。构建一个稳定的身份,将其置于特定动作中,并利用镜头与光线来阐明故事。对于视频,需明确开场画面之后的变化。当结果不理想时,应修改出问题的层级,而非重写整个概念。

最新发布