很多人用AI做角色设计,都会遇到同一个问题:
是同一个角色啊,怎么第一张还挺像样的,第二张就开始变脸了?更别说后面的,脸不一样,气质不一样,甚至连一会儿幼态一会儿成熟的。
你以为是你用的模型不行?其实不是的。
问题出在一件事情上:
你根本没有“定义”这个人。
AI不是在帮你创造角色,它是在根据你的规则设定角色。
既然你给的规则是模糊的,那它也只有随机发挥了。
一、先别着急做图,你得先做“标准照”
大多数人一打开AI就想搞大场面,什么战斗场面、霓虹灯、雨夜、电影感、氛围感,全部一气呵成,哪有这么容易?
问题就是这种图对“角色识别”是很不友好的。信息太多了,模型会混淆重点。
真正正确的起点不是创作,是:
先做一张“没有干扰的标准角色图”
你可以理解成:这是给AI看的“角色身份证照片”。
所以要满足几个条件:
-
背景必须干净(白色或浅灰)
-
不要任何场景元素
-
不要复杂构图
-
不要情绪化光影
-
角度尽量正面
-
光线尽量均匀

示例角色形象设计图
这一步的核心不是审美,是“信息稳定”。
你要让模型只记住一件事:这个人本身长什么样。
二、三步走:从“脸”到“人”再到“完整角色档案”
整个角色设计流程,其实可以压缩成三层结构:
第一步:先锁定“脸”
这是最容易被忽略,但也是最关键的一步。
很多人习惯直接做全身图,结果就是角色的脸在不同图里漂移。有时候更精致,有时候更成熟,有时候甚至换了风格。谁能看出来你的主角是谁?何时出场?
原因非常简单,在全身图里,脸的信息权重太低。模型会优先保证“整体合理”,而不是“脸一致”。
所以你只注重这一件事就行了:只做面部特写,不做任何其他干扰信息。
在这一阶段,你要做的事情只有一个:
不断生成、筛选、调整,直到出现一张你可以固定下来的脸。
它要满足五官结构稳定、轮廓清晰、有记忆点、不依赖光影加成这些必要条件。
一旦确定,这张图就是后面所有步骤的“锚点”。

第二步:再做全身,但必须贴着脸走。
有了脸之后,再进入全身图。
但这里很多人又会踩一个坑:脸又变了。
所以这一阶段的重点不是“全身好不好看”,而是:
全身图里的脸,必须和第一步完全一致。
否则整个角色会断裂。
全身图的制作需要明确一下几个条件:
-
身高比例(高矮、腿身比例)
-
体型(瘦、匀称、偏壮)
-
肩宽与姿态
-
基础穿搭风格
但注意一个原则:脸是核心资产,其它都是附属变量。
所以在提示词里一定要强化:
“保持面部特征与参考图完全一致”。
这一步完成后,这个角色才算真正从“脸”变成“一个人”。
通用提示词模板:
需要基于给定的面部参考图,制作一张人物的正面全身形象设计图。请务必保证生成的人物在脸型、五官比例、发型发色等面部特征上与参考图完全一致,维持原有的人物辨识度。画面要求人物以正面站姿完整呈现,从头到脚清晰可见,能够准确展示其身材比例以及所穿的服装和鞋子。拍摄视角为平视,光线采用均匀的平光照明,确保没有明显的阴影遮挡。背景请使用干净的纯色,不要添加任何多余的干扰元素。
第三步:四视图,让角色变成“可调用资产”
到这一步,很多人其实已经能用了,但如果你要做内容生产,比如视频、连续图集,还差一步:
四视图。
也就是:正面、侧面、背面、面部特写,放在同一张图里。
它的作用不是“展示”,而是解决一个隐性问题:
远景和近景不一致。
你会发现用AI设计角色的一个通病:远看还好,一旦镜头推近,脸开始变形。
是因为模型没有完整的“多角度认知”。
四视图的作用就是补齐这个认知缺口。
让模型同时知道:
-
这个人正面长什么样
-
侧面轮廓是什么结构
-
背面发型和整体比例
-
特写脸部细节
这样后面你无论你生成八百个角度,都不会被“换人”。
通用提示词模板:
请生成一张16:9比例的角色设定图。画面布局要求:左侧放置人物面部超大特写;右侧依次排列人物的全身正面、侧面及背面三视图。人物需从头到脚完整入镜,采用平视视角与均匀光照,背景保持纯色简约。核心要求:所有视图必须为同一角色,确保面部特征、发型、服装配饰及身材比例绝对一致,仅观察角度发生变化。整体排版需清晰规整,符合标准角色三视图规范。
三、一个绕不开的问题:为什么AI总是把脸变“平均”
你一定遇到过这种情况:
换了很多提示词,生成一堆脸。但问题是它们都不差,但也都不特别。看起来都像“同一类好看的人”。
这是AI的默认机制,它会倾向生成“统计意义上更安全的脸”。
也就是:
-
对称
-
干净
-
结构标准
-
风险最低
问题是这种脸没有记忆点。
所以你必须打破它的默认路径。
方法不是加“好看”“精致”这种词,而是拆结构。
比如你要描述一张脸,不是说“漂亮的女孩”
而是说:
-
脸型:偏方还是偏圆
-
眉眼:是上挑还是下垂
-
鼻子:鼻梁高低 + 鼻翼宽窄
-
嘴唇:厚薄比例 + 唇峰形态
-
皮肤:冷白 / 小麦 / 有无雀斑
-
发型:长度 + 形状 + 层次
重点不是写“美”,而是写“差异”。
差异越具体,AI越不会走平均值。
五、衣服这件事,比你想的更容易踩坑
很多人到这一步会变得很随意:看到一件好看的衣服直接丢给AI,或者直接用商品图当参考。
但这里有两个问题:
第一,风险问题(版权不确定性)
第二,更关键的是,你是在复制,而不是设计。
正确做法是,不要复制衣服,要拆衣服。
一件衣服可以拆成四个层:
-
配色逻辑(不是颜色,是组合方式)
-
廓形结构(修身 / 宽松 / 落肩)
-
材质质感(挺括 / 柔软 / 垂坠)
-
设计类型(领型、袖型、口袋结构)
你真正需要的不是“这件衣服”,而是这件衣服为什么让你觉得合适。
把这个“感觉”翻译成语言,才是正确输入。
五、最后一步:修改时一定要“锁死角色”
进入后期阶段,比如换衣服、换场景、换状态时,很多人会遇到一个问题:角色开始慢慢变了,脸变了,气质变了,甚至年龄感都变了。
原因只有一个:
你没有告诉模型“什么不能动”。
所以正确写法必须包含两部分:要改什么、不能改什么
重点永远在后者。
比如:
-
不能改面部五官、脸型结构、身材比例、发型发色;
-
只允许改衣服、配饰、场景元素。
这一步的本质是:给角色建立“身份锁”。
锁住核心,才能自由变化表层。
六、结尾
做AI角色设计,本质不是在“画图”。
而是在做一件更底层的事:
建立一个可以被重复调用的“稳定人物”。
一旦你把这个稳定性做出来,后面的事情会变得非常简单。
做不出来,也不是技术问题。
只是你还没把“这个人”真正定下来。
先从一张脸开始。
就够了。



