游戏美术狗狂喜:用Stable Diffusion三天搞定角色原画(附避坑指
游戏美术狗狂喜:用Stable Diffusion三天搞定角色原画(附避坑指
游戏美术狗狂喜:用Stable Diffusion三天搞定角色原画(附避坑指南)
“哥,策划又双叒叕改需求了,这回要一个‘赛博妲己、机械九尾、还得带点敦煌飞天味儿’的角色,明早给图。”
听完我直接原地升天。
但三天后,我把成图甩群里,策划沉默半晌,回了一句:“卧槽,你偷偷外包了?”
我邪魅一笑:外包个屁,老子有AI外挂——Stable Diffusion。
先别急着装,显卡先喊冤
别一看别人晒图就冲去下整合包,先摸摸自己主机的底。
最低门槛:
- N卡≥6G显存(A卡也能跑,但得折腾Rocm,劝退率99%)
- 硬盘≥30G(一个模型就5~7G,再加上缓存,分分钟干爆C盘)
推荐配置:
- 显存12G以上(3060起步),直接开xformers,省30%显存,生成的妹子手指数量大概率≤5。
如果你只有Mac?也行,M1/M2能用DiffusionBee,就是速度堪比树懒翻身,适合睡前挂机,梦里出图。
安装包别瞎下,整合包也有坑
B站一搜“Stable Diffusion整合包”,全是“一键启动、小姐姐合集”,点进去先送全家桶:2345、快压、传奇私服。
正确姿势:
- 直接撸AUTOMATIC1111的官方仓库(别问我要链接,上面不让放,自己搜)。
- 装好Git、Python3.10(别整3.11,插件全军覆没)。
- 拉代码后,
webui-user.bat里加两行:
set COMMANDLINE_ARGS=--xformers --medvram
显存小就写--medvram,再小就--lowvram,别害羞,面子没显卡寿命重要。
第一次跑图,先整点“阳间参数”
很多萌新打开WebUI,提示词就写个girl,然后对着一团彩色马赛克怀疑人生。
起手式模板(直接抄):
正面:
(upper body:1.2), (cute:1.3), cyber fox spirit, neon tattoo, floating silk ribbons, (glow effects:1.1), detailed armor, sharp focus, 8k uhd, dslr, high quality, film grain, Fujifilm XT3
负面:
(worst quality:2), (low quality:2), (normal quality:2), lowres, bad anatomy, bad hands, extra digit, fewer digits, missing fingers, extra limbs, poorly drawn hands, mutation, deformed, blurry, bad proportions
参数别乱飞:
- Steps:20~30(再多边际效应,电费翻倍)
- Sampler:DPM++ 2M Karras(跑得快,出图稳)
- CFG:7~11(数字越大AI越听话,但过12容易油画脸)
- Seed:-1(随机roll,抽到ssr再固定)
生成角色三件套:提示词、LoRA、ControlNet
1. 提示词不是作文,是“藏头诗”
把想画的东西拆成**“主体+装饰+光影+材质+相机”**,顺序越靠前权重越高。
想强调?加括号:((red eyes)) 代表1.21倍权重,[red eyes] 降到0.9倍。
别写小作文,200 token后AI直接走神,给你画个克苏鲁。
2. LoRA:给AI喂私货
官方模型只会画通用脸,想让你的角色“一眼认出”?
LoRA=小抄,10~20张原画就能训练,大小只有几十兆,随插随用。
训练套路:
- 先抠图,统一512×512,背景纯白,命名格式:
100_xxx.png(100代表步数,别省) - 用Kohya脚本,学习率0.0001,batch 2,跑1500步足够。
- 训练完把
.safetensors扔进models/Lora文件夹,重启WebUI,在提示词里写:
<lora:cyberFox_v1:0.8>
权重0.6~1.0之间调,过高会过拟合,脸像被门夹过。
3. ControlNet:让AI别乱飘
只写提示词,AI能把耳朵给你画到下巴。
ControlNet=紧箍咒,先上传一张线稿,勾选Enable,预处理器选canny,模型选control_canny,AI就在你给的轮廓里涂色,跑十次都不带歪。
游戏里最常用:
- 线稿→概念色→策划闭嘴
- 3D渲染法线→直接生成贴图→美术组提前下班
三天实战:从“妲己”到“九尾机械姬”
Day1:草图轰炸
策划给的关键词:赛博、九尾、敦煌、狐狸、娘。
我先用Blender拉了个九尾剪影,渲染成纯Alpha轮廓,扔进ControlNet,提示词:
cyber fox girl, (neon circuit tattoos:1.2), (floating silk ribbons, Chinese cloud pattern:1.3), mechanical tails, (glowing eyes:1.1), upper body, sharp focus, 8k
步数25,CFG 8,一次出64张,像抽卡一样爽。
第一轮roll完,筛出6张能看的,扔进PS液化,把尾巴调到策划满意的长度(他说九尾就得九条,少一条都扣我绩效)。
Day2:精修+LoRA微调
把昨天挑的2B小姐姐重新描线,训练专属LoRA,20张图,10分钟搞定。
再跑图,这次提示词直接写:
<lora:cyberFox_v1:0.75>, (upper body:1.2), cyber fox spirit, detailed mechanical armor, (iridescent enamel:1.1), (gradient silk:1.2), rim light, cinematic composition
出图稳定,脸不再像拼夕夕买家秀。
img2img重绘:把尾巴尖端改成武器,重绘幅度0.4,既保留整体,又能局部魔改。
Day3:三视图+拆件
策划突然要三视图?拿同一张seed,ControlNet开depth模型,正面→侧面→背面连跑三张,角度固定,尾巴不歪。
再跑一张纯色块版,当拆件遮罩,UI同学直接拖去切图,省得手绘AO。
最终交付:
- 概念精图4K×2K PNG
- 三视图2048×1024
- 色指定+材质遮罩
- 源文件打包,命名
FoxGirl_v1_final_reallyFinal_thisTimeFinal.psd
翻车现场TOP5:血与泪的合集
| 翻车 | 症状 | 急救 |
|---|---|---|
| 1. 六指琴魔 | 手指数≥6 | 负面提示词加fewer digits,再跑;不行就局部重绘,手单独画 |
| 2. 显存爆炸 | 黑屏+风扇狂飙 | 开--medvram,图片尺寸先512,出图后再ESRGAN超分 |
| 3. 风格漂移 | 同一天参数出两种脸 | 把seed固定+LoRA锁脸,别乱动CFG |
| 4. 版权雷 | 商用怕撞车 | 训练集别用版权图,反向搜图用yandex.com,宁可丑也别坐牢 |
| 5. 模型不兼容 | 加载卡住 | 看清版本,SD1.5的LoRA别往SDXL里塞,会原地自闭 |
让AI更听话的阴间技巧
反向提示词黑魔法
把你不想要的打包成“诅咒”:
(ugly:1.3), (duplicate moles:1.2), crossed eyes, (jaw tumor:1.5), (poorly drawn Chinese characters:1.4)
别怕难听,越具体AI越怕。
区域重绘:打补丁不心疼
WebUI切到Inpaint,面具涂尾巴,提示词只写mechanical tail blade, glowing edge,其他留空,AI只改尾巴,身体不动,省得全图重roll。
多LoRA鸡尾酒
想中日混搭?
<lora:japaneseAnime_v2:0.4>, <lora:chineseAncient_v3:0.6>
权重和为1,先低后高,慢慢调,别一次拉满,容易精神污染。
高清修复两条路
- ESRGAN 4×:显存友好,出图快,适合预览。
- SD Upscale:把图切成若干512格子,分别重绘,再拼回,细节爆炸,但耗时×4,适合最终立绘。
版权别装死,真的会寄律师函
Stable Diffusion训练集里混了海量版权图,商用前务必:
- 自己训LoRA,训练集用自产或CC0素材。
- 出图后反向搜图,Google、Yandex双搜,撞车率>30%就回炉。
- 大版本留工程文件,万一被锤,能证明“原创流程”。
别心存侥幸,被盯上赔偿按张算,一张几千刀,够你显卡烧到RTX9090。
AI不是终结者,是加班终结者
写到这里,显卡还在呼呼转,像极了我第一次通宵渲染的光景。
但这一次,我能在凌晨两点前合眼,因为AI帮我搬完了最沉的那块砖。
最后一碗毒鸡汤:
不会画画的策划,别把AI当救命稻草;
会画画的美术,也别把AI当夺命镰刀。
它就是个工具人,你越懂它,它越像你手里那支笔——
笔不会替你脑洞,但能替你手酸。
明天策划要是再改需求?
我直接甩他一句:“行,等我先泡杯茶,让显卡先干会儿。”
(代码、参数、模型配置文件我已打包扔群文件,文件名FoxGirl_AIO.7z,自己扒,别再问我“为什么你跑得出我跑不出”,问就是显卡不爱吃青菜。)

更多推荐


所有评论(0)