游戏美术狗狂喜:用Stable Diffusion三天搞定角色原画(附避坑指南)

“哥,策划又双叒叕改需求了,这回要一个‘赛博妲己、机械九尾、还得带点敦煌飞天味儿’的角色,明早给图。”
听完我直接原地升天。
但三天后,我把成图甩群里,策划沉默半晌,回了一句:“卧槽,你偷偷外包了?”
我邪魅一笑:外包个屁,老子有AI外挂——Stable Diffusion。


先别急着装,显卡先喊冤

别一看别人晒图就冲去下整合包,先摸摸自己主机的底。
最低门槛

  • N卡≥6G显存(A卡也能跑,但得折腾Rocm,劝退率99%)
  • 硬盘≥30G(一个模型就5~7G,再加上缓存,分分钟干爆C盘)

推荐配置

  • 显存12G以上(3060起步),直接开xformers,省30%显存,生成的妹子手指数量大概率≤5。

如果你只有Mac?也行,M1/M2能用DiffusionBee,就是速度堪比树懒翻身,适合睡前挂机,梦里出图。


安装包别瞎下,整合包也有坑

B站一搜“Stable Diffusion整合包”,全是“一键启动、小姐姐合集”,点进去先送全家桶:2345、快压、传奇私服。
正确姿势

  1. 直接撸AUTOMATIC1111的官方仓库(别问我要链接,上面不让放,自己搜)。
  2. 装好Git、Python3.10(别整3.11,插件全军覆没)。
  3. 拉代码后,webui-user.bat里加两行:
set COMMANDLINE_ARGS=--xformers --medvram

显存小就写--medvram,再小就--lowvram,别害羞,面子没显卡寿命重要。


第一次跑图,先整点“阳间参数”

很多萌新打开WebUI,提示词就写个girl,然后对着一团彩色马赛克怀疑人生。
起手式模板(直接抄):

正面:
(upper body:1.2), (cute:1.3), cyber fox spirit, neon tattoo, floating silk ribbons, (glow effects:1.1), detailed armor, sharp focus, 8k uhd, dslr, high quality, film grain, Fujifilm XT3  
负面:
(worst quality:2), (low quality:2), (normal quality:2), lowres, bad anatomy, bad hands, extra digit, fewer digits, missing fingers, extra limbs, poorly drawn hands, mutation, deformed, blurry, bad proportions  

参数别乱飞

  • Steps:20~30(再多边际效应,电费翻倍)
  • Sampler:DPM++ 2M Karras(跑得快,出图稳)
  • CFG:7~11(数字越大AI越听话,但过12容易油画脸)
  • Seed:-1(随机roll,抽到ssr再固定)

生成角色三件套:提示词、LoRA、ControlNet

1. 提示词不是作文,是“藏头诗”

把想画的东西拆成**“主体+装饰+光影+材质+相机”**,顺序越靠前权重越高。
想强调?加括号:((red eyes)) 代表1.21倍权重,[red eyes] 降到0.9倍。
别写小作文,200 token后AI直接走神,给你画个克苏鲁。

2. LoRA:给AI喂私货

官方模型只会画通用脸,想让你的角色“一眼认出”?
LoRA=小抄,10~20张原画就能训练,大小只有几十兆,随插随用。
训练套路

  • 先抠图,统一512×512,背景纯白,命名格式:100_xxx.png(100代表步数,别省)
  • 用Kohya脚本,学习率0.0001,batch 2,跑1500步足够。
  • 训练完把.safetensors扔进models/Lora文件夹,重启WebUI,在提示词里写:
<lora:cyberFox_v1:0.8>

权重0.6~1.0之间调,过高会过拟合,脸像被门夹过。

3. ControlNet:让AI别乱飘

只写提示词,AI能把耳朵给你画到下巴。
ControlNet=紧箍咒,先上传一张线稿,勾选Enable,预处理器选canny,模型选control_canny,AI就在你给的轮廓里涂色,跑十次都不带歪。
游戏里最常用

  • 线稿→概念色→策划闭嘴
  • 3D渲染法线→直接生成贴图→美术组提前下班

三天实战:从“妲己”到“九尾机械姬”

Day1:草图轰炸

策划给的关键词:赛博、九尾、敦煌、狐狸、娘
我先用Blender拉了个九尾剪影,渲染成纯Alpha轮廓,扔进ControlNet,提示词:

cyber fox girl, (neon circuit tattoos:1.2), (floating silk ribbons, Chinese cloud pattern:1.3), mechanical tails, (glowing eyes:1.1), upper body, sharp focus, 8k

步数25,CFG 8,一次出64张,像抽卡一样爽。
第一轮roll完,筛出6张能看的,扔进PS液化,把尾巴调到策划满意的长度(他说九尾就得九条,少一条都扣我绩效)。

Day2:精修+LoRA微调

把昨天挑的2B小姐姐重新描线,训练专属LoRA,20张图,10分钟搞定。
再跑图,这次提示词直接写:

<lora:cyberFox_v1:0.75>, (upper body:1.2), cyber fox spirit, detailed mechanical armor, (iridescent enamel:1.1), (gradient silk:1.2), rim light, cinematic composition

出图稳定,脸不再像拼夕夕买家秀。
img2img重绘:把尾巴尖端改成武器,重绘幅度0.4,既保留整体,又能局部魔改。

Day3:三视图+拆件

策划突然要三视图?拿同一张seed,ControlNet开depth模型,正面→侧面→背面连跑三张,角度固定,尾巴不歪。
再跑一张纯色块版,当拆件遮罩,UI同学直接拖去切图,省得手绘AO。
最终交付

  • 概念精图4K×2K PNG
  • 三视图2048×1024
  • 色指定+材质遮罩
  • 源文件打包,命名FoxGirl_v1_final_reallyFinal_thisTimeFinal.psd

翻车现场TOP5:血与泪的合集

翻车 症状 急救
1. 六指琴魔 手指数≥6 负面提示词加fewer digits,再跑;不行就局部重绘,手单独画
2. 显存爆炸 黑屏+风扇狂飙 --medvram,图片尺寸先512,出图后再ESRGAN超分
3. 风格漂移 同一天参数出两种脸 把seed固定+LoRA锁脸,别乱动CFG
4. 版权雷 商用怕撞车 训练集别用版权图,反向搜图用yandex.com,宁可丑也别坐牢
5. 模型不兼容 加载卡住 看清版本,SD1.5的LoRA别往SDXL里塞,会原地自闭

让AI更听话的阴间技巧

反向提示词黑魔法

把你不想要的打包成“诅咒”:

(ugly:1.3), (duplicate moles:1.2), crossed eyes, (jaw tumor:1.5), (poorly drawn Chinese characters:1.4)

别怕难听,越具体AI越怕。

区域重绘:打补丁不心疼

WebUI切到Inpaint,面具涂尾巴,提示词只写mechanical tail blade, glowing edge,其他留空,AI只改尾巴,身体不动,省得全图重roll。

多LoRA鸡尾酒

想中日混搭?

<lora:japaneseAnime_v2:0.4>, <lora:chineseAncient_v3:0.6>

权重和为1,先低后高,慢慢调,别一次拉满,容易精神污染。

高清修复两条路

  1. ESRGAN 4×:显存友好,出图快,适合预览。
  2. SD Upscale:把图切成若干512格子,分别重绘,再拼回,细节爆炸,但耗时×4,适合最终立绘。

版权别装死,真的会寄律师函

Stable Diffusion训练集里混了海量版权图,商用前务必:

  • 自己训LoRA,训练集用自产或CC0素材。
  • 出图后反向搜图,Google、Yandex双搜,撞车率>30%就回炉。
  • 大版本留工程文件,万一被锤,能证明“原创流程”。
    别心存侥幸,被盯上赔偿按张算,一张几千刀,够你显卡烧到RTX9090。

AI不是终结者,是加班终结者

写到这里,显卡还在呼呼转,像极了我第一次通宵渲染的光景。
但这一次,我能在凌晨两点前合眼,因为AI帮我搬完了最沉的那块砖。

最后一碗毒鸡汤
不会画画的策划,别把AI当救命稻草;
会画画的美术,也别把AI当夺命镰刀。
它就是个工具人,你越懂它,它越像你手里那支笔——
笔不会替你脑洞,但能替你手酸。

明天策划要是再改需求?
我直接甩他一句:“行,等我先泡杯茶,让显卡先干会儿。”

(代码、参数、模型配置文件我已打包扔群文件,文件名FoxGirl_AIO.7z,自己扒,别再问我“为什么你跑得出我跑不出”,问就是显卡不爱吃青菜。)

在这里插入图片描述

Logo

有“AI”的1024 = 2048,欢迎大家加入2048 AI社区

更多推荐