AI绘画SD教程:Stable Diffusion入门到出图
简单说:AI绘画SD入门就四步——装WebUI、下大模型、写提示词、调采样器CFG步数出图,难点不在装而在参数怎么调,CFG5到7、步数20到30是新手甜点区。
ai绘画sd教程这事儿我接触得早,两年前第一次装Stable Diffusion差点被劝退——光装环境就折腾了一晚上,依赖报错满天飞。后来Automatic1111的WebUI整合包出来,门槛才算降下来。SD跟MJ、即梦不一样,它开源、免费、本地跑,自由度天花板,但代价是得自己装环境、下模型、调参数,上手陡。这篇我把从零到第一张出图的流程掰开讲,踩过的坑都标出来,新手照着走能少走不少弯路。
SD到底强在哪
原子答案:SD强在开源免费、本地跑、可炼LoRA和挂ControlNet,自由度天花板,代价是上手陡、要会装环境调参数,适合愿意折腾的人。
SD跟MJ、即梦的本质区别是"开源本地"。MJ是云端订阅制,你交钱用它的服务,图在它服务器出,好处是省事,坏处是不可控、要持续付费。SD是开源模型放本地跑,一次买断显卡后续零成本,模型随便换、LoRA随便炼、ControlNet随便挂,自由度没有上限。代价是你得自己装环境、自己下模型、自己调参数,对动手能力弱的人是劝退门槛。
我自己用SD两年了,最大的爽点是"可炼专属LoRA"。我把自己的画风炼进LoRA,之后出图都带我的味,这是MJ给不了的。再一个爽点是ControlNet锁构图,人物姿势、手势都能精准控制。这俩是SD的杀手锏。但说实话,如果你就图个乐、出几张漂亮图,MJ或即梦更省心,SD是给"想深度玩"的人准备的。电脑配置是硬门槛,配置参考 AI绘画电脑配置。
第一步:装WebUI和运行环境
原子答案:新手装SD用整合包最省事,下载即用不用配环境,爱装的话用秋叶整合包或Automatic1111的WebUI,别从零配Python和PyTorch,那是劝退陷阱。
装环境是SD劝退第一关。从零装Python、装PyTorch、装各种依赖,新手光是报错就能折腾一整晚,没必要。用整合包——秋叶整合包(国内最流行)或者Automatic1111的WebUI一键包,下载解压双击就能跑,环境全打包好了。我个人推荐秋叶整合包,国内下载快、中文界面、新手友好。
装完双击"启动器",点"一键启动",等几分钟黑窗口跑完,浏览器自动打开WebUI界面,就装好了。整合包的好处是模型、插件、依赖都预装,省去手动配置地狱。真想从零配环境那是进阶玩家的事,新手别碰。
关于运行环境的基础概念,可以参考 AI绘画画图入门 里"工具环境准备"的逻辑,SD和MJ在环境这块区别最大。
第二步:下大模型
原子答案:SD出图靠大模型(checkpoint),新手推荐下"anything-v5"画二次元、"realisticvision"画写实,模型放 models/Stable-diffusion 文件夹,模型文件几G别下错地方。
光装WebUI不出图,得有大模型。大模型(checkpoint)是SD出图的"大脑",决定画什么画风。模型文件几G一个,得手动下。下载站首选 Civitai,全球最大的SD模型库,各种画风模型都有。
新手推荐两个起步模型:画二次元下"anything-v5"或"橙橘",画写实下"realisticvision"或"chilloutmix"。下完把.safetensors文件放进 stable-diffusion-webui/models/Stable-diffusion 文件夹,回WebUI刷新就能在模型下拉框里看到。模型文件大,几个G起步,下载慢的话挂梯子或用国内镜像。
我自己的模型库现在攒了四十多个,按画风分了"二次元""写实""国风""水彩"几个文件夹。新手先下俩用着,别贪多,模型下太多管理混乱反而乱。
第三步:写提示词
原子答案:SD提示词是英文逗号分隔的标签,写法是"主体+细节+画质词+风格词",正向词放正面框、负向词放反面框,新手照着模板套最快。
SD提示词跟MJ不一样,是英文逗号分隔的标签,不是自然语言句子。写法有个固定骨架:主体(画什么)+细节(长什么样)+画质词(masterpiece, best quality, highres)+风格词(什么画风)。比如画个二次元女孩:1girl, long black hair, red eyes, school uniform, smile, masterpiece, best quality, anime style。
负向词(反面框)是"不要什么",新手固定套 worst quality, lowres, bad anatomy, extra fingers, deformed, blurry。这串负向词能挡掉大部分低质和崩坏。提示词权重要点:想强调某词用括号 (red eyes:1.3),数值越大越强调。
提示词写法是SD的核心功夫,深入可以看 SD提示词合集,里面权重、调度、组合讲得透。新手先套模板,熟了再调权重。
第四步:调采样器CFG步数出图
原子答案:新手出图参数甜点区是采样器DPM++ 2M Karras、CFG 5到7、步数20到30,分辨率512x768起,这套跑二次元写实都稳,调过头反而崩。
参数是SD劝退第二关。界面一堆滑块,新手懵。重点就三个:采样器、CFG、步数。采样器选DPM++ 2M Karras(最稳最常用),CFG(提示词权重)5到7——低了图糊不忠于词、高了过饱和崩坏,6是甜点。步数(迭代次数)20到30——少了图没画完、多了过度优化反而崩,25够用。分辨率512x768或768x512起步,别一上来拉1024,显存炸且容易崩。
这套参数我跑了上千张,稳定。新手照着设,点Generate,等个二三十秒,第一张图就出来了。出图时间跟显卡有关,我RTX 3060 12G跑512x768约18秒一张。想出更好的再调高分辨率、加LoRA、加ControlNet,那是进阶。
根据Stability AI 官方文档,SD的CFG值推荐范围是5到7.5,步数推荐20到50,我实测甜点区跟官方建议基本一致,CFG超过8、步数超过40对多数场景收益递减。
新手最容易翻的三个坑
原子答案:三个高频坑是显存炸(分辨率拉太高)、出图糊(步数太低或CFG太低)、模型没刷新(下了模型没重启WebUI),对应解法是512起步、步数25CFG6、下模型后刷新重启。
第一坑是显存炸。新手贪心分辨率拉1024甚至2048,结果爆显存出不了图。512x768起步,熟了再往上加。第二坑是出图糊。步数低于15或CFG低于4,图就糊没画完。步数25、CFG6基本不会糊。第三坑是模型没刷新。下了新模型没刷新WebUI,下拉框里看不到,以为下错了。下完模型回WebUI点刷新或重启,才出现。
再补一个冷门坑:出图人脸崩。多半是负向词没写够,加 bad anatomy, deformed face, extra fingers 到负向框,崩脸率能降一半。再崩就上Inpaint局部重绘修脸。
常见问题
Stable Diffusion装不上怎么办?
别从零配Python和PyTorch,用整合包。秋叶整合包国内下载快、中文界面、环境全打包,下载解压双击就能跑。从零配环境是劝退陷阱,新手别碰。整合包是真"一键启动",省去手动配置地狱。
SD出图总是崩脸崩手怎么办?
负向词加 bad anatomy, deformed face, extra fingers, deformed hands。CFG调到6,步数25。再崩用Inpaint把脸框出来单独重绘,幅度压0.3到0.4。SD的崩脸比MJ严重,得靠负向词和局部重绘压,这是SD的代价。
SD和Midjourney哪个更适合新手?
新手图省事选Midjourney,云端订阅、上手快、出图稳。想深度玩、要自由度选SD,开源免费本地跑、可炼LoRA挂ControlNet。SD上手陡但上限高,MJ省心但要持续付费。我个人两个都用,SD炼专属风格,MJ出质感图。
SD出图慢怎么提速?
分辨率降回512x768,步数压到20到25,采样器用DPM++ 2M Karras(速度快质量稳)。显存够的话开xformers加速。出图时间主要看显卡,我RTX 3060 12G跑512x768约18秒,想快只能升级显卡,配置参考 AI绘画电脑配置。
SD这工具,上手是陡,但摸进去自由度是真爽。装WebUI、下大模型、写提示词、调采样器CFG步数,这四步走通,第一张图就出来了。新手甜点区记死:DPM++ 2M Karras、CFG6、步数25、512x768。这套跑稳了再往进阶玩——加LoRA、挂ControlNet、炼专属模型。今天有空的话,下个秋叶整合包,照着这套参数跑一张二次元女孩试试,保准有成就感。出片满意的别藏着,发个朋友圈或晒到小红书,让朋友也看看你本地跑的第一张SD图——这种"我自己跑出来"的成就感,不分享可惜了。想深入提示词和参数原理的,顺带把 AI绘画SD入门教程 和 SD提示词合集 翻翻。