Stable Diffusion WebUI 是 GitHub 上星标最高的 AI 绘画项目之一,累计 16.48 万星标。它本质上是一个网页工具:把 Stable Diffusion 这套「根据文字描述生成图片」的 AI 模型,包装成浏览器里就能操作的界面,装好就能用。你不需要写代码,也不需要懂模型原理——打开网页、输入一句描述、点一下生成,就能得到图片。它适合三类人:想体验 AI 绘画的普通用户、需要快速出图或批量处理素材的设计师,以及想在本地训练和微调模型的研究型开发者。

项目全名 AUTOMATIC1111/stable-diffusion-webui,作者网名 AUTOMATIC1111。它基于 Gradio 搭建——Gradio 是一个 Python 界面库,几行代码就能把程序变成网页——并配有一键启动脚本,2022 年发布后迅速成为 Stable Diffusion 生态里最常用的工具。截至本次数据抓取,该仓库有 3.06 万 fork、1300 人正在关注,586 名开发者参与过贡献,代码提交 7689 次,采用 AGPL-3.0 开源协议。

它能做什么

文字生图(txt2img):输入一段文字描述(提示词),选择参数,生成对应图片。这是最常用的功能。图片改图(img2img):上传一张已有图片,AI 按你的描述改写它,比如把实拍照片改成油画风格。

修图与放大:外扩画面(outpainting,把图片四周向外延伸、生成新的内容)、局部重绘(inpainting,抹掉图上某个区域让 AI 重新画,常用于修瑕疵)、以及多款高清放大工具(RealESRGAN、SwinIR 等,把低分辨率图片变清晰)。放大工具本质是另一套神经网络,专门负责补充细节。

批量与对比:支持一次处理整个文件夹的图片;X/Y/Z plot 功能可以一次生成多张不同参数的图片排成网格,方便直接对比哪个参数效果最好。

新手为什么容易上手

  • 一键安装:Windows 下双击 webui.bat、Linux 下运行 webui.sh,脚本会自动安装依赖并启动,装完自动打开浏览器界面。
  • 门槛低:官方说明 4GB 显存即可运行(社区有 2GB 显存成功运行的反馈)。显存是显卡上专门存放模型数据的存储器,AI 绘图对它的占用最大,这一条直接决定了普通电脑能不能跑。
  • 便利细节:生成图片时会自动把所用参数(提示词、尺寸、随机种子等)存进图片文件,把图片拖回界面即可恢复这些参数;支持负向提示词(negative prompt),专门列出「不想要什么」,比如「模糊、多手指」,能明显减少废图。

进阶:训练与定制

WebUI 内置训练功能,不只是「生成图片」:Textual Inversion(文本反转)允许用户用少量图片训练一个自定义「单词」,之后在提示词里用这个词就能生成相似风格的内容,8GB 显存的显卡即可训练;LoRA 是一种轻量微调方法,用很小的文件就能调整模型的风格或保持角色一致性;还支持超网络(hypernetworks)、模型合并(checkpoint merger,把多个模型混合成一个)。

扩展生态是它功能齐全的重要原因:社区为它写了大量插件,例如动漫图片自动打标签(DeepDanbooru)、历史图片浏览、提示词辅助等,官方 wiki 收录的扩展列表很长,大多数功能都可以通过装插件获得。

它在 2026 年的位置

从仓库数据看,这个项目已经进入「开发放缓」阶段:主分支最后一次代码提交停在 2024 年 7 月 27 日,最新正式版 v1.10.1 发布于 2025 年 2 月 9 日(共 27 个版本)。2024 年 6 月曾加入对 Stable Diffusion 3 的初始支持,之后没有大的更新。

原版放缓后,社区出现了多个活跃分支(fork)继续维护,多数新项目都沿用了 WebUI 的操作习惯和扩展格式。对 2026 年的新用户来说,它依然是资料最全、功能最完整的入门选择;如果追求更新的模型特性,可以关注它的活跃分支或新生态工具,但先理解这套界面如何组织功能,依然是进入 AI 绘图领域最顺的路径。

结论:Stable Diffusion WebUI 是 AI 绘画领域公认的经典工具——用网页界面把复杂的生成模型变成人人可用,16.48 万星标和 586 名贡献者说明了它的地位;它现在的价值在于功能完整与资料积累,适合入门学习和稳定使用。