Stable Diffusion
开源图像模型,可本地部署、可精细控制
- 收费
- 模型开源免费,官方云服务按量计费
- 访问
- 大陆可直接访问
Stable Diffusion 是什么
Stable Diffusion 是 Stability AI 发布的开源图像生成模型系列。它本身不是一个网站,而是一套可以下载的模型权重,配合 ComfyUI、WebUI 这类社区界面使用;官方也提供按量计费的云端 API。
开源是它最大的区别点:模型可以下载到自己的机器上跑,图片不经任何第三方,也没有平台强加的生成内容审核。做商业项目、或者素材本身涉密时,这一条往往就决定了选它。
生态是另一个优势。ControlNet 这类控制手段可以按姿势、深度、边缘图来约束构图,LoRA 可以用少量素材训练出特定风格或角色。要做“每张图里同一个人物”或“严格贴合线稿”,这条路线是可行的,Midjourney 则很难。
主要功能
- 文生图与图生图:既能从文字出图,也能以一张已有图片为起点改风格、改内容。
- 局部重绘与扩图:用蒙版指定区域重新生成,或向外延展画面,适合修图和补全。
- ControlNet 构图控制:用姿势骨架、深度图、线稿等条件锁定构图,生成结果贴合设计稿。
- LoRA 微调:用几十张图训练一个小模型,固定某个角色、产品或画风。
- 节点式工作流:在 ComfyUI 里把各个步骤串成流程,保存后可以反复复用和分享。
如何使用
- 准备一台有独立显卡的电脑,安装 ComfyUI 或 WebUI 等界面(多数提供一键安装包)。
- 从官方或 Civitai、LiblibAI 等社区下载底模,放进对应的模型目录。
- 启动界面,写正向和反向提示词,设置尺寸、步数、采样器后生成。
- 效果稳定后,再按需要叠加 ControlNet、LoRA 或放大模型,逐步精修。
适用场景
- 对数据隐私敏感的项目:全程本地运行,素材和成品都不离开自己的机器。
- 需要角色或产品一致性的系列图:LoRA 加参考控制是目前最可靠的做法之一。
- 严格按线稿或草图出图:ControlNet 能把构图牢牢固定住。
- 批量生产和自动化:工作流可以脚本化,适合接入自己的生产管线。
优势与不足
优势
- 可本地部署,不依赖任何平台,也不按张收费。
- 控制手段最丰富,精确度远超封闭的在线工具。
- 社区模型和教程极多,几乎任何风格都能找到现成的底模或 LoRA。
不足
- 上手成本高,要自己配环境、挑模型、调参数,本地运行还需要一块像样的显卡。
- 开箱即用的观感不如 Midjourney,好效果依赖经验。
- 不同版本的许可证条款不一样,较新的模型对商用有附加条件,使用前要逐一核对。
- 社区模型的训练素材来源不透明,商用时存在版权风险。
Stable Diffusion 与同类工具对比
| 工具 | 一句话介绍 | 收费 | 访问 |
|---|---|---|---|
| Midjourney | 出图审美最稳的一个,代价是可控性 | 订阅制,没有长期免费额度 | 大陆不可用 |
| Stable Diffusion | 开源图像模型,可本地部署、可精细控制 | 模型开源免费,官方云服务按量计费 | 大陆可直接访问 |
| 即梦 | 字节的图像与视频生成工具,中文提示词直接可用 | 有每日免费额度,超出后按积分计费 | 大陆可直接访问 |
| Ideogram | 图中文字渲染准确的图像生成工具 | 有免费额度 | 大陆可直接访问 |
| LiblibAI 哩布哩布 | 国内的模型分享社区与在线出图平台 | 有免费额度 | 大陆可直接访问 |
| Civitai | 全球最大的开源图像模型分享社区 | 浏览下载免费,在线生成按积分 | 大陆可直接访问 |
收费和功能变动频繁,以官网为准。