产品介绍
Stable Diffusion 是 Stability AI 推出的开源文本到图像生成模型,也是整个 AI 图像生成浪潮中最重要的开源项目之一。用户输入文本提示词,模型即可生成对应图像;通过 LoRA、ControlNet、IP-Adapter 等扩展技术,还可以实现风格迁移、姿势控制、角色一致性和局部重绘。相比 Midjourney 等闭源服务,Stable Diffusion 最大的优势是「可本地运行、可微调、可商用」,这催生出了 Civitai、ComfyUI、Stable Diffusion WebUI 等庞大社区生态。
定价采用「开源免费 + 商业服务」模式。模型权重本身可免费下载并在本地运行;Stability AI 官方提供 DreamStudio 网页工具和 API 调用,按生成数量计费;企业客户还可以通过 Amazon Bedrock 和 Stability AI 的企业授权获得合规支持。对创作者和小团队来说,本地部署+社区模型基本是零成本;对需要 SLA 和版权保障的商业客户,官方 API 或 Bedrock 更合适。
公司现状方面,Stability AI 在 2024 年前后确实经历了管理层更替与战略重组,但 2025 年以来在新 CEO Prem Akkaraju 带领下已重新聚焦企业级创意服务。2025-2026 年间,Stability AI 先后与 Electronic Arts、Warner Music Group、Universal Music Group 达成战略合作,并将图像服务接入 Amazon Bedrock,同时发布了 Stable Audio 3.0 和 Stable Diffusion 3.5 系列新模型。截至 2026 年中,Stability AI 仍在正常运营并持续发布模型。
生态位上,Stable Diffusion 是「可控、可定制、可私有化」图像生成的代表。Midjourney 更适合追求艺术效果的普通用户,DALL·E 更适合与 OpenAI 生态集成,而 Stable Diffusion 则是设计师、开发者、广告公司和游戏工作室进行深度定制的首选。
注意:本地运行 Stable Diffusion 需要一定显存(建议 8GB+),复杂工作流推荐 ComfyUI;商业使用需关注 Stability AI 的许可证条款,部分衍生模型可能有额外限制。
模型迭代时间线
| 时间 | 版本/模型 | 要点 |
|---|---|---|
| 2022-08 | Stable Diffusion 1.x | 开源文生图模型首次走红 |
| 2022-11 | SD 1.5 | 社区生态爆发,LoRA/ControlNet 涌现 |
| 2023-07 | SDXL | 1024px 原生分辨率,画质飞跃 |
| 2024-06 | Stable Diffusion 3 | 新架构,文本渲染能力增强 |
| 2024-10 | Stable Diffusion 3.5 | 多尺寸模型,企业与消费级兼顾 |
| 2025-05 | SD 3.5 AMD NPU 版 | 针对 AMD NPU 本地推理优化 |
新一代多尺寸模型,提升文本渲染与构图
1024px 原生分辨率,画质显著提升
首个走红开源社区的文生图模型




