Stable Diffusion

#7 · 图像生成开源▲ 2.6k / 7d

开源文本到图像生成模型,可本地运行、可商用微调,是开源文生图生态的奠基者。

Stable Diffusion

产品介绍

Stable Diffusion 是 Stability AI 推出的开源文本到图像生成模型,也是整个 AI 图像生成浪潮中最重要的开源项目之一。用户输入文本提示词,模型即可生成对应图像;通过 LoRA、ControlNet、IP-Adapter 等扩展技术,还可以实现风格迁移、姿势控制、角色一致性和局部重绘。相比 Midjourney 等闭源服务,Stable Diffusion 最大的优势是「可本地运行、可微调、可商用」,这催生出了 Civitai、ComfyUI、Stable Diffusion WebUI 等庞大社区生态。

定价采用「开源免费 + 商业服务」模式。模型权重本身可免费下载并在本地运行;Stability AI 官方提供 DreamStudio 网页工具和 API 调用,按生成数量计费;企业客户还可以通过 Amazon Bedrock 和 Stability AI 的企业授权获得合规支持。对创作者和小团队来说,本地部署+社区模型基本是零成本;对需要 SLA 和版权保障的商业客户,官方 API 或 Bedrock 更合适。

公司现状方面,Stability AI 在 2024 年前后确实经历了管理层更替与战略重组,但 2025 年以来在新 CEO Prem Akkaraju 带领下已重新聚焦企业级创意服务。2025-2026 年间,Stability AI 先后与 Electronic Arts、Warner Music Group、Universal Music Group 达成战略合作,并将图像服务接入 Amazon Bedrock,同时发布了 Stable Audio 3.0 和 Stable Diffusion 3.5 系列新模型。截至 2026 年中,Stability AI 仍在正常运营并持续发布模型。

生态位上,Stable Diffusion 是「可控、可定制、可私有化」图像生成的代表。Midjourney 更适合追求艺术效果的普通用户,DALL·E 更适合与 OpenAI 生态集成,而 Stable Diffusion 则是设计师、开发者、广告公司和游戏工作室进行深度定制的首选。

注意:本地运行 Stable Diffusion 需要一定显存(建议 8GB+),复杂工作流推荐 ComfyUI;商业使用需关注 Stability AI 的许可证条款,部分衍生模型可能有额外限制。

模型迭代时间线

时间版本/模型要点
2022-08Stable Diffusion 1.x开源文生图模型首次走红
2022-11SD 1.5社区生态爆发,LoRA/ControlNet 涌现
2023-07SDXL1024px 原生分辨率,画质飞跃
2024-06Stable Diffusion 3新架构,文本渲染能力增强
2024-10Stable Diffusion 3.5多尺寸模型,企业与消费级兼顾
2025-05SD 3.5 AMD NPU 版针对 AMD NPU 本地推理优化
🤖开源可商用模型权重开放,支持本地部署、微调和二次开发
生态庞大Stable Diffusion 催生了 Civitai、ComfyUI、LoRA 等完整生态
企业级服务Stability AI 通过 API、Amazon Bedrock 和企业授权提供商业支持
更新记录
vStable Diffusion 3.52024

新一代多尺寸模型,提升文本渲染与构图

vSDXL2023

1024px 原生分辨率,画质显著提升

vStable Diffusion 1.52022

首个走红开源社区的文生图模型

相关产品

同类工具 · 点击查看
已复制,可直接粘贴给你的 AI