跳到主要内容
Stable Diffusion

Stable Diffusion

Stable Diffusion 是开源的 AI 图像生成模型,可本地部署运行,支持高度自定义,是艺术家和开发者的首选工具。

图像生成 免费
访问网站

Stable Diffusion 是由 Stability AI 开发的开源潜在扩散模型,于 2022 年 8 月发布。与其他主要在云端运行的 AI 图像生成工具不同,Stable Diffusion 可以在消费级 GPU 上本地运行,为用户提供完整的控制权和隐私保护,同时无需支付使用费用。

Stable Diffusion 的工作原理是将文本提示和/或参考图像映射到潜在空间,然后通过迭代去噪过程生成新图像。模型通过 CLIP 文本编码器理解文本描述,并在潜在空间中进行扩散运算,最终解码为高分辨率图像。

其最重要的特性之一是开放的权重和架构,允许社区在基础模型上进行微调,生成了数千种专注于特定艺术风格、主题或用途的自定义模型(checkpoint)。LoRA、ControlNet 等技术进一步扩展了控制精度,允许用户对姿势、构图和风格进行精确控制。

Automatic1111(AUTOMATIC1111/stable-diffusion-webui)和 ComfyUI 等开源 Web UI 使非技术用户也能通过浏览器界面使用 Stable Diffusion,无需编写代码。这些工具提供了丰富的控制选项,包括 img2img、修复、超分辨率放大等功能。

2024 年推出的 Stable Diffusion 3 采用了全新的多模态扩散变换器架构,在文字渲染、复杂构图和整体图像质量方面取得了重大突破。

主要功能

  • 开源免费,可在消费级 GPU 上本地运行,完全保护隐私
  • 文字转图像和图像转图像生成,高度可定制
  • 庞大的社区自定义模型生态,覆盖数千种艺术风格和主题
  • ControlNet 实现精确的姿势、边缘和深度图控制
  • LoRA 技术支持高效微调,针对特定风格或角色训练
  • 修复(Inpainting)和外扩(Outpainting)功能
  • 支持 AUTOMATIC1111、ComfyUI 等多种开源 Web UI
  • 超分辨率放大,将低分辨率图像增强至高清
  • 批量生成和自动化工作流支持
  • 通过 Stability AI API 提供云端访问选项

常见问题

Stable Diffusion 是完全免费的吗?

是的,Stable Diffusion 模型权重完全免费开源,可下载后在本地运行,无使用限制。本地运行需要一定配置的 GPU(推荐 NVIDIA GPU,显存 6GB 以上)。通过 DreamStudio 等云端服务使用 Stable Diffusion 通常需要付费,但直接下载模型并自行部署是完全免费的。

Stable Diffusion 支持中文提示词吗?

Stable Diffusion 基础模型主要针对英文提示词进行了优化,但社区已开发了针对中文的微调模型和扩展。为获得最佳效果,建议使用英文提示词。部分 Web UI 工具(如 AUTOMATIC1111)支持安装中文翻译插件,可在界面层面提供中文支持,将输入自动翻译为英文处理。

Stable Diffusion 最适合哪类用户?

Stable Diffusion 最适合技术型用户、数字艺术家、游戏开发者和希望对图像生成有完全掌控的研究人员。对于想要无限制生成能力、自定义模型训练或完全隐私保护的用户来说尤为理想。入门门槛相对较高,但社区资源丰富,学习成本可控。

运行 Stable Diffusion 需要什么硬件?

标准图像生成推荐使用显存 6GB 以上的 NVIDIA GPU(RTX 3060 或更高)。使用 8-bit 量化技术可在 4GB 显存的 GPU 上运行,但速度较慢。也可以通过 CPU 运行,但速度非常缓慢,不建议用于正式创作。M1/M2 Mac 支持通过 Metal 加速运行。

Stable Diffusion 对初学者友好吗?

直接使用 Stable Diffusion 有一定的技术门槛,涉及安装配置和理解参数设置。但借助 AUTOMATIC1111 或 ComfyUI 等 Web UI 工具,普通用户可以通过图形界面上手使用,无需编写代码。也可以通过 Civitai 等在线平台体验,降低入门难度。大量中文教程和社区资源可帮助新手快速入门。

替代工具

图像生成的其他工具

标签

image-generation open-source local-AI LoRA ControlNet diffusion customizable self-hosted

相关指南

Udio 官网 AI 音乐生成首页
音频

Udio官网还能下载歌曲吗?网页版生成、积分与当前限制

Udio 官网目前仍能在浏览器里生成和编辑 AI 音乐,但已经不能下载音频、视频或分轨文件。截至 2026 年 8 月 31 日,官方首页仍提供文字生成歌曲、Extend、Inpaint、Remix 和上传音频等入口;官方帮助中心则明确写明,audio、video 与 stems 的下载已停用。 这意味着许多旧版“生成后下载 MP3/WAV”的教程已经不适用。…

阅读更多 →
Photoroom 网页版中文一键移除背景上传界面
图像生成

PhotoRoom网页版怎么用?抠图、换背景与免费限制

PhotoRoom 有可直接使用的网页版,而且官方提供简体中文入口。如果你的目的只是给商品图抠图,不必先安装手机 App:打开 PhotoRoom 官方一键移除背景页面,上传 JPEG 或 PNG,选择透明、白色或自定义颜色背景,再下载 PNG、JPEG 或 WEBP 即可。 但“免费开始”不等于所有导出、批处理和 AI 生成功能都没有限制。…

阅读更多 →
CapCut 网页版视频编辑器中文界面
视频

剪映网页版在线使用入口在哪?CapCut 操作与价格

剪映网页版应进入哪个官方入口?本文核对 CapCut 在线编辑器与剪映中国官网的实际跳转,说明浏览器上传、字幕、导出、免费范围及 Vrew、Descript 替代选择。

阅读更多 →
DeepSeek NotebookLM ChatPDF Jasper AI客户案例白皮书写作工作流
写作

AI客户案例白皮书写作工作流2026:用DeepSeek、NotebookLM、ChatPDF和Jasper从访谈证据到销售内容

从客户授权、访谈、主张台账和指标口径,到长篇案例、行业白皮书、公众号、销售PPT、事实审核与持续更新的中文B2B内容流程。

阅读更多 →