Stable Diffusion

Stable Diffusion

开源本地部署的文生图模型,权重参数完全自主可控

核心功能

Stable Diffusion是Stability AI开源的扩散模型系列,最新3.5版本采用MMDiT架构,擅长复杂提示理解与文字排版。权重在Hugging Face公开下载,可本地离线推理或通过API云端调用;搭配ComfyUI、WebUI与LoRA微调,从出图到成片全流程可控。

功能亮点

本地离线

权重下载后离线生成,无API限制,数据不出设备

海量模型

SD3.5/SDXL等官方权重加社区模型,风格任选

构图控制

ControlNet用线稿深度姿态约束,指哪画哪

风格微调

LoRA与Checkpoint训练专属风格,工具链成熟

自定义模型 / 模型接入

本地模型

开放权重模型,可从Hugging Face免费下载本地推理,也可用Stability官方API或Replicate托管;年营收超100万美元需企业许可。

接入方式
  • Hugging Face下载权重(safetensors)
  • ComfyUI/AUTOMATIC1111 WebUI本地运行
  • diffusers代码库调用
  • Stability API云端调用
支持模型
Stable Diffusion 3.5 LargeStable Diffusion 3.5 MediumStable Diffusion 3.5 FlashSDXLSD1.5
bash
权重从huggingface.co/stabilityai下载,放入WebUI models目录或用diffusers加载;配合LoRA可训练专属风格

适用场景

• 概念艺术与插画创作
• 电商商品图批量生成
• 游戏美术素材产出
• 个人风格化头像定制

安装配置

开源项目:git clone ComfyUI 或 AUTOMATIC1111 WebUI,安装Python+PyTorch依赖;权重从Hugging Face下载;也可用Stability AI云端API

使用方法

bash
1) 安装ComfyUI或WebUI:git clone仓库并按文档装依赖
2) 从Hugging Face下载SD3.5/SDXL权重(safetensors)放入模型目录
3) 写正向提示词描述画面,可加负面提示词排除不想要内容
4) 调采样器、步数、CFG引导强度、种子等参数
5) 需要构图控制时加载ControlNet,选线稿/深度/姿态等控制方式
6) 批量出图后挑选结果,再用放大模型或图生图精修

关键指标

尚未核验对标产品,此处只列本工具自身指标,不做对比结论。

指标Stable Diffusion
价格免费
开源
上手难度专家
Token 消耗

相关工具

优点

  • 开源免费,本地无限次生成
  • 参数与模型完全可控
  • 社区生态与LoRA微调丰富
  • 无内容审查,自由度最高

缺点

  • 部署配置需一定技术能力
  • 生成质量依赖显卡性能
  • 默认模型需调参才出好图