Stable Diffusion

Stable Diffusion

官方背景

Stable Diffusion 是由 Stability AI 于 2022 年 8 月开源发布的潜在空间(Latent)文本生成图像扩散模型,是真正把 AI 生图带进普通人电脑的里程碑。它的核心算法源自慕尼黑大学 CompVis 实验室的 Latent Diffusion Model(潜在扩散模型)研究,并联合 RunwayML、EleutherAI 共同完成。相比当时只能在云端大算力上运行的模型,Stable Diffusion 的权重完全开放、可在消费级显卡本地部署,一夜之间点燃了全球的开源生图生态。此后版本不断演进:2023 年推出画质与构图大幅跃升的 SDXL 1.0,2024 年发布文字渲染与提示词遵循更强、分辨率更高的 SD 3 / SD 3.5 系列;社区则派生出 Automatic1111 WebUI、ComfyUI、InvokeAI 等一整套工具链,Stability AI 自身也提供 Stable Image 云端 API 与 platform.stability.ai 平台。

核心能力

潜空间扩散架构——先在压缩后的潜空间去噪再解码,算力需求低,消费级 GPU(甚至 6GB 显存)即可流畅出图,本地运行、数据不出本机;② 多模态生成——支持文生图、图生图、局部重绘(Inpainting)/外扩(Outpainting)与高清放大,配合 ControlNet 可实现姿态、深度、边缘、线稿等的精准构图控制;③ 开放权重与可微调——完整模型权重开源,可用 LoRA / DreamBooth 低成本训练专属风格与角色,自由合并、混用各类检查点(checkpoint);④ 庞大生态——海量社区模型、扩展插件与预设工作流(Civitai、Hugging Face 上数以万计),从写实到二次元到设计稿应有尽有;⑤ 持续进化——SDXL / SD 3.5 将常用分辨率提升至 1024px 级别,文字与复杂提示词的还原度显著改善。

应用场景

Stable Diffusion 是独立创作者、设计师、游戏与影视概念美术、电商与自媒体最常用的工作马之一。典型场景包括:插画与概念设定(角色、场景、分镜)、游戏与设计素材(图标、贴图、UI、产品图)、电商与海报(商品换背景、模特图、营销主视觉)、老照片修复与风格化、以及教学课件与科普配图。由于可本地免费运行、无需联网付费,它在注重隐私、可控与可商用的团队中尤其受欢迎,也是大量 AI 绘画工具(含国内平台)的底层引擎原型。

定价与可及性

Stable Diffusion 以开放权重形式免费提供,可从 Hugging Face、Civitai 等平台下载后在本地显卡运行;其使用遵循 Stability AI 的社区许可——个人与非商业用途免费,年营收低于门槛的小微企业亦可免费商用,超过则需购买商业许可。对不想折腾本地环境的用户,Stability AI 提供 platform.stability.ai 与 Stable Image 系列云端 API(按调用量计费),并有无数第三方托管与套壳产品;本地侧则只需一块兼容的 NVIDIA/AMD 显卡配合 Automatic1111 或 ComfyUI 即可开箱即用。

立即体验 Stable Diffusion →

Stability AI · 开源潜空间扩散 · 本地可跑 · 海量社区模型

© 版权声明
THE END
喜欢就支持一下吧
点赞68 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容