Stable Diffusion

StabilityAI推出的文本到图像生成AI

AI图像工具

Stability AI

Stability AI 是一家总部位于英国伦敦的人工智能公司,成立于 2019 年,以其开源的文本生成图像模型 Stable Diffusion 而闻名。

公司自称为“世界顶级的开源生成式 AI 公司”,在全球拥有超过 30 万名创作者、开发者和研究者组成的活跃社区。其使命是“构建激活人类潜能的基础,通过开放的基础模型,让世界各地的开发者都能免费下载并基于我们的代码进行开发”。

2022 年 8 月,Stability AI 发布 Stable Diffusion,迅速声名大噪。同年 10 月完成 1.01 亿美元融资,估值突破 10 亿美元。

近年来,公司经历了商业化转型和管理层变动。2025 年推出企业级产品「Stability AI Solutions」,标志着从开源社区向企业服务的战略转型。CEO 也经历了多次更迭。

Stable Diffusion

Stable Diffusion 是由 Stability AI 管理的一款开源的深度学习文本生成图像模型,由德国慕尼黑大学的研究人员开发,于 2022 年 8 月公开发布。

✨ 核心功能

  • 文本生成图像(txt2img):输入文字描述(提示词/Prompt),AI 即可生成对应的图像。
  • 图像生成图像(img2img):输入一张图片并结合文字描述,生成新的变体图像。
  • 视频与动画生成:除了图像,还可用于创建视频和动画。
  • 3D 物体生成:支持多视角 3D 物体生成。

🚀 主要特点

  • 开源免费:代码与模型权重完全公开,支持本地部署与二次开发。
  • 低硬件门槛:基于潜在扩散技术,在消费级 GPU 上即可运行。
  • 精准控制:集成 ControlNet、LoRA 等技术,可实现骨骼绑定、局部重绘等像素级精准控制
  • 生态丰富:拥有活跃的开发者社区,提供海量预训练模型与插件库
  • 多模态创作:支持文本、图像、视频的跨模态创作,覆盖动漫、写实、艺术等多种风格。

📅 主要版本演进

  • 2022 年 8 月:发布 Stable Diffusion 1.0,下载量在 2 个月内迅速突破千万。
  • Stable Diffusion XL(SDXL):拥有 35 亿参数的高级文本生成图像模型,提供高分辨率、照片级真实感的输出。
  • SDXL Turbo:SDXL 的精简版本,利用对抗性扩散蒸馏技术,可实现一步实时图像生成。
  • Stable Diffusion 3 Medium:20 亿参数模型,在照片级真实感、多主体提示词、图像质量和拼写能力方面都有显著提升。
  • Stable Diffusion 3.5 Large:目前该系列最强大的模型,具备卓越的质量和提示词遵循能力。

🔧 使用方式

  • 本地部署:可在 Hugging Face 下载权重,通过 ComfyUI 等工具在本地运行。
  • API 调用:可通过 Stability AI API 平台集成到应用中。
  • Web 应用:可通过 Stable Assistant 等网页端创意平台使用。

总结:Stable Diffusion 是 Stability AI 公司的核心开源产品,是一个强大的 AI 图像生成模型,以其免费开源、低硬件门槛、可控性强和生态丰富等特点,成为全球 AIGC 领域的标志性工具之一。

关于Stable Diffusion特别声明

本站AATOK提供的Stable Diffusion都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由AATOK实际控制,在2026-08-25 08:16收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,AATOK不承担任何责任。

相关导航