返回时间轴
2022-08-22

Stable Diffusion 将文本到图像生成开源给公众

Capability Breakthrough 产品工具

事件摘要

Stability AI 于 2022 年 8 月发布了 Stable Diffusion,一个开源的文本到图像模型,可以在消费级 GPU 上从自然语言描述生成高质量图像。与 DALL-E 2(封闭 API)和 Midjourney(专有)不同,Stable Diffusion 的权重公开发布,引发了一波社区工具、微调和创意应用的爆发。它几乎在一夜之间将 AI 艺术从一种新奇事物转变为大众现象。

影响评估

  • 普惠化 +3 · 即时

    开源权重发布使任何拥有消费级 GPU 的人都能从文本生成高质量图像。创建了丰富的社区工具生态(AUTOMATIC1111、ComfyUI)、微调技术(Dreambooth、LoRA)和控制方法(ControlNet)。确立了"开源权重"分发模型,成为后续基础模型的标配。

    受影响群体: artists、designers、hobbyists、students、startups

  • 经济冲击 -2 · 短期

    打乱了商业插画、图库摄影和平面设计的经济模式。艺术家在社交媒体平台上抗议。Shutterstock 等服务商被迫引入 AI 生成内容政策,同时面临生存威胁。模型在未经许可的版权图像上训练导致了多起集体诉讼。

    受影响群体: illustrators、photographers、graphic designers、stock image industry

  • 风险制造 -2 · 中期

    引发了关于 AI 训练数据中版权、艺术家退出权以及生成未经同意图像的可能性的根本问题。引发了全球范围内关于 AI 生成内容标签和责任的监管讨论。

    受影响群体: artists、policymakers、legal professionals、general public

共识度与来源

重要度 L1
分类 能力突破 / 产品工具
共识度 广泛共识
影响指数 6/10
  • 1

    原文可访问: https://stability.ai/stable-image

    Stable Diffusion is a text-to-image model that enables you to create realistic images from text descriptions. The model was trained on 256 Nvidia A100 GPUs.
    参考证据 引用已记录 原文可访问
  • 2

    原文可访问: https://en.wikipedia.org/wiki/Stable_Diffusion

    Stable Diffusion is a deep learning, text-to-image model released in 2022 based on diffusion techniques.
    参考证据 引用已记录 原文可访问