2022-08-22
Stable Diffusion 将文本到图像生成开源给公众
事件摘要
Stability AI 于 2022 年 8 月发布了 Stable Diffusion,一个开源的文本到图像模型,可以在消费级 GPU 上从自然语言描述生成高质量图像。与 DALL-E 2(封闭 API)和 Midjourney(专有)不同,Stable Diffusion 的权重公开发布,引发了一波社区工具、微调和创意应用的爆发。它几乎在一夜之间将 AI 艺术从一种新奇事物转变为大众现象。
影响评估
-
普惠化 +3 · 即时
开源权重发布使任何拥有消费级 GPU 的人都能从文本生成高质量图像。创建了丰富的社区工具生态(AUTOMATIC1111、ComfyUI)、微调技术(Dreambooth、LoRA)和控制方法(ControlNet)。确立了"开源权重"分发模型,成为后续基础模型的标配。
受影响群体: artists、designers、hobbyists、students、startups
-
经济冲击 -2 · 短期
打乱了商业插画、图库摄影和平面设计的经济模式。艺术家在社交媒体平台上抗议。Shutterstock 等服务商被迫引入 AI 生成内容政策,同时面临生存威胁。模型在未经许可的版权图像上训练导致了多起集体诉讼。
受影响群体: illustrators、photographers、graphic designers、stock image industry
-
风险制造 -2 · 中期
引发了关于 AI 训练数据中版权、艺术家退出权以及生成未经同意图像的可能性的根本问题。引发了全球范围内关于 AI 生成内容标签和责任的监管讨论。
受影响群体: artists、policymakers、legal professionals、general public
共识度与来源
重要度
L1
分类
能力突破 / 产品工具
共识度
广泛共识
影响指数
6/10
-
1
Stable Diffusion is a text-to-image model that enables you to create realistic images from text descriptions. The model was trained on 256 Nvidia A100 GPUs.参考证据 引用已记录 原文可访问
-
2
Stable Diffusion is a deep learning, text-to-image model released in 2022 based on diffusion techniques.参考证据 引用已记录 原文可访问