返回时间轴
2021-01-05

OpenAI 发布 DALL-E,首次展示文本到图像的生成能力

Capability Breakthrough

事件摘要

2021 年 1 月 5 日,OpenAI 宣布了 DALL-E,一个 120 亿参数的 GPT-3 变体,经过训练可以从文本描述生成图像。它能够生成新颖的组合——

影响评估

  • 能力跃迁 +2 · 长期

    首次成功证明生成式语言模型可以从文本描述生成连贯的新颖图像,证明了文本到图像生成是可行的,并触发了生成式 AI 竞赛。

    受影响群体: AI researchers、computer vision researchers

  • 认知转变 +1 · 短期

    向公众引入了从文本生成 AI 图像的概念,为 2022 年生成式 AI 工具的爆发做了文化预热。

    受影响群体: general public、artists、creative professionals

共识度与来源

重要度 L1
分类 能力突破
共识度 广泛共识
影响指数 6/10
  • 1

    原文可访问: https://openai.com/index/dall-e/

    We've trained a neural network called DALL-E that creates images from text captions for a wide range of concepts expressible in natural language.
    参考证据 引用已记录 原文可访问
  • 2

    原文可访问: https://en.wikipedia.org/wiki/DALL-E

    DALL-E is a text-to-image generation model developed by OpenAI using a 12-billion parameter version of GPT-3.
    参考证据 引用已记录 原文可访问