2023-03-14
OpenAI 发布 GPT-4,第一个多模态大语言模型
事件摘要
2023 年 3 月 14 日,OpenAI 发布了 GPT-4——一个可以同时接受文本和图像输入并生成文本输出的多模态模型。GPT-4 在律师资格考试中达到了第 90 百分位,SAT 中第 99 百分位,并在推理能力、事实准确性和可引导性上相比 GPT-3.5 有显著提升。它被集成到 ChatGPT Plus 作为付费层,其 API 成为基于 LLM 构建的开发者的默认选择。GPT-4 提高了 LLM 能力的上限,并为 AI 能力设定了新的基线,这一基线一直保持到 2024 年底的模型发布潮。
影响评估
-
能力跃迁 +2 · 长期
在标准化考试中达到专业级别表现(律师资格考试前 10%,SAT 数学第 99 百分位)。大规模引入了多模态输入(视觉+文本)。与 GPT-3.5 相比,幻觉显著减少,指令遵循能力明显提升。
受影响群体: AI researchers、developers、professionals、students
-
经济冲击 +2 · 中期
加速了 AI 在专业服务领域(法律、会计、咨询、软件)的整合。ChatGPT Plus(含 GPT-4,每月 $20)成为增长最快的消费者订阅产品。触发了财富 500 强企业的企业级 AI 采用浪潮。
受影响群体: tech industry、professional services、enterprises、investors
-
风险制造 -2 · 中期
提高了 AI 安全、对齐和监管的紧迫性。GPT-4 的增强能力(包括视觉)扩大了滥用的范围——生成令人信服的伪造文件、有害活动的详细指令以及大规模自动虚假信息。加速了包括欧盟 AI 法案在内的监管努力。
受影响群体: policymakers、ethicists、general public、AI safety researchers
共识度与来源
重要度
L2
分类
能力突破
共识度
广泛共识
影响指数
7/10
-
1
We've created GPT-4, the latest milestone in OpenAI's effort in scaling up deep learning. GPT-4 is a large multimodal model that exhibits human-level performance on various professional and academic benchmarks.参考证据 引用已记录 原文可访问
-
2
OpenAI releases GPT-4, a multimodal AI that it claims is state-of-the-art.新闻报道 引用已记录 原文可访问