2023-02-24
Meta 发布 LLaMA,引发开源权重大语言模型革命
事件摘要
Meta 于 2023 年 2 月发表 LLaMA,一组从 7B 到 65B 参数的基础语言模型,仅在公开可用的数据上训练。LLaMA-13B 在大多数基准测试上超过了 GPT-3(175B),证明了更小但训练更好的模型可以与更大的模型竞争。虽然最初以非商业研究许可发布,权重被泄露并迅速被社区微调——催生了重塑 AI 产业的开源权重大语言模型生态。
影响评估
-
普惠化 +3 · 长期
触发了开源权重 LLM 革命。LLaMA 的泄露权重使全球数千家初创公司、研究人员和个人能够构建、微调和部署自己的 LLM。LLaMA 生态(Alpaca、Vicuna、Llama 2/3)使任何拥有适度计算资源的人都能使用最先进的语言建模,从根本上改变了 AI 产业的力量格局。
受影响群体: researchers、startups、small businesses、independent developers、global south
-
经济冲击 +2 · 长期
通过提供可行的免费替代方案,对闭源 API 提供商(OpenAI、Anthropic)施加了定价压力。推动了一波全球范围的 LLM 驱动的应用和初创公司,这些公司原本无法承担基于 API 的模型。Meta 决定以商业许可发布(Llama 2)直接挑战了闭源 LLM 公司的商业模式。
受影响群体: tech industry、startups、investors、AI API providers
共识度与来源
重要度
L2
分类
社会文化 / 能力突破
共识度
广泛共识
影响指数
7/10
-
1
We introduce LLaMA, a collection of foundation language models ranging from 7B to 65B parameters. LLaMA-13B outperforms GPT-3 on most benchmarks.参考证据 引用已记录 原文可访问
-
2
Meta Llama is a collection of state-of-the-art large language models designed to help developers and researchers build generative AI experiences.参考证据 引用已记录 原文可访问
- 3