AI Pulse
📡 X 信号

natolambert统计arXiv论文模型提及率变化

natolambert统计arXiv论文模型提及率变化

上周末,我让 Codex 分析了ChatGPT推出以来 arXiv 上的 50 万篇 AI/ML 论文,统计有哪些开源模型被用于研究。

2024 年,约 30% 的论文提到了一款美国开源模型,只有 10% 的论文提到了中国开源模型。

如今,约 40% 的论文提到了中国开源大语言模型,提到美国开源模型的只有 25-30%。

中国模型已经成为研究的默认选择。提到中国模型的比例仍在增长,而美国开源模型的份额已经停滞。

分析这份数据时,需要记住:论文发布远远滞后于模型发布,因为研究需要很长时间。Qwen 的稳定增长体现了这一点,Llama 的长期影响力也同样如此。

更多观察:

1. Qwen 一直在稳定增长,如今三分之一提到了任意大语言模型的论文都提到了 Qwen。OpenAI 的闭源模型占比总体最高,约为 37%。

2. Llama 在 2025 年 4 月左右达到峰值,在所有提到任意大语言模型(包括 ChatGPT 等)的论文中占 30%。Llama 4 差不多也在同期发布,此后 Llama 的占比就开始下降。

3. Gemini 和 Claude 的提及率低于头部开源模型,它们在论文中的提及率为 10-15%,落后于 Qwen、Llama 和 DeepSeek。

开源模型本就应该是开放研究的基础,现在事实也确实如此。自 2023 年以来,提及任意大语言模型的论文占比一直在稳步上升:

| 年份 | 一月 | 四月 | 七月 | 十月 |
| 2023 | 10.43% | 15.39% | 18.69% | 32.18% |
| 2024 | 29.70% | 33.93% | 35.70% | 44.25% |
| 2025 | 39.23% | 45.28% | 44.94% | 53.52% |
| 2026 | 55.49% | 57.26% | 53.14% | 待定 |

如今已有超过 50% 的 AI 论文提及大语言模型,2023 年这一数字仅为 10%。

其他说明:

- Gemma 和 Mistral 的提及率在 5-10% 浮动。
- 我们 beloved 全开源 Olmo 模型自 2024 年 1 月首次发布以来,提及率一直约为 1%。
- DeepSeek 在 2025 年 1 月 R1 发布后,提及率出现了明显跃升。

数据来源于 arXiv 最热门的几个 ML 分类:cs.AI、cs.CL、cs.CV、cs.LG、stat.ML。

和我们的下载量、衍生模型数据一样,这份数据会在 Interconnects Open Model Dashboard 每日更新。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新