natolambert统计arXiv论文模型提及率变化
上周末,我让 Codex 分析了ChatGPT推出以来 arXiv 上的 50 万篇 AI/ML 论文,统计有哪些开源模型被用于研究。
2024 年,约 30% 的论文提到了一款美国开源模型,只有 10% 的论文提到了中国开源模型。
如今,约 40% 的论文提到了中国开源大语言模型,提到美国开源模型的只有 25-30%。
中国模型已经成为研究的默认选择。提到中国模型的比例仍在增长,而美国开源模型的份额已经停滞。
分析这份数据时,需要记住:论文发布远远滞后于模型发布,因为研究需要很长时间。Qwen 的稳定增长体现了这一点,Llama 的长期影响力也同样如此。
更多观察:
1. Qwen 一直在稳定增长,如今三分之一提到了任意大语言模型的论文都提到了 Qwen。OpenAI 的闭源模型占比总体最高,约为 37%。
2. Llama 在 2025 年 4 月左右达到峰值,在所有提到任意大语言模型(包括 ChatGPT 等)的论文中占 30%。Llama 4 差不多也在同期发布,此后 Llama 的占比就开始下降。
3. Gemini 和 Claude 的提及率低于头部开源模型,它们在论文中的提及率为 10-15%,落后于 Qwen、Llama 和 DeepSeek。
开源模型本就应该是开放研究的基础,现在事实也确实如此。自 2023 年以来,提及任意大语言模型的论文占比一直在稳步上升:
| 年份 | 一月 | 四月 | 七月 | 十月 |
| 2023 | 10.43% | 15.39% | 18.69% | 32.18% |
| 2024 | 29.70% | 33.93% | 35.70% | 44.25% |
| 2025 | 39.23% | 45.28% | 44.94% | 53.52% |
| 2026 | 55.49% | 57.26% | 53.14% | 待定 |
如今已有超过 50% 的 AI 论文提及大语言模型,2023 年这一数字仅为 10%。
其他说明:
- Gemma 和 Mistral 的提及率在 5-10% 浮动。
- 我们 beloved 全开源 Olmo 模型自 2024 年 1 月首次发布以来,提及率一直约为 1%。
- DeepSeek 在 2025 年 1 月 R1 发布后,提及率出现了明显跃升。
数据来源于 arXiv 最热门的几个 ML 分类:cs.AI、cs.CL、cs.CV、cs.LG、stat.ML。
和我们的下载量、衍生模型数据一样,这份数据会在 Interconnects Open Model Dashboard 每日更新。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖