OpenBMB发布MiniCPM5-2B 成4B参数以下开源大模型第一
OpenBMB的MiniCPM5-2B在Artificial Analysis Intelligence Index v4.2上获得15分,这是4B参数及以下开放权重模型中的最高分
Hugging Face:https://huggingface.co/openbmb/MiniCPM5-2B
GitHub:github.com/OpenBMB/MiniCPM
―― 高票评论(帖子共 83 条讨论)――
[+85] u/JsThiago5:如今2B模型的得分与现在的gpt oss 120b相同。
[+41] u/NigaTroubles:不错,我会用它来做我的
ASR -> MiniCPM5-2B -> TTS
[+23] u/Nomski88:非常好奇它与Ling Tiny 3.0相比表现如何,我用一台小型迷你电脑运行无聊的自动化任务,但智能性很重要,这就是我喜欢LT3.0的原因,因为可以说我拥有近8B参数的“大脑”。
[+23] u/Roubbes:这么快的LLM能用于哪些家庭用途(与编码无关)?
[+15] u/fatihmtlm:我想知道它与gemma 4 e2b相比如何。
[+15] u/pmttyji:从模型卡中注意到,他们为此模型发布了DSpark……更多t/s。
https://huggingface.co/openbmb/MiniCPM5-2B-DSpark
[+11] u/DefNattyBoii:仅供参考,在AA“智能指数”上,GPT-OSS-120B是16分,而这个是15分。你自己得出结论吧。
不是说这不行,但最好还是看看你自己挑选的基准测试,并制定你自己的“智能指数”。
[+9] u/JLeonsarmiento:是的,但它能打败Qwen3.5-2B吗?🤔 不过它没有视觉功能……
[+8] u/Eyelbee:1B版本也很棒。
[+7] u/Hefty_Wolverine_553:这基本上是一次开源发布,令人惊叹的是他们发布了训练每个阶段的检查点以及训练数据集!
[+7] u/edward-dev:从基准测试来看,我们终于在2B模型中拥有了Claude 3.5,一切发展得真快!
[+6] u/Iory1998:https://preview.redd.it/q3zwsij8v4oh1.png?width=1476&format=png&auto=webp&s=897579f899530fbbc9edd0965efdf6171796aee1
它未能通过洗车测试,但确实通过了我的“大海捞针”测试。我提供了一篇76K长的科学论文,并在其中随机插入了两次一个短语。我让LLM找出最奇怪的句子,它应该给出正确答案。这既测试了模型的阅读理解能力,也测试了其在长文本中的回忆能力。直到一年前,所有本地模型都未能通过这两项测试。这个模型肯定有一些用例。