你听说了吗?开源智能体模型追平顶级闭源模型
不少喜欢折腾AI工具的人习惯了在GitHub翻开源模型,却总发现开源模型性能离头部闭源模型还差一截。
现在NexEcosystem推出了最新开源智能体模型Nex-N2.5系列,一共三个版本,覆盖不同需求。
Mini是350亿参数版本,Pro是3970亿参数版本,这两个版本都支持多模态理解和操作计算机的能力。Max是1.6万亿参数的纯文本MoE模型(混合专家模型,简单说就是把大模型拆分成多个小专家,每次只激活一部分来处理任务,兼顾性能和效率),专门面向复杂推理、编码和智能体工作流设计。
从测试成绩来看,这个系列的表现超出很多人的预期。
Max在AutomationBench v1.0.6测试中拿到50.2分,成绩仅比Claude Opus 5低0.1分。Pro在OSWorld-2测试中得分56.4,比Qwen3.8-Max的46.7分更高。
@NexEcosystem认为:Nex-N2.5系列具备连续动作、视觉反馈和自我修正能力,可以更好完成自动化工作流和计算机操作任务。
@AiwithNomi认为:这套模型给开源AI领域带来了不小的惊喜,从1.6T的大模型到35B的轻量选项,全都是为实际的智能体工作流设计的。
@AiwithAlyar认为:Nex-N2.5是开源智能体领域迈出的重要一步,AI正在从单纯生成内容走向完成实际任务。
之前已经有DeepSeek V4推出了1.6万亿参数的开源MoE模型,小米也发布了面向智能体任务的开源模型MiMo-V2.5和V2.5-Pro。
加上这次Nex-N2.5跟进,开源社区在智能体模型上的推进速度越来越快,性能也在不断向顶级闭源模型靠拢。
过去想要体验接近顶级水平的AI能力,要么付费订阅闭源服务,要么只能接受开源模型性能的差距。现在普通用户也能自己部署一个接近顶级水平的开源智能体,完成复杂推理、编码或是自动化工作流。
当开源模型性能追平闭源模型,接下来会改变普通人使用AI的方式吗?