英伟达刚放出了能在家跑的开源大模型,速度快4倍
有人刚升级完本地AI模型,转眼又看到了新发布。
Meta在一天前刚推出了自家开源模型Glimmer,NVIDIA紧接着就发布了Nemotron 3.5 Lightning和配套工具NeMo Switchyard。
这是一款总参数300亿的MoE(混合专家模型,简单说就是把大模型拆成多个小专家,每次只用其中几个干活),实际运行时只激活30亿参数。它面向常驻在线的AI智能体设计,用来处理高批量的专业任务,输出速度最高能达到同等规模模型的4倍,吞吐量效率比很多现有开源模型都高。
和很多闭源商用模型不同,这款模型可以免费下载、使用和修改,属于NVIDIA开放权重、开放训练数据和训练方案的Nemotron开源模型系列。
@cryptopunk7213 认为:美国开源AI热度正高,不到24小时就出了3个新模型,这次NVIDIA的新模型,和Meta前一天发布的Glimmer是直接对标的,但有个明显不同——你可以在家运行它。
@kimmonismus 认为:在Meta发布模型一天后,NVIDIA就拿出了自己的产品,展示了做本地智能体AI的另一种路线。
以前想要跑一个性能不错的开源大模型,要么需要买好几张高端显卡,要么只能依赖云端接口付费使用,普通人想要自己折腾本地AI门槛很高。
这次推出的模型,靠「只激活部分参数」的设计,把实际运行需要的硬件门槛降了下来。普通人不用投入几万块买硬件,也能在自己的设备上跑一个速度够快的专业AI。
对想要搭建自己本地AI工作流的人来说,现在又多了一个完全免费可改的选择。
巨头接连下场放出开源模型,下一个能在家跑的会是多大参数的模型?