AI Pulse
🔥 热点深度解读

30亿参数小模型击败了OpenAI40倍大模型

有人用手机跑AI推理,还跑赢了比自己大几十倍的云端大模型。

webAI Intelligence Lab刚刚开源了他们首个形式推理模型TwiL-LM3,参数规模只有30亿。

已验证的数据显示,这个小模型在5项形式推理基准测试里,有4项击败了OpenAI参数规模1200亿的GPT-OSS-120B模型,参数只有对手的四十分之一,推理速度反而快了2.6倍,而且能直接在消费级硬件甚至iPhone上流畅运行。

这个模型专门针对合规规则、合约逻辑和研究推理这类需要严谨逻辑的场景构建,现在已经放到开源平台HuggingFace,支持主流推理框架,采用非商业授权开放。

@Davidstout 认为:它在支撑可靠工具调用、代码生成、结构化输出和AI智能体的推理任务里,已经达到了当前最优性能。

@ai_for_success 认为:今天对开源AI来说是个好日子,这样的成果会越来越多。

@svpino 认为:体积更小、专门方向的开源模型,就是AI的未来。

过去想要好的AI推理能力,要么得靠云端大模型交网费、按调用次数掏钱,要么得买几万块的高端显卡才能本地跑。

现在这个小模型证明,把参数花在专门的推理能力上,不用堆规模就能拿到更好的结果,普通手机就能运行,不用依赖云端服务,也能拿到不错的推理效果。

原本被大模型垄断的推理能力,现在有了更小更便宜的开源替代路径。

接下来,专门做一件事的小模型,会替代通用大模型处理你手边的大部分工作吗?

📎 参考来源

查看原始推文

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新