webAI的30亿参数模型,竟赢了OpenAI的1200亿模型
今天,我们很高兴开源 TwiL-LM3,这是 webAI Intelligence Lab 推出的首个形式化推理模型。
TwiL-LM3 仅拥有 30 亿参数,却在 5 项形式化推理基准测试中,有 4 项的表现超过了 OpenAI 的 GPT-OSS-120B,同时还能在消费级硬件上高效运行。
参数数量减少了 40 倍,推理速度提升了 2.6 倍,并且在支撑可靠工具调用、代码生成、结构化输出和 AI 智能体的推理任务中达到了当前最顶尖性能。
TwiL-LM3 是通过 webAI 专属推理流程,在 webAI 自有、经过验证的数据集上训练得到的——所用数据并非爬取的互联网数据。
我们相信,更强的推理能力来自更好的训练流程和更高质量的数据,而不只是更大的模型。我们的方法证明,高效模型可以匹敌——甚至在很多情况下超过——尺寸是其数十倍的模型。
TwiL-LM3 为边缘设备设计,可以在人们已经拥有的硬件上运行——从 Raspberry Pi 到 iPhone——无需依赖云端就能为数百万设备提供高级推理能力。
这是 webAI Intelligence Lab 首个开源发布项目,而这仅仅是开始。研发地为得克萨斯州奥斯汀。
文章链接:
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖