AI Pulse
📡 X 信号

大模型能力每三个月翻一倍,两年后手机就能用

Sam Altman这条,让我想起了清华系模型公司面壁智能(ModelBest)提出的「密度定律」。2025年,面壁用8B参数的MiniCPM-o 2.6,在多模态能力上达到了2024年GPT-4o级别。到了2026年,9B参数的MiniCPM-o 4.5,已经开始接近2025年的Gemini 2.5 Flash,而且能够在不到12GB内存的设备上运行。

前沿模型继续向上突破的同时,过去的前沿能力也在快速被压缩。一年前需要云端旗舰模型完成的任务,之后可能只需要一个小模型。原本昂贵的API能力,会逐渐变成廉价服务、开源模型,最后进入手机和个人电脑。

Sam提到,四个月前GPT-5.4旗舰模型的能力,如今已经能以大约十三分之一的Token价格获得。面壁的密度定律则指出,同等参数规模能够承载的模型能力,大约每三个月翻一倍。一个观察价格,一个观察参数,但它们指向的是同一件事:智能正在快速普及。

按照这个速度,两年后的端侧模型,未必能完整复现今天最强模型的全部能力,但很可能���经能够覆盖其中相当大的一部分。今天仍然稀缺、昂贵、只有少数公司能够提供的智能,可能很快就会变成随处可用的基础设施。准备All in 端侧🫡

查看 X 原帖

订阅 AI Pulse

每天 09:00 · 14:30 · 19:30 更新