Mostik提出跨模型互联,成本仅1/20
🚨这是一个足以获得图灵奖级别的AI突破!
来自俄罗斯的研究者的革命性创新可以让你手机上运行的4B模型,随时可以获得GLM5.3级别的智能!
刚刚, @WIRED 报道了一家很新的AI公司 @mostik_ai 。 Mostik在俄语里是桥的意思,他们做的事情不是蒸馏,也不是让大模型先生成一大段CoT,再让小模型读一遍。
他们做了一件很不一样的事:把两个完全不同的模型连接起来,让它们不需要先生成文字、再把文字喂给另一个模型,而是直接通过模型内部的数学表示传递信息。
Mostik拿两个中国开源模型做了实验: 一个是753B参数的GLM-5.2,另一个是只有4B、可以跑在移动设备上的Qwen-3.5。 连接之后,这个混合系统的性能正好落在两者之间,但运行成本只有完整GLM-5.2的1/20。
这件事真正有价值的地方,是它可能改变大模型的使用方式。 现在两个AI模型合作,本质上还是像人一样聊天:A生成一堆token,B把这些token重新读一遍,再继续干活。
Mostik想做的是:大模型只负责最难的思考,然后把内部状态直接交给便宜的小模型继续干活。 也就是说,未来手机、电脑甚至机器人上都可以长期跑一个小模型,只有真正遇到难题时,才去云端借一下大模型的推理能力。
以后大模型可能不用从头到尾处理整个任务,只负责提供最难的那部分能力,再通过内部表示把信息交给小模型继续执行。 而且他们已经用这套方法做出了一个模型,目前冲到了ARC-AGI 3排行榜第一,只是比赛还没结束,所以具体方案暂时没公开。
Mostik目前只有15个人,12位博士,首席科学家还是2010年菲尔兹奖得主Stanislav Smirnov。 我觉得这个方向太牛逼了。
大家都在研究怎么造一个更大的模型,Mostik想的是,能不能让一群大小模型直接共享思考。 如果这条路成立,未来最强的AI系统可能根本不是一个万亿参数的超级模型,而是一整个互相连接的模型网络。