腾讯开源Hy4:处理复杂任务前,它会先自己过一遍脑子
腾讯发布了新模型Hy4 Preview。开源权重,只接受文本输入,不支持视觉。它比上一代Hy3大出不少。总参数从295B涨到770B,激活参数从21B增至49B。上下文窗口从256K扩到1M token。模型文件也膨胀到1.56TB,托管在Hugging Face上。
参数数字不必深究。直观差别是它能一口气处理更长的对话或文档,抵得上好几本书。处理复杂任务时,模型会先自己过一遍脑子。
开发者查了Hy4的聊天模板,里面定义了两个推理档位。high是默认,模型深度思考;no_think禁用推理。没有中间档,参数设成别的值直接报错。这个“思考/不思考”的开关把选择权交给调用方:简单问题快速答,复杂问题慢慢想。
有开发者拿“生成一只骑自行车的鹈鹕”的提示词实测了high模式。模型先输出一段内部推理,盘算要不要给鹈鹕加头盔、加太阳镜、加水,最后决定都不加。这段推理用的英语略有截断,推测是完美语法对隐藏推理没什么用,还浪费token。
Hy4的商用许可没有公布。模型虽然开源权重,但1.56TB的体积摆在那里,部署门槛不低。普通设备跑不动,云上跑要花钱——开源不等于免费用上。