Mistral Large 4预览版:深度思考画鹈鹕更好,token反而更少
Mistral 发布了 Large 4 预览版。参数规模 1 万亿,激活参数 490 亿。训练在自有集群上进行。集群由 3800 块 NVIDIA Grace Blackwell GPU 组成。预览版已开放 API,公司承诺月底放出开源权重。
推理级别只有两个选项:'none“ 不思考直接答,”high“ 先想清楚再动手。画鹈鹕能看出差别。”high' 模式画得更好,输出 token 也更少:2717 个对 3275 个。深度思考并不等于写更多。
Artificial Analysis 给 Large 4 打了 38 分。这个分数略低于 DeepSeek 4.1 Flash(552B 参数)。去年 12 月的 Large 3 只有 9 分,鹈鹕画得没法看。进步很大。
等月底权重开源,个人开发者和小团队不必从零训练,也能用上接近前沿的模型。
它算不上顶级,但已经回到距前沿约 6 个月的位置。