AI Pulse
📡 X 信号

小米下一代大模型跑分流出,对标头部GPT和Claude

小米下一代大模型跑分流出,对标头部GPT和Claude

🔥突发:小米下一代大模型 MiMo-V3-Pro 的 Benchmark 图疑似提前流出。

今天下午一张截图在我的群组里流传,是小米Mimo还未发布的V3-Pro的跑分图。

如果这张图是真的,小米这次有点猛。 MiMo-V3-Pro 直接被拉去和 GLM 5.3、Kimi K3、Claude Opus 5、GPT-5.6 Sol Max、Fable 放在一张表里对打。

基本可以看出MiMo-V3-Pro 这次就是冲着 Coding Agent 和通用 Agent 去的。

尤其 SWE-Bench Pro 72.8,已经明显压过图里的 GLM 5.3 67.9 和 Kimi K3 65.8,离 Opus 5 的 74.6、GPT-5.6 Sol Max 的 75.4 只差几个点。

Terminal-Bench 2.0 也是类似: MiMo 70.6,Opus 5 72.0,GPT-5.6 Sol Max 73.5。

通用 Agent 部分差距同样很小,τ3-bench 做到 76.4,GPT-5.6 Sol Max 是 78.8。

换句话说,如果这套成绩最后能在正式版复现,小米的新旗舰已经摸到海外最强闭源模型这一档了。

而且这个名字也很有意思:MiMo-V3-Pro。

看起来 MiMo V3 大概率不会只有一个版本,Pro 很可能只是其中的高阶型号。

目前这张图的来源和最终成绩都还需要等官方确认,先当爆料看。

但今年国产模型这个榜单,已经快挤不下了。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新