小米下一代大模型跑分流出,对标头部GPT和Claude
🔥突发:小米下一代大模型 MiMo-V3-Pro 的 Benchmark 图疑似提前流出。
今天下午一张截图在我的群组里流传,是小米Mimo还未发布的V3-Pro的跑分图。
如果这张图是真的,小米这次有点猛。 MiMo-V3-Pro 直接被拉去和 GLM 5.3、Kimi K3、Claude Opus 5、GPT-5.6 Sol Max、Fable 放在一张表里对打。
基本可以看出MiMo-V3-Pro 这次就是冲着 Coding Agent 和通用 Agent 去的。
尤其 SWE-Bench Pro 72.8,已经明显压过图里的 GLM 5.3 67.9 和 Kimi K3 65.8,离 Opus 5 的 74.6、GPT-5.6 Sol Max 的 75.4 只差几个点。
Terminal-Bench 2.0 也是类似: MiMo 70.6,Opus 5 72.0,GPT-5.6 Sol Max 73.5。
通用 Agent 部分差距同样很小,τ3-bench 做到 76.4,GPT-5.6 Sol Max 是 78.8。
换句话说,如果这套成绩最后能在正式版复现,小米的新旗舰已经摸到海外最强闭源模型这一档了。
而且这个名字也很有意思:MiMo-V3-Pro。
看起来 MiMo V3 大概率不会只有一个版本,Pro 很可能只是其中的高阶型号。
目前这张图的来源和最终成绩都还需要等官方确认,先当爆料看。
但今年国产模型这个榜单,已经快挤不下了。