上海AI实验室开源 744B Atria Dawn Preview 模型
卧槽,又来一个国产开源模型,掀桌子了啊!GPT-5.6 Sol、Claude Opus 5、DeepSeek V4 Pro、Kimi K3、Qwen3.8-Max。现在市面上最贵的那几个闭源 API,你能叫出名字的,都在这张对标表里。
上海 AI 实验室把 GLM-5.2 的 744B MoE 基座拿过来,没有继续调通用推理,而是专门训了一个只干一件事的模型。它叫 Atria Dawn Preview。不是聊天机器人,不是写作助手。
是一个跑长任务链的 agentic 基础模型,接到一个开放式科研问题,自己拆解、自己查资料、自己写代码跑实验、自己读结果、失败了自己改,循环到交付为止。16 项 benchmark,5 项最高分。BrowseComp 92.5 ,DeepSearchQA ,96.0。
CyberGym 86.5 ,BFCL v4 77.0 ,AutomationBench 53.8。人类评估里,大约三分之一被 AI 辅助完成的任务,评审员的结论是“没有 AI 根本做不了”。再看一遍,不是“做得更快”。
是“做不了”。说实话,有几个坑:所有 benchmark 都是自报数据,暂时没有第三方独立复现。编码榜 SWE-bench Pro 只拿了 59.6,中等水平。
上下文窗口 256K,竞品已经到 1M。但真正值得注意的不是跑���。是它的协议,MIT. 744B 的完整权重啊,BF16 和 FP8,直接下载,跑在你自己的集群上。
那些闭源 API 卖给你的是一个黑盒的推理结果。Atria Dawn Preview 给你的是整条 agentic 管线的所有权。你自己的数据、你自己的环境、你自己的实验循环,不经过任何人的服务器。
开源地址: