昨天看到上海AI实验室发了个新模型,叫Atria Dawn Preview。第一反应是又一个国产大模型,但仔细看了下技术细节,发现这玩意儿有点不一样。
它不是聊天机器人,也不是写作助手。它是一个专门跑长任务链的agentic基础模型。什么意思呢?就是你给它一个开放式科研问题,它能自己拆解、自己查资料、自己写代码跑实验、自己读结果,失败了还能自己改,循环到交付为止。
底层用的是GLM-5.2的744B MoE基座,但没有继续调通用推理,而是专门训了一个只干一件事的模型。从benchmark来看,16项测试里拿了5项最高分:BrowseComp 92.5、DeepSearchQA 96.0、CyberGym 86.5、BFCL v4 77.0、AutomationBench 53.8。
人类评估里有个数据挺有意思:大约三分之一被AI辅助完成的任务,评审员的结论是"没有AI根本做不了"。注意,不是"做得更快",是"做不了"。
当然也有坑:所有benchmark都是自报数据,暂时没有第三方独立复现。编码榜SWE-bench Pro只拿了59.6,中等水平。上下文窗口256K,竞品已经到1M。
但真正让我觉得有价值的是它的协议:MIT。744B的完整权重,BF16和FP8,直接下载,跑在你自己的集群上。那些闭源API卖给你的是一个黑盒的推理结果,Atria Dawn Preview给你的是整条agentic管线的所有权。
你自己的数据、你自己的环境、你自己的实验循环,不经过任何人的服务器。对于做科研或者企业内部部署来说,这个价值比跑分高多了。
开源地址:github.com/atria-asi/Atri…
话题来源 @berryxia
78.5K阅读 ❤️219 x.com/…↗ 已改写,非原文转载
16 浏览 0 评论
0 反应











