Atria Dawn Preview 是上海人工智能实验室(Shanghai AI Lab)在 9 月中旬悄然开源的一款智能体(Agent)大模型。它基于智谱 GLM-5.2 的 7440 亿参数 MoE 底座二次训练而成,采用 MIT 协议免费开放,并在浏览研究、网络安全等多项基准上超越了 GPT-5.6 Sol、Claude Opus 5 等闭源旗舰。对关注国产开源 AI 的用户来说,这是一次值得认真拆解的发布。
核心能力
Atria Dawn Preview 定位为「面向研究与工程场景的智能体」,官方把它的能力拆成四个维度:
- 发现(Discovery):深度研究、证据检索,把研究问题转化为可执行的实验计划
- 创造(Creation):编写软件、交互应用、游戏、数据可视化与机器学习系统
- 交付(Delivery):把文档、数据转化为报告、演示等结构化成果
- 安全(Cybersecurity):在授权环境中分析漏洞、验证并复现修复
关键规格方面:744B 参数 MoE 架构,256K 上下文窗口,支持中英双语。它采用了一套名为 Verifiable Experience Pipeline(可验证经验管线)的训练方法——用「确认可完成、可执行、可复现」的任务轨迹来训练,而非简单堆叠合成数据。
基准表现是它最大的亮点。在 16 项基准中,Atria 拿下了 5 项第一:
- BrowseComp 92.5:超越 GPT-5.6 Sol(92.2)和 Claude Opus 5(90.8)
- DeepSearchQA 96.0:深度搜索研究任务领跑
- CyberGym 86.5:网络安全任务,高于 GLM-5.3(84.5)
- BFCL v4 77.0 与 AutomationBench 53.8:工具调用与自动化
使用体验 / 局限
最诱人的一点是完全免费:MIT 协议开源权重,Hugging Face 和 ModelScope 均可直接下载,官方还提供 API 控制台(国际版 api.atria-asi.ai、国内版 intern-ai.org.cn)。中文原生支持对国内用户也足够友好。
但也要说清楚几处局限。第一,744B 参数自托管门槛极高,需要多卡大显存集群(SGLang 或 vLLM 部署),普通个人基本只能走官方 API。第二,它目前仍是 「Preview」预览版,独立第三方的完整评测尚未出炉,几个 0.3 分左右的领先也处在噪声范围内。第三,只接受文本输入,多模态能力有限。
综合评分
| 维度 | 评分 | 评价 |
|---|---|---|
| 功能完整度 | 8.8 / 10 | 覆盖研究、编码、交付、安全四大场景,Agent 闭环完整 |
| 易用性 | 7.5 / 10 | 官方 API 可用,但 744B 自托管门槛高,仍处预览状态 |
| 性价比 | 9.5 / 10 | MIT 开源免费,同类旗舰级能力零成本即可获取 |
| 中文支持 | 9.0 / 10 | 中英双语原生,国内 API 入口完善 |
| 输出质量 | 8.8 / 10 | BrowseComp、CyberGym 多项超越闭源旗舰,独立评测待验证 |
综合评分:8.7 / 10
一句话总结:Atria Dawn Preview 是国产开源智能体的一次硬核亮相,免费 MIT + 多项基准超越闭源旗舰,尤其适合做研究、编码和安全自动化的团队尝鲜。想找更多同类好用的 AI 工具,欢迎访问 AI Dash 发现更多。
