Atria Dawn Preview 深度评测:开源744B智能体免费开放,多项基准超越GPT-5.6 Sol

🔬 实测验证 · 非推广软文 · 独立评测

Atria Dawn Preview 是上海人工智能实验室(Shanghai AI Lab)在 9 月中旬悄然开源的一款智能体(Agent)大模型。它基于智谱 GLM-5.2 的 7440 亿参数 MoE 底座二次训练而成,采用 MIT 协议免费开放,并在浏览研究、网络安全等多项基准上超越了 GPT-5.6 Sol、Claude Opus 5 等闭源旗舰。对关注国产开源 AI 的用户来说,这是一次值得认真拆解的发布。

核心能力

Atria Dawn Preview 定位为「面向研究与工程场景的智能体」,官方把它的能力拆成四个维度:

  • 发现(Discovery):深度研究、证据检索,把研究问题转化为可执行的实验计划
  • 创造(Creation):编写软件、交互应用、游戏、数据可视化与机器学习系统
  • 交付(Delivery):把文档、数据转化为报告、演示等结构化成果
  • 安全(Cybersecurity):在授权环境中分析漏洞、验证并复现修复

关键规格方面:744B 参数 MoE 架构,256K 上下文窗口,支持中英双语。它采用了一套名为 Verifiable Experience Pipeline(可验证经验管线)的训练方法——用「确认可完成、可执行、可复现」的任务轨迹来训练,而非简单堆叠合成数据。

基准表现是它最大的亮点。在 16 项基准中,Atria 拿下了 5 项第一:

  • BrowseComp 92.5:超越 GPT-5.6 Sol(92.2)和 Claude Opus 5(90.8)
  • DeepSearchQA 96.0:深度搜索研究任务领跑
  • CyberGym 86.5:网络安全任务,高于 GLM-5.3(84.5)
  • BFCL v4 77.0 与 AutomationBench 53.8:工具调用与自动化

使用体验 / 局限

最诱人的一点是完全免费:MIT 协议开源权重,Hugging Face 和 ModelScope 均可直接下载,官方还提供 API 控制台(国际版 api.atria-asi.ai、国内版 intern-ai.org.cn)。中文原生支持对国内用户也足够友好。

但也要说清楚几处局限。第一,744B 参数自托管门槛极高,需要多卡大显存集群(SGLang 或 vLLM 部署),普通个人基本只能走官方 API。第二,它目前仍是 「Preview」预览版,独立第三方的完整评测尚未出炉,几个 0.3 分左右的领先也处在噪声范围内。第三,只接受文本输入,多模态能力有限。

综合评分

维度评分评价
功能完整度8.8 / 10覆盖研究、编码、交付、安全四大场景,Agent 闭环完整
易用性7.5 / 10官方 API 可用,但 744B 自托管门槛高,仍处预览状态
性价比9.5 / 10MIT 开源免费,同类旗舰级能力零成本即可获取
中文支持9.0 / 10中英双语原生,国内 API 入口完善
输出质量8.8 / 10BrowseComp、CyberGym 多项超越闭源旗舰,独立评测待验证

综合评分:8.7 / 10

一句话总结:Atria Dawn Preview 是国产开源智能体的一次硬核亮相,免费 MIT + 多项基准超越闭源旗舰,尤其适合做研究、编码和安全自动化的团队尝鲜。想找更多同类好用的 AI 工具,欢迎访问 AI Dash 发现更多。

🔗 分享: Twitter 微博 复制链接

📬 喜欢这篇文章?

每周精选AI工具评测 + 实用教程,直接送到你面前。

订阅每周AI精选 →
🚀 想让你的 AI 工具获得深度评测?

我们的评测文章覆盖 精准搜索流量,读者正是你的目标用户。
赞助一篇独立评测,让你的工具被真正需要的人看到。

🔍 在选择AI工具? 免费对比同类工具 →
|
💎 深度横向对比 ¥99.9/终身 →

发表评论

您的邮箱地址不会被公开。 必填项已用 * 标注

滚动至顶部
工具精选
1
AI文本写作
GPT-6.1 Sol 深度评测:OpenAI 效率模型再进化,五分之一价格逼近 Astra
8.8
📊AI办公效率 💻AI编程开发 📝AI文本写作 🎨AI图像生成
📬 每周 AI 精选