
上海人工智能实验室(InternLM团队所在机构)低调开源了Atria Dawn Preview——一个7440亿参数(744B)的开放权重大模型,采用MIT许可,允许不受限的商业使用、修改与再分发,直接对标OpenAI、Anthropic未开放旗舰权重的前沿智能体能力。
事件背景
9月11日前后,Hugging Face与GitHub仓库悄然上线权重与模型卡,FP8检查点随后放出,直到9月14日才发布配套技术论文《Atria Dawn: The Dawn of Agentic Superintelligence》,一反“先论文后权重”的行业惯例。
核心内容
模型基于智谱GLM-5.2的744B MoE底座构建,每token激活约180–400亿参数,上下文窗口256K,纯文本输入输出:
- 采用“可验证经验管线”(Verifiable Experience Pipeline),将工具中介推理绑定到可执行环境与外部校验结果;
- 在实验室报告的16项基准中,5项取得对比模型最高分:BrowseComp 92.5、DeepSearchQA 96.0、BFCL v4 77.0、AutomationBench 53.8、CyberGym 86.5;
- 自托管需约756GB(FP8)至1.5TB(BF16)显存/内存,支持SGLang、vLLM及OpenAI兼容API。
影响与解读
MIT许可移除了按token计费风险,把服务成本转移给部署方;其“无定价、无论文先行、无护栏讨论”的发布方式,与同期OpenAI、Anthropic、xAI围绕前沿节奏与智能体护栏的公开争论形成鲜明对照。不过所有基准均为厂商自报,尚待独立复现。
相关动态 / 展望
在“任务助手”向“项目级协作”演进的当下,开放权重智能体为科研、工程团队提供了可私有化部署的替代路径,也把“开源能否追上闭源智能体能力”的话题再度推到台前。
信息来源:Pandaily / GenAI Daily
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

评论(0)