Mistral 发布 1.05 万亿参数旗舰模型 Large 4,开源权重定档 10 月 27 日

10 月 6 日,法国人工智能公司 Mistral 正式发布新一代旗舰模型 Mistral Large 4(内部昵称 “Le Chonk”)。这是一款通用多模态混合专家(MoE)模型,总参数达 1.05 万亿,每次推理仅激活 490 亿参数,并配备 16 亿参数的视觉编码器,原生支持图文输入,上下文窗口最长 100 万 token。

事件背景

今年以来,欧美实验室在开放权重(open-weights)路线上竞争加剧。Mistral 延续其一贯的”欧洲自主”定位,强调模型从训练、API 服务到未来自主部署都可留在欧洲基础设施上,并以数据主权作为核心卖点。

核心内容

  • 架构:细粒度 MoE,1.05 万亿总参数 / 490 亿活跃参数 / 16 亿视觉编码器,原生流畅支持超过 160 种语言。
  • 发布状态:10 月 6 日通过 API 开放公开预览;开放权重计划于 2026 年 10 月 27 日发布。
  • 训练:据 BlockBeats 等报道,Mistral 使用约 4000 块 Nvidia Grace Blackwell GPU,在欧洲自有数据中心训练约两个月。
  • 定价:公开预览期每百万输入 token 约 1.36 美元、输出 4.18 美元(不同汇总源口径略有差异)。

Mistral 宣称,在综合基准上 Large 4 是”美国或欧洲开发的最佳开放权重模型”,在网络安全、金融、制造业等负载上处于开源权重领先水平,并在视觉定位任务上优于部分封闭前沿模型。不过多家媒体指出,相关成绩主要来自由 Mistral 自测,并非统一口径:例如在 DeepSWE v1.1 软件工程评测中,Mistral 自报 62%,而智谱 GLM-5.3 同榜为 66.9%、月之暗面 Kimi K3 为 67.5%。

影响与解读

“公告跑在权重前面”成为近期开放权重发布的共同节奏——Reflection AI 于 10 月 5 日预告 Beam,Mistral 于 10 月 6 日预告 Large 4,两者均承诺本月末放出可下载权重。对企业和政府用户而言,真正的分野在于”能握在手中的权重”,而非只能通过 API 租赁的能力。在权重公开、并由第三方复现之前,相关性能声明仍应保留审慎。

相关动态 / 展望

开放权重落地后,Mistral 能否凭借”欧洲自主 + 可自托管”在主权 AI 市场建立差异化优势,将是下一阶段观察重点。模型还引入了与网络安全合作伙伴的私下协作机制,先让防御方获得工具。

信息来源:BlockBeats 快讯、Unite.AI、Mistral 官网

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。