Grok 4.7 正式发布:马斯克的“补齐短板”追赶之作

北京时间 9 月 22 日,马斯克旗下的 SpaceXAI 正式发布新一代模型 Grok 4.7。与此前的多次“跳票”不同,这次发布被外界视为一次目标明确的“补短板”升级,而非代际跃升。

事件背景

自 7 月以来,头部大模型几乎完成一轮迭代:Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 等相继登场,而 Grok 4.6 仍停留在 8 月水平。在几乎所有竞品都补强了长时程智能体与编程能力后,SpaceXAI 终于交卷。

核心内容

Grok 4.7 采用 2.1 万亿参数规模,较前代 Grok 4.6 增长约 40%。官方称其为“目前功能最强大的编程与知识处理模型”,并喊出“速度是同类模型的两倍,价格却只有一半”的口号。

  • 能力与定位:更长时间的强化学习训练,重点强化长时程任务、自我检查和长上下文管理,并被训练为原生理解 Grok Bot 的运行框架。
  • 规格:500K 上下文窗口,支持文本与图像输入、纯文本输出,且无输出长度限制;推理强度支持 low / medium / high / xhigh。
  • 价格:标准版每百万输入 token 2 美元、输出 6 美元,与 Grok 4.6 一致;另有 Fast 版速度翻倍、价格也同步翻倍。

影响与解读

据 Artificial Analysis 数据,Grok 4.7 在智能指数上得分 46(榜单第六),在 AA-Briefcase 长时程智能体知识工作基准中仅落后于 Claude Opus 5 与 Claude Fable 5.1;搭配官方编程智能体 Grok Build,其在编程智能体指数中排名第四。CursorBench 4.0 得分 46.3%,高于 Grok 4.6 的 40.4%。

不过从首批评测看,它在长任务与编程场景进步明显,但在网页、3D 场景与可视化编程等实测中出现了“跑分很强、落地翻车”的样本。整体而言,这是一次补齐短板的追赶,而非全面领先的代际跃升。

相关动态 / 展望

SpaceXAI 的“并行模型”策略让 Grok 以约两周一代的速度更新,下一代 2.5T 量级的 Grok 4.8 已在训练之中。随着价格战持续,编程与知识工作模型的性价比竞争将愈发激烈。

信息来源:xAI 官方发布说明、第一财经(今日头条)

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。