
9 月 30 日至 10 月 1 日,Google DeepMind 正式发布新一代前沿旗舰模型 Gemini 4 Argon,这是谷歌自 2025 年 11 月 Gemini 3 以来时隔近 10 个月再度推出旗舰模型。
事件背景
在 OpenAI 与 Anthropic 接连曝出前沿模型安全隐患、AI 安全成为行业焦点的背景下,谷歌选择了一条更保守的路线:不一次性面向全体用户开放,而是分阶段、受控地交付。
核心内容
能力跃升:Gemini 4 Argon 的输出 token 上限从上一代的 6.4 万提升至 100 万,可一次性处理数十万 token 的复杂任务。在官方公布的基准中,DeepSWE v1.1 真实软件工程测试得分 77.9%,高于 Claude Opus 5.5 的 74.2% 与 GPT-6 Astra 的 74.1%;CWE-bench v1 漏洞修复测试以 68% 并列第一;Zapier AutomationBench 以 51.3% 排名第一;长视频理解 LVBench 达 91.7%。官方 19 项基准中拿下 13 项领先。
受控发布:模型通过“Fairwind 计划”仅向经过严格审核的网络安全防御人员开放,并参与美国政府的预发布安全评估;推广期 API 定价为每百万输入 token 2 美元、输出 10 美元,缓存输入可享约 95% 折扣,后续将上调。面向普通开发者的全面开放时间尚未公布。
内部实战:谷歌称 Argon 已在内部承担真实工作——一组智能体分析全公司数据中心性能数据,自主定位并应用内存优化,全面铺开后释放超 300 TiB 内存;还被用于把 C/C++ 代码库向 Rust 迁移(涉及 Zircon 内核等超 80 万行),并在开源解码器 libgav1 上替换 3.2 万行 SIMD 代码,得到比原 Rust 移植版快 2.7 倍的结果。
影响与解读
Argon 的“有限开放”被分析人士解读为安全与商业竞争的双重考量:既塑造“安全可信”的厂商形象,也为内部争取调试时间、规避提前开放表现不佳损害声誉的风险。但业内也提醒,基准亮眼不等于真实业务场景同样强大。
相关动态
发布前一天,谷歌 CEO 皮查伊在白宫与特朗普及主要科技高管签署了自愿性的《超级智能协议》,行业自律能否真正约束前沿风险仍存争议。
信息来源:环球网/新浪(引述 CNBC,2026-10-03)、今日头条/格隆汇(2026-10-01)、腾讯新闻(2026-10-01)相关报道

评论(0)