
当地时间 9 月 28 日,Anthropic 正式发布 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5。就在六天前,这家AI实验室刚刚推出旗舰级 Claude Opus 5.5,如今中端主力的快速跟进,显示出新一轮模型迭代节奏正在明显提速。
价格不变,但更省 token
Sonnet 5.5 的 API 名义定价与上一代 Sonnet 5 持平:输入每百万 Token 2 美元、输出每百万 Token 10 美元,正好是 Opus 5.5(4/20 美元)的一半,也与 OpenAI 的 GPT-6 Sol 处于同一价位带。Anthropic 强调,真正的成本下降来自做同样的活儿花更少的 Token——官方称其输出生成速度提升超过 30%,并通过削减冗余推理与无效工具调用,把单项任务的综合成本最高压低 30%。
编程能力大幅跃升
在自主智能体编程测试 Terminal-Bench 4.0 中,Sonnet 5.5 得分达到 70.6%,而上一代 Sonnet 5 仅为 10.3%,甚至压过了一周前 Opus 5.5 在高算力档位(Xhigh)下 66.4% 的成绩。在覆盖 44 种职业真实工作场景的 GDPval-AA v2.1 测试中,它拿到 1844 分,与 Opus 5.5 的 1846 分几乎持平,并高于 OpenAI GPT-6 Sol 的 1487 分。多家客户提供了实测数据:Box 反馈响应快 2.4 倍、少耗 12% Token,Slack 输出 Token 减少 14%,Lovable 在编程任务上的工具调用次数下降约三分之一。
安全升级与后续规划
Sonnet 5.5 是首款搭载 Opus 级别网络安全防护的 Sonnet 模型,并新增了防止他人提取推理过程的分类器。Anthropic 透露,企业客户已占其业务约 80%,涵盖 Salesforce、Databricks、高盛、诺和诺德等。更小、更快、面向高吞吐场景的 Haiku 5.5 将于数周内推出。模型已登陆 Anthropic API、AWS Bedrock、Google Cloud Vertex AI 与微软 Azure。
信息来源:路透社(经 Yahoo 转载)、腾讯新闻、太平洋电脑网

评论(0)