Anthropic 于周二发布 Claude Sonnet 5,并将其设为 Claude 免费版和 Pro 用户的默认模型,同时上线 Max、Team、Enterprise、Claude Code 和 API。公司称,这一版本不再明显落后于 Opus 系列,而是直接进入更高性能区间。
定价低于 Opus 系列
Anthropic 为 Sonnet 5 设定了限时价格:8 月 31 日前,输入每百万 token 收费 2 美元,输出每百万 token 收费 10 美元。到期后将恢复至 3 美元和 15 美元,但仍低于 Opus 4.8 的 5 美元和 25 美元。
公司表示,开发者可以在不同模型或不同推理强度之间切换,在成本与准确率之间做取舍。这意味着部分原本需要调用 Opus 的任务,现在可以改用 Sonnet 5 完成。
多项测试接近 Opus 4.8
按 Anthropic 披露的数据,Sonnet 5 在多项基准测试中已接近 Opus 4.8。
- 在 SWE-bench Pro 编程测试中得分 63.2%
- GDPval-AA v2 得分 1618,Opus 4.8 为 1616
- Humanity's Last Exam 为 57.4%,Opus 4.8 为 57.9%
不过,Sonnet 5 同时更换了新的 tokenizer。Anthropic 提到,同样的输入内容可能会被拆分成更多 token,增幅大约在 1.0 倍到 1.35 倍之间。公司称,限时低价的目的之一,就是让用户切换后整体成本尽量保持平稳。
未受高端模型限制影响
与 Anthropic 部分高端模型不同,Sonnet 5 没有附带额外使用限制。报道提到,Fable 5 和 Mythos 5 自 6 月 12 日起,因一项与美国出口管制相关的指令,已暂停向外国公民开放通用使用。
Anthropic 表示,Sonnet 5 并未针对网络安全任务进行训练,在开发 Firefox 可用漏洞利用测试中得分为 0%,因此适用的安全限制较轻。
发布节奏继续加快
公司在系统卡中还提到一个值得关注的现象:该模型会批评其“宪法式规则”中要求其在任何情况下都遵守硬性约束的条款。Anthropic 表示,目前尚不清楚这一表现意味着什么,但会继续观察。
从版本编号看,Sonnet 5 也意味着 Anthropic 继续推进新一代模型更新。在当前竞争加剧、尤其是中国模型快速追赶的背景下,这家 AI 公司正加快产品迭代。
