Anthropic 今天发布 Claude Sonnet 5,替代 Sonnet 4.6 成为免费版和 Pro 版的默认模型。Anthropic 的定位很明确:Agent 能力接近自家最贵的 Opus 4.8,API 价格...
AI 摘要
Anthropic 发布 Claude Sonnet 5,定位为 Agent 能力接近旗舰 Opus 4.8 但价格仅为其 40% 的模型。在 Agent 编程基准上 Sonnet 5 得分 63.2%,高于前代 Sonnet 4.6 的 58.1%,低于 Opus 4.8 的 69.2%;知识工作基准甚至略超 Opus 4.8。模型更换了新分词器,同样文本可能消耗 1.0-1.35 倍 Token,但推广期定价已对冲此涨幅。对开发者而言,Sonnet 5 提供了更优的性价比,但需注意推广期结束后实际花费涨幅可能高于标价涨幅。 核心观点: 1. Sonnet 5 在 Agent 编程基准得分 63.2%,Sonnet 4.6 为 58.1%,Opus 4.8 为 69.2%。 2. 新分词器导致同样文本消耗 1.0-1.35 倍 Token,推广期定价已对冲此涨幅。 3. API 推广价(至 8 月 31 日)为输入 $2/百万 Token、输出 $10/百万 Token,之后涨至 $3 和 $15。
推荐理由高信息密度,值得细读
原文
Sonnet 系列是开发者用量最大的一档。但过去几个月,AI Agent 能力(让模型自主规划、调用工具完成多步骤任务)的主要进步集中在更贵的 Opus 系列,两者差距越来越明显。Sonnet 5 把差距缩了回来。在 Agent 编程基准上,Sonnet 5 得分 63.2%,Sonnet 4.6 是 58.1%,Opus 4.8 是 69.2%。在知识工作基准上,Sonnet 5 甚至略微超过了 Opus 4.8。
早期测试者的反馈比较一致:以前 Sonnet 做到一半会停的复杂任务,现在能跑完,还会主动检查自己的输出。Zapier 的工程师说,让 Sonnet 5 连续执行“更新 Salesforce 账户等级,再给企业客户发公告邮件”,模型一口气做完了,“以前会卡在半路”。
API 定价分两阶段:8 月 31 日前的推广价是输入 2 美元/百万 Token、输出 10 美元/百万 Token,之后涨到 3 美元和 15 美元。据 TechCrunch 报道,这个价格低于 OpenAI 的 GPT-5.5 和 Google 的 Gemini 3.1 Pro,但仍高于 Gemini 3.5 Flash。
有个容易忽略的细节:Sonnet 5 换了新的分词器,同样的文本可能消耗 1.0 到 1.35 倍的 Token。Anthropic 说推广期的定价已经把这个涨幅对冲掉了,过渡期总成本大致不变。但推广价结束后,实际花费会比官方标价的涨幅更大。
安全方面,Sonnet 5 的幻觉率和迎合倾向低于前代,Agent 场景下抵御提示注入和恶意请求的能力更强。因为网络安全能力有所提升,模型默认开启了实时安全防护(和 Opus 4.7、4.8 相同的机制)。
Sonnet 5 今天起在 Claude 所有套餐、Claude Code 和 API 上可用,模型代号 claude-sonnet-5。
讨论
暂无评论。