# Anthropic 今天发布 Claude Sonnet 5，替代 Sonnet 4.6 成为免费版和 Pro 版的默认模型。Anthropic 的定位很明确：Agent 能力接近自家最贵的 Opus 4.8，API 价格...

- 来源：宝玉
- 发布时间：2026-07-01 02:33
- AIWatch 分数：70
- AIWatch 标记：本周精选
- AIWatch 链接：https://aiwatch.icu/events/evt_01kwdzhqgfe8bfh5fa9dfk9g43
- 原文链接：https://x.com/dotey/status/2072025716913262957

## 精选理由

高信息密度，值得细读

## AI 摘要

Anthropic 发布 Claude Sonnet 5，定位为 Agent 能力接近旗舰 Opus 4.8 但价格仅为其 40% 的模型。在 Agent 编程基准上 Sonnet 5 得分 63.2%，高于前代 Sonnet 4.6 的 58.1%，低于 Opus 4.8 的 69.2%；知识工作基准甚至略超 Opus 4.8。模型更换了新分词器，同样文本可能消耗 1.0-1.35 倍 Token，但推广期定价已对冲此涨幅。对开发者而言，Sonnet 5 提供了更优的性价比，但需注意推广期结束后实际花费涨幅可能高于标价涨幅。
核心观点：
1. Sonnet 5 在 Agent 编程基准得分 63.2%，Sonnet 4.6 为 58.1%，Opus 4.8 为 69.2%。
2. 新分词器导致同样文本消耗 1.0-1.35 倍 Token，推广期定价已对冲此涨幅。
3. API 推广价（至 8 月 31 日）为输入 $2/百万 Token、输出 $10/百万 Token，之后涨至 $3 和 $15。

## 正文

Sonnet 系列是开发者用量最大的一档。但过去几个月，AI Agent 能力（让模型自主规划、调用工具完成多步骤任务）的主要进步集中在更贵的 Opus 系列，两者差距越来越明显。Sonnet 5 把差距缩了回来。在 Agent 编程基准上，Sonnet 5 得分 63.2%，Sonnet 4.6 是 58.1%，Opus 4.8 是 69.2%。在知识工作基准上，Sonnet 5 甚至略微超过了 Opus 4.8。

早期测试者的反馈比较一致：以前 Sonnet 做到一半会停的复杂任务，现在能跑完，还会主动检查自己的输出。Zapier 的工程师说，让 Sonnet 5 连续执行“更新 Salesforce 账户等级，再给企业客户发公告邮件”，模型一口气做完了，“以前会卡在半路”。

API 定价分两阶段：8 月 31 日前的推广价是输入 2 美元/百万 Token、输出 10 美元/百万 Token，之后涨到 3 美元和 15 美元。据 TechCrunch 报道，这个价格低于 OpenAI 的 GPT-5.5 和 Google 的 Gemini 3.1 Pro，但仍高于 Gemini 3.5 Flash。

有个容易忽略的细节：Sonnet 5 换了新的分词器，同样的文本可能消耗 1.0 到 1.35 倍的 Token。Anthropic 说推广期的定价已经把这个涨幅对冲掉了，过渡期总成本大致不变。但推广价结束后，实际花费会比官方标价的涨幅更大。

安全方面，Sonnet 5 的幻觉率和迎合倾向低于前代，Agent 场景下抵御提示注入和恶意请求的能力更强。因为网络安全能力有所提升，模型默认开启了实时安全防护（和 Opus 4.7、4.8 相同的机制）。

Sonnet 5 今天起在 Claude 所有套餐、Claude Code 和 API 上可用，模型代号 claude-sonnet-5。
