Sonnet 5永久锁价2/10美元

Anthropic 取消 Claude Sonnet 5 原定于 9 月 1 日实施的 50% 涨价,输入与输出价格永久维持每百万 Token 2 美元和 10 美元。对高频调用模型的 Agent 工作流而言,这比一次促销更重要:长期成本终于可以按现价规划。
Anthropic 在涨价前踩下刹车
Anthropic 已取消 Claude Sonnet 5 原定于 2026 年 9 月 1 日生效的涨价计划。
据 IT之家 8 月 11 日报道,Anthropic 于当地时间 8 月 10 日宣布,Claude Sonnet 5 将永久维持首发推广价格:每百万输入 Token 2 美元、每百万输出 Token 10 美元。此前公布的标准价格为输入 3 美元、输出 15 美元,两项费率都比当前价格高出 50%。
这里的“永久价格”更准确地说,是 Anthropic 取消了已经排期的 9 月涨价,而不是承诺未来永不调整费率。对于开发者而言,最直接的结果是:至少目前不需要再为 9 月 1 日准备一次预算上调,也不必因为促销窗口结束而迁移已经搭好的工作流。
| 计费项目 | 现行价格 | 原定 9 月 1 日价格 | 被取消的涨幅 | 相对原定价格节省 | |---|---:|---:|---:|---:| | 输入 Token | 2 美元/百万 Token | 3 美元/百万 Token | 50% | 33.3% | | 输出 Token | 10 美元/百万 Token | 15 美元/百万 Token | 50% | 33.3% |
这两个百分比看起来不同,是因为比较基准不同:从 2 美元涨到 3 美元是上涨 50%,而从原计划的 3 美元回到 2 美元,则是下降 33.3%。输出费率同理。

这不是小促销,而是 Agent 成本结构的一次修正
Token 是大模型处理文本和生成内容时使用的计量单位,英文单词、汉字、标点与代码片段都会被分词器拆成一个或多个 Token。模型服务通常分别统计输入和输出 Token,因此“2 美元/10 美元”不能简单理解为平均每百万 Token 6 美元,真实成本取决于任务中输入与输出的比例。
AI Agent 是能够自主拆解目标、调用浏览器或终端等工具,并通过多轮决策完成任务的模型工作流。它和普通聊天最大的区别,不是单次回答更长,而是同一项任务会重复读取上下文、检查工具结果、修正计划,再发起下一轮调用。
Agent 的主要成本问题来自调用链长度,而不是某一次请求的价格。一次普通问答可能只调用模型一轮,但一个代码修复 Agent 可能需要读取仓库、搜索符号、生成补丁、执行测试、分析报错并重新修改;一个研究 Agent 也可能连续检索数十个页面,再进行去重、交叉验证和写作。每一步都会继续消耗输入和输出 Token。
因此,取消 50% 涨价对 Agent 开发者的意义明显高于普通聊天用户。消费级 Claude 用户通常按月订阅,不会直接看到每轮对话的 Token 账单;企业和开发团队则会把模型费率写进单任务成本、毛利率、客户报价和用量预警系统,基础费率变动会直接影响产品能否规模化运行。
一笔典型账单能少多少钱
实际账单可以用一个中等规模的 Agent 服务来估算。假设某团队每月使用 1 亿输入 Token 和 2000 万输出 Token,不计提示缓存、批处理折扣及其他附加机制,按照现行价格计算:
- 输入成本:100 × 2 美元,即 200 美元;
- 输出成本:20 × 10 美元,即 200 美元;
- 月度合计:400 美元。
按照此前计划在 9 月执行的 3 美元/15 美元费率,同一用量的月度成本将变为 600 美元。Anthropic 取消涨价后,这个团队每月少支出 200 美元,一年少支出 2400 美元,账单相对原计划下降 33.3%。
规模越大,这笔差异越接近一项基础设施决策。若企业每月消耗 100 亿输入 Token 和 20 亿输出 Token,现价对应 4 万美元,原定价格对应 6 万美元;保持当前费率意味着每月少支出 2 万美元,一年少支出 24 万美元。
| 月度用量示例 | 2/10 美元现价 | 3/15 美元原计划价 | 每月节省 | 每年节省 | |---|---:|---:|---:|---:| | 1 亿输入、2000 万输出 | 400 美元 | 600 美元 | 200 美元 | 2400 美元 | | 10 亿输入、2 亿输出 | 4000 美元 | 6000 美元 | 2000 美元 | 2.4 万美元 | | 100 亿输入、20 亿输出 | 4 万美元 | 6 万美元 | 2 万美元 | 24 万美元 |
输出 Token 仍然是更昂贵的部分。Sonnet 5 每百万输出 Token 10 美元,是输入费率的 5 倍,因此压缩冗长回复、限制无效思考路径、减少重复生成,通常比单纯缩短系统提示词更能降低账单。
Sonnet 5为什么值得Anthropic主动少收钱
Claude Sonnet 5 是 Anthropic 于 2026 年 6 月 30 日发布的中高端闭源模型,也是目前 Sonnet 系列中代理能力最强的一代。它被放在轻量模型与旗舰 Opus 之间,核心卖点不是单轮聊天,而是在编程、工具调用、浏览器操作和知识工作中提供接近旗舰模型的能力,同时维持更适合批量部署的成本。
Sonnet 5 提供 100 万 Token 上下文窗口和最高 128K Token 输出,知识截止日期为 2026 年 1 月。上下文窗口是模型单次请求能够读取的 Token 总量,它决定模型能否一次装入大型代码库片段、长篇研究资料或持续数小时的 Agent 轨迹。
100 万 Token 上下文并不意味着每次都应该塞满 100 万 Token。若一次请求实际使用 100 万输入 Token,仅输入就需要 2 美元;若再生成完整的 128K Token 输出,输出费用约为 1.28 美元,单次理论账单达到 3.28 美元,而且这还没有计算后续多轮调用。长上下文适合解决“必须看全局”的问题,却不适合替代检索、裁剪和上下文管理。
Sonnet 5 在 SWE-bench Verified 上取得了 85.20% 的成绩。SWE-bench Verified 是以真实 GitHub 项目问题测试模型软件工程能力的评测集,模型需要理解代码仓库并生成能够通过测试的修复方案;85.20% 说明 Sonnet 5 已进入适合承担复杂代码任务的能力区间,而不只是生成孤立函数或解释报错。
| 项目 | Claude Sonnet 5 | |---|---| | 发布时间 | 2026 年 6 月 30 日 | | 产品定位 | Sonnet 系列中高端模型,侧重 Agent 与编程 | | 上下文窗口 | 100 万 Token | | 最大输出 | 128K Token | | 知识截止日期 | 2026 年 1 月 | | SWE-bench Verified | 85.20% | | 输入价格 | 2 美元/百万 Token | | 输出价格 | 10 美元/百万 Token |
Anthropic 此次真正强化的是 Sonnet 5 的“单位任务性价比”。模型价格不能只看每百万 Token 的标价,还要看完成同一任务需要多少轮调用、产生多少无效输出,以及最终成功率如何;一个便宜但频繁失败的模型,可能比单价更高但一次完成任务的模型更贵。
与 Opus 档位相比,Sonnet 的位置更清楚了
Sonnet 5 的当前费率约为 Claude Opus 4.8 的 40%。根据公开价格信息,Opus 4.8 为每百万输入 Token 5 美元、每百万输出 Token 25 美元,而 Sonnet 5 分别为 2 美元和 10 美元,输入和输出都便宜 60%。
| 模型 | 输入价格 | 输出价格 | 价格定位 | 更适合的任务 | |---|---:|---:|---|---| | Claude Sonnet 5 | 2 美元/百万 Token | 10 美元/百万 Token | 中高端、高吞吐 | 编程 Agent、研究、浏览器自动化、日常知识工作 | | Claude Sonnet 5原定价格 | 3 美元/百万 Token | 15 美元/百万 Token | 已取消 | 原计划自 2026 年 9 月 1 日执行 | | Claude Opus 4.8 | 5 美元/百万 Token | 25 美元/百万 Token | 旗舰档 | 高难度推理、低容错复杂任务、关键决策辅助 |
这种价格梯度让模型路由更容易设计。常规步骤可以交给 Sonnet 5,只有极高难度或连续失败的任务再升级至 Opus 4.8;如果 Sonnet 5 在足够多的 Agent 任务上接近 Opus 的成功率,企业就能把旗舰模型从默认选项变成异常处理选项。
Anthropic 原定的 3/15 美元价格会削弱这种分层。涨价后 Sonnet 5 虽然仍比 Opus 4.8 便宜 40%,但对于需要数十轮调用的 Agent 产品,成本优势已经不够激进;维持 2/10 美元,则让 Sonnet 继续承担平台主力模型,而不是被挤到“能力不错但不够便宜”的尴尬位置。
标价下降不等于每项任务都便宜三分之一
分词器差异可能改变同一段内容的实际 Token 数量。分词器是把文本拆解为 Token 的编码组件,不同模型即使读取完全相同的中文、英文或代码,也可能统计出不同数量的 Token。
部分第三方测算认为,Sonnet 5 对相同文本的 Token 计数可能比 Sonnet 4.6 高约 30%,但这个比例会随语言、代码密度和文本结构变化,不能直接套用到所有工作负载。若某段内容在旧模型中是 100 万 Token,在新模型中变成 130 万 Token,那么 Sonnet 5 按 2 美元费率计算的输入成本是 2.6 美元,与旧模型按 3 美元费率计算的 3 美元已经相当接近。
开发者不应只拿价格表推算迁移收益。更可靠的方法是抽取真实生产流量,分别统计输入 Token、输出 Token、任务成功率、重试次数、工具调用轮数和端到端耗时,再计算每个成功任务的平均成本。
提示缓存也会影响长上下文 Agent 的真实账单。提示缓存是把重复出现的系统提示、代码库索引或长文档前缀保存下来,后续请求不必按完整读取成本重复处理;对于每轮都携带相同背景资料的工作流,缓存命中率往往比基础输入单价更重要。
价格稳定性正在成为模型能力的一部分
企业采购模型时已经不能只比较排行榜。一个 Agent 工作流通常会绑定提示模板、权限系统、工具协议、评测集、审计日志和故障恢复策略,迁移模型并不是修改一个名称,而是需要重新做回归测试和安全验证。
价格突然变化会迫使企业在技术债与成本之间二选一。如果接受涨价,产品毛利率会下降;如果迁移模型,团队又要承担评测、适配和线上风险。Anthropic 提前取消 9 月涨价,相当于移除了一个已经确定的预算冲击,也降低了企业在 8 月集中寻找替代模型的必要性。
这次调整也说明前沿模型竞争正在从“谁的跑分最高”转向“谁能以稳定成本完成任务”。模型能力、Token 单价、上下文效率、缓存策略、任务成功率和服务稳定性,正在共同决定企业的单位经济性。
Anthropic 的选择并不难理解。Sonnet 是最适合承接规模化调用的产品档位,维持更低费率有利于扩大用量、积累 Agent 工作负载,并把开发者留在 Claude Code 与 Claude Platform 生态中;相比每百万 Token 多收 1 美元输入费和 5 美元输出费,占据企业默认模型的位置可能更有价值。
对开发者最实际的三个建议
开发者现在可以按 2/10 美元重新建立中期预算基线。此前为 9 月涨价预留的 50% 单价缓冲可以取消,但仍应保留用量增长、任务复杂度上升和未来价格调整的风险空间。
- 按“成功任务成本”而不是“每百万 Token 单价”选模型。 同时记录 Token、重试次数、完成率和人工接管率,才能判断 Sonnet 5 是否真的比其他模型便宜。
- 重点治理输出和重复上下文。 输出单价是输入的 5 倍,冗长回答与无效反思会迅速放大成本;重复背景资料则应通过检索、裁剪和缓存机制处理。
- 为高难任务保留模型路由。 Sonnet 5 可以作为常规 Agent 默认模型,连续失败或高风险步骤再升级至 Opus 档位,通常比所有任务都使用旗舰模型更合理。
OpenAI Hub 观点:Anthropic 买下的是开发者的成本预期
Anthropic 取消涨价是一项比表面数字更重要的产品决策。它没有让 Sonnet 5 在今天突然变得更便宜,因为开发者本来就在支付 2/10 美元;它真正改变的是 9 月以后,团队还敢不敢继续扩大用量。
Sonnet 5 的优势也不能被简化为“比原计划便宜 33.3%”。它的价值取决于 85.20% 的 SWE-bench Verified 成绩、100 万 Token 上下文、128K 最大输出、Agent 工具调用能力,以及这些能力在真实任务中能否减少重试和人工接管。
这次锁价对已经上线的代码开发、研究和浏览器自动化产品最有用。对这些产品而言,模型不是偶尔调用的聊天组件,而是一项持续消耗的生产资料;费率稳定后,企业才更愿意把试验性 Agent 变成正式工作流。
截至 2026 年 8 月 11 日,Claude Sonnet 5 的明确价格基线就是输入 2 美元、输出 10 美元,每项均按百万 Token 计费。原定于 9 月 1 日实施的 3/15 美元价格已经取消,开发者无需再按涨价后的费率规划现有项目。
参考来源
- IT之家:Anthropic Claude Sonnet 5 模型将维持首发优惠价,不再恢复原价——报道 Anthropic 于 2026 年 8 月 10 日取消原定 9 月 1 日涨价计划,并确认 2 美元输入、10 美元输出的每百万 Token 价格继续保留。



