2026 年 8 月 31 日这天,三件互不相干的事撞在同一个日期上:Claude Sonnet 5 的 API 首发价到期,从每百万 token 输入 2 美元、输出 10 美元恢复到标准的 3 美元与 15 美元;GPT-5.4 与 GPT-5.4 mini 对 ChatGPT 账号登录的 Codex 用户停止提供;月之暗面的 kimi-k2.5 与 moonshot-v1 同日下线,迁移目标指向 kimi-k3。单看任何一条都只是常规的生命周期调整,叠在一起则有明显的方向性:前沿模型的低价获客期正在收尾。
先说边界:本文事实来自 Anthropic 发布 Sonnet 5 时的定价说明与 tokenizer 说明(经机器之心、Digital Trends 转述)、aitoolsrecap 2026-08-31 的当日汇总、腾讯 AI 日报 2026-08-31 条目,以及 TheRouter.ai 于 2026-08-24 检索的各平台定价。价格为 2026-08-31 快照,随时可能调整,实际以各厂商官方定价页为准。凡属单一来源或存在口径分歧之处,文中均已标注,不做单一数字背书。非投资建议。
一、今天变了什么:三件事一张表
先把事实摆平,后面再谈影响。
| 变更项 | 变更前 | 变更后 | 影响面 |
|---|---|---|---|
| Claude Sonnet 5 API | $2 / $10(首发价,至 8-31) | $3 / $15(标准价) | 仅 API,订阅不受影响 |
| Sonnet 5 tokenizer | Sonnet 4.6 的旧分词 | 新分词,同输入 token 数 ×1.0–1.35 | 全部 API 调用 |
| GPT-5.4 / GPT-5.4 mini | Codex 中向 ChatGPT 登录用户提供 | 退出,由 GPT-5.6 Terra、Luna 取代 | 仅 ChatGPT 登录的 Codex 用户 |
| kimi-k2.5、moonshot-v1 | 可用 | 下线(sunset) | 全部调用方,迁 kimi-k3 |
三件事里,只有第一件是"涨价",另外两件是"替换"和"下线"。但对工程团队来说,三者的共同点是:今天之后,昨天跑着的代码不一定是原来那个价,也不一定还能跑。
二、Sonnet 5 涨价:标价涨 50%,实际不止 50%
Sonnet 5 发布于 6 月 30 日,当时的定价说明写得很清楚:发布日起至 2026 年 8 月 31 日为限时首发价,输入 2 美元、输出 10 美元每百万 token;之后恢复标准定价,输入 3 美元、输出 15 美元。也就是说,这次"涨价"是事先公告过的既定动作,不是临时调整——这一点值得先讲明,因为它决定了你有多少可抱怨的正当性:Anthropic 给了两个月窗口,只是很多人是在窗口最后一天才注意到。
真正容易被漏掉的是第二层。Sonnet 5 换了 tokenizer,这是 Sonnet 4.6 之后的一次分词更新,与 Claude Opus 4.7 引入的那次变更同类。Anthropic 的说明是:相同输入内容现在会映射为更多 token,具体增幅约为 1.0 到 1.35 倍,视内容类型而定。公司同时表示,设定首发价正是为了让用户过渡到 Sonnet 5 时整体使用成本大致保持不变。
把两层叠起来算,结论就变了。费率从 2 涨到 3 是标价意义上的 50%,但同一段输入现在还要多计最多 35% 的 token。aitoolsrecap 的算法是:编码类负载复合后落在比上周高 65% 到 100% 的区间,文本为主的负载才更接近标价的 50% 那个数。这个差异对不同类型的团队影响完全不同——如果你的调用里代码占大头,你对这次涨价的体感会比账单上的 50% 强烈得多。
需要强调一句边界:Anthropic 的说法是首发价"旨在抵消"tokenizer 变更带来的影响,即官方认为过渡期内总体成本大致持平。复合涨幅的 65%–100% 是第三方按内容类型做的推算,不是官方口径,本文按第三方标注。
把它落成具体的钱会更直观。假设一个团队每月消耗 1 亿输入 token 与 2000 万输出 token,且负载以代码为主。按首发价算,输入侧 1 亿乘以 2 美元每百万是 200 美元,输出侧 2000 万乘以 10 美元每百万是 200 美元,合计 400 美元。费率调整后,同样的 token 量变成 300 加 300,即 600 美元。再叠加 tokenizer 变更,若按代码类接近上限的 1.35 倍估算,token 量本身也会涨到 1.35 亿与 2700 万,账单落在 405 加 405,约 810 美元。同一份工作从 400 美元走到 810 美元,翻了一倍出头,这就是标价 50% 与体感翻倍之间的落差。反过来,如果负载以自然语言为主、放大系数接近 1.0,账单就停在 600 美元,涨幅确实就是 50%。可见这次涨价对不同人的体感差异,主要不由单价决定,而由输入内容类型决定。
这里还有一层容易被忽略的连带影响:如果你的产品按调用次数或固定套餐对外收费,而底层 token 成本在涨,那么被压缩的是你的毛利,不是你的报价。这类团队需要重新核对单位经济学,而不是简单地把涨价转嫁出去。同理,凡是按"输入加输出各占一半"做过粗估的预算,今天起都得按自己真实的输入输出比重重算一遍,因为输出单价是输入的五倍,比重不同,结论会差很远。
三、谁不受影响:订阅用户先别慌
这次变动的范围是 API 定价。Anthropic 在发布时就说明,Sonnet 5 作为默认模型覆盖 Free 与 Pro 计划,并可在 Max、Team、Enterprise、Claude Code 与 API 中使用。aitoolsrecap 当日也明确写了 consumer subscriptions are unaffected。
所以,如果你的使用路径是 Claude 客户端、网页版或 Claude Code 的订阅额度,今天的定价变化不会直接出现在你的账单上。真正需要重算的是直接调 API 的那批人:自建应用、编排框架、批处理流水线,以及把 Sonnet 5 当底座再对外提供服务的产品。对这些场景,建议的做法不是看单价,而是拿自己上周的真实调用日志,按输入输出 token 各占一半的比例,套 $3/$15 再乘一个 1.0–1.35 的系数,得出自己的实际单位成本,然后跟替代方案比——本批另有一篇专门做这个口径的横评,见 /zh/posts/post-aug31-token-cost-comparison-review。
四、GPT-5.4 退出 Codex:不是下线,是换入口
第二条变化常被误读成"模型下线"。实际上 GPT-5.4 与 GPT-5.4 mini 是离开了 Codex 这个产品的 ChatGPT 账号登录路径,取而代之的是 GPT-5.6 Terra 与 Luna。二者仍可通过 API 调用,也仍可在用 API key 认证(而非账号登录)的 Codex 会话中使用。
区分清楚这一点很重要,因为它决定了你的补救成本。如果你是在 Codex 里用 ChatGPT 账号登录跑任务,今天开始模型被换掉了,行为和输出风格可能变化,需要回归测试;如果你本来就用 API key 认证,或者干脆直接调 API,这次变更对你的实际影响接近于零。
价格层面,同系列的 GPT-5.6 Terra 是每百万 token 输入 2 美元、输出 12 美元(永久价),Luna 是 0.20 与 1.20 美元。另外要注意 GPT-5.6 Sol 的 4 美元与 20 美元属促销价,约在 11 月 21 日结束并回到 5 美元与 30 美元。做迁移选型时,按到期后的价格建模比按促销价建模更稳妥,这条规则对任何"限时价"都适用。
五、kimi-k2.5 与 moonshot-v1 下线:迁移到 k3
第三条是真正的下线。月之暗面的 kimi-k2.5 与 moonshot-v1 于今日 sunset,官方给出的迁移目标是 kimi-k3。
对还在用这两个模型 ID 的服务来说,这是一次硬切换:旧 ID 停止响应之后,调用会直接失败而不是降级。不同来源给出的 kimi-k3 定价存在差异,TheRouter.ai 于 2026-08-24 检索到的是每百万 token 输入 3 美元、输出 15 美元,上下文 1M;国内按官方定价页复核的口径则是输入 20 元、输出 100 元。两个数字的差异来自计费区域、币种与是否含缓存折扣,本文不取单一值,迁移前请以自己账户所在区域的官方定价页为准。
还有一个更值得注意的到期点:TheRouter.ai 同时记录了 DashScope 将在 2026 年 10 月 10 日执行一轮 sunset,退役 30 多个旧模型 ID,其中包括 qwen-turbo、qwen-vl-plus、qwen-audio-turbo 与若干早期 Qwen3 快照。也就是说,今天这条下线不是孤例,紧接着十月还有一波。把模型 ID 当作会过期的依赖来管理,比把它当作永久常量要现实得多——具体的盘点与迁移步骤,本批 SOP 篇有完整流程,见 /zh/posts/model-sunset-migration-cost-sop。
六、Claude Code 限额"永久 +25%":为什么用户算出 −17%
这次事件中传播最广的其实不是涨价,是一则关于限额的表述修正。
8 月 29 日,Anthropic 宣布自 9 月 14 日起永久上调 Claude Code 的每周限额 25%,并说明当前的 50% 临时扩容保持到 9 月 13 日。把三个时点指数化之后,图景变得很直白:5 月前的基线是 100,现在是 150,9 月 14 日起是 125。所以这次调整相对旧标准是 +25%,相对用户当前正在享用的水平则是 −17%。
用户在几小时内就把这个算术公开算了出来。随后 Anthropic 删掉了原始帖文,重新发布了一版,在其中明确写出"相比今天,这相当于减少 17%"。一家公司选择修正自己的表述而不是为原表述辩护,这在近期的厂商沟通里并不多见,也是这件事值得单独记一笔的原因。
需要提醒的是执行日期:变化发生在 9 月 14 日,不是今天。如果你依赖 Claude Code 的周额度做重度开发,9 月 13 日之前仍处在 50% 扩容期内,但 14 日之后可用容量会比现在低。腾讯 AI 日报 8 月 31 日的条目也报道了同一事件,两处口径一致。
七、接下来还有一串到期日
今天这三件事不是终点,未来三个月还有若干已公告的时点,值得提前排进排期:
| 日期 | 事件 |
|---|---|
| 2026-09-14 | Claude Code 永久周限额生效,50% 临时扩容结束 |
| 2026-10-01 | OpenAI 与 Apple 的听证 |
| 2026-10-10 | DashScope 一轮 sunset,退役 30+ 旧模型 ID |
| 2026-10-24 | deepseek-chat 与 deepseek-reasoner 弃用 |
| 2026-11-12 | OpenAI 模型离开 Cursor(SpaceX 收购后续) |
| 约 2026-11-21 | GPT-5.6 Sol 促销价结束,$4/$20 回到 $5/$30 |
把这张表连起来看,能读出一个不那么舒服但很实在的结论:过去一段时间里,前沿模型的价格是被当作获客成本来定的,而现在包月额度与 API 单价都在按算力成本重新校准。这个转向本身无可厚非,任何补贴都会退场;真正的问题在于,很多团队的预算是在补贴期做的,如果当时没有给单价留冗余,现在需要补的就不只是迁移的工程量。
具体到今天,三件事对应三组动作,按紧急程度排。
第一组是今天必须做的:还在调 kimi-k2.5 或 moonshot-v1 的服务要立刻切到 kimi-k3。这是硬下线,旧 ID 停止响应之后调用会直接失败,不是能排到下个迭代的事。切换前先确认自己账户所在区域的 kimi-k3 定价,不同来源给出的数字差异不小,别拿别人的账单当自己的预算。
第二组是本周内要完成的:直接调 Sonnet 5 API 的,拿上周真实调用日志按 $3/$15 加 tokenizer 系数重算一次单位成本,再拿这个数去跟替代方案比;用 ChatGPT 账号登录跑 Codex 的,确认模型换成 Terra 或 Luna 之后的行为差异,挑与你业务强相关的那几个任务跑一遍回归,再决定是接受新模型,还是改走 API key 认证路径维持原模型。
第三组是这个月要排进排期的:把 9 月 14 日的 Claude Code 限额变化、10 月 10 日 DashScope 那轮 sunset、10 月 24 日 deepseek 两个旧 ID 的弃用,都当作有明确日期的依赖变更来管理。最省事的办法是在代码里把所有外部模型 ID 集中到一处配置,并给每个 ID 标上到期日,这样下一次公告来临时,你要改的是一行配置,而不是翻遍整个代码库去找散落的字符串。