2026 年 8 月 13 日,DeepSeek 把旗舰模型更新到 DeepSeek-V4-Pro-0813 快照,轻量档同步到 DeepSeek-V4-Flash-0731,调用方法不变,照样用 deepseek-v4-pro / deepseek-v4-flash 两个名字。但这次真正炸场的不是版本号,是两张底牌:1M 上下文 + 384K 输出,以及官方原生支持 Anthropic API 格式--意味着你原来调 Claude 的代码、跑 Claude Code 的终端,改两个环境变量就能切到 DeepSeek。国产模型第一次正面卡进了 Claude 的生态位。这是本站 前沿编码模型横评 的新闻由头,横评讲怎么选,这篇讲发生了什么、为什么重要。
先说清边界:本文事实来自 DeepSeek 官方 API 文档(api-docs.deepseek.com)的「模型 & 价格」「使用 Anthropic API」「接入 Claude Code」三页,2026-08-13 抓取。定价与能力以官网为准;本文做新闻解读,非独立实测复现。与本站早前的 DeepSeek-V4-Flash 热点 互补不重复:那篇讲 Flash 旧快照,这篇聚焦 Pro-0813 + Anthropic API 兼容这条新主线。
一、0813 快照:两张底牌
DeepSeek 这次的版本快照刷新没有改调用名,deepseek-v4-pro 现在指向 0813、deepseek-v4-flash 指向 0731。真正值得看的是规格表里两张早就埋好、这次一并摆上桌的底牌。
| 维度 | deepseek-v4-pro(V4-Pro-0813) | deepseek-v4-flash(V4-Flash-0731) |
|---|---|---|
| 上下文长度 | 1M | 1M |
| 最大输出 | 384K | 384K |
| 思考模式 | 支持非思考与思考模式(默认) | 支持非思考与思考模式(默认) |
| Anthropic API | 支持 | 支持 |
| Responses API / Tool Calls / Json Output | 支持 | 支持 |
| 输入价(缓存未命中)/M tokens | 3 元 | 1 元 |
| 输出价 /M tokens | 6 元 | 2 元 |
| 并发限制 | 500 | 2500 |
两张底牌。第一,1M 上下文 + 384K 输出:一百万 token 的输入窗口加最大 38 万 token 的单次输出,意味着你可以把一整个中型代码库或几百页文档一次性塞进去,让它一次性产出超长改写或长报告,而不是切片拼接。第二,思考模式默认开:Pro 和 Flash 都支持「非思考 + 思考」两种模式,且默认就是思考模式--模型会先输出一段推理过程再给答案,对标 Claude 的 Extended Thinking、GPT-5.6 的推理档。
辅助能力也齐:Json Output、Tool Calls、Responses API、对话前缀续写(Beta)、FIM 补全(Beta,仅非思考模式)。FIM 是「中间填充」补全,编码场景里做行内补全、块内插入靠它。
二、Anthropic API 兼容才是真王炸
如果只看参数,1M 上下文是强但不唯一--Claude、Gemini 也在长上下文赛道。真正的王炸是 DeepSeek 官方原生支持 Anthropic API 格式,base_url 是 https://api.deepseek.com/anthropic。
这件事的分量在于「换引擎不动管线」。原来用 Anthropic SDK 写的应用、跑 Claude Code 的终端、依赖 Anthropic API 的开源编码工具,底层调的都是 Anthropic 的 messages 接口。DeepSeek 把自己的接口做成了 Anthropic 格式的兼容层,你只要把 base_url 指过来、key 换成 DeepSeek 的,模型名一改,剩下全不动。官方甚至做了模型名自动映射:你传 claude-opus 开头的模型名,后端自动路由到 deepseek-v4-pro;传不支持的模型名,自动落到 deepseek-v4-flash。等于给所有「写死调 Claude」的工具留了后门。
最直接的落地是 Claude Code。DeepSeek 官方文档专门给了「接入 Claude Code」指南,从零安装到迁移只要几步(详见本批 DeepSeek 接 Claude Code 实战 SOP):装好 Claude Code,设 ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic、ANTHROPIC_AUTH_TOKEN 填 DeepSeek key、ANTHROPIC_MODEL=deepseek-v4-pro[1m],claude 一敲就跑在 DeepSeek 上。这不是社区 hack,是官方背书的接法。
三、定价:便宜到离谱,但涨价预警已挂
DeepSeek 的定价一直是它的杀手锏,0813 快照延续了这个定位(按每百万 tokens 计)。
| 计费项 | deepseek-v4-pro | deepseek-v4-flash |
|---|---|---|
| 输入(缓存命中)/M | 0.025 元 | 0.02 元 |
| 输入(缓存未命中)/M | 3 元 | 1 元 |
| 输出 /M | 6 元 | 2 元 |
两个要点。第一,缓存命中价低到可忽略:Pro 缓存命中输入只要 0.025 元/M,Flash 更是 0.02 元/M。反复用同一段系统提示、同一份代码上下文的场景(编码 agent 就是典型),缓存命中率高,实际输入成本被压到接近零。第二,Pro 是 Flash 的 3 倍:输出 6 元 vs 2 元,输入(未命中)3 元 vs 1 元,Pro 贵在推理深度,Flash 便宜在吞吐--Pro 并发 500、Flash 并发 2500,正好对应「少量重活走 Pro、海量轻活走 Flash」的分工。
但冷水也要泼:官方在价格页明确挂出预警--计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,让用户合理安排使用。也就是说现在的低价窗口可能要收窄。要重度依赖的,趁现在囤用量、压缓存命中率,比赌它一直便宜更稳。具体方案以官方正式通知为准。
四、冷思考与格局
泼三盆冷水。第一,思考模式默认开,成本要算清。思考模式会先吐一段推理 token 再出答案,这段思考也计费。Pro 思考模式下的实际 token 消耗比非思考模式高,长任务跑下来账单可能比纸面单价暗示的贵。要省钱的场景显式切非思考模式。第二,Pro 并发只有 500。对比 Flash 的 2500,Pro 的并发上限偏低,高并发批量任务(比如一次跑几十个 agent)可能撞限流,得排队或拆批。第三,Anthropic API 兼容不等于 100% 等价。兼容层覆盖的是接口格式,底层模型能力、工具调用细节、prompt 缓存行为跟原版 Claude 仍有差异,复杂 agent 工作流迁过来要回归测试,别假设「能跑通就等于表现一致」。
格局上看,这是一次生态位的正面卡位。DeepSeek 没有去卷「我的参数比你高」,而是用 Anthropic API 兼容直接钻进 Claude 的工具链--对开发者来说切换成本被压到「改两个环境变量」,这才是真威胁。选型上:要开箱即用、不在意持续付费、依赖 Claude 原生表现,继续 Claude;要长上下文 + 便宜 + 能复用 Claude 工具链、愿意做回归测试,DeepSeek-V4-Pro-0813 是目前最顺的平替;要海量吞吐走 Flash。三条路线并存,不是谁替代谁。本站 前沿编码模型横评 把 DeepSeek 和 Claude、GPT-5.6 摆在一起逐项比,可对照。
常见问题
Q1:deepseek-v4-pro 和 DeepSeek-V4-Pro-0813 是什么关系?
A1:前者是调用名,后者是版本快照。DeepSeek 在 2026-08-13 把 deepseek-v4-pro 这个调用名指向的版本更新为 DeepSeek-V4-Pro-0813,deepseek-v4-flash 同步更新为 DeepSeek-V4-Flash-0731。调用方法不变,代码里继续用 deepseek-v4-pro / deepseek-v4-flash,自动调到最新快照。
Q2:DeepSeek 支持 Anthropic API 是什么意思,有什么用?
A2:DeepSeek 官方提供 Anthropic 格式的兼容接口,base_url 是 https://api.deepseek.com/anthropic。原来用 Anthropic SDK 写的应用、跑 Claude Code 的终端、依赖 Anthropic API 的开源工具,把 base_url 指过来、key 换成 DeepSeek 的就能用。官方还做了模型名映射:claude-opus 开头自动路由到 deepseek-v4-pro,不支持的模型名落到 deepseek-v4-flash。
Q3:1M 上下文和 384K 输出能干什么? A3:1M 上下文可以一次性塞进一整个中型代码库或几百页文档;384K 最大输出意味着单次能产出超长改写或长报告,不用切片拼接。适合大型代码库理解、长文档处理、批量改写等场景。注意思考模式默认开,思考 token 也计费,长任务要算总成本。
Q4:DeepSeek 现在的价格会一直这样吗? A4:不一定。官方在价格页明确预警,计划近期整体上调 API 服务定价,预计涨幅较大,建议合理安排使用。目前低价窗口可能收窄。重度依赖的场景建议趁现在压缓存命中率(缓存命中价极低,Pro 0.025 元/M、Flash 0.02 元/M),具体调价以官方正式通知为准。
Q5:DeepSeek-V4-Pro 能直接替代 Claude 吗? A5:不是简单等价。Anthropic API 兼容覆盖的是接口格式,底层模型能力、工具调用细节、prompt 缓存行为跟原版 Claude 仍有差异。复杂 agent 工作流迁过来要做回归测试。但就「复用 Claude 工具链 + 长上下文 + 低成本」这个组合,V4-Pro-0813 是目前切换成本最低的平替。详细对比见本站前沿编码模型横评。
参考来源
- DeepSeek 官方 API 文档 · 模型 & 价格(版本号、上下文、输出、思考模式、Anthropic API、价格、并发、涨价预警):https://api-docs.deepseek.com/zh-cn/quick_start/pricing
- DeepSeek 官方 API 文档 · 使用 Anthropic API(base_url、模型名映射、SDK 调用):https://api-docs.deepseek.com/zh-cn/guides/anthropic_api
- DeepSeek 官方 API 文档 · 接入 Claude Code(环境变量、安装步骤):https://api-docs.deepseek.com/zh-cn/quick_start/agent_integrations/claude_code
- 本站相关:前沿编码模型横评 | DeepSeek 接 Claude Code 实战 SOP | Cline 接 DeepSeek 开源解析 | DeepSeek-V4-Flash 热点 | Claude Code vs Cursor vs Codex