前沿热点
前沿热点

王炸 DeepSeek-V4-Pro-0813 来了:1M 上下文 + Anthropic API 兼容,国产模型叫板 Claude

2026-08-13 DeepSeek 把 V4-Pro 更新到 0813 快照、V4-Flash 到 0731,调用名不变。1M 上下文+384K 输出、思考模式默认开、原生 Anthropic API 兼容(base_url api.deepseek.com/anthropic)= 改两个环境变量就能把 Claude Code 切到 DeepSeek。Pro ¥6/M 输出、Flash ¥2/M,官方挂涨价预警。事实据官方文档,以官网为准。

发布于 2026年8月13日7 分钟阅读
<!-- deepseek-v4-pro-0813-hotspot | hotspot | 王炸 DeepSeek-V4-Pro-0813 来了:1M 上下文 + Anthropic API 兼容,国产模型叫板 Claude -->

2026 年 8 月 13 日,DeepSeek 把旗舰模型更新到 DeepSeek-V4-Pro-0813 快照,轻量档同步到 DeepSeek-V4-Flash-0731,调用方法不变,照样用 deepseek-v4-pro / deepseek-v4-flash 两个名字。但这次真正炸场的不是版本号,是两张底牌:1M 上下文 + 384K 输出,以及官方原生支持 Anthropic API 格式--意味着你原来调 Claude 的代码、跑 Claude Code 的终端,改两个环境变量就能切到 DeepSeek。国产模型第一次正面卡进了 Claude 的生态位。这是本站 前沿编码模型横评 的新闻由头,横评讲怎么选,这篇讲发生了什么、为什么重要。

先说清边界:本文事实来自 DeepSeek 官方 API 文档(api-docs.deepseek.com)的「模型 & 价格」「使用 Anthropic API」「接入 Claude Code」三页,2026-08-13 抓取。定价与能力以官网为准;本文做新闻解读,非独立实测复现。与本站早前的 DeepSeek-V4-Flash 热点 互补不重复:那篇讲 Flash 旧快照,这篇聚焦 Pro-0813 + Anthropic API 兼容这条新主线。

一、0813 快照:两张底牌

DeepSeek 这次的版本快照刷新没有改调用名,deepseek-v4-pro 现在指向 0813、deepseek-v4-flash 指向 0731。真正值得看的是规格表里两张早就埋好、这次一并摆上桌的底牌。

维度deepseek-v4-pro(V4-Pro-0813)deepseek-v4-flash(V4-Flash-0731)
上下文长度1M1M
最大输出384K384K
思考模式支持非思考与思考模式(默认)支持非思考与思考模式(默认)
Anthropic API支持支持
Responses API / Tool Calls / Json Output支持支持
输入价(缓存未命中)/M tokens3 元1 元
输出价 /M tokens6 元2 元
并发限制5002500

两张底牌。第一,1M 上下文 + 384K 输出:一百万 token 的输入窗口加最大 38 万 token 的单次输出,意味着你可以把一整个中型代码库或几百页文档一次性塞进去,让它一次性产出超长改写或长报告,而不是切片拼接。第二,思考模式默认开:Pro 和 Flash 都支持「非思考 + 思考」两种模式,且默认就是思考模式--模型会先输出一段推理过程再给答案,对标 Claude 的 Extended Thinking、GPT-5.6 的推理档。

辅助能力也齐:Json Output、Tool Calls、Responses API、对话前缀续写(Beta)、FIM 补全(Beta,仅非思考模式)。FIM 是「中间填充」补全,编码场景里做行内补全、块内插入靠它。

二、Anthropic API 兼容才是真王炸

如果只看参数,1M 上下文是强但不唯一--Claude、Gemini 也在长上下文赛道。真正的王炸是 DeepSeek 官方原生支持 Anthropic API 格式,base_url 是 https://api.deepseek.com/anthropic

这件事的分量在于「换引擎不动管线」。原来用 Anthropic SDK 写的应用、跑 Claude Code 的终端、依赖 Anthropic API 的开源编码工具,底层调的都是 Anthropic 的 messages 接口。DeepSeek 把自己的接口做成了 Anthropic 格式的兼容层,你只要把 base_url 指过来、key 换成 DeepSeek 的,模型名一改,剩下全不动。官方甚至做了模型名自动映射:你传 claude-opus 开头的模型名,后端自动路由到 deepseek-v4-pro;传不支持的模型名,自动落到 deepseek-v4-flash。等于给所有「写死调 Claude」的工具留了后门。

最直接的落地是 Claude Code。DeepSeek 官方文档专门给了「接入 Claude Code」指南,从零安装到迁移只要几步(详见本批 DeepSeek 接 Claude Code 实战 SOP):装好 Claude Code,设 ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropicANTHROPIC_AUTH_TOKEN 填 DeepSeek key、ANTHROPIC_MODEL=deepseek-v4-pro[1m]claude 一敲就跑在 DeepSeek 上。这不是社区 hack,是官方背书的接法。

三、定价:便宜到离谱,但涨价预警已挂

DeepSeek 的定价一直是它的杀手锏,0813 快照延续了这个定位(按每百万 tokens 计)。

计费项deepseek-v4-prodeepseek-v4-flash
输入(缓存命中)/M0.025 元0.02 元
输入(缓存未命中)/M3 元1 元
输出 /M6 元2 元

两个要点。第一,缓存命中价低到可忽略:Pro 缓存命中输入只要 0.025 元/M,Flash 更是 0.02 元/M。反复用同一段系统提示、同一份代码上下文的场景(编码 agent 就是典型),缓存命中率高,实际输入成本被压到接近零。第二,Pro 是 Flash 的 3 倍:输出 6 元 vs 2 元,输入(未命中)3 元 vs 1 元,Pro 贵在推理深度,Flash 便宜在吞吐--Pro 并发 500、Flash 并发 2500,正好对应「少量重活走 Pro、海量轻活走 Flash」的分工。

但冷水也要泼:官方在价格页明确挂出预警--计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,让用户合理安排使用。也就是说现在的低价窗口可能要收窄。要重度依赖的,趁现在囤用量、压缓存命中率,比赌它一直便宜更稳。具体方案以官方正式通知为准。

四、冷思考与格局

泼三盆冷水。第一,思考模式默认开,成本要算清。思考模式会先吐一段推理 token 再出答案,这段思考也计费。Pro 思考模式下的实际 token 消耗比非思考模式高,长任务跑下来账单可能比纸面单价暗示的贵。要省钱的场景显式切非思考模式。第二,Pro 并发只有 500。对比 Flash 的 2500,Pro 的并发上限偏低,高并发批量任务(比如一次跑几十个 agent)可能撞限流,得排队或拆批。第三,Anthropic API 兼容不等于 100% 等价。兼容层覆盖的是接口格式,底层模型能力、工具调用细节、prompt 缓存行为跟原版 Claude 仍有差异,复杂 agent 工作流迁过来要回归测试,别假设「能跑通就等于表现一致」。

格局上看,这是一次生态位的正面卡位。DeepSeek 没有去卷「我的参数比你高」,而是用 Anthropic API 兼容直接钻进 Claude 的工具链--对开发者来说切换成本被压到「改两个环境变量」,这才是真威胁。选型上:要开箱即用、不在意持续付费、依赖 Claude 原生表现,继续 Claude;要长上下文 + 便宜 + 能复用 Claude 工具链、愿意做回归测试,DeepSeek-V4-Pro-0813 是目前最顺的平替;要海量吞吐走 Flash。三条路线并存,不是谁替代谁。本站 前沿编码模型横评 把 DeepSeek 和 Claude、GPT-5.6 摆在一起逐项比,可对照。

常见问题

Q1:deepseek-v4-pro 和 DeepSeek-V4-Pro-0813 是什么关系? A1:前者是调用名,后者是版本快照。DeepSeek 在 2026-08-13 把 deepseek-v4-pro 这个调用名指向的版本更新为 DeepSeek-V4-Pro-0813,deepseek-v4-flash 同步更新为 DeepSeek-V4-Flash-0731。调用方法不变,代码里继续用 deepseek-v4-pro / deepseek-v4-flash,自动调到最新快照。

Q2:DeepSeek 支持 Anthropic API 是什么意思,有什么用? A2:DeepSeek 官方提供 Anthropic 格式的兼容接口,base_url 是 https://api.deepseek.com/anthropic。原来用 Anthropic SDK 写的应用、跑 Claude Code 的终端、依赖 Anthropic API 的开源工具,把 base_url 指过来、key 换成 DeepSeek 的就能用。官方还做了模型名映射:claude-opus 开头自动路由到 deepseek-v4-pro,不支持的模型名落到 deepseek-v4-flash

Q3:1M 上下文和 384K 输出能干什么? A3:1M 上下文可以一次性塞进一整个中型代码库或几百页文档;384K 最大输出意味着单次能产出超长改写或长报告,不用切片拼接。适合大型代码库理解、长文档处理、批量改写等场景。注意思考模式默认开,思考 token 也计费,长任务要算总成本。

Q4:DeepSeek 现在的价格会一直这样吗? A4:不一定。官方在价格页明确预警,计划近期整体上调 API 服务定价,预计涨幅较大,建议合理安排使用。目前低价窗口可能收窄。重度依赖的场景建议趁现在压缓存命中率(缓存命中价极低,Pro 0.025 元/M、Flash 0.02 元/M),具体调价以官方正式通知为准。

Q5:DeepSeek-V4-Pro 能直接替代 Claude 吗? A5:不是简单等价。Anthropic API 兼容覆盖的是接口格式,底层模型能力、工具调用细节、prompt 缓存行为跟原版 Claude 仍有差异。复杂 agent 工作流迁过来要做回归测试。但就「复用 Claude 工具链 + 长上下文 + 低成本」这个组合,V4-Pro-0813 是目前切换成本最低的平替。详细对比见本站前沿编码模型横评。


参考来源

本文由 AI 辅助生成,经人工审核编辑。最后更新:2026-08-13

常见问题

deepseek-v4-pro 和 DeepSeek-V4-Pro-0813 是什么关系?
前者是调用名,后者是版本快照。DeepSeek 在 2026-08-13 把 `deepseek-v4-pro` 这个调用名指向的版本更新为 DeepSeek-V4-Pro-0813,`deepseek-v4-flash` 同步更新为 DeepSeek-V4-Flash-0731。调用方法不变,代码里继续用 `deepseek-v4-pro` / `deepseek-v4-flash`,自动调到最新快照。
DeepSeek 支持 Anthropic API 是什么意思,有什么用?
DeepSeek 官方提供 Anthropic 格式的兼容接口,base_url 是 `https://api.deepseek.com/anthropic`。原来用 Anthropic SDK 写的应用、跑 Claude Code 的终端、依赖 Anthropic API 的开源工具,把 base_url 指过来、key 换成 DeepSeek 的就能用。官方还做了模型名映射:`claude-opus` 开头自动路由到 `deepseek-v4-pro`,不支持的模型名落到 `deepseek-v4-flash`。
1M 上下文和 384K 输出能干什么?
1M 上下文可以一次性塞进一整个中型代码库或几百页文档;384K 最大输出意味着单次能产出超长改写或长报告,不用切片拼接。适合大型代码库理解、长文档处理、批量改写等场景。注意思考模式默认开,思考 token 也计费,长任务要算总成本。
DeepSeek 现在的价格会一直这样吗?
不一定。官方在价格页明确预警,计划近期整体上调 API 服务定价,预计涨幅较大,建议合理安排使用。目前低价窗口可能收窄。重度依赖的场景建议趁现在压缓存命中率(缓存命中价极低,Pro 0.025 元/M、Flash 0.02 元/M),具体调价以官方正式通知为准。
DeepSeek-V4-Pro 能直接替代 Claude 吗?
不是简单等价。Anthropic API 兼容覆盖的是接口格式,底层模型能力、工具调用细节、prompt 缓存行为跟原版 Claude 仍有差异。复杂 agent 工作流迁过来要做回归测试。但就「复用 Claude 工具链 + 长上下文 + 低成本」这个组合,V4-Pro-0813 是目前切换成本最低的平替。详细对比见本站前沿编码模型横评。

相关文章

前沿热点

Gemini 3.8 Flash 发布:更聪明但单任务更贵

2026-09-02(美东)/ 9-3 国内,Google DeepMind 同发 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber,6 周内第 3 个 Flash 版本。3.8 Flash 定位"最聪明的 Flash 工作马":1M 上下文、64K 输出、三档思考、知识截止 2026-03;定价与 3.7 Flash 持平(输入 $0.75/输出 $3.75,优惠至 2026-12-31,之后 $1.50/$7.50)。基准:DeepSWE v1.1 73.7%(逼近 Opus 5 的 74.0%)、Terminal-Bench 2.1 89.4%(世界 #1)、HLE-Verified 54.9%;短板在 Terminal-Bench 4.0 仅 19.1%、OSWorld 2.0 59.0%。Flash Cyber 仅经 Fairwind Program 限可信防御方,无公开价【未确认】。关键反差:单价未涨,但 Artificial Analysis 实测单任务成本因"更努力"上涨约 40%($0.40→$0.58)。所有分数含官方口径与第三方实测,引用须标注。

2026年9月1日9 分钟阅读
前沿热点

2026 年 8 月 AI 编程 Agent 格局:三大阵营各占一极

2026 年 8 月,AI 编程 Agent 赛道定型为三大阵营:浏览器开箱即用的在线平台(Replit/Bolt/Lovable)、深度融合代码库的本地 IDE(Cursor/Copilot/Trae)、终端自主的 CLI Agent(Claude Code/Codex/Cline)。三阵营不是高低档是不同射程,选型原则是先跑起来再优化。底层都是「获取上下文-执行-验证-循环」,真正门槛是拆解需求的能力。

2026年8月5日6 分钟阅读