DeepSeek V4 Pro 正式版指南 2026:九项Agent基准逼近Claude,8月17日峰谷定价涨价前最后的API接入窗口
海外梯子

更新:2026-08-14 — DeepSeek-V4-Pro-0813 正式版已于 8 月 13 日晚间在 App、网页端和 API 同步上线。本文基于官方 API 文档、官方定价页与多家媒体报道整理。

8 月 13 日晚,DeepSeek 没开发布会,公众号一条消息就把 V4 系列最后一块拼图补齐了:V4 Pro 正式版上线。同一天晚上,马斯克的 Grok 4.6 也来凑热闹,两家中美头部模型在智能体赛道正面对撞。

但对大多数开发者来说,真正值得关注的是另一件事:DeepSeek 官方宣布 8 月 17 日 0 时起,API 全面切换到峰谷定价——价格要涨了。 当前输入 0.435 美元、输出 0.87 美元的过渡价,是 V4 Pro 正式版历史上最便宜的窗口,只剩最后几天。

如果你在用 DeepSeek 做 Agent 开发、接 API,或者只是想在涨价前锁定便宜额度,这篇值得看完。

太长不看版

维度结论
发布时间2026-08-13 晚间,App/网页端/API 同步上线
模型规格V4-Pro 总参数 1.6T,上下文 1M,最大输出 384K
核心变化九项 Agent 基准平均提升约 25.7 分,逼近 Claude Fable 5
最大卖点原生支持 OpenAI Responses API + Anthropic API + Codex 一键配置
当前价格输入 $0.435 / 输出 $0.87(每百万 token,过渡价)
涨价预告8/17 0 时起峰谷定价:闲时 $0.66/$1.98,高峰 $1.32/$3.96
思考模式low / high / max 三档可调,默认开启
适合谁Agent 开发、长上下文处理、价格敏感的 API 重度用户

这版 V4 Pro 为什么值得关注

V4 系列 4 月 24 日发布预览版时,Flash 和 Pro 一起亮相。7 月 31 日 Flash 正式版先到,九项 Agent 基准反超预览版 Pro,直接把”Flash 打赢 Pro”的剧本演了一遍。现在轮到 Pro 自己转正。

正式版 DeepSeek-V4-Pro-0813 的规格:1.6 万亿总参数的 MoE 架构、100 万 token 上下文、单次最大输出 38.4 万 token——这个输出上限意味着它能把一整本长篇小说一次性吐完,做长文档生成、代码仓库级任务时不用像小模型那样分段拼。

社区流出的评测对比显示,V4-Pro-0813 相比预览版九项智能体测试平均提升约 25.7 分:Agent 编程基准 DeepSWE 从 12.8 直接干到 62.7,Terminal-Bench 拿到 87.9 分,贴着 Claude Fable 5 的 88 分走。HLE 测试里,不借助工具得分 42.7,用上工具后跳到 60.0——工具调用依赖度明显,但这也说明它的 Agent 链路是真的能干活。

生产环境的提升尤其明显。官方原话是”正式版增强了 Agent 能力,在生产环境中的性能表现提升尤为显著”。翻译一下:跑真实业务、长任务、多工具协作的场景,比预览版稳得多。

三档思考强度:按任务复杂度省钱

这次更新里最实用的一个功能:思考模式支持 low / high / max 三档,V4-Flash 和 V4-Pro 都有。

档位适用场景建议
low简单问答、分类、信息提取快速响应,token 消耗最低
high日常 Agent 任务、工具调用默认选择,性价比均衡
max复杂推理、长程规划、代码工程效果最强,token 消耗最高

以前 V4 的思考模式是”开或不开”二选一,现在给了中间档。简单任务用 low、日常用 high、硬骨头用 max——这直接关系到你的 API 账单,尤其是峰谷定价生效之后,思考强度选对了能省一截。

调用时在请求里带上参数即可(下面有示例)。

API 接入:Responses API + Codex 是最大亮点

V4 Pro 正式版在接口层面做了两件大事:

第一,原生支持 OpenAI Responses API 格式。 之前 V4 只兼容 Chat Completions 风格,现在 Responses API 也原生支持了。这意味着用 OpenAI 生态的项目,改个 base_url 和模型名就能切过来,不用重写调用逻辑。同时兼容 Anthropic API 格式(https://api.deepseek.com/anthropic)。

第二,针对性适配 Codex。 官方提供了 Codex 一键配置脚本,按文档跑一遍就能把 Codex 的模型后端切到 DeepSeek。对用 Codex 做编程 Agent 的人来说,这是把”贵模型”换成”便宜模型”的最短路径。

接入方式,OpenAI 兼容格式:

1
2
3
4
5
6
7
8
9
10
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DEEPSEEK_API_KEY" \
-d '{
"model": "deepseek-v4-pro",
"messages": [{"role": "user", "content": "Hello!"}],
"thinking": {"type": "enabled"},
"reasoning_effort": "high",
"stream": false
}'

模型名不用变——deepseek-v4-pro 这个参数对应的版本已经自动切到 0813,调用方式保持不变。想用三档思考强度,调 reasoning_effort 字段就行。

网页端和 App 用户更简单:打开 DeepSeek 的 App 或网页版,在模型选择里切到”专家模式“就能直接用上 V4 Pro 正式版,不需要任何配置。

峰谷定价:8 月 17 日涨价,当前是最后窗口

这是本文最想提醒你的事。北京时间 2026 年 8 月 17 日 0 时起,DeepSeek API 全面切换到峰谷定价,闲时价格为高峰时段价格的一半。 关键是:新价格比现在的过渡价高不少。

模型当前价(过渡)8/17 后·闲时8/17 后·高峰
V4-Pro 输入$0.435$0.66$1.32
V4-Pro 输出$0.87$1.98$3.96
V4-Flash 输入$0.14$0.22$0.44
V4-Flash 输出$0.28$0.66$1.32

(单位:每百万 token,缓存命中另有低价。高峰时段为 UTC 01:00-04:00 和 06:00-10:00,即北京时间 09:00-12:00 和 14:00-18:00。)

算一笔账:V4-Pro 现在的输出价 0.87 美元,闲时价 1.98 美元、高峰价 3.96 美元——高峰时段输出价涨到现在的 4.5 倍。对重度 API 用户来说,这不是小波动,是量级变化。

两个实用建议:

  1. 赶在 8 月 17 日 0 时前充值/囤额度,过渡价是历史最低。
  2. 涨价后把批量任务挪到闲时跑(北京时间 18:00 之后到次日早上),闲时直接砍半。DeepSeek 官方的意图很明确:用价格杠杆把流量错峰,夜里算力闲着也是闲着,半价卖给愿意挪时间的用户。

顺带一提,DeepSeek 中国区的调用价格本身就有汇率优势,即使涨价后闲时价,对比海外旗舰仍然便宜一大截——这也是它能在 OpenRouter 周调用量上连续霸榜的原因之一(8 月首周中国模型包揽全球 Token 调用量前四,DeepSeek-V4-Flash 以 8.83 万亿 Token 登顶)。

和同夜发布的 Grok 4.6 怎么选

8 月 13 日凌晨到晚上,Grok 4.6 和 DeepSeek V4 Pro 正式版先后落地,两家都押注 Agent 赛道。简单对比:

维度DeepSeek V4 ProGrok 4.6GPT-5.6 SolClaude Fable 5
综合智能指数逼近第一梯队61 分(追平 Sol)61 分63 分
API 输出价$0.87(过渡)$6$30更贵
上下文1M长上下文长上下文长上下文
开源权重否(API 为主)
特色国产低价 + Responses API长程 Agent + Cursor 生态综合均衡综合最强

DeepSeek 的定位一直很清晰:价格打到地板,性能贴着天花板。V4 Pro 的输出价是 Grok 4.6 的七分之一,即使 8/17 涨价后高峰价 3.96 美元,也只有 Grok 的 66%。预算敏感、跑长任务的团队,DeepSeek 依然是最极端的性价比选择。

谁适合现在就用 V4 Pro

  • Agent 开发团队:原生 Responses API + Codex 适配,迁移成本最低,九项 Agent 基准逼近 Fable 5
  • 长文档/代码库处理:1M 上下文 + 384K 输出,长程任务不用分段
  • API 价格敏感用户:8/17 前是历史最低价窗口,错过就要等闲时半价
  • 企业办公场景:金山办公灵犀专业版已首批接入,办公智能体链路完整

FAQ

Q1:V4 Pro 和 V4-Flash 怎么选? 看任务复杂度。Flash 便宜(过渡价输入 0.14/输出 0.28 美元)但能力弱一档,适合高频简单任务;Pro 贵但 Agent 能力和长上下文强得多,适合复杂工程和长程任务。预算允许且要跑 Agent,直接上 Pro。

Q2:8 月 17 日涨价是真的吗?会影响网页版吗? 是真的,官方定价页已公布峰谷价目表,8/17 0 时(北京时间)生效。受影响的是 API 调用价格;App/网页端的订阅和免费额度机制不变。

Q3:高峰期是什么时候? UTC 01:00-04:00 和 06:00-10:00,换算成北京时间是 09:00-12:00 和 14:00-18:00。想省钱就把批量任务挪到闲时(北京时间 18:00 后到次日 9 点前、中午 12-14 点)。

Q4:涨价前囤额度有用吗? 有用。余额按扣费时价格结算,8/17 前充值的余额不会因涨价贬值,反而等于锁定了当前低价。

Q5:Codex 怎么接 DeepSeek? 官方文档”快速开始-接入 Agent 工具-Codex”有一键配置脚本,按步骤跑完把模型后端切到 deepseek-v4-pro 即可,无需改代码。

Q6:思考模式三档有什么区别? low 适合简单问答(省 token),high 适合日常 Agent 任务(推荐默认),max 适合复杂推理和长程规划(效果最强但最贵)。涨价后按任务选档,能显著控制成本。


如果你要用 DeepSeek V4 Pro、Grok 4.6 或其他海外 AI 服务做长任务,稳定的跨境网络是前提——API 调用和网页版都依赖它。推荐几个长期在用的方案:

方案特点适合人群直达
光速云IEPL 专线 + IEPL专线 多路复用,100+ 节点主力推荐,开发者首选前往
飞猫云IEPL 专线,入门到专业全档位预算敏感的长任务用户前往
SS-IDIEPL 专线,流媒体解锁,5 设备办公 + 娱乐兼顾前往
MESLIEPL 入门款,价格友好轻量使用前往

更多 DeepSeek 教程: DeepSeek V4-Flash 正式版指南 2026DeepSeek 入门指南DeepSeek 高阶组合玩法

最后更新:2026-08-14。定价以 DeepSeek 官网实时显示为准。