更新:2026-08-14 — DeepSeek-V4-Pro-0813 正式版已于 8 月 13 日晚间在 App、网页端和 API 同步上线。本文基于官方 API 文档、官方定价页与多家媒体报道整理。
8 月 13 日晚,DeepSeek 没开发布会,公众号一条消息就把 V4 系列最后一块拼图补齐了:V4 Pro 正式版上线。同一天晚上,马斯克的 Grok 4.6 也来凑热闹,两家中美头部模型在智能体赛道正面对撞。
但对大多数开发者来说,真正值得关注的是另一件事:DeepSeek 官方宣布 8 月 17 日 0 时起,API 全面切换到峰谷定价——价格要涨了。 当前输入 0.435 美元、输出 0.87 美元的过渡价,是 V4 Pro 正式版历史上最便宜的窗口,只剩最后几天。
如果你在用 DeepSeek 做 Agent 开发、接 API,或者只是想在涨价前锁定便宜额度,这篇值得看完。
太长不看版
| 维度 | 结论 |
|---|---|
| 发布时间 | 2026-08-13 晚间,App/网页端/API 同步上线 |
| 模型规格 | V4-Pro 总参数 1.6T,上下文 1M,最大输出 384K |
| 核心变化 | 九项 Agent 基准平均提升约 25.7 分,逼近 Claude Fable 5 |
| 最大卖点 | 原生支持 OpenAI Responses API + Anthropic API + Codex 一键配置 |
| 当前价格 | 输入 $0.435 / 输出 $0.87(每百万 token,过渡价) |
| 涨价预告 | 8/17 0 时起峰谷定价:闲时 $0.66/$1.98,高峰 $1.32/$3.96 |
| 思考模式 | low / high / max 三档可调,默认开启 |
| 适合谁 | Agent 开发、长上下文处理、价格敏感的 API 重度用户 |
这版 V4 Pro 为什么值得关注
V4 系列 4 月 24 日发布预览版时,Flash 和 Pro 一起亮相。7 月 31 日 Flash 正式版先到,九项 Agent 基准反超预览版 Pro,直接把”Flash 打赢 Pro”的剧本演了一遍。现在轮到 Pro 自己转正。
正式版 DeepSeek-V4-Pro-0813 的规格:1.6 万亿总参数的 MoE 架构、100 万 token 上下文、单次最大输出 38.4 万 token——这个输出上限意味着它能把一整本长篇小说一次性吐完,做长文档生成、代码仓库级任务时不用像小模型那样分段拼。
社区流出的评测对比显示,V4-Pro-0813 相比预览版九项智能体测试平均提升约 25.7 分:Agent 编程基准 DeepSWE 从 12.8 直接干到 62.7,Terminal-Bench 拿到 87.9 分,贴着 Claude Fable 5 的 88 分走。HLE 测试里,不借助工具得分 42.7,用上工具后跳到 60.0——工具调用依赖度明显,但这也说明它的 Agent 链路是真的能干活。
生产环境的提升尤其明显。官方原话是”正式版增强了 Agent 能力,在生产环境中的性能表现提升尤为显著”。翻译一下:跑真实业务、长任务、多工具协作的场景,比预览版稳得多。
三档思考强度:按任务复杂度省钱
这次更新里最实用的一个功能:思考模式支持 low / high / max 三档,V4-Flash 和 V4-Pro 都有。
| 档位 | 适用场景 | 建议 |
|---|---|---|
| low | 简单问答、分类、信息提取 | 快速响应,token 消耗最低 |
| high | 日常 Agent 任务、工具调用 | 默认选择,性价比均衡 |
| max | 复杂推理、长程规划、代码工程 | 效果最强,token 消耗最高 |
以前 V4 的思考模式是”开或不开”二选一,现在给了中间档。简单任务用 low、日常用 high、硬骨头用 max——这直接关系到你的 API 账单,尤其是峰谷定价生效之后,思考强度选对了能省一截。
调用时在请求里带上参数即可(下面有示例)。
API 接入:Responses API + Codex 是最大亮点
V4 Pro 正式版在接口层面做了两件大事:
第一,原生支持 OpenAI Responses API 格式。 之前 V4 只兼容 Chat Completions 风格,现在 Responses API 也原生支持了。这意味着用 OpenAI 生态的项目,改个 base_url 和模型名就能切过来,不用重写调用逻辑。同时兼容 Anthropic API 格式(https://api.deepseek.com/anthropic)。
第二,针对性适配 Codex。 官方提供了 Codex 一键配置脚本,按文档跑一遍就能把 Codex 的模型后端切到 DeepSeek。对用 Codex 做编程 Agent 的人来说,这是把”贵模型”换成”便宜模型”的最短路径。
接入方式,OpenAI 兼容格式:
1 | curl https://api.deepseek.com/chat/completions \ |
模型名不用变——deepseek-v4-pro 这个参数对应的版本已经自动切到 0813,调用方式保持不变。想用三档思考强度,调 reasoning_effort 字段就行。
网页端和 App 用户更简单:打开 DeepSeek 的 App 或网页版,在模型选择里切到”专家模式“就能直接用上 V4 Pro 正式版,不需要任何配置。
峰谷定价:8 月 17 日涨价,当前是最后窗口
这是本文最想提醒你的事。北京时间 2026 年 8 月 17 日 0 时起,DeepSeek API 全面切换到峰谷定价,闲时价格为高峰时段价格的一半。 关键是:新价格比现在的过渡价高不少。
| 模型 | 当前价(过渡) | 8/17 后·闲时 | 8/17 后·高峰 |
|---|---|---|---|
| V4-Pro 输入 | $0.435 | $0.66 | $1.32 |
| V4-Pro 输出 | $0.87 | $1.98 | $3.96 |
| V4-Flash 输入 | $0.14 | $0.22 | $0.44 |
| V4-Flash 输出 | $0.28 | $0.66 | $1.32 |
(单位:每百万 token,缓存命中另有低价。高峰时段为 UTC 01:00-04:00 和 06:00-10:00,即北京时间 09:00-12:00 和 14:00-18:00。)
算一笔账:V4-Pro 现在的输出价 0.87 美元,闲时价 1.98 美元、高峰价 3.96 美元——高峰时段输出价涨到现在的 4.5 倍。对重度 API 用户来说,这不是小波动,是量级变化。
两个实用建议:
- 赶在 8 月 17 日 0 时前充值/囤额度,过渡价是历史最低。
- 涨价后把批量任务挪到闲时跑(北京时间 18:00 之后到次日早上),闲时直接砍半。DeepSeek 官方的意图很明确:用价格杠杆把流量错峰,夜里算力闲着也是闲着,半价卖给愿意挪时间的用户。
顺带一提,DeepSeek 中国区的调用价格本身就有汇率优势,即使涨价后闲时价,对比海外旗舰仍然便宜一大截——这也是它能在 OpenRouter 周调用量上连续霸榜的原因之一(8 月首周中国模型包揽全球 Token 调用量前四,DeepSeek-V4-Flash 以 8.83 万亿 Token 登顶)。
和同夜发布的 Grok 4.6 怎么选
8 月 13 日凌晨到晚上,Grok 4.6 和 DeepSeek V4 Pro 正式版先后落地,两家都押注 Agent 赛道。简单对比:
| 维度 | DeepSeek V4 Pro | Grok 4.6 | GPT-5.6 Sol | Claude Fable 5 |
|---|---|---|---|---|
| 综合智能指数 | 逼近第一梯队 | 61 分(追平 Sol) | 61 分 | 63 分 |
| API 输出价 | $0.87(过渡) | $6 | $30 | 更贵 |
| 上下文 | 1M | 长上下文 | 长上下文 | 长上下文 |
| 开源权重 | 否(API 为主) | 否 | 否 | 否 |
| 特色 | 国产低价 + Responses API | 长程 Agent + Cursor 生态 | 综合均衡 | 综合最强 |
DeepSeek 的定位一直很清晰:价格打到地板,性能贴着天花板。V4 Pro 的输出价是 Grok 4.6 的七分之一,即使 8/17 涨价后高峰价 3.96 美元,也只有 Grok 的 66%。预算敏感、跑长任务的团队,DeepSeek 依然是最极端的性价比选择。
谁适合现在就用 V4 Pro
- Agent 开发团队:原生 Responses API + Codex 适配,迁移成本最低,九项 Agent 基准逼近 Fable 5
- 长文档/代码库处理:1M 上下文 + 384K 输出,长程任务不用分段
- API 价格敏感用户:8/17 前是历史最低价窗口,错过就要等闲时半价
- 企业办公场景:金山办公灵犀专业版已首批接入,办公智能体链路完整
FAQ
Q1:V4 Pro 和 V4-Flash 怎么选? 看任务复杂度。Flash 便宜(过渡价输入 0.14/输出 0.28 美元)但能力弱一档,适合高频简单任务;Pro 贵但 Agent 能力和长上下文强得多,适合复杂工程和长程任务。预算允许且要跑 Agent,直接上 Pro。
Q2:8 月 17 日涨价是真的吗?会影响网页版吗? 是真的,官方定价页已公布峰谷价目表,8/17 0 时(北京时间)生效。受影响的是 API 调用价格;App/网页端的订阅和免费额度机制不变。
Q3:高峰期是什么时候? UTC 01:00-04:00 和 06:00-10:00,换算成北京时间是 09:00-12:00 和 14:00-18:00。想省钱就把批量任务挪到闲时(北京时间 18:00 后到次日 9 点前、中午 12-14 点)。
Q4:涨价前囤额度有用吗? 有用。余额按扣费时价格结算,8/17 前充值的余额不会因涨价贬值,反而等于锁定了当前低价。
Q5:Codex 怎么接 DeepSeek? 官方文档”快速开始-接入 Agent 工具-Codex”有一键配置脚本,按步骤跑完把模型后端切到 deepseek-v4-pro 即可,无需改代码。
Q6:思考模式三档有什么区别? low 适合简单问答(省 token),high 适合日常 Agent 任务(推荐默认),max 适合复杂推理和长程规划(效果最强但最贵)。涨价后按任务选档,能显著控制成本。
如果你要用 DeepSeek V4 Pro、Grok 4.6 或其他海外 AI 服务做长任务,稳定的跨境网络是前提——API 调用和网页版都依赖它。推荐几个长期在用的方案:
| 方案 | 特点 | 适合人群 | 直达 |
|---|---|---|---|
| 光速云 | IEPL 专线 + IEPL专线 多路复用,100+ 节点 | 主力推荐,开发者首选 | 前往 |
| 飞猫云 | IEPL 专线,入门到专业全档位 | 预算敏感的长任务用户 | 前往 |
| SS-ID | IEPL 专线,流媒体解锁,5 设备 | 办公 + 娱乐兼顾 | 前往 |
| MESL | IEPL 入门款,价格友好 | 轻量使用 | 前往 |
更多 DeepSeek 教程: DeepSeek V4-Flash 正式版指南 2026 | DeepSeek 入门指南 | DeepSeek 高阶组合玩法
最后更新:2026-08-14。定价以 DeepSeek 官网实时显示为准。