DeepSeek V4-Pro 正式版上线,Agent 接口与峰谷计费同步推进
DeepSeek 将 V4-Pro 转为正式版,并在 API 文档中明确 Responses API、工具调用、长上下文和思考强度控制。新的峰谷计费将在 8 月 17 日零时按北京时间生效,开发者需要同时复核兼容性与任务成本。
模型调用方不能只按旧单价估算预算;长流程 Agent 还要结合峰值时段、缓存命中、输出长度和任务成功率重新设计调度与回退策略。
正式版把 Agent 兼容性放到接口层
DeepSeek V4-Pro 正式版继续使用 deepseek-v4-pro 作为模型名,原有 API 基础地址也没有变化。对已经接入预览版本的应用,升级不需要重写认证和基础请求,但仍应重新验证输出结构、工具参数和长任务中的状态保持。
官方文档同时列出 Responses API、工具调用、JSON 输出和 Anthropic 格式接口,并提供 low、high、max 三档思考强度。模型发布因此不再只强调回答能力,而是直接面向代码 Agent、工具编排和持续执行工作流。
峰谷计费会改变真实任务成本
新价格在北京时间 8 月 17 日零时生效。高峰时段对应北京时间 09:00 至 12:00、14:00 至 18:00,其余时间为非高峰,非高峰单价是高峰的一半。批处理、离线分析和非紧急代码任务可以据此调整执行时间。
以 V4-Pro 为例,每百万 Token 的缓存未命中输入价格为非高峰 0.66 美元、高峰 1.32 美元,输出价格为非高峰 1.98 美元、高峰 3.96 美元。即使安排在非高峰,新价格也不能简单理解为旧价格打折,预算需要按新表重新计算。
长上下文需要和缓存、限额一起验证
1M 上下文和最高 384K 输出提供了更大的任务空间,但把更多材料一次性放进请求会增加延迟、费用和无关信息。更稳妥的做法仍是先检索和压缩上下文,再通过检查点保存长任务状态,避免失败后从头重放。
中转服务还需要验证不同线路是否完整支持 Responses API、工具调用和思考强度参数,并记录实际模型版本、缓存状态和重试过程。只有请求成功率而没有任务级观测,无法准确判断新版模型的成本与稳定性。
