2026 年 7 月 31 日——DeepSeek 宣布,其 API 正式新增对 OpenAI Responses API 格式的支持(base_urlhttps://api.deepseek.com),开发者可通过标准接口将 DeepSeek 模型接入 OpenAI Codex 等 Agent 工具,只需修改少量配置即可完成对接。同期,deepseek-v4-flash 模型正式版开启 API 公测:DeepSeek-V4-Flash-0731 模型结构与 Preview 版本保持一致,仅重新进行后训练,Agent 能力大幅增强,上下文长度 1M、最大输出 384K。新增的 Responses API 支持语义化流式事件输出、function 工具调用与服务端联网搜索,现有 Responses API 客户端无需修改即可接入;该能力目前仅对 deepseek-v4-flash 开放,deepseek-v4-pro 预计于 2026 年 8 月初完成接入。

据 DeepSeek 官方更新日志,DeepSeek-V4-Flash-0731 的模型结构与 Preview 版本保持一致,仅重新进行后训练,Agent 能力大幅增强,基准测试表现优于 Preview 版本。据 DeepSeek 特别说明,公测目前仅限 API 端,App 和网页端暂不支持;DeepSeek-V4-Pro 模型预计于 2026 年 8 月初完成接入。

1. 正式接入 Codex

针对开发者接入 Codex 的需求,DeepSeek API 现已支持 Responses API 格式,开发者修改少量配置后即可在 Codex 中直接调用 DeepSeek 模型。代码调用示例如下:

from openai import OpenAI

client = OpenAI(api_key="<your DeepSeek API Key>", base_url="https://api.deepseek.com")

response = client.responses.create(
    model="deepseek-v4-flash",
    instructions="You are a helpful assistant.",
    input="Hi, how are you?",
)

print(response.output_text)

2. 流式输出升级

Responses API 支持语义化流式输出:设置 stream: true 后,响应以带事件类型(event 字段)和递增序号(sequence_number)的 SSE 事件序列返回。与 Chat Completions 不同,其流以 response.completedresponse.incompleteresponse.failed 等语义化事件收尾,不再返回 data: [DONE] 消息。事件类型覆盖文本增量、思维链、Function 调用、服务端联网搜索等环节。

3. 兼容性与迁移成本

据 DeepSeek 官方公告,Responses API 兼容性要点如下:

  • 高度兼容:响应对象与 OpenAI Responses API 结构一致;不支持的参数会被静默忽略而不报错,现有 Responses API 客户端无需修改即可接入。
  • 函数与联网搜索:支持 function 工具及服务端执行的 web_searchweb_search_2025_08_26;针对 Codex 兼容,还支持 apply_patch 自定义工具。
  • 多工具与模型能力:支持 tool_choicereasoning.efforttop_logprobstext.format 等,并行工具调用始终开启。
  • 无状态架构:API 采用无状态设计,不支持 previous_response_idconversationstore 等参数;输入超出上下文窗口时返回 400 错误。
  • 上下文缓存:上下文缓存自动管理,usage 字段返回 cached_tokens(命中缓存的输入 token 数)与 reasoning_tokens(思维链 token 数)。

4. 模型参数与价格

以下参数与价格据 DeepSeek 开放平台文档整理,价格以百万 tokens 为单位:

模型细节 deepseek-v4-flash deepseek-v4-pro
BASE URL(OpenAI 格式) https://api.deepseek.com https://api.deepseek.com
BASE URL(Anthropic 格式) https://api.deepseek.com/anthropic https://api.deepseek.com/anthropic
模型版本 DeepSeek-V4-Flash-0731 DeepSeek-V4-Pro
思考模式 支持非思考与思考模式(默认) 同左
上下文长度 1M 1M
输出长度 最大 384K 最大 384K
功能 · JSON Output 支持 支持
功能 · Tool Calls 支持 支持
功能 · Responses API 支持 暂不支持
功能 · Anthropic API 支持 支持
功能 · 对话前缀续写(Beta) 支持 支持
功能 · FIM 补全(Beta) 仅非思考模式支持 仅非思考模式支持
价格 · 百万 tokens 输入(缓存命中) 0.02 元 0.025 元
价格 · 百万 tokens 输入(缓存未命中) 1 元 3 元
价格 · 百万 tokens 输出 2 元 6 元
并发限制 2500 500

注 1:Responses API 目前仅支持 deepseek-v4-flash 模型,deepseek-v4-pro 预计于 2026 年 8 月初接入。

注 2:上表价格为平时价格。DeepSeek API 执行峰谷定价机制,高峰时段价格为平时价格的 2 倍,适用于所有计费项,具体高峰时段定义以官方正式通知为准。

注 3:并发限制以官方文档为准。

5. 后续进展(截至 2026 年 8 月 12 日)

据 2026 年 8 月 6 日媒体报道,DeepSeek 发布公告,计划近期整体上调 API 服务定价,预计涨幅较大,具体方案以正式通知为准。报道同时指出,DeepSeek API 目前执行峰谷定价机制,高峰时段(北京时间工作日 9:00-12:00、14:00-18:00)价格为平时价格的 2 倍。业内人士分析认为,此次涨价预告可能意味着 V4-Pro 正式版即将上线。

更多关于 Responses API 的事件列表、参数兼容性明细及接入指南,可查阅 DeepSeek 开放平台官方文档(https://api.deepseek.com)。