2026 年 7 月 31 日——DeepSeek 宣布,其 API 正式新增对 OpenAI Responses API 格式的支持(base_url 为 https://api.deepseek.com),开发者可通过标准接口将 DeepSeek 模型接入 OpenAI Codex 等 Agent 工具,只需修改少量配置即可完成对接。同期,deepseek-v4-flash 模型正式版开启 API 公测:DeepSeek-V4-Flash-0731 模型结构与 Preview 版本保持一致,仅重新进行后训练,Agent 能力大幅增强,上下文长度 1M、最大输出 384K。新增的 Responses API 支持语义化流式事件输出、function 工具调用与服务端联网搜索,现有 Responses API 客户端无需修改即可接入;该能力目前仅对 deepseek-v4-flash 开放,deepseek-v4-pro 预计于 2026 年 8 月初完成接入。
据 DeepSeek 官方更新日志,DeepSeek-V4-Flash-0731 的模型结构与 Preview 版本保持一致,仅重新进行后训练,Agent 能力大幅增强,基准测试表现优于 Preview 版本。据 DeepSeek 特别说明,公测目前仅限 API 端,App 和网页端暂不支持;DeepSeek-V4-Pro 模型预计于 2026 年 8 月初完成接入。
1. 正式接入 Codex
针对开发者接入 Codex 的需求,DeepSeek API 现已支持 Responses API 格式,开发者修改少量配置后即可在 Codex 中直接调用 DeepSeek 模型。代码调用示例如下:
from openai import OpenAI
client = OpenAI(api_key="<your DeepSeek API Key>", base_url="https://api.deepseek.com")
response = client.responses.create(
model="deepseek-v4-flash",
instructions="You are a helpful assistant.",
input="Hi, how are you?",
)
print(response.output_text)
2. 流式输出升级
Responses API 支持语义化流式输出:设置 stream: true 后,响应以带事件类型(event 字段)和递增序号(sequence_number)的 SSE 事件序列返回。与 Chat Completions 不同,其流以 response.completed、response.incomplete、response.failed 等语义化事件收尾,不再返回 data: [DONE] 消息。事件类型覆盖文本增量、思维链、Function 调用、服务端联网搜索等环节。
3. 兼容性与迁移成本
据 DeepSeek 官方公告,Responses API 兼容性要点如下:
- 高度兼容:响应对象与 OpenAI Responses API 结构一致;不支持的参数会被静默忽略而不报错,现有 Responses API 客户端无需修改即可接入。
- 函数与联网搜索:支持
function工具及服务端执行的web_search、web_search_2025_08_26;针对 Codex 兼容,还支持apply_patch自定义工具。 - 多工具与模型能力:支持
tool_choice、reasoning.effort、top_logprobs、text.format等,并行工具调用始终开启。 - 无状态架构:API 采用无状态设计,不支持
previous_response_id、conversation、store等参数;输入超出上下文窗口时返回 400 错误。 - 上下文缓存:上下文缓存自动管理,
usage字段返回cached_tokens(命中缓存的输入 token 数)与reasoning_tokens(思维链 token 数)。
4. 模型参数与价格
以下参数与价格据 DeepSeek 开放平台文档整理,价格以百万 tokens 为单位:
| 模型细节 | deepseek-v4-flash | deepseek-v4-pro |
|---|---|---|
| BASE URL(OpenAI 格式) | https://api.deepseek.com | https://api.deepseek.com |
| BASE URL(Anthropic 格式) | https://api.deepseek.com/anthropic | https://api.deepseek.com/anthropic |
| 模型版本 | DeepSeek-V4-Flash-0731 | DeepSeek-V4-Pro |
| 思考模式 | 支持非思考与思考模式(默认) | 同左 |
| 上下文长度 | 1M | 1M |
| 输出长度 | 最大 384K | 最大 384K |
| 功能 · JSON Output | 支持 | 支持 |
| 功能 · Tool Calls | 支持 | 支持 |
| 功能 · Responses API | 支持 | 暂不支持 |
| 功能 · Anthropic API | 支持 | 支持 |
| 功能 · 对话前缀续写(Beta) | 支持 | 支持 |
| 功能 · FIM 补全(Beta) | 仅非思考模式支持 | 仅非思考模式支持 |
| 价格 · 百万 tokens 输入(缓存命中) | 0.02 元 | 0.025 元 |
| 价格 · 百万 tokens 输入(缓存未命中) | 1 元 | 3 元 |
| 价格 · 百万 tokens 输出 | 2 元 | 6 元 |
| 并发限制 | 2500 | 500 |
注 1:Responses API 目前仅支持
deepseek-v4-flash模型,deepseek-v4-pro预计于 2026 年 8 月初接入。注 2:上表价格为平时价格。DeepSeek API 执行峰谷定价机制,高峰时段价格为平时价格的 2 倍,适用于所有计费项,具体高峰时段定义以官方正式通知为准。
注 3:并发限制以官方文档为准。
5. 后续进展(截至 2026 年 8 月 12 日)
据 2026 年 8 月 6 日媒体报道,DeepSeek 发布公告,计划近期整体上调 API 服务定价,预计涨幅较大,具体方案以正式通知为准。报道同时指出,DeepSeek API 目前执行峰谷定价机制,高峰时段(北京时间工作日 9:00-12:00、14:00-18:00)价格为平时价格的 2 倍。业内人士分析认为,此次涨价预告可能意味着 V4-Pro 正式版即将上线。
更多关于 Responses API 的事件列表、参数兼容性明细及接入指南,可查阅 DeepSeek 开放平台官方文档(https://api.deepseek.com)。
举手提问