2026 年 9 月 10 日——DeepSeek 于 9 月 10 日正式发布 DeepSeek-V4.1-Flash 模型,并宣布自 9 月 14 日 12:00 起所有发往 deepseek-v4-pro 的请求将路由至 V4.1 Flash,API 价格同步下调至输入(缓存未命中)1 元、输出 2 元每百万 tokens。
V4.1 Flash 是 DeepSeek 新模型结构系列中最小尺寸的模型,采用全新架构,原生支持多模态视觉理解。官方表示,新架构的目标是提高能力上限、加快推理速度、提升吞吐量,并可扩展至更大的参数规模。开发者调用时将模型名设置为 deepseek-flash 即可使用新模型。
V4 Pro 请求将路由至 V4.1 Flash
据 DeepSeek 官方公告,经多方测试,V4.1 Flash 在性能、费用、速度、总用时等指标上全面超越 V4 Pro。基于这一结论,DeepSeek 计划有序下线 V4 Pro:自北京时间 2026 年 9 月 14 日 12:00 起,到未来 V4.1 Pro 上线之前,所有发往 deepseek-v4-pro 的请求将全部路由至 V4.1 Flash,并按 V4.1 Flash 的单价计费。
旧模型下线与兼容处理
随 V4.1 Flash 上线,旧版 V4 Flash 与 V4 Flash Vision Exp 已同步下线。为兼容存量调用,模型名 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 将暂时路由至 V4.1 Flash,调用方式保持不变。
性能跑分数据
官方文档列出的 V4.1 Flash 代表性评测成绩如下:
| 评测项目 | 得分 |
|---|---|
| GPQA Diamond | 90.9 |
| HLE | 36.8(带工具 63.9) |
| Codeforces | 3471 |
| MathArena Apex | 65.6 |
| Terminal-Bench 2.1 | 90.6 |
数据来源:DeepSeek 官方文档(api-docs.deepseek.com)。
价格与上下文规格
官方价格页显示,降价后的 API 价格如下(以百万 tokens 为单位,人民币计价):
| 项目 | deepseek-flash(V4.1 Flash) | deepseek-v4-pro |
|---|---|---|
| 输入(缓存命中) | 0.02 元 | 0.025 元 |
| 输入(缓存未命中) | 1 元 | 3 元 |
| 输出 | 2 元 | 6 元 |
| 上下文长度 | 1M tokens | 1M tokens |
| 最大输出 | 384K tokens | 384K tokens |
9 月 14 日路由生效后,使用 deepseek-v4-pro 模型名的调用同样按 V4.1 Flash 价格扣费,输入与输出价格相当于下调约 67%。另据 Flash 系列峰谷定价公告,自 9 月 10 日 12:00 起错峰时段价格进一步降低。
对于正在调用 deepseek-v4-pro 的项目,9 月 14 日中午后请求将静默切换至 V4.1 Flash,输出内容可能存在差异,建议开发者提前切换模型名并完成测试;如需使用 Pro 级别能力,需等待官方后续发布 V4.1 Pro。
举手提问