2026 年 9 月 30 日——OpenAI 在旧金山举办的 DevDay 2026 开发者大会上发布 Decisions API,一个面向实时、低延迟分类与路由场景的接口,官方称单次调用约 150 毫秒即可返回结果,比通过常规 API 调用 Luna 快约 10 倍。该接口即日起面向部分 API 客户限量预览,官方计划在未来几天全面开放。
DevDay 2026 于当地时间 9 月 29 日在旧金山举行,OpenAI 在会上共发布约 25 项更新,包括全天候智能体 Dots、ChatGPT Space、GPT-6.1 Sol 模型、Ultrafast 高速服务和 Agents API 电脑操作等,Decisions API 是其中模型速度板块的预览项。OpenAI 同时宣布 ChatGPT 周活跃用户已超过 12 亿。
工作方式:从预设选项中做选择
与生成完整回复的对话接口不同,Decisions API 的调用方式是:开发者提供问题上下文和一组自定义问题,每个问题只附带有限的几个候选答案,由模型从中挑选一个返回,支持文字和图片两种输入。据 OpenAI 在会上介绍,把模型的能力集中在「做选择」这一件事上,可以换取接近即时的响应速度,同时保留看图、多语言和安全防护能力。
官方给出的典型用途包括三类:对内容做分类、对请求做路由、决定 Agent 下一步执行什么动作。由于接口返回的是从预设选项中选定的结果,开发者可以把返回值直接接入程序逻辑,无需再解析自然语言输出。
速度表现与背后模型
据 IT 之家报道,Decisions API 单次调用约 150 毫秒返回结果,比通过常规 API 调用 Luna 快大约 10 倍;按此折算,走常规接口完成同样一次判断约需 1.5 秒上下。该接口背后是 GPT-6 家族中的小模型 Luna,OpenAI 在现场公布的模型对齐评测中也单独列出了 GPT-6 Luna 一项。
| 项目 | 数据 |
|---|---|
| 发布场合 | OpenAI DevDay 2026,当地时间 2026 年 9 月 29 日,旧金山 |
| 单次判断延迟 | 约 150 毫秒(官方口径) |
| 相对速度 | 较常规 API 调用 Luna 快约 10 倍 |
| 输入类型 | 文字与图片 |
| 输出形式 | 从预设候选答案中选定一项返回 |
| 背后模型 | GPT-6 家族小模型 Luna |
| 典型用途 | 内容分类、请求路由、Agent 决策 |
| 发布状态 | 限量预览,官方称未来几天全面开放 |
数据来源:OpenAI DevDay 2026 主题演讲与官方回顾页、IT 之家报道,统计时间为 2026 年 9 月 30 日。
演示场景与后续开放安排
OpenAI 在主题演讲中现场演示了用 Decisions API 操作电脑预订机票,画面未做加速处理,每一步选择均快速完成。演示环节还提到,该接口可处理视觉输入,机器人方向的开发者期待用它让机器人根据看到的画面,以近实时的速度做出快速动作。
按官方说明,Decisions API 限量预览现阶段仅面向部分 API 客户开放测试,全面开放预计在未来几天内进行,具体的定价与调用配额截至发稿尚未在官方文档中单独公布。
举手提问