AI导航

OpenAI Decisions API 开启公测:判断类请求快约十倍

AI资讯
2 min read
0 次阅读

OpenAI Decisions API 是 OpenAI 在 2026 年 10 月 6 日通过官方开发者账号宣布进入公开测试的新接口,官方文档同步上线。它不生成段落,只回答定型问题:给定一段文本或一张图片,返回某个条件成立的概率、从固定选项里挑出的一个答案,或者按量表算出的分数。官方称它的返回速度约为 Responses API 的 10 倍,数周内将正式可用(GA)。

三种问题类型,覆盖大多数判断类需求

Decisions API 的请求由三部分组成:模型、共享输入和一组问题。目前唯一可选的模型是 gpt-6-luna,端点为 POST /v1/decisions。问题分三类:predicate 判断条件是否成立,返回 0 到 1 的概率,适合查图片里的商品有没有破损、一段文本和某个主题是否相关;choice 从开发者给定的选项中选一个,并附带每个选项的概率和整体置信度,适合把客诉分流到计费、技术或物流部门;score 按有序等级打分,返回概率加权后的平均分,可以落在两个等级之间,适合评估工单严重程度。多个互不依赖的问题可以放进同一次请求共用同一份输入,答案依赖前一步结果的,则要拆成多次请求。

和结构化输出怎么分工,价格怎么算

OpenAI 在文档里把边界划得很清楚:需要概率、选项或分数这类定型答案时用 Decisions API;需要按自家 JSON 结构抽取字段或生成解释文字,继续用 Responses API 的结构化输出;需要模型发起工具调用,则用函数调用。计费只按输入 token 收取,gpt-6-luna 为每 100 万输入 token 0.10 美元,没有缓存读写和输出 token 费用。图片输入目前只接受内嵌的 base64 数据,不支持外链 URL 和 file_id,这一点在迁移旧流程时容易踩坑。合规方面,它支持符合条件客户的零数据保留(ZDR)与 HIPAA 场景,数据驻留覆盖美国和欧洲。

哪些团队值得先试

最适合先试的是本来就在用大模型做分类、审核和路由的团队:内容审核的通过与拦截、工单分诊、线索优先级排序这类任务过去要用生成式接口拿一段文本再解析,现在可以直接拿概率定阈值。需要注意的是,官方建议用自家标注样本校准阈值,因为误报和漏报的代价因业务而异;公测阶段也只有 gpt-6-luna 一个模型可选,判断质量是否够用,必须拿真实业务样本实测后再决定是否替换现有链路。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。