Agent编排里最贵的往往不是「会写长文」,而是「能不能又快又稳地做一次分类决策」。
10月6日,OpenAI将此前在DevDay限量预览的Decisions API推向公开测试。开发者通过专用端点POST /v1/decisions调用,当前仅支持模型gpt-6-luna。接口不生成散文式回复,而是针对开发者定义的问题返回类型化答案:谓词(条件为真的概率)、选择(固定选项及置信度)或评分(有序等级上的加权分)。输入可为文本,或含内联base64图像的消息;官方文档指出不支持托管图片URL与file ID。
性能与定价: OpenAI称该端点给出答案的速度约为通过Responses API调用同一模型的约10倍。定价为每百万输入token约0.10美元,且不收取输出token、缓存读/写费用;区域处理溢价与长上下文倍率仍适用。公司表示符合条件的客户可支持零数据保留与HIPAA场景,并提供美欧数据驻留选项。Playground已可试用该API。
典型用途: 官方与生态反馈列出的场景包括:在模型/工具/Agent之间做请求路由、大规模标注与打分、截图导航与内容分类、拦截高风险工具调用等。对构建多层Agent系统的团队,这相当于把「决策层」从聊天补全里拆出来,变成可计时、可计费的基础设施部件。
边界: 公测阶段模型名单仅限Luna;官方称未来数周有望转GA。准确率需独立评测验证。事实以OpenAI API文档与changelog为准。