返回行业动态
智能体与应用

OpenAI 开放 Agents API 公测:把 Codex 的托管执行框架变成开发者基础设施

9 月 10 日 OpenAI 宣布 Agents API 进入公开测试,把支撑 Codex 的托管执行框架以编程接口形式向全体开发者开放。该 API 提供上下文自动压缩、工具按需搜索与并行调用、多代理协同三项核心能力,并支持 OpenAI 托管沙箱、自有基础设施与九家合作伙伴沙箱三种运行位置。OpenAI 不单独收取平台费用,但沙箱按标准容器费率计费,长生命周期会话的成本需提前测算。

来源:OpenAI(官方开发者发布)原标题:Introducing the Agents API查看原文
抽象几何插画:深蓝色背景中多层同心圆弧与环状结构环绕一个发光核心,边缘有细小光点流动,寓意托管执行框架与多代理协同

图片来源:北京拓实科技原创(AI 生成)

发生了什么

9 月 10 日,OpenAI 宣布 Agents API 进入公开测试,把支撑其旗舰编程助手 Codex 的托管执行框架以编程接口形式向所有开发者开放。此前这套框架只服务 Codex 与企业版 ChatGPT,现在开发者无需额外平台订阅费用,仅按模型 Token、工具调用与沙箱计算量计费。

它替开发者承担了什么

Agents API 的核心设计是降低构建长时间运行智能体的工程门槛。开发者只需一次调用指定任务、模型、工具与运行环境,上下文管理、子代理编排与失败恢复由 OpenAI 侧维护,并随模型版本同步更新,避免每次模型升级都要重写执行框架。

  • 上下文自动压缩:会话接近上下文窗口上限时自动压缩早期内容,使智能体可连续运行数小时乃至数天,跨多个上下文窗口而不中断。
  • 工具搜索与并行调用:按需加载工具定义以降低 Token 消耗并保留 prompt 缓存,支持并行执行多个调用并在代码层过滤、合并结果。
  • 多代理协同:主代理把复杂任务拆解后下发给并行运行的子代理,各子代理独立维护上下文,最终由主代理汇总结果。
  • 运行位置可选:支持 OpenAI 托管沙箱、自有基础设施与合作伙伴沙箱三种模式,首发合作伙伴包括 Cloudflare、DigitalOcean、Modal、Oracle、Vercel 等九家,便于部署在自有 VPC 或指定密钥存储环境。

早期客户的量化反馈

OpenAI 披露的早期数据包括:SafetyKit 将案例审核工作流迁移后单案处理成本下降 60%;Hypha 把代理执行框架与沙箱解耦,代理响应失败率降低 86%;Ciridae 的评估分数从 0.71 提升至 0.85,同时延迟下降约 4 倍。OpenAI 同时称,仅靠执行框架层面的设置(保留推理链加上下文压缩),就能把 GPT-5.6 Sol 在 ARC-AGI-3 上的分数从 13.3% 提升到 38.3%,并让输出 Token 减少至六分之一。

需要打折扣的部分

以上均为厂商与客户自述数据,缺少第三方复现,应作为方向性参考而非基准结论。成本结构上也有需要注意的地方:沙箱容量按标准容器费率单独计费,而长生命周期会话意味着一台持续保温的容器,团队在架构阶段就应把这项开支计入。更实质的考量是锁定风险——一旦应用依赖某家供应商的会话格式、压缩策略与恢复语义,迁移成本可能高于更换模型本身。较稳妥的做法是让工具契约与业务状态尽量留在托管会话之外。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。