OpenAI Agents API开放公测,支持多智能体协作
「OpenAI 推出 Agents API 公测版,开发者一次调用即可创建云端智能体,运行代码、处理文件并执行跨上下文长任务。该服务复用 Codex 执行框架,支持托管与第三方沙盒,具备上下文压缩、工具搜索及多智能体并行能力。公测期间不额外收取 API 费用,仅按模型 Token 与工具计费。」
OpenAI 于当地时间 9 月 10 日宣布,Agents API 正式进入公测阶段。开发者可以通过 API 调用由 OpenAI 托管的云端 AI 智能体运行环境,只需一次 API 调用,就能创建具备生产环境能力的智能体。该服务复用了 Codex 背后的智能体执行框架与基础设施,开发者可以指定任务、模型、工具以及运行环境,从而构建能够执行多步骤任务的 AI 应用。
与传统的单轮对话接口不同,Agents API 中的智能体可以在云端运行代码、处理文件、保存中间结果,并持续执行跨越数小时甚至数天的长周期任务。OpenAI 负责维护智能体执行框架,开发者则可以把精力集中在自身应用所需的工具、知识和工作流程上,这在一定程度上降低了构建复杂智能体应用的门槛。
在运行环境方面,Agents API 既支持 OpenAI 托管的沙盒环境,也支持部署在开发者自有基础设施或合作伙伴提供的沙盒中。OpenAI 已与 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 和 Vercel 等服务商合作,提供不同的 CPU、GPU、内存及存储配置,开发者可以根据任务的资源需求灵活选择。
与此同时,OpenAI 还推出了 OpenAI Hosted Sandbox 服务。开发者无需自行搭建沙盒基础设施,即可为智能体配置文件、软件包、技能和插件。该环境用于运行代码、处理文件和生成产物,并采用与 Codex 和 ChatGPT 相同的沙盒基础设施,在隔离性与稳定性上保持一致。
长任务执行是此次发布的一大看点。Agents API 提供上下文管理能力,当会话接近上下文窗口限制时,系统会自动压缩早期信息,帮助智能体跨越多个上下文窗口继续执行任务,避免因上下文溢出而中断。该 API 还支持工具搜索与程序化工具调用,智能体可以按需加载工具定义,并行运行调用、串联操作或筛选结果,从而减少不必要的上下文占用。
多智能体支持同样值得关注。开发者可以将复杂任务拆分为多个独立子任务,由子智能体并行处理,再由主智能体负责协调和汇总结果。在 OpenAI 提供的示例中,开发者可以配置最多 3 个并发子智能体。这种分工协作的模式,为处理检索、分析、生成等多环节串联的复杂流程提供了新的实现路径。
从技术底座来看,Agents API 基于开源 Codex 执行框架打造。OpenAI 表示,开发者可以查看公开代码库,了解协调模型调用、工具和上下文的核心逻辑;而框架本身由 OpenAI 负责维护,并会随着模型更新持续改进智能体能力。这意味着开发者既能深入理解底层机制,又不必承担框架维护的长期成本。
目前 Agents API 已向所有开发者开放公测,公测期间不额外收取 API 使用费用,用户仅需按照所使用的模型 Token 和工具付费。OpenAI 表示,将在公测期间根据开发者反馈持续迭代,并逐步推进正式发布。对于正在探索智能体落地的团队而言,这是一次成本相对可控的验证机会。
来源:Heooo AI工具导航