产品简介
OpenAI Agents API 是 OpenAI 于 2026 年 9 月 10 日推出的云端智能体构建与运行接口,公开测试版面向所有开发者开放。它的核心思路是把驱动 Codex 的同一套 harness 与基础设施通过单次 API 调用开放出来,智能体在云端运行、由 OpenAI 完全托管,开发者只需专注任务、工具和工作流本身。
创建一个生产级智能体只需指定任务、模型(如 gpt-6-astra)和环境。运行环境提供三种选择:OpenAI 托管沙箱(与 Codex 和 ChatGPT 相同的基础设施,可配置文件、包、技能和插件)、部署在自有基础设施或 VPC 的自托管模式,以及 E2B、Modal、Cloudflare、Vercel、Daytona、DigitalOcean、Oracle 等沙箱合作伙伴。
底层的 Codex harness 是开源的,核心逻辑公开在 GitHub。关键能力包括长会话上下文自动压缩、按需加载工具定义以降低 token 用量的工具搜索、程序化的并行与链式工具调用(支持 MCP、自定义函数和内置工具如网页搜索),以及把复杂任务拆分给维护独立上下文的子智能体并行执行。
核心功能
- 单次调用创建云端智能体:指定任务、模型和环境即可创建生产级智能体,harness 维护由 OpenAI 负责,开发者专注工具与工作流。
- 三种运行环境:OpenAI 托管沙箱、自有基础设施自托管,以及 E2B、Modal、Cloudflare、Vercel 等沙箱伙伴,满足不同合规与部署需求。
- 长会话上下文管理:会话接近上下文上限时自动压缩早期上下文,支持跨多个上下文窗口的长时任务。
- 工具搜索与程序化调用:按需加载相关工具定义降低 token 成本,支持并行调用、链式操作、结果过滤合并,兼容 MCP、自定义函数与网页搜索等内置工具。
- 子智能体并行:复杂任务拆分给多个子智能体并行执行,各自维护独立上下文,主智能体负责协调汇总。
- 开源 harness:基于 GitHub 上开源的 Codex harness,核心逻辑可审计,随模型发布提供版本化的新能力。
适合谁用
以下类型的用户会特别受益于 OpenAI Agents API:
- 自动化研究与信息处理:让云端智能体持续跑资料收集、整理与汇总任务
- 客服与运营自动化:结合工具调用处理工单分类、数据核查与流程审批
- 长时数据处理管道:跨上下文窗口的压缩机制适合数小时级的批处理任务
- 多智能体协作系统:用子智能体并行拆解复杂项目,主智能体汇总结果
- 合规敏感部署:自托管或沙箱伙伴模式把执行环境放进自己的 VPC
优点亮点
- 复用驱动 Codex 的成熟 harness,稳定性经受过大规模生产验证
- 平台本身不额外收费,只按 token 与工具用量计费
- 托管、自托管、九家沙箱伙伴三种环境覆盖绝大多数部署需求
- 工具搜索按需加载定义,显著降低长工具列表场景的 token 成本
- 子智能体机制让复杂任务天然并行,各自上下文互不污染
- harness 开源可审计,避免黑盒依赖
价格与方案
公开测试版面向所有开发者开放,平台本身不收取额外费用,仅按智能体消耗的 token 和工具使用量计费。早期客户数据:Ciridae 评估分数从 0.71 提升至 0.85 且延迟降低四倍,SafetyKit 单案例成本降低 60%,Hypha 失败响应减少 86%。
总结与建议
Agents API 标志着智能体开发从框架拼装进入平台托管时代。它把 Codex 在生产环境打磨出来的 harness 直接开放成 API,上下文压缩、工具搜索、子智能体这些关键机制开箱即用,加上不收平台费只按用量计费的定价,对想快速上生产级智能体的团队是很低的门槛。公测期间值得接入试水。
版本演进
- OpenAI Agents API 公测版发布,Codex harness 开放为云端智能体 API (2026-09-10):驱动 Codex 的 harness 与基础设施通过单次 API 调用开放,智能体云端全托管运行。支持 OpenAI 托管沙箱、自托管与 E2B、Modal、Cloudflare 等沙箱伙伴,内置上下文压缩、工具搜索、程序化工具调用与子智能体并行,harness 开源。公测面向所有开发者,平台不额外收费,按 token 与工具用量计费。