OpenAI Agents API 正式开放:Codex 的 Agent 编排能力,现在人人可用
这是什么?
OpenAI 在 ChatGPT 和 Codex 内部运行了一套复杂的 Agent 编排系统:管理长会话、自动压缩上下文、启动子 Agent 并行处理任务、在沙盒中执行代码、崩溃后恢复状态。9月10日,OpenAI 把这个系统通过 Agents API 正式开放给所有开发者,且没有额外费用。
这意味着,你不再需要自己搭建会话管理、沙盒环境、崩溃恢复、子 Agent 协调这一整套基础设施——一通 API 调用就能起步。
核心能力一览
🔑 六大核心功能
- 托管会话管理:API 自动处理上下文管理,超过阈值时自动压缩,避免每次手动截断
- 沙盒执行:支持 OpenAI 托管沙盒(内置 Linux 环境)或自带沙盒,代码执行无需自己搭环境
- 子 Agent 编排:一个主 Agent 可以派生子 Agent 并行完成任务,再汇总结果
- MCP 工具支持:原生兼容 Model Context Protocol,可直接接入第三方工具
- 崩溃恢复:Agent 运行中断后自动从最近检查点恢复,无需重头开始
- GPT-Live-1 语音集成:可搭配全双工语音模型,打造语音驱动 Agent
定价:没有隐藏费用
Agents API 本身不收取额外费用,仅按标准 token 价格计费。配套 GPT-Live-1 语音模型 API 定价为 $0.05/分钟(全双工,可同时听和说),这是 OpenAI 将 ChatGPT Voice 中的体验开放给开发者的关键一步。
后端模型怎么选?
Agents API 本身只是一个"编排层",不负责推理。开发者需要根据任务复杂度搭配不同的后端模型:
这种灵活组合让 Agent 既能省钱(简单任务用 Luna),也能在需要时调用最强模型(Astra)。OpenAI 官方示例中,GPT-Live-1 搭配 GPT-6 Astra 在 Tau3 语音 Agent 基准测试中排名 第一。
为什么这件事很重要?
对开发者而言:这是 Agent 开发门槛的大幅降低。过去要自建会话管理、沙盒、崩溃恢复、子 Agent 协调等一整套基础设施,现在一通 API 调用就能获得同样能力。
对行业而言:这是 OpenAI 首次在平台层面公开其 Agent 基础设施。此前这些能力只有 Codex 和 ChatGPT Work 独占,现在所有开发者都能用。这对 Anthropic 的 MCP 生态、Claude Code、以及开源 Agent 框架(如 LangChain、AutoGen)都是一次直接竞争。
对语音 Agent 场景:GPT-Live-1 的全双工能力让语音交互不再需要"你说完 → AI 想 → AI 说"的串行模式,用户可以随时打断,Agent 能边听边说,延迟低于 300ms。这对客服、教育、车载等场景意义重大。
与已有文章的关系
本文是 GPT-Live-1 语音模型 API(id=749,9/11发布)的姊妹篇。上一篇聚焦语音层($0.05/分钟,全双工对话),本文聚焦编排层(Agents API,Agent 基础设施)。两者结合,才是 OpenAI 完整的语音 Agent 解决方案。
- OpenAI 官方博客:Build more natural voice experiences with GPT‑Live‑1 in the API(2026-09-10)
- MarkTechPost:OpenAI Launches the Agents API in Public Beta(2026-09-10)
- AiCybr:OpenAI Agents API: Codex Harness, Hosted Sandboxes, Subagents and Pricing(2026-09-11)
- explainx.ai:GPT-Live-1 API: OpenAI Voice Model for Developers(2026-09-11)
- Progressive Robot:GPT-Live-1 API and Agents API Beta: Essential Risks to Avoid(2026-09-11)