OpenAIは、自律的にタスクを実行するAIエージェントを構築・運用できる「Agents API」のパブリックベータ版を公開しました。CodexやChatGPT for Workを支える実行基盤と同じ仕組みを、シンプルなAPI経由で開発者に提供します。
この記事の要点
- Codexを支えるエージェント実行基盤をAPIとして一般開発者向けにベータ公開
- 長時間のセッションに対応するコンテキスト自動圧縮やサブエージェント並列処理を標準搭載
- API自体の追加利用料は不要で、使用したトークンやツールに応じた通常課金のみで利用可能
単一のAPIコールでエージェントを立ち上げ可能に
これまで自律型のAIエージェントを自作する場合、プロンプトの連結やツールの呼び出し管理、エラー発生時のリトライといった複雑な基盤を独自に構築する必要がありました。今回提供されたAgents APIでは、タスク、モデル、利用するツール、実行環境を指定して呼び出すだけで、本格的なエージェントセッションを立ち上げられます。
実行環境となるサンドボックスは、OpenAIがホストするセキュアな環境を利用できるほか、Cloudflare、DigitalOcean、Vercel、Modalなどのパートナー環境や自社のVPC環境を選択することも可能です。これにより、コードの実行やファイルの操作、中間成果物の保存といった作業を柔軟な構成で任せられます。
複数エージェントの並列処理と長時間の実行に対応
Agents APIの大きな特徴が、マルチエージェント連携とセッション維持の機能です。複雑なタスクを複数のサブエージェントへ分解して並列で作業させることができ、各サブエージェントが個別のコンテキストを持ちながら連携して調査やコーディングを進めます。
また、数時間以上に及ぶ作業でもコンテキストの上限に達しないよう、過去のやり取りを自動で要約・圧縮する仕組みが組み込まれました。MCP(Model Context Protocol)やWeb検索などの外部ツール呼び出しにも対応しており、必要なツール定義だけを動的に読み込むことでトークン消費を抑える工夫も施されています。
追加料金なしで利用できるパブリックベータ
Agents APIはすべての開発者に向けてパブリックベータとして提供が始まっています。API自体の追加利用料は設定されておらず、エージェントが消費したモデルのトークン代や利用したツールの料金のみで動かせます。基盤となるハーネスのロジックはオープンソースとしても公開されており、内部の挙動を確認しながらプロダクトへの組み込みを進められます。

コメント