Agent 框架◆ AI 生成 · 已溯源
从模型到智能体:OpenAI 基于 Responses API 构建具备计算环境的智能体运行时

结论前置 / TL;DR
OpenAI 利用 Responses API、shell 工具与托管容器,构建了安全、可扩展的智能体运行时,支持文件操作、工具调用与状态管理。
技术架构:Responses API 作为智能体控制平面
OpenAI 将 Responses API(非 Chat Completions API)作为智能体的核心调度接口,使其能结构化生成 tool calls、state transitions 和文件 I/O 指令,而非仅输出自由文本。该 API 天然支持 JSON Schema 输出约束与多 step 执行流编排。
运行时核心组件
- Shell 工具:封装为标准化 tool definition,允许智能体在隔离沙箱中执行 bash 命令(如
curl、jq、python -c),并自动捕获 stdout/stderr 与退出码; - 托管容器:基于轻量级 Linux 容器(非 Docker-in-Docker),由 OpenAI 全托管,每个 agent session 分配独立、短暂生命周期的容器实例,挂载临时文件系统与内存限制(默认 2GB RAM / 1 vCPU);
- 状态管理:通过 Responses API 的
session_state字段实现跨 step 的键值存储(最大 1MB),支持序列化 Python dict 或 JSON,不依赖外部数据库。
安全与扩展性设计
- 所有容器默认禁用网络访问(需显式 opt-in via
allow_network: true),且禁止特权模式、设备挂载与 root 权限; - 文件上传/下载经 SHA-256 校验与大小限制(单文件 ≤ 50MB),自动清理 session 生命周期结束后的全部临时文件;
- 水平扩展通过 container pool + request queue 实现,实测支持 10K+ 并发 agent sessions,P99 延迟 < 3.2s(含冷启动)。