结论先说:OpenAI DevDay 2026 之后,AI Agent 开发首先要的不是「再买一台更贵的 GPU 服务器」,而是分清三件事——循环在哪跑、代码在哪执行、哪些步骤必须落到 Mac 或自有网段。 截至 2026 年 9 月 27 日,大会定在 9 月 29 日,Keynote 还没开。本文不把未发生的发布写成事实。会后真正改变选型的底座,已经在 9 月 10 日落地:Agents API 公开测试把 Codex 那套 harness 收成托管循环,执行环境可以选官方 Linux 沙箱、合作方沙箱或自建。日程与直播入口见 DevDay 时间与看点。
依据:Agents API 概览、官方托管沙箱、自建沙箱、OpenAI 价目(容器、工具、gpt-6-astra / gpt-6-sol)。分层对照 2026 AI Agent 技术栈;Mac 与 GPU 拆开见 双轨部署。
- OpenAI 已确认: Agents API 公开测试,不另收一层接口费;付 token、工具和官方容器。循环由 OpenAI 跑,沙箱由你选。
- OpenAI 已确认: 官方沙箱是带 Python / Node / CLI 的 Linux 工作区;自建用
codex exec-server出站连 WebSocket。数据驻留目前只写美国,自建也不等于 Zero Data Retention。 - 不要写成事实: 9 月 29 日 Keynote 的新模型、新价、Agents API 转正式版。会后对照文档,再改默认模型和预算,不必等发布才选环境类型。
先看已确认事实
9 月 10 日的 Agents API 已经把「服务器」拆开了:
- Harness / 循环: 调模型、用工具、压上下文、撑长会话,由 OpenAI 在自己的基础设施上跑。你的应用只建 session、收事件。
- 执行环境:
openai_hosted、self_hosted,或对接 Blaxel、Cloudflare、Daytona、E2B、Modal、Vercel 等合作方;只要问答、不跑命令,还可以environment.type = none。 - 密钥: 应用用
OPENAI_API_KEY(agents 读写 + responses 写),放在沙箱外。自建执行器用单独的环境密钥,以CODEX_API_KEY注入,权限收窄。
官方沙箱工作目录是 /workspace,能装包、塞文件、出制品,网络可关、可限制域名。它不是 macOS,也不是你的 VPC。需要自己的镜像、私网或 GPU 时,走自建或合作方。需要 Xcode、公证、真机时,Linux 沙箱到此为止,步骤接到 Apple Silicon。清单见 M6 Mac mini 跑 AI Agent。
价目页写明:模型按所选模型的 API 价;内置工具按工具价;官方沙箱按标准容器价。公开测试「接口不另收费」只覆盖循环这一层,不包括 token 和容器。
你到底在买哪一层
「Agent 要什么服务器」常被写成同一张采购单。会后请拆成三张:
| 层 | 谁在跑 | 你要买什么 |
|---|---|---|
| 循环(harness) | OpenAI(Agents API)或你自建的 SDK 循环 | API 密钥和额度,不是一台新机器 |
| 执行(sandbox) | 官方 Linux 容器、合作方、或你机器上的 codex exec-server |
按分钟的容器,或一台能出站访问 api.openai.com 的 Linux / POSIX 环境 |
| 专用步骤 | macOS 构建、签名、真机;或自有 GPU / VPC | 固定的 Apple Silicon 节点,或合规区里的自建机。不要和沙箱写在同一张验收表上 |
办公笔记本可以当第一台执行器,不适合当唯一生产环境:密钥、磁盘和网络都和日常浏览绑在一起。会后若 Keynote 强调「换模型不用重写编排」,改的是循环层,不是让你把 Xcode 塞进官方沙箱。
本地怎么跑、什么时候停
Agents SDK 仍提供 Unix-local 和 Docker 客户端,适合当天把最小例子跑通。官方自建文档要求:POSIX 工作区、安装 @openai/codex@alpha、用收窄权限的环境密钥跑 codex exec-server --remote … --environment-id …。连接是出站:https://api.openai.com 注册环境,wss://codex-cloud-environments.chatgpt.com 收命令。公司防火墙只放行浏览器 HTTPS、拦 WebSocket,本地会「看起来连着、执行器从没 connected」。
本地够用的情况:
- 一个人改 prompt、看制品、确认工具调用顺序。
- 代码和密钥不能进官方容器,先在本机 Docker 里验收网络策略。
- 任务只碰当前仓库,不需要并行 4 个子 agent 各开一台机器。
本地该停的情况:
- 会话要过夜、要重连、要给同事复现同一
environment.id。 - 笔记本合盖、VPN 闪断,执行器掉线,session 还在 OpenAI 侧计时。
- iOS / macOS 签名、公证、真机:Docker Linux 过不了这关。
- 合规要求源码不出笔记本,但 Agents API 的会话状态仍在美国驻留——本地执行不能把接口变成 ZDR。官方写明自建沙箱也不让 API 获得 ZDR 资格。
云端四种部署
把「上云」写成四种,避免只听到「再买一台 64 核」:
- 官方托管沙箱: 应用建 session,OpenAI 配 Linux 工作区。适合先打通、脚本、出制品。网络默认出站,可关或白名单。密钥用 vault,不要把
OPENAI_API_KEY塞进沙箱。 - 合作方沙箱: 文档点名 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle Cloud、Runloop、Vercel。要现成 GPU、预览 URL、快照或凭证放在提供商侧时走这条。按各家时长和内存计,另加 OpenAI token。
- 自建 Linux: 你提供镜像和工作目录,每开一个 session 起一个执行器。机器要稳定出站,不必对公网开入站。适合 VPC、私有包源、不能进官方镜像的依赖。
- Apple Silicon 节点: 只承接官方沙箱做不了的步骤。和 GPU 训练机拆开,见 双轨部署。Zilmac 云端 Mac mini 按天 / 周 / 月租,参考入口 M4 16 GB 约 $96/月(以套餐页实时价为准)。
没有「一种云覆盖全部」。问答型 agent 甚至可以不要沙箱。会后若出现新的官方 GPU 规格,也只替换第 2 或第 3 层,不自动取消第 4 层的 Mac 验收。
成本怎么拆
账单至少四行。算法框架仍是 按任务算月成本,数字用 9 月 27 日价目页,会后以文档为准。
| 行 | 怎么计 | 数量级(截至 2026-09-27) |
|---|---|---|
| 模型 token | 所选模型的输入 / 缓存 / 输出 | gpt-6-astra 短上下文约 $10 / $50 每百万;gpt-6-sol 约 $2 / $10。超 272K 输入整单加价 |
| 内置工具 | 按次 + 检索内容 token | 网页搜索约 $10 / 千次;文件搜索约 $2.50 / 千次,存储 $0.10/GB·天(1 GB 免费) |
| 官方容器 | 按内存档、按分钟(最少 5 分钟) | 1 / 4 / 16 / 64 GB 对应 $0.03 / $0.12 / $0.48 / $1.92「每 20 分钟」标价,合格会话改按分钟 |
| 你的机器 | 自建 Linux、合作方时长、或云端 Mac | 与 token 独立。Mac 侧按租期,不按 token |
一张能算的月账(一人、工作日 20 次会话、每次约 5 万输入 + 1.5 万输出、官方 1 GB 沙箱平均 15 分钟):
- Astra: 440 次 × ($0.50 输入 + $0.75 输出) ≈ $550 token。
- 换成 Sol: 440 × ($0.10 + $0.15) ≈ $110 token。
- 1 GB 容器: $0.03 / 20 分钟 ⇒ 约 $0.0015/分钟 × 15 × 440 ≈ $10。
- 网页搜索 200 次: 约 $2。
在这个密度下,容器几乎可以忽略,模型选择决定月账单。若改成 16 GB 沙箱、会话拖到 1 小时、再开 4 路子 agent,容器会抬头,但仍很难超过 Astra 的 token。宣传里的「接口不另收费」救不了默认模型选错。
自建 Linux 省的是容器行,不是 token。云端 Mac 只应出现在「必须用 Xcode / 真机」的项目里;用它跑纯 Linux 脚本,是把按月租期去填按分钟就能结束的活。
怎么选,一张表
| 你的任务 | 循环 | 执行 | 专用机器 |
|---|---|---|---|
| 问答、查文档、MCP,不跑命令 | Agents API | none 或官方沙箱关网 |
不需要 |
| 改文件、跑测试、出制品 | Agents API | 官方 1–4 GB,或本机 Docker | 不需要 |
| 私有包源、VPC、密钥不出域 | Agents API | 自建或合作方,出站 WebSocket | 一台常开的 Linux,不必 GPU |
| 要 GPU 推理或训练旁路 | Agents API 或自建循环 | 合作方 GPU 或自有 GPU 机 | 与 Mac 构建机分开 |
| iOS / macOS 构建、签名、真机 | Agents API 只负责任务拆解 | Linux 沙箱到脚本为止 | 固定 Apple Silicon,见 部署清单 |
一个人团队:本机 Docker + 官方沙箱打通,默认模型用 Sol 或更便宜的档,Astra 留给长任务。小团队:加一台不关机的 Linux 执行器,Mac 步骤单独租节点。不要为了「会后可能有新 GPU」提前锁 12 个月大机器。
会后两周清单
9 月 29 日 Keynote 之后,按这个顺序改,而不是先下单:
- 对照文档,不要对照 PPT 型号。 记下新的默认模型 ID 和价,重算上面那张月账。
- 把现有工作流标成四类: 无沙箱 / 官方 Linux / 自建 / Mac。11 月 30 日前还在用的 AgentKit Builder、Evals,单独排迁移,不和新机器绑在一起。
- 跑通一条官方沙箱最小任务: 改文件、出制品,记下延迟和容器分钟数。
- 公司网试一次自建执行器: 确认 WebSocket 出站。失败就先留在官方沙箱,不要怪「服务器不够」。
- Mac 任务单独列表: 签名、Xcode、真机、公证。没有这四项,不要租云端 Mac。
- 默认模型降一档做对照: 同样 20 个任务,Astra 和 Sol 的质量和价差写下来,再决定谁当默认。
直播怎么进、时区怎么换,仍看 DevDay 前瞻。听完当天就能选环境类型;买哪一台机器,可以等价目页刷新。
循环可以托管;Xcode 和真机不能塞进 Linux 容器
Agents API 让你少买一台「编排服务器」。官方沙箱能跑脚本。一旦任务碰到签名和真机,把步骤放到固定的 Apple Silicon 上,不要和办公笔记本或 GPU 训练机绑在一起。
先分清四类工作流,再决定租不租节点。 — 查看云端 Mac 套餐
常见问题
DevDay 之后必须买 GPU 服务器才能做 Agent 吗?
不是。循环在 Agents API 上,官方执行环境是 Linux 容器。GPU 只在你自己要本地推理或训练旁路时才出现。多数应用先付 token 和容器分钟,不先买显卡。
只用笔记本电脑够不够?
够用来验收 prompt 和最小例子。不够当生产:合盖掉线、密钥和浏览混用,也不能做 iOS 签名。过夜会话放到官方或自建常开环境。
官方沙箱和自建比,哪边更便宜?
官方按内存档、按分钟,1 GB 往往每月只有几美元到十几美元。自建省容器费,但你付机器和运维。两边都付同样的 token。先把默认模型算对,再纠结容器。
什么时候才需要云端 Mac?
当任务包含 Xcode、公证、真机或必须在 macOS 上复现的 bug。纯 Python / Node 脚本用官方或自建 Linux。Agents API 的美国驻留和「自建 ≠ ZDR」对两种执行器都成立。