GPT-6 Astra 艰难的第一周占据了各大头条,但对工程团队而言,更大的看点在于 OpenAI 围绕它交付了多少基础设施。Agents API 进入公测,将 Codex 运行框架作为托管服务对外提供。Codex CLI 0.154.0 借助 git 工作树,把这套终端工具变成了一个并行协作系统。一份质量复盘报告确认了三个降低 Astra 输出质量的缺陷,并触发了一次全面的用量重置。此外,受产能压力影响,OpenAI 暂停了 ChatGPT Pro 的新用户注册。
以下是本周的详细拆解。
1. Astra 质量复盘:三个缺陷,一次重置
到 9 月 11 日,关于 Astra「感觉不如发布周」的并排对比视频和开发者抱怨已经达到了临界点。Codex/ChatGPT 负责人 Tibo Sottiaux 于 9 月 12 日发布了一份复盘报告,确认了三个具体问题:
- 旧版技能误触发 —— 为前代模型编写的技能被过于激进地触发,或阻止 Astra 检查自己的工作。
- 上下文管理实验缺陷 —— 一项可选加入的实验导致提前停止和回复过期消息。约 4,000–5,000 名用户受影响。该实验已被禁用。
- 服务引擎配置错误 —— 调校不当的引擎降低了长尾流量的质量。相关引擎已被移除。
OpenAI 在 9 月 12 日至 13 日午夜为 Codex 和 Astra 用户发布了一次全面的用量重置。尚未解决的问题包括:关于 xHigh 推理消耗的用量比 Medium 更少的抱怨,以及用量上限比发布周收紧最高达 4 倍的报告。由于产能限制,ChatGPT Pro 的新订阅也被暂停。
给工程负责人的要点: 如果你的团队在最初 48 小时内就上线了 Astra 并形成了质量方面的判断,那么现在应重新评估。复盘中的修复实质性地改变了后续跟进的稳定性和对最新消息的追踪。
2. Agents API:把 Codex 运行框架变成托管服务
OpenAI 于 9 月 10 日发布 Agents API 公测版。这不是改名的 Assistants API —— 而是一个构建于 Codex 运行框架基础设施之上的全新服务,而该基础设施在内部支撑着 Codex CLI 和 ChatGPT。
OpenAI 负责管理的部分
会话、编排、上下文压缩、崩溃恢复、子代理协调、工具惰性加载以及 MCP 服务器连接。你只需提供代理定义(模型、指令、工具)、可选的沙箱环境以及业务逻辑。
沙箱选项
- OpenAI 托管沙箱 —— 与 Codex 和 ChatGPT 背后的基础设施相同。可通过文件、软件包、技能和插件进行配置。
- 自托管 —— 在你的环境中运行
codex exec-server。所有连接均为出站 WebSocket。 - 九家合作伙伴沙箱 —— Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop、Vercel。
两个企业级阻碍
- 公测期间仅限美国数据驻留。对于有数据驻留要求的欧盟/英国工作负载,这是一个硬性阻碍。
- 不支持零数据保留(ZDR) —— 在任何配置下都不支持,包括自托管沙箱。这一保留限制位于 API 层,而非沙箱层。即便把计算迁移到自己的 VPC,依然无法获得 ZDR。
定价很直接:Agents API 没有单独费用。你按标准模型 token 费率、托管工具调用费率以及 OpenAI 托管沙箱的容器时间付费。
评估: 对于已经绑定 OpenAI 模型栈的团队,Agents API 是从原型到生产的最快路径。运行框架与计算的分离 —— 工具执行运行在非特权沙箱中,而编排保持特权 —— 在架构上是合理的。但仅限美国驻留且不支持 ZDR,意味着合规姿态严格的企业应将其视为一个美国区域公测版,而非全球生产平台。
3. Codex CLI 0.154.0:并行工作树与内联问答
本周重磅 CLI 版本于 9 月 9 日发布,带来两项改变团队使用 Codex 会话方式的功能。
Git 工作树
--worktree 或 /worktree 会为新建或分叉的会话创建隔离的 git 检出。并行任务不再在同一个工作目录中相互冲突。一个修改了 package.json 的会话,不会与在同一仓库中运行测试的另一个会话发生冲突。工作树会话可以独立浏览和恢复。
内联问答
Codex 现在可以在继续工作的同时回答提问 —— 既可使用建议选项,也可输入自定义文本。此前,一次要求澄清的提示会阻塞整个会话。现在,代理在你按自己的节奏回复时仍在持续执行。
其他值得注意的新增内容
- Windows 共享后台服务器,带有守护进程生命周期命令和托管更新。
- MCP OAuth 处理 —— 连接会协调 token 刷新,并在刷新失败时提示登录验证。
- 启动信任加固 —— 工作区控制的辅助程序不再在信任建立之前运行。
- macOS 终端注入防护 —— 沙箱可阻止终端输入注入攻击。
- 插件刷新 —— 已有会话无需重启即可获取新安装的插件工具。
已弃用的 codex mcp-server 入口点(通过 stdio 将 Codex 作为 MCP 服务器运行)在 0.154.0 中已不再可用。使用该集成的团队需要迁移。
4. API 中的 GPT-Live-1:每分钟 0.05 美元的语音
OpenAI 的全双工语音到语音模型于 9 月 10 日进入 API。GPT-Live-1 可同时倾听和说话,具备自然的轮流发言和打断处理能力。该架构将语音层与后端推理分离 —— GPT-Live-1 处理语音,并将更深入的工作委托给任意后端文本模型(Astra、GPT-5.6 Luna 或第三方模型)。
其定价结构不同于 Realtime 系列模型:语音层每分钟 0.05 美元,按秒计费,外加后端模型的标准 API 费率。作为参考,gpt-realtime-2.1 每百万音频输入 token 收费 32 美元,每百万音频输出 token 收费 64 美元。在典型语音密度下,仅语音层一项,GPT-Live-1 就便宜约一个数量级。
并发范围从 25 个会话(第 1 层)到 500 个(第 5 层)。无免费层。
5. ChatGPT Images 2.5 与 Data Agent
两个值得关注的产品发布,面向构建内部工具的工程团队:
ChatGPT Images 2.5(9 月 8 日)随附一个 Sketch 工具,可内联绘制视觉参考;支持基于评论的编辑,用于对图像进行定向修改;相比 Images 2.0 延迟降低 50%。两个 API 模型 —— Flare(默认,快速)和 Sunburst(高级,精确)—— 定价为 GPT-Image-2 费率的 2 倍。ChatGPT、Codex 和 API 均已加入 SynthID 水印。
面向 ChatGPT Work 的 Data Agent(9 月 10 日)可连接 Snowflake、BigQuery、Redshift、Databricks、ClickHouse、MongoDB 和 Datadog,并能读取现有的 Power BI、Tableau 和 Sigma 仪表板。它以自然语言回答业务问题、调查指标变化的原因,并在审批工作流的支持下构建交互式仪表板。
6. 竞争格局:Anthropic 的收入领先优势扩大
本周的竞争数据印证了自春季以来不断积累的一种叙事:
- Anthropic 2026 年第二季度收入:116 亿美元,对比 OpenAI 的 67 亿美元
- Anthropic 年化运行率:650 亿美元,对比 OpenAI 的 400 亿美元以上
- 新增企业采购:Anthropic 65%,OpenAI 32%
- Anthropic 私募估值:9,650 亿美元,对比 OpenAI 的 8,520 亿美元
OpenAI 在总用户规模上仍然领先(周活跃用户超 9 亿,付费订阅者超 5,000 万),并在基准测试中保持领先地位。但采购势头已经发生转变。对于评估平台的团队而言,实际含义是:OpenAI 不再是企业的默认选择 —— 它是两个选择之一,而这一决策越来越取决于具体的工作负载特征,而非品牌。
下周展望
OpenAI DevDay 2026 定于 9 月 29 日在旧金山举行。预计会有 Agents API 的更新,ZDR 或国际数据驻留可能给出正式可用(GA)时间,以及可能公布模型路线图细节。对于当前正在 Agents API 上构建的团队来说,仅限美国和暂不支持 ZDR 这两项限制是值得关注的关键事项。
在 https://x.com/kkaminsk 关注每日 Codex 更新。Codex Weekly 系列每周一发布。