GPT-5.6 发布后的尘埃正在落定,本周的焦点从破坏性自主行为转向平台整合。OpenAI 发布了 Codex CLI v0.145.0——自 ChatGPT 桌面端合并以来最大的功能版本——带来稳定化的多智能体协作、跨工具迁移导入器和音频输入。15 个旧模型快照(包括所有 Codex 品牌模型)在 7 月 23 日按计划关闭。ChatGPT Work 推出了小企业计划。而 Google 的 Gemini 3.5 Pro 第三次错过发布期限,改以 Gemini 3.6 Flash 作为过渡方案。
以下是 OpenAI 模型、Codex 生态和更广泛竞争格局中本周最重要内容的拆解。
1. Codex CLI v0.145.0——多智能体 V2、迁移和音频
7 月 21 日的版本是自 v0.144.0 将 Codex 合并到 ChatGPT 桌面应用以来功能最丰富的更新。它在三个领域同时发力:智能体协作、工具迁移和输入方式。
多智能体 V2 稳定化。 可选的多智能体体验从预览升级为稳定版。根会话现在可以生成可配置的子智能体——每个拥有自己的模型、推理级别、并发限制和沙箱配置——使用 spawn_agent、send_input、resume_agent、wait_agent 和 close_agent。角色和导航已从早期预览中恢复,实现被归类为稳定版但默认仍处于禁用状态。对工程团队而言,这意味着单个 Codex 会话现在可以跨不同模型层级并行工作——Sol 用于规划,Luna 用于机械编辑——无需外部编排。
/import 扩展至 Cursor 和 Claude Code。 Codex 现在可以检测并迁移 Cursor 和 Claude Code 的设置、MCP 服务器、插件、会话、命令和项目级记忆。插件命令在导入时转换为 Codex 技能。迁移是单向的——Codex 中的更改不会回写——且 Claude Code 的聊天对话不包含在内,仅迁移智能体配置和最近会话。导入器在 TUI 中本地运行,拒绝远程会话,并将会话导入限制为 30 天内更改的 50 个会话。这对于评估迁移到 Codex 的团队来说,大幅降低了切换成本。
实验性分页线程历史。 线程历史现在支持高效恢复、搜索、持久化名称、子智能体历史和记忆集成。这解决了一个长期痛点:长对话重新加载昂贵且无法搜索。该功能标记为实验性。
音频输入和流式实时 V3。 本地音频格式现在可以作为输入,工具输出也可以包含音频。流式实时 V3 对话已引入,但在标记注册表中仍处于开发阶段。
Amazon Bedrock 登录(实验性)。 自定义端点和身份验证支持上线,GPT-5.6 Sol 作为默认 Bedrock 模型。这为 AWS 原生团队提供了无需通过 OpenAI API 直接路由即可使用 Codex 的第一类路径。
可靠性改进。 编辑早期提示或重试安全缓冲轮次现在会创建适当的上下文分支,而不是改变原始对话。Windows 沙箱获得原生 exec-server 支持和正确引用的钩子命令。MCP 启动截止时间覆盖客户端创建,OAuth 发现阶段不再阻塞启动,刷新操作已序列化。
2. 十五个模型退役——包括所有 Codex 快照
7 月 23 日,OpenAI 在单批次中关闭了 15 个模型快照。最关键的是:所有 Codex 品牌的 API 模型现已退役。
退役的 Codex 模型: gpt-5-codex、gpt-5.1-codex、gpt-5.1-codex-max、gpt-5.1-codex-mini 和 gpt-5.2-codex 全部映射到 gpt-5.5(mini 变体映射到 gpt-5.4-mini)。如果你的生产代码调用了这些端点,请求现在将直接失败。
退役的聊天模型: gpt-5-chat-latest 和 gpt-5.1-chat-latest 都合并到 gpt-5.5。
计算机使用和搜索: computer-use-preview-2025-03-11 迁移到 gpt-5.4-mini。搜索预览模型(gpt-4o-search-preview、gpt-4o-mini-search-preview)也映射到 gpt-5.4-mini。
深度研究: o3-deep-research 和 o4-mini-deep-research 都合并到 gpt-5.5-pro,价格为每百万 token $30 输入 / $180 输出——对自动化研究管道来说是显著的成本增加。
音频: gpt-4o-mini-tts-2025-03-20 迁移到 gpt-4o-mini-tts-2025-12-15,gpt-audio-mini-2025-10-06 映射到 gpt-audio-1.5。
工程团队行动项: 审计代码库中是否有退役列表中硬编码的模型 ID。将 API 调用更新为推荐替代。特别关注深度研究管道——从 o3-deep-research 到 gpt-5.5-pro 的成本跳跃约为输出 6 倍。下一批退役将于 10 月 23 日进行,涵盖 GPT-3.5、GPT-4、GPT-4 Turbo、GPT-4.1 Nano、GPT-4o 和多个 o 系列模型。
3. ChatGPT Work——小企业计划和企业成熟化
ChatGPT 小企业计划(7 月 21 日)。 OpenAI 推出了围绕 ChatGPT Work 构建的综合中小企业计划。包括面向会计、营销和电商工作流的实战虚拟培训研讨会;通过 OpenAI Academy 团队在美国各地举办的线下 AI 学院;可直接上传到 ChatGPT Work 的交互式指南;以及与 Dropbox、Shopify、Intuit、Slack、Atlassian 和 Wix 的合作伙伴集成。五场免费直播课程已从 7 月 30 日排期至 8 月 27 日。ChatGPT Work 由 GPT-5.6 驱动,在所有订阅计划中可用——不锁定在企业层级。该平台已达到约 1000 万 ChatGPT Work 和 Codex 合并用户。
企业治理更新。 ChatGPT Enterprise 和 Edu 工作空间在 Global Admin Console 中获得了额度使用分析和更新支出控制。工作空间智能体于 7 月 6 日转向基于 token 的定价——额度消耗现在基于输入 token、缓存输入 token 和输出 token,而非固定成本。ChatGPT for PowerPoint 对 Business 工作空间达到正式可用,Enterprise 客户的基于 token 定价在 8 月 6 日后生效。
服务账户 API 密钥管理。 Go SDK v3.44.0(7 月 18 日)通过 /organization/projects/{project_id}/service_accounts/{service_account_id}/api_keys 端点增加了对服务账户 API 密钥的编程管理。Admin 密钥——与标准 API 密钥不同,范围限定于组织管理——现在供工作空间所有者和管理员使用,可连接工具到 ChatGPT 和 Codex 管理 API,具有基于角色的权限(全部、只读、受限)。
桌面端聊天/工作分离。 ChatGPT 桌面应用在 7 月 16 日添加了聊天和工作模式之间的全局切换器。工作对话在网页、移动端和桌面端同步。自定义指令限制从 1,500 字符增加到 5,000 字符,适用于 Plus、Enterprise、Business 和 Education 用户。
4. Assistants API——倒计时 33 天
8 月 26 日关停距今还有 33 天。没有新的迁移工具发布。推荐的 7 月中旬内部截止日期已过。
关键提醒: 没有自动化迁移工具,也不会发布。没有 Thread 导出——立即提取对话历史。迁移期间的静默失败很常见:200 OK 响应但上下文丢失、grounding 为空或流中断。Responses API 已达到完全功能对等,包括深度研究、MCP 工具连接和计算机使用。Azure OpenAI 遵循同一时间线。Zapier 已弃用所有使用 Assistants API 的 ChatGPT 步骤——这些工作流将在 8 月 26 日停止工作。
对于仍在使用 Assistants API 的团队: 将此视为 P0 迁移。清点所有 beta.assistants、beta.threads 和 beta.threads.runs 调用。将 threads 映射到 Conversations,runs 映射到 Responses。为流式传输、后台工作、重试和取消构建回归测试。在切换生产流量之前,先运行抑制副作用的影子切换。
5. 竞争格局——Google 停滞、xAI 开源
Google——Gemini 3.5 Pro 第三次错过期限
Gemini 3.5 Pro 未发布。Sundar Pichai 在 Google I/O 上公开承诺 6 月交付的模型现已错过三个期限:原始 6 月窗口、7 月 17 日目标以及 7 月中的修订估计。Google 官方模型目录仍未列出 Gemini 3.5 Pro——Pro 层级仍为 Gemini 3.1 Pro(预览版)和 Gemini 2.5 Pro(稳定版)。
Bloomberg 报道称内部编码基准未达标且关键研究人员已离职。Google 唯一的公开声明:“Gemini 3.5 Pro 目前正在与合作伙伴测试中,我们计划在准备好后广泛发布。“没有日期、没有基准、没有定价。
替代发布的版本: Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 于 7 月 21 日正式可用。Gemini 3.6 Flash 定价为每百万 token $1.50/$7.50,知识截止日期为 2026 年 3 月,可在 Google AI Studio、Android Studio、Google Antigravity、GitHub Copilot 和 Gemini 应用中使用。专用 Gemini 3.5 Flash Cyber 漏洞检测模型处于受限试点阶段。
xAI——Grok Build 在数据争议后开源
xAI 于 7 月 15 日在 Apache 2.0 下开源了 Grok Build——一个 130 万行 Rust 代码库,涵盖智能体循环、工具实现、终端 UI 和扩展系统。此次发布源于数据外泄争议:用户发现 grok CLI 默认将包括 SSH 密钥和密码管理器数据库在内的整个目录上传到 xAI 的 Google Cloud 存储桶。xAI 禁用了上传行为,删除了保留的数据,并发布了完整源代码以恢复信任。
对开发者的意义: Grok Build 是唯一完全开源并具有公共线协议(Agent Client Protocol)的主要编码智能体框架。它支持 MCP 服务器、技能、插件和钩子——可直接复用现有 Claude Code MCP 配置。但外部贡献不被接受;这是一个源透明发布,不是社区项目。默认模型 Grok 4.5 定价为每百万 token $2/$6——比 Opus 4.8 或 GPT-5.6 Sol 便宜得多。
Anthropic——Claude Code 加速
Claude Code 于 7 月 21 日发布 v2.1.217,保持与 Codex 的发布节奏同步。近期亮点包括 /fork 后台会话克隆、Web 搜索和子智能体会话级上限(各 200)、长时间调用 MCP 自动后台化,以及权限分析器全面检修采用失败即关闭行为。Claude Sonnet 5 仍是默认模型,具有 1M token 上下文窗口,8 月 31 日前每百万 token $2/$10。Fable 5 访问已转向 Pro 用户基于使用的计费——这是行业向顶级模型消费型定价更广泛转变的信号。
开源权重生态
DeepSeek V4 继续提供低至每百万 token $0.07 的缓存命中输入定价。Moonshot AI 的 Kimi K3 仍是 2+ 万亿参数的开源模型。前沿专有模型与开源权重替代方案之间的差距在多项编码评估上已缩小到个位数基准差距。对于自托管场景,这些模型值得评估。
结语
本周标志着从危机管理到平台构建的转变。Codex CLI v0.145.0 的多智能体稳定化和跨工具迁移导入器表明 OpenAI 正专注于降低整合到其平台的团队摩擦。模型退役是必要的清理——但运行 15 个已弃用快照中任何一个的团队需要昨天就完成迁移。
工程领导者本周的三个行动:第一,审计你的 API 调用是否包含在退役模型列表中,更新为推荐替代——特别是如果你在运行任何 Codex 品牌模型或 o3-deep-research。第二,如果你还没开始 Assistants API 迁移,现在就开始——33 天不足以完成带适当测试的生产切换。第三,评估 Codex CLI v0.145.0 的 /import 以评估 Codex、Claude Code 和 Cursor 之间的切换成本——多智能体 V2 功能和 Bedrock 支持可能会改变你团队架构的考量。
竞争格局正在产生真正的替代方案。Grok Build 的开源框架、Claude Sonnet 5 的价值定价,以及 DeepSeek 和 Moonshot 的开源前沿模型都值得评估。Google 在 Gemini 3.5 Pro 上的持续困境同时提醒我们,并非每个实验室都能维持这种节奏。
在 X 上关注讨论。