GPT-5.6 發布後的塵埃正在落定,本週的焦點從破壞性自主行為轉向平台整合。OpenAI 發布了 Codex CLI v0.145.0——自 ChatGPT 桌面端合併以來最大的功能版本——帶來穩定化的多智能體協作、跨工具遷移匯入器和音訊輸入。15 個舊模型快照(包括所有 Codex 品牌模型)在 7 月 23 日按計畫關閉。ChatGPT Work 推出了小企業計畫。而 Google 的 Gemini 3.5 Pro 第三次錯過發布期限,改以 Gemini 3.6 Flash 作為過渡方案。

以下是 OpenAI 模型、Codex 生態和更廣泛競爭格局中本週最重要內容的拆解。

1. Codex CLI v0.145.0——多智能體 V2、遷移和音訊

7 月 21 日的版本是自 v0.144.0 將 Codex 合併到 ChatGPT 桌面應用以來功能最豐富的更新。它在三個領域同時發力:智能體協作、工具遷移和輸入方式。

多智能體 V2 穩定化。 可選的多智能體體驗從預覽升級為穩定版。根會話現在可以生成可配置的子智能體——每個擁有自己的模型、推理級別、並發限制和沙箱設定——使用 spawn_agentsend_inputresume_agentwait_agentclose_agent。角色和導航已從早期預覽中恢復,實現被歸類為穩定版但預設仍處於停用狀態。對工程團隊而言,這意味著單個 Codex 會話現在可以跨不同模型層級並行工作——Sol 用於規劃,Luna 用於機械編輯——無需外部編排。

/import 擴展至 Cursor 和 Claude Code。 Codex 現在可以偵測並遷移 Cursor 和 Claude Code 的設定、MCP 伺服器、外掛、會話、命令和專案層級記憶。外掛命令在匯入時轉換為 Codex 技能。遷移是單向的——Codex 中的更改不會回寫——且 Claude Code 的聊天對話不包含在內,僅遷移智能體設定和最近會話。匯入器在 TUI 中本地執行,拒絕遠端會話,並將會話匯入限制為 30 天內更改的 50 個會話。這對於評估遷移到 Codex 的團隊來說,大幅降低了切換成本。

實驗性分頁執行緒歷史。 執行緒歷史現在支援高效恢復、搜尋、持久化名稱、子智能體歷史和記憶整合。這解決了一個長期痛點:長對話重新載入昂貴且無法搜尋。該功能標記為實驗性。

音訊輸入和串流即時 V3。 本地音訊格式現在可以作為輸入,工具輸出也可以包含音訊。串流即時 V3 對話已引入,但在標記登錄中仍處於開發階段。

Amazon Bedrock 登入(實驗性)。 自訂端點和身分驗證支援上線,GPT-5.6 Sol 作為預設 Bedrock 模型。這為 AWS 原生團隊提供了無需透過 OpenAI API 直接路由即可使用 Codex 的第一類路徑。

可靠性改進。 編輯早期提示或重試安全緩衝回合現在會建立適當的上下文分支,而不是改變原始對話。Windows 沙箱獲得原生 exec-server 支援和正確引用的鉤子命令。MCP 啟動截止時間涵蓋客戶端建立,OAuth 發現階段不再阻塞啟動,刷新操作已序列化。

2. 十五個模型退役——包括所有 Codex 快照

7 月 23 日,OpenAI 在單批次中關閉了 15 個模型快照。最關鍵的是:所有 Codex 品牌的 API 模型現已退役。

退役的 Codex 模型: gpt-5-codexgpt-5.1-codexgpt-5.1-codex-maxgpt-5.1-codex-minigpt-5.2-codex 全部映射到 gpt-5.5(mini 變體映射到 gpt-5.4-mini)。如果你的生產程式碼呼叫了這些端點,請求現在將直接失敗。

退役的聊天模型: gpt-5-chat-latestgpt-5.1-chat-latest 都合併到 gpt-5.5

電腦使用和搜尋: computer-use-preview-2025-03-11 遷移到 gpt-5.4-mini。搜尋預覽模型(gpt-4o-search-previewgpt-4o-mini-search-preview)也映射到 gpt-5.4-mini

深度研究: o3-deep-researcho4-mini-deep-research 都合併到 gpt-5.5-pro,價格為每百萬 token $30 輸入 / $180 輸出——對自動化研究管線來說是顯著的成本增加。

音訊: gpt-4o-mini-tts-2025-03-20 遷移到 gpt-4o-mini-tts-2025-12-15gpt-audio-mini-2025-10-06 映射到 gpt-audio-1.5

工程團隊行動項: 稽核程式碼庫中是否有退役列表中硬編碼的模型 ID。將 API 呼叫更新為推薦替代方案。特別關注深度研究管線——從 o3-deep-research 到 gpt-5.5-pro 的成本跳躍約為輸出的 6 倍。下一批退役將於 10 月 23 日進行,涵蓋 GPT-3.5、GPT-4、GPT-4 Turbo、GPT-4.1 Nano、GPT-4o 和多個 o 系列模型。

3. ChatGPT Work——小企業計畫和企業成熟化

ChatGPT 小企業計畫(7 月 21 日)。 OpenAI 推出了圍繞 ChatGPT Work 構建的綜合中小企業計畫。包括面向會計、行銷和電商工作流的實戰虛擬培訓研討會;透過 OpenAI Academy 團隊在美國各地舉辦的線下 AI 學院;可直接上傳到 ChatGPT Work 的互動式指南;以及與 Dropbox、Shopify、Intuit、Slack、Atlassian 和 Wix 的合作夥伴整合。五場免費直播課程已從 7 月 30 日排期至 8 月 27 日。ChatGPT Work 由 GPT-5.6 驅動,在所有訂閱計畫中可用——不鎖定在企業層級。該平台已達到約 1000 萬 ChatGPT Work 和 Codex 合併使用者。

企業治理更新。 ChatGPT Enterprise 和 Edu 工作空間在 Global Admin Console 中獲得了額度使用分析和更新支出控制。工作空間智能體於 7 月 6 日轉向基於 token 的定價——額度消耗現在基於輸入 token、快取輸入 token 和輸出 token,而非固定成本。ChatGPT for PowerPoint 對 Business 工作空間達到正式可用,Enterprise 客戶的基於 token 定價在 8 月 6 日後生效。

服務帳戶 API 金鑰管理。 Go SDK v3.44.0(7 月 18 日)透過 /organization/projects/{project_id}/service_accounts/{service_account_id}/api_keys 端點增加了對服務帳戶 API 金鑰的程式化管理。Admin 金鑰——與標準 API 金鑰不同,範圍限定於組織管理——現在供工作空間所有者和管理員使用,可連接工具到 ChatGPT 和 Codex 管理 API,具有基於角色的權限(全部、唯讀、受限)。

桌面端聊天/工作分離。 ChatGPT 桌面應用在 7 月 16 日新增了聊天和工作模式之間的全域切換器。工作對話在網頁、行動端和桌面端同步。自訂指令限制從 1,500 字元增加到 5,000 字元,適用於 Plus、Enterprise、Business 和 Education 使用者。

4. Assistants API——倒數 33 天

8 月 26 日關停距今還有 33 天。沒有新的遷移工具發布。推薦的 7 月中旬內部截止日期已過。

關鍵提醒: 沒有自動化遷移工具,也不會發布。沒有 Thread 匯出——立即提取對話歷史。遷移期間的靜默失敗很常見:200 OK 回應但上下文丟失、grounding 為空或串流中斷。Responses API 已達到完全功能對等,包括深度研究、MCP 工具連接和電腦使用。Azure OpenAI 遵循同一時間線。Zapier 已棄用所有使用 Assistants API 的 ChatGPT 步驟——這些工作流將在 8 月 26 日停止運作。

對於仍在使用 Assistants API 的團隊: 將此視為 P0 遷移。清點所有 beta.assistantsbeta.threadsbeta.threads.runs 呼叫。將 threads 映射到 Conversations,runs 映射到 Responses。為串流、背景工作、重試和取消建構迴歸測試。在切換生產流量之前,先執行抑制副作用的影子切換。

5. 競爭格局——Google 停滯、xAI 開源

Google——Gemini 3.5 Pro 第三次錯過期限

Gemini 3.5 Pro 未發布。Sundar Pichai 在 Google I/O 上公開承諾 6 月交付的模型現已錯過三個期限:原始 6 月窗口、7 月 17 日目標以及 7 月中的修訂估計。Google 官方模型目錄仍末列出 Gemini 3.5 Pro——Pro 層級仍為 Gemini 3.1 Pro(預覽版)和 Gemini 2.5 Pro(穩定版)。

Bloomberg 報導稱內部編碼基準未達標且關鍵研究人員已離職。Google 唯一的公開聲明:「Gemini 3.5 Pro 目前正在與合作夥伴測試中,我們計畫在準備好後廣泛發布。」沒有日期、沒有基準、沒有定價。

替代發布的版本: Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 於 7 月 21 日正式可用。Gemini 3.6 Flash 定價為每百萬 token $1.50/$7.50,知識截止日期為 2026 年 3 月,可在 Google AI Studio、Android Studio、Google Antigravity、GitHub Copilot 和 Gemini 應用中使用。專用 Gemini 3.5 Flash Cyber 漏洞偵測模型處於受限試點階段。

xAI——Grok Build 在資料爭議後開源

xAI 於 7 月 15 日在 Apache 2.0 下開源了 Grok Build——一個 130 萬行 Rust 程式碼庫,涵蓋智能體迴圈、工具實現、終端 UI 和擴充系統。此次發布源於資料外洩爭議:使用者發現 grok CLI 預設將包括 SSH 金鑰和密碼管理器資料庫在內的整個目錄上傳到 xAI 的 Google Cloud 儲存桶。xAI 停用了上傳行為,刪除了保留的資料,並發布了完整原始碼以恢復信任。

對開發者的意義: Grok Build 是唯一完全開源並具有公開線協定(Agent Client Protocol)的主要編碼智能體框架。它支援 MCP 伺服器、技能、外掛和鉤子——可直接複用現有 Claude Code MCP 設定。但外部貢獻不被接受;這是一個原始碼透明發布,不是社群專案。預設模型 Grok 4.5 定價為每百萬 token $2/$6——比 Opus 4.8 或 GPT-5.6 Sol 便宜得多。

Anthropic——Claude Code 加速

Claude Code 於 7 月 21 日發布 v2.1.217,保持與 Codex 的發布節奏同步。近期亮點包括 /fork 背景會話複製、Web 搜尋和子智能體會話級上限(各 200)、長時間呼叫 MCP 自動背景化,以及權限分析器全面檢修採用失敗即關閉行為。Claude Sonnet 5 仍是預設模型,具有 1M token 上下文視窗,8 月 31 日前每百萬 token $2/$10。Fable 5 存取已轉向 Pro 使用者基於使用的計費——這是行業向頂級模型消費型定價更廣泛轉變的訊號。

開源權重生態

DeepSeek V4 繼續提供低至每百萬 token $0.07 的快取命中輸入定價。Moonshot AI 的 Kimi K3 仍是 2+ 千億參數的開源模型。前沿專有模型與開源權重替代方案之間的差距在多項編碼評估上已縮小到個位數基準差距。對於自託管場景,這些模型值得評估。

結語

本週標誌著從危機管理到平台構建的轉變。Codex CLI v0.145.0 的多智能體穩定化和跨工具遷移匯入器表明 OpenAI 正專注於降低整合到其平台的團隊摩擦。模型退役是必要的清理——但執行 15 個已棄用快照中任何一個的團隊需要昨天就完成遷移。

工程領導者本週的三個行動:第一,稽核你的 API 呼叫是否包含在退役模型列表中,更新為推薦替代——特別是如果你在執行任何 Codex 品牌模型或 o3-deep-research。第二,如果你還沒開始 Assistants API 遷移,現在就開始——33 天不足以完成帶適當測試的生產切換。第三,評估 Codex CLI v0.145.0 的 /import 以評估 Codex、Claude Code 和 Cursor 之間的切換成本——多智能體 V2 功能和 Bedrock 支援可能會改變你團隊架構的考量。

競爭格局正在產生真正的替代方案。Grok Build 的開源框架、Claude Sonnet 5 的價值定價,以及 DeepSeek 和 Moonshot 的開源前沿模型都值得評估。Google 在 Gemini 3.5 Pro 上的持續困境同時提醒我們,並非每個實驗室都能維持這種節奏。

X 上關注討論。