本週是 Claude 平台的轉捩點。Anthropic 推出了四項主要的 Managed Agents 功能,完成了 MCP 協定史上最大規模的規格修訂,並悄悄跨越了一個業務里程碑,使其有望在十月以接近一兆美元的估值 IPO。同時,Claude Code 的 auto 模式今日起成為預設——其 89% 的危險指令攔截率重新定義了 AI 程式碼安全性的討論方向。

對工程主管而言,實際影響立即顯現:工作階段預算上限改變了您管控 agent 支出的方式,無狀態 MCP 協定改變了您架構工具伺服器的方式,而 Sonnet 5 於 8 月 31 日的漲價則改變了您的成本預測。讓我們來拆解重點。

Managed Agents:工作階段預算、顧問模型與地理固定

本次 API 更新的重點是 8 月 7 日推出的四項新 Managed Agents 功能。它們共同解決企業對 agentic 工作負載最關切的三大問題:成本可預測性、模型靈活性與資料落地。

工作階段預算(Session Budgets) 是營運上影響最大的功能。您可以設定每個工作階段的硬性支出上限——以整數美分計價、按公開牌價收費——當工作階段達到預算上限時,系統會以 budget_reached 的停止原因暫停,而不是繼續觸發新的模型請求。檢查會在模型請求之間進行,因此進行中的請求仍會完成。每個執行緒最多超支一個模型請求。您可以調高或移除預算以恢復執行,但移除是單向的——您無法為既有工作階段重新加上上限。部署時可以為啟動的每個工作階段套用預算。

這是企業自 Managed Agents 推出以來一直要求的成本治理工具。不再有失控的 agent 迴圈產生意外的 token 帳單。在工作階段建立時設定預算,平台便會強制執行。

顧問模型(Advisor Model) 為多 agent 陣容新增了一個角色。任務執行途中,工作階段可以向另一個獨立模型徵詢意見,針對較困難的步驟尋求第二意見——而不必把整個任務交給更強大的模型。顧問模型的能力至少必須與 agent 本身相當。設定只需在陣容中新增一個項目。這實現了分層策略:由成本效益高的模型處理大部分工作,只有在真正遇到困難步驟時才諮詢更強大的模型。

推論地理固定(Inference Geo-Pinning,inference_geo 控制模型推論實際執行的位置。可在建立 agent 時於 model 物件內設定,或按工作階段覆寫,值為 us(僅限美國,2026 年 2 月 1 日之後發布的模型以 1.1 倍計費)或 global(標準定價,在任何有容量的地方執行)。這直接回應了資料落地需求——這是許多受監管產業的障礙。

GitHub Skills 自動載入 補齊了這組功能。Managed Agents 工作階段現在可以直接從掛載的 GitHub 儲存庫載入 skills。位於 .claude/skills 根目錄的任何 skills 都會在工作階段啟動時自動探索。無需手動複製到 agent 環境中。

MCP 2026-07-28:無狀態協定修訂

7 月 28 日定案的 MCP 規格是協定推出以來最大規模的架構修訂。核心轉變:MCP 現在是徹底無狀態的協定。

initializeinitialized 交握已移除。Mcp-Session-Id 標頭已移除。每個請求都是自描述的——在 _meta 欄位中內嵌協定版本、客戶端身分與客戶端能力。可選的 server/discover RPC 取代了需要在呼叫前取得能力的客戶端所需的先行交握。

這為什麼重要:任何請求現在都可以落在純循環式(round-robin)負載平衡器後方的任何伺服器實例上。不需要黏性工作階段,也不需要開放串流。MCP 伺服器可以作為一級 HTTP 工作負載部署在 serverless 與邊緣基礎設施上。

基於標頭的路由 放大了這個優勢。Mcp-MethodMcp-Name 透過 Streamable HTTP 請求的 HTTP 標頭傳遞,因此閘道、速率限制器與 WAF 無需解析 JSON body 即可路由與授權。標準 HTTP 基礎設施現在可以直接處理 MCP 流量。

多回程請求(Multi-Round-Trip Requests,MRTR) 處理互動式工具工作流程——確認、消歧——而不需要持續串流。工具可以在呼叫中途暫停、回傳 input_required,客戶端再以所需的輸入重試。這取代了依賴串流的提示索取機制。

可快取的清單結果tools/listprompts/listresources/listresources/read 回應新增了 ttlMscacheScope。客戶端可以快取工具目錄,將多餘的來回請求減少約 85%,並透過穩定的 prompt 快取實現更快的重新連線。

在驗證方面,規格新增了 RFC 9207 發行者驗證,從 Dynamic Client Registration 轉向 Client ID Metadata Documents(CIMD),並引入了 Enterprise Managed Authorization 擴充,用於集中式的身分提供者管理。DCR 已正式棄用,預計在 2027 年夏季之後移除。

正式的棄用政策引入了至少 12 個月的過渡期。本次發布棄用了三項功能:Roots(由明確的工具參數取代)、Sampling(由直接呼叫 LLM 提供者 API 取代)與 Logging(stdio 由 stderr 取代,雲端由 OpenTelemetry 取代)。舊版 HTTP+SSE 傳輸也一併棄用。

SDK 就緒程度不一。 C# SDK v2.0 於 7 月 28 日以穩定版發布——向後相容且預設無狀態。Ruby 以 100% 符合性達到 Tier 2 的 v1.0 穩定版。TypeScript、Python、Go 與 Rust 仍在 beta。Cloudflare 在 Agents SDK v0.20.0 中推出 day-zero 支援的 createMcpHandler,無需 Durable Objects 即可無狀態地提供 MCP 工具。

這項破壞性變更千真萬確,且不相容於舊版。12 個月的棄用窗口提供了緩衝空間,但新的實作應該從第一天起就鎖定無狀態協定。

Claude Code:Auto 模式成為預設

自今日(8 月 14 日)起,auto 模式成為 Pro、Max 與 Team 方案的新 Claude Code 工作階段預設權限模式。Auto 模式使用分類器篩選工具呼叫,而非提示人工核准。Anthropic 報告其危險指令攔截率為 89%,而人工核准僅有 13.6%——這個反直覺的結果顯示,人類審查者才是安全鏈中的薄弱環節。

分類器的開銷不再於 Pro、Max 與 Team 方案中計費。Enterprise、API、Bedrock、Google Cloud 與 Microsoft Foundry 目前仍維持選擇加入(opt-in)。

8 月 6 日至 8 日期間發布了四個版本(v2.1.223 至 v2.1.226)。值得注意的新增功能包括跨工作階段的 SendMessage——工作階段現在可以透過 ListAgents 探索功能跨機器互相傳訊。子 agent 生成上限已移除。archive 外掛程式來源支援透過 HTTPS 的 zip 型外掛程式,並可選擇以 SHA-256 驗證。Sandbox 憑證遮罩現在具備 JWT 感知能力,並支援 AWS SigV4 重新簽章。

另一個值得注意的獨立發展:Anthropic 將 Claude 5 模型的 Claude Code 系統提示詞縮減了 80% 以上,而內部程式碼評測沒有任何可測量的損失。六項上下文建構轉變以基於判斷的引導取代僵化規則、透過 skills 進行漸進式揭露,並以自動記憶取代人工維護的 CLAUDE.md 檔案。新的 claude doctor 指令會稽核並簡化 CLAUDE.md 檔案。

Inference Hooks:Prompt 層級的企業 DLP

Anthropic 於 8 月 5 日以 Claude Enterprise beta 形式推出 Inference Hooks——這是第一個原生內建的內聯控制點,可管控組織傳送給模型的內容。

當員工在受治理的介面(claude.ai、Claude Code、Claude Cowork)提交 prompt 時,Anthropic 會暫停、透過簽署的 HTTPS 將對話紀錄 POST 到組織設定的安全伺服器,並在推論執行前等待允許/拒絕的裁定。被拒絕的請求永遠不會到達 Claude。單一組織層級設定即可涵蓋網頁、桌面與 CLI 上的聊天、Claude Code 與 Claude Cowork。來自 MCP、skills 與外掛程式的工具呼叫回應也會在 Claude 看到之前先經過檢查。

其限制相當明顯:只有二元裁定(無法改寫或遮罩)、推出初期僅限 prompt 端(回應端強制執行已在規劃中)、原始圖片與檔案不會送交檢查(僅限文字),以及 5 秒的預設逾時。已具名的整合包括 Netskope、Palo Alto Networks、Proofpoint 與 Zscaler。也支援自訂伺服器。

推出控制包含影子模式(一律允許但記錄決策)、基於角色的排除,以及百分比式逐步推出。此功能已包含在 Enterprise 方案中,每位使用者每月 $20 加用量計費——不另收費。

這是企業 DLP 值得關注的發展。沒有其他主要 AI 廠商提供原生的內聯 prompt 檢查。但目前這些限制意味著它是地基,而非完成品。

破壞性變更與時程

日期變更內容需採取的行動
8 月 5 日(已過)Opus 4.1 從 API 永久移除遷移至 claude-opus-4-8;非預設的 temperaturetop_ptop_k 會回傳 HTTP 400
8 月 17 日Legacy Workbench 存取結束從 Console 匯出已儲存的 prompts、變數與 evals
8 月 31 日Sonnet 5 上市優惠價結束:$2/$10 → $3/$15 每 MTok重新預測支出;新 tokenizer 對等效文字會多產生約 10-35% 的 tokens
9 月 29 日Sonnet 4.5 暫定退役遷移至受支援的模型
10 月 15 日Haiku 4.5 暫定退役遷移至受支援的模型
11 月 24 日Opus 4.5 暫定退役遷移至受支援的模型

Sonnet 5 漲價特別值得注意。從每百萬 tokens $2/$10 調漲至 $3/$15 的 50% 漲幅,再加上 tokenizer 變更對等效文字多產生約 10-35% tokens 的影響,兩者疊加。對高用量 API 消費者的綜合影響相當可觀。請在 8 月 31 日前提前執行批次作業,並在適用之處啟用 prompt 快取。

SDK 更新:維持每週節奏

Anthropic Python SDK 於 8 月 7 日發布 v0.121.0,包含全部四項 Managed Agents 功能、對話中途工具變更 beta,以及移除已退役的 Opus 4.1 模型。v0.122.0 隨後於 8 月 12 日左右發布,新增 Dreams 的 output_behavior,並修復 Bedrock 串流與非同步 AWS SigV4 簽章的錯誤。TypeScript SDK 於 8 月 7 日發布 v0.116.0,遵循相同的軌跡。

Claude Agent SDK TypeScript(v0.3.214)與 Python(v0.2.126)均於 7 月 18 日至 22 日發布,新增型別的 model_usage、結果訊息上的 terminal_reason,以及透過 'max' 的 effort 等級支援。

八個官方 MCP SDK 現在會在所有的記憶體儲存呼叫中傳送 agent-memory-2026-07-22 beta 標頭,取代舊的 managed-agents-2026-04-01 標頭。關鍵行為變更:穩定的伺服器定義排序、depth 限制為 0/1/省略,以及 path_prefix 必須以 / 結尾。舊標頭的分頁游標在新標頭下無效——您必須從第一頁重新開始。

更新節奏大約是每週一次。請在正式環境中釘住版本,並審慎升級。

Anthropic 的 IPO 軌跡與運算擴建

這些平台變更背後的商業脈絡值得了解。Anthropic 的 H 輪融資於 5 月籌得 650 億美元,投後估值達 9,650 億美元——超越 OpenAI 的 8,520 億美元。營收運行率(revenue run rate)從 2 月的 140 億美元 ARR 成長至 5 月的 470 億美元以上,三個月內成長近五倍。

6 月 1 日向 SEC 提交了機密的 S-1。那斯達克上市目標定於 2026 年 10 月,由 Goldman Sachs、JPMorgan 與 Morgan Stanley 擔任承銷商。部分投資人根據 2026 年底前年化營收預計達 1,000 至 1,200 億美元的預測,預期 IPO 估值可超過 2 兆美元。

支撐這項成長的運算擴建規模空前。Anthropic 已與 AMD(最高 50 億美元,用於 2 GW 的 MI450 GPU)、SpaceX(自 2029 年 5 月起每月 12.5 億美元租用 Memphis 的 Colossus 1)、Amazon(數十億美元)、Google 加 Broadcom(數 GW)、Volta Infra Holdings(100 億美元、為期 6 年的挪威交易)、Riot Platforms(90 億美元)達成協議,並與 Macquarie-GIC 合資成立名為 Theseus Infrastructure 的公司,由 Anthropic 擔任錨定租戶。Google 另提供 350 億美元貸款,用於在五個資料中心租用晶片。Anthropic 承諾投入 500 億美元於美國自建資料中心,並正在組建自有的晶片團隊。

行動清單

  1. 為所有 Managed Agents 部署設定工作階段預算——這是本季推出的最具影響力成本治理功能。在部署層級套用,以限制每個工作階段。
  2. 立即開始規劃 MCP 2026-07-28 遷移——無狀態協定是破壞性變更。12 個月的窗口相當寬裕,但新的伺服器應從第一天起就鎖定新協定。評估您的 MCP 伺服器中哪些使用了 Roots、Sampling 或 HTTP+SSE 傳輸——這三者皆已棄用。
  3. 在 8 月 31 日前提前執行 Sonnet 5 批次作業——50% 漲價加上 tokenizer 變更會疊加。請啟用 prompt 快取。
  4. 在 8 月 17 日前匯出 Workbench 資產——已儲存的 prompts 與 evals 將被永久刪除。
  5. 評估 Inference Hooks 以滿足企業 DLP 需求——如果您使用 Claude Enterprise,beta 現已可用。先從影子模式開始,了解您的安全伺服器會封鎖什麼。
  6. 在正式環境中釘住 SDK 版本——每週更新節奏意味著未釘住的相依套件會漂移。若需要 Managed Agents 功能集,請鎖定 Python v0.121.0+ 或 TypeScript v0.116.0+。
  7. 對您的 CLAUDE.md 檔案執行 claude doctor——系統提示詞縮減 80% 的策略同樣適用於您的專案脈絡。簡化內容,讓基於判斷的引導取代僵化規則。

平台的基礎設施化速度之快,值得高度關注。工作階段預算、無狀態 MCP 與 auto 模式預設並非漸進式改良——而是改變您建構於 Claude 之上的方式的架構性轉變。十月的 IPO 將帶來更多審視與更快的步調。對工程主管而言,問題在於您的架構是否已為這兩者做好準備。

歡迎追蹤 x.com/kkaminsk,每週獲取 Claude 生態系分析。