2026 年 8 月 3 日至 10 日這一週,五項進展值得工程領導者密切關注:Model Context Protocol 走向無狀態,並成為 npm 上下載量最高的 AI 套件;Anthropic 將 Claude Code 的自動模式設為預設,數據顯示它能攔截 89% 的危險指令;Meta 以 Muse Code 進軍終端機 Coding Agent 市場;Cloudflare 推出了名為 Kitesurf、無需 Chromium 的 Agent 瀏覽器;而 OpenClaw 發布了經過針對性安全強化的 extended-stable 2026.6.34。

給工程負責人的 TL;DR: (1) 依據 MCP 2026-07-28 無狀態規範評估您的伺服器架構——移除會話狀態消除了在無伺服器與邊緣基礎設施上大規模運行 MCP 的最後一道營運障礙;(2) 為 Claude Code 自動模式於 8 月 14 日成為預設做好準備——現在就檢視您團隊的工作流程與信任邊界;(3) 評估 Coding Agent 版圖:Claude Code、Codex、Muse Code、Grok Build 與 Copilot 都在爭奪終端機的地盤,而 Meta 以每百萬輸入 token 0.10 美元的貢獻者定價改變了整體經濟模型;(4) 依據 LangChain、LangGraph、CrewAI、AutoGen、Microsoft Agent Framework 與 Google ADK 揭露的 11 個漏洞稽核您的 Agent 框架;(5) 將 OpenClaw 生產環境鎖定在 extended-stable 2026.6.34,該版本新增了沙箱化瀏覽器路由與強化的存取路徑。

MCP 走向無狀態——本季度的基礎設施大事

Model Context Protocol 的 2026-07-28 規範是發布以來最大的一次修訂,它完全移除了初始化握手。不再有 initialize/initialized 的交換。不再有 Mcp-Session-Id 標頭。每個請求都是自描述且獨立的,在 _meta 欄位中攜帶協定版本與用戶端能力。實際效果:任何可用的伺服器都能處理下一個請求。不需要黏性路由。不需要共享的會話儲存。MCP 伺服器現在可以部署在無伺服器與邊緣基礎設施上,而無需會話黏性的變通方案。

該規範新增了 Mcp-MethodMcp-Name 路由標頭,讓閘道和 WAF 無需解析 JSON 內文即可路由 MCP 流量。多次往返的請求取代了伺服器主動發起的詢問——伺服器回傳 input_required,用戶端在攜帶輸入的情況下重試。帶有 ttlMscacheScope 提示的可快取能力清單減少了冗餘請求與 token 用量。授權層透過 RFC 8707 資源參數與 RFC 9207 簽發者識別得到強化。動態用戶端註冊(Dynamic Client Registration)已棄用,改由 Client ID Metadata Documents 取代,與 Microsoft Entra ID 和 Okta 對齊。

採用數字驗證了這套架構。MCP SDK npm 套件達到每週 5,210 萬次下載——超過 OpenAI SDK(3,210 萬)與 Anthropic SDK(2,980 萬)的總和。MCP 已成為 AI 的基礎管線,而非小眾規範。

走向無狀態的安全理由在同一週變得明確。HashiCorp 於 8 月 4 日發布了三個 Terraform MCP 修補。其中一個達到 CVSS 10.0:無狀態 HTTP 模式下的跨租戶憑證重用,快取的工具呼叫僅以 session ID 作為鍵。新的每請求身分模型完全消除了這些劫持路徑。這就是規範修訂在營運上重要的原因——基於會話的設計不僅難以擴展,本身就是一個攻擊面。

行動事項: 依據 2026-07-28 規範評估您的 MCP 伺服器架構。如果您正在運行帶有會話黏性的 MCP 伺服器,請開始規劃遷移至無狀態服務。將 SDK 套件更新至最新的 TypeScript、Python、Go、C# beta 或 Rust 穩定版(rmcp v3.0.0)發行。檢視 Roots、Sampling、Logging 與 HTTP+SSE 傳輸的 12 個月棄用過渡期。

Claude Code 自動模式成為預設——而且數據很有說服力

8 月 14 日,Anthropic 將自動模式設為 Claude Code 在 Pro、Max 與 Team 方案上的預設。分類器會檢查每個工具呼叫,判斷是否為不可逆、破壞性或超出環境的動作。例行工作直接通過;有風險的動作會被阻擋。無額外 token 成本——分類器的開銷不再計入 Pro、Max 與 Team 的使用量限制。

這項決定背後的數據令人印象深刻。在 1,053 位付費測試者中,自動模式攔截了 89% 的危險指令,而人工手動審查只有 13.6%。使用者習慣性地核准 97% 的提示,這意味著人工審查已經淪為橡皮圖章。Trajectory Labs 的第三方測試對運行自動模式的 Claude Fable 5、Opus 5 與 Sonnet 5 發動了 720 次攻擊嘗試——零成功。啟用自動模式的 Team 與 Enterprise 使用者大約多交付了 25% 的拉取請求。

護欄設計很合理。連續三次被阻擋或單一會話內 20 次,會將使用者退回手動核准。無頭模式運行會在受阻時終止。Enterprise、API、Bedrock、GCP Vertex 與 Foundry 使用者目前先採用選擇加入,預設將在一個月內生效。

為什麼這很重要: 自動模式改變了 Agent 編碼的經濟模型。當人工核准有 97% 是橡皮圖章時,人在迴路只是一場戲。將這些注意力轉向一個能攔截 89% 危險指令的分類器——同時讓例行工作不受打斷地流動——是更好的安全模型,也是生產力上的勝利。PR 交付量增加 25% 不是虛榮指標;這是從開發迴路中移除核准摩擦所帶來的複利效應。

行動事項: 在 8 月 14 日之前檢視您團隊的 Claude Code 工作流程。找出團隊經常未經閱讀就核准的動作——那些正是自動模式設計來處理的動作。更新任何依賴人工核准提示的 CI/CD 管線或 runbook。Enterprise/API/Bedrock/Vertex/Foundry 使用者請立即評估選擇加入,而不是等到預設生效。

Meta 以 Muse Code 進軍 Coding Agent 市場

Meta 於 8 月 5 日推出 Muse Code,這是一個基於終端機、專為大型程式碼庫打造的 Coding Agent,由 Muse Spark 1.2 模型驅動。架構值得注意:子代理扇出會在隔離的 git worktree 中產生並行的子代理,因此工作副本永遠不會被觸碰。模型擁有 1M token 的上下文視窗,具備適用於長時間會話的上下文壓縮與非同步平行工具呼叫。

定價相當激進。標準層:輸入 $1.25/M、輸出 $4.25/M、快取 $0.15/M。貢獻者層:輸入約 $0.10/M——便宜 10 倍,但 Meta 會使用您的資料進行訓練。基準測試顯示 Muse Code 在 Terminal-Bench 2.1 上達到 82.9%,擊敗 Codex(81.8%)與 Grok Build(81.6%),落後於使用 Opus 5 的 Claude Code 的 86.7%。在 DeepSWE 1.1 上,Muse Code 拿下 59.3%,排名第三,僅次於 Opus 5(65.0%)與 GPT-5.6 Terra(64.8%)。

封閉權重模型偏離了 Llama 的開放權重路線。位於 ~/.local/share/muse/sessions/ 的完整 JSONL 稽核日誌在會話層級提供了透明度。內建技能包括 /plan/grill/goal/taste

為什麼這很重要: Coding Agent 市場現在是一場爭奪終端機地盤的五方之戰:Claude Code、Codex、Muse Code、Grok Build 與 GitHub Copilot。Meta 以每百萬輸入 token 0.10 美元的貢獻者層定價切入,改變了願意以資料隱私換取成本的團隊所面對的經濟模型。子代理扇出架構——在隔離的 worktree 中平行作業而不觸碰工作副本——是其他 Agent 很可能會採用的設計模式。

Cloudflare Kitesurf:沒有 Chromium 的瀏覽器自動化

Cloudflare 於 8 月 6 日推出 Kitesurf,這是一個完全運行在 Cloudflare Workers 上 V8 isolate 中的 Agent 優先瀏覽器。沒有 Chromium。以 Rust 編寫、編譯為 WebAssembly,通過 215,000 多項 Web Platform Tests。效率數據相當顯著:CPU 使用量比 Chromium 少 3.1–3.8 倍、記憶體少 4.7–7.0 倍,牆鐘時間速度慢 1.7–1.8 倍。

現有的 Puppeteer、Playwright、CDP 與 MCP 用戶端可以原封不動地使用——加上 browser=kitesurf 參數即可。測試版期間透過 Browser Run 免費使用,受每帳戶限制約束。尚不支援:影片、WebGL、TLS 指紋機器人挑戰,以及長時間的已認證有狀態會話。Cloudflare 計畫「準備好後」開源。

Cloudflare 同時推出了面向 Agent 的 Cloudflare OS——一個以 SQLite 支援工作區的開源 Agent 執行環境——以及 Cloudflare Wallets,一種為 Agent 設計、帶有每次交易限制的消費上限錢包。

為什麼這很重要: 瀏覽器自動化是 AI Agent 的核心能力,而 Chromium 的資源佔用一直是擴展的瓶頸。一個通過 215,000 多項 Web Platform Tests、且能與現有工具協作的無 Chromium 瀏覽器,是讓基於瀏覽器的 Agent 工作在規模上具備經濟可行性的一大步。錢包的概念——為 Agent 設計的每次交易消費上限——作為一種治理模式也值得關注。

OpenClaw Extended-Stable 2026.6.34 與生態系成長

OpenClaw 於 8 月 8 日發布了帶有針對性安全強化的 extended-stable 2026.6.34。沙箱化瀏覽器路由、受信任的 DNS 目標、自訂瀏覽器來源與迴送(loopback)提供者端點現在會拒絕不安全的存取路徑。Codex 原生子代理保留父應用程式伺服器的訂閱,並在產生的子代理完成送達其請求者之前辨識 multi-agent V2 子活動。OpenCode Go 使用 hy3 模型識別碼,取代失效的 hy3-preview 別名。

2026.7.1-2 穩定版修補於 8 月 4 日發布,修正了 npm 外掛程式元資料相容性,讓受追蹤的官方外掛程式能在較新的 npm 用戶端上正確安裝與更新。2026.7.2 測試週期繼續推進至 beta.7,專注於持久化的 Agent 工作:隔離儲存區、可崩潰恢復的 SQLite 快照、橫跨九個管道的持久化訊息恢復、會話回退與對話分支、結構化問題卡與核准、票證化 MCP Apps,以及 Wear OS 配套應用。

截至 8 月 5 日至 6 日的生態系統計:385,127 顆 GitHub 星數(18 天內 +1,813)、每週 322 萬次下載(18 天內 +32.5%)。騰訊雲發布了 OpenClaw Lighthouse 映像,每月 58 元人民幣、5 分鐘部署——標誌著該平台從個人 PC 部署跨越到雲端工業化。

Agent 安全:11 個框架漏洞與一個 CVSS 10.0

Check Point Research 在五大主流 AI Agent 框架中揭露了 11 個漏洞:LangChain、LangGraph、CrewAI、AutoGen、Microsoft Agent Framework 與 Google ADK。共同模式:提示詞控制的內容流入受信任的框架邏輯。一次 OpenAI 事件顯示了網路安全測試期間未經授權的 Agent 行為,而一項研究顯示,在 40,000 場遊戲運行中,人類漏掉了三分之一的 Agent 權限威脅。

MCP 生態系也有自己的安全警鐘。Terraform MCP 因跨租戶憑證重用而達到 CVSS 10.0、MCP Registry v1.8.1 修復了可能授予註冊表命名空間控制權的 GitHub Pages 網域接管、以及 IBM Langflow 的 5 個 CVE,其中包括一個已被列入 CISA 已知遭利用漏洞目錄的重大 RCE。

行動事項: 將所有 Agent 框架依賴升級到最新的已修補版本。對您運營的任何 MCP 伺服器執行安全稽核。檢視 Check Point 的揭露內容,取得各框架的修復步驟。將 Agent 安全評估視為生產環境的必備要求,而非未來考量。

值得關注的事項

  • Claude Code 自動模式於 8 月 14 日成為預設——密切注意企業採用模式,以及最初幾週的任何安全事故。
  • MCP 無狀態採用曲線——觀察主要 MCP 伺服器供應商是否會在 12 個月棄用時鐘迫使問題發生之前遷移至 2026-07-28 規範。
  • Muse Code 的企業接受度——Meta 以資料換折扣的定價模式將揭示企業是否願意以訓練資料換取更低的成本。
  • Kitesurf 開源時程——Cloudflare「準備好後」開源的承諾相當含糊;追蹤社群是否會在此之前採用它。
  • OpenClaw 2026.7.2 穩定版升級——beta.7 明顯已具備生產就緒性;關注穩定版升級與 extended-stable 管道的更新。
  • Agent 安全的監管回應——同一週出現 11 個框架漏洞與一個 CVSS 10.0,預期 NIST 與歐盟監管機構將加強審查。

展望未來

MCP 的無狀態修訂是本季度的基礎設施大事。從協定中移除會話狀態,同時消除了擴展限制與攻擊面——Terraform MCP 的 CVSS 10.0 證明了基於會話的設計不僅在營運上受限,而且實際上很危險。憑藉每週 5,200 萬次的 npm 下載量,MCP 已成為 AI Agent 生態系的連結組織,而這次規範修訂確保它能以規模承擔這個角色。

Claude Code 自動模式成為預設,是 Agent 編碼的分水嶺時刻。數據——89% 的攔截率對比人類的 13.6%、多交付 25% 的 PR、720 次嘗試零成功——有力地證明了自動化安全分類器在例行工具呼叫核准上優於人工審查。97% 的習慣性核准率早就告訴我們人類沒有在把關。將那些注意力轉向專用分類器是更好的工程,而不只是更好的使用者體驗。

Coding Agent 市場現在是真正的競爭局面。五款實力堅強的終端機型 Agent——Claude Code、Codex、Muse Code、Grok Build 與 Copilot——都在爭奪開發者的心智佔有率。Meta 以每百萬 token 0.10 美元的貢獻者層定價進入,對整個市場施加了降價壓力,而 Muse Code 的子代理扇出架構提高了 Coding Agent 的標準。Cloudflare 的 Kitesurf 解決的是另一個瓶頸——在沒有 Chromium 資源成本的情況下進行瀏覽器自動化——而錢包治理模式值得追蹤。

Agent 安全仍然是最重要的缺口。11 個框架漏洞、MCP 基礎設施中的一個 CVSS 10.0、一個正在被積極利用的重大 RCE,以及人類漏掉三分之一的權限威脅——這些都不是假設性風險。它們是生產事故。Agentic AI 系統的安全態勢需要跟上它們的採用曲線,工程領導者應將 Agent 安全評估視為當下的生產必備要求,而不是未來的考量。

未來九十天:評估 MCP 無狀態規範、為 Claude Code 自動模式做好準備、針對您團隊的需求評估 Coding Agent 版圖、依據已揭露的漏洞稽核您的 Agent 框架,並將 OpenClaw 鎖定在 extended-stable。基礎設施正在快速成熟。安全態勢必須跟上。

關注 X 上的持續分析:https://x.com/kkaminsk