Anthropic 的变化节奏没有丝毫放缓的迹象。本周带来了一系列重磅消息:原定的 Sonnet 5 涨价取消、所有 Claude 输出全球启用隐形水印、Claude Code 默认切换为自动模式、六天内发布七个版本,以及首批企业级 MCP 安全管控。对于 CTO 和工程负责人来说,影响是立竿见影的:预算预测需要修订、合规姿态需要重新审视,而你的 CI 流水线也变得更加自主。

Sonnet 5 定价:一场没有发生的涨价

本周 API 方面最重磅的消息:Anthropic 取消了原定于 9 月 1 日实施的 Claude Sonnet 5 涨价计划。 每百万输入/输出 token 2 美元/10 美元的入门价现已成为永久标准价格。定价页面上此前警告将上调至 3 美元/15 美元的脚注已被完全移除。

对于已按涨价做预算的 API 用户来说,这是一次实打实的成本削减——与此前公布的价格相比,输入成本降低 33%,输出成本降低 50%。此举看起来是竞争性策略。OpenAI 一直在下调旗舰产品定价,而让 Sonnet 5 保持亲民价位,有助于巩固其作为 Claude 产品线中最佳性价比层级的地位。如果你原本计划在 8 月 31 日之前提前安排批量任务,或为 token 效率重新设计架构,现在可以停手了。

隐形水印:SynthID 全球覆盖

Anthropic 确认了其隐形水印系统的详细技术规格,覆盖范围比预期更广。

该技术是 Google DeepMind SynthID-Text 方案的一个变体,相关论文于 2024 年发表在《Nature》上。水印机制使用加密密钥和上文词境(而非随机数生成器)来微妙地引导 Claude 在同等合理的候选词之间做出选择。没有隐藏字符、没有额外 token、没有成本增加、没有质量影响。覆盖范围是全球范围——不仅限于欧盟——涵盖 Claude Platform(API)、Claude.ai、Claude Code、Claude Cowork、Claude Tag,以及通过 AWS、Google Cloud 和 Microsoft Foundry 的部署。

触发因素在于欧盟《人工智能法案》第 50 条,该条款已于 2026 年 8 月 2 日起强制执行。Anthropic 于 7 月与约 190 家签署方共同签署了欧盟《人工智能生成内容透明度实践准则》。违规罚款最高可达 1500 万欧元或全球年营业额的 3%。2026 年 8 月 2 日当天或之后发布的模型自发布起即带水印;较旧模型处于过渡期内。

在文件层面,Anthropic 正在为受支持的图片格式(.png、.jpg、.svg)添加 C2PA 加密签名溯源元数据,不过 8 月 13 日的测试发现该功能在生成的图片上尚未生效——文件标记机制仍在逐步推出中。

水印检测 API “即将推出”,暂无公开发布日期。第三方目前无法验证水印。其局限性值得了解:检测结果为阳性仅表示 Claude “可能处理过"该内容——并不能确认内容完全由 AI 独立创作,也不能排除人工编辑的可能。没有水印并不证明文本出自人手。水印在大量改写后会退化,但在复制粘贴和轻度编辑后依然留存。水印不嵌入任何用户、账户或组织信息。

对企业而言,这主要是合规赋能——而非风险。但如果你的交付物中包含 Claude 生成的文本,且可能受到客户或监管机构的审查,那么现在正是更新 AI 披露政策的时候。

Claude Code:自动模式成为默认

自 8 月 14 日起,自动模式成为 Pro、Max 和 Team 套餐上新建 Claude Code 会话的默认权限模式。筛选工具调用的分类器取代了逐步手动审批提示。Anthropic 报告称,危险命令拦截率为 89%,而手动审批仅为 13.6%——这一反直觉的结果表明,人工审核员才是安全链条中的薄弱环节。随着会话时间拉长,人工表现进一步下滑。

分类器的 token 开销在 Pro、Max 和 Team 套餐上不再计费——最后一个成本障碍也被移除。Enterprise、API、Bedrock、Google Cloud 和 Microsoft Foundry 目前仍为可选开启,更广泛的推广计划在未来一个月内进行,并将提前通知管理员。

如需禁用:在 .claude/settings.json 中设置 disableAutoMode,或在 CLI 中使用 Shift+Tab 切换。管理员可通过托管设置中的 defaultMode 固定组织级默认值。拥有生产访问权限的组织应在 Enterprise 推广之前制定明确的策略。

六天七个版本:Claude Code v2.1.232–v2.1.237

本周的发布节奏非同寻常:

v2.1.232 默认启用了子代理分叉(subagent forking)——子代理现在可以分叉自己的会话,继承完整的对话和提示缓存,而无需冷启动。跨会话 @提及(@mentions)让会话之间可以用 @ 语法相互引用。三个安全修复解决了 PowerShell 权限绕过、Windows Git Bash 符号链接问题,以及嵌套 git 仓库的信任继承问题。

v2.1.233 新增了 GitLab MR 支持、Linux 内存 cgroup 限制(CLAUDE_CODE_TOOL_MEMORY_LIMIT,防止失控构建拖垮会话),以及一个 WebFetch 缓存 TTL 环境变量。还有一个破坏性变更:todo/任务跟踪工具(TaskCreate、TodoWrite 等)现已在 Opus 4.8、Sonnet 5 及更新型号上默认禁用。可通过 CLAUDE_CODE_ENABLE_TODO_TOOLS=1 重新启用。理由是新型号模型可以在对话中自行管理任务,无需工具。

v2.1.234 是最大的一次发布——51 项变更,包括新的 /design 技能(研究预览版,可在 Claude Code 内生成画板选项)、用量限制重置时自动继续,以及 12 项安全更新。近四分之一的变更都与权限或信任相关。

v2.1.235 新增了内置拼写检查、带实时播报的 VS Code 屏幕阅读器支持,以及用于跨会话通信的 notify_when_idle

v2.1.236–v2.1.237 引入了 ANTHROPIC_DEFAULT_MODEL 环境变量(用于指定新会话使用的模型)、内置的 “Concise”(简洁)输出风格,以及网关缓存修复。

如果你的工作流依赖 todo 工具,v2.1.233 的破坏性变更需要立即处理。如果在这个快速发布阶段需要稳定性,请锁定你的 Claude Code 版本。

Playground 取代 Workbench

Anthropic 推出了 Claude Playground,取代 Claude Console 中的旧版 Workbench。Playground 支持 Messages API 的全部参数,并在每次运行时同时展示完整的 SDK 请求和 API 响应。任何内容都不会存储在 Anthropic 的服务器上——当前草稿只保存在浏览器中。

关键改进在于:旧版 Workbench 与 API 实际发送的内容存在偏差。提示词在浏览器中看起来没问题,但在代码中行为可能不同。Playground 通过让确切请求可见来弥合这一差距。可用的请求可以导出为代码片段。

需要采取的行动: 已保存的 Workbench 提示词、变量和评估(evals)可在 2026 年 9 月 1 日之前从 Console 设置中导出为 JSON。之后数据将被清除。三个实验性的提示工程端点现在会返回错误。

Google Workspace 写入操作

Anthropic 扩展了其 Google Workspace 连接器的写入能力。Gmail 现在可以发送、回复和转发邮件(在现有搜索/读取/草稿功能之外)。Google Drive 现在可以共享、移动和删除文件(在现有搜索/读取/上传功能之外)。

所有发送/回复/转发(Gmail)和共享/移动/删除(Drive)操作默认开启人工介入审批(human-in-the-loop)。Team 和 Enterprise 套餐所有者可以决定成员是否可以跳过逐操作确认。适用于所有付费套餐,覆盖 Claude 网页版、桌面版、移动端、Claude Code 和 Claude API。

对于涉及 Gmail 或 Drive 的代理工作流,这开辟了新的自动化路径——但默认审批模式意味着你需要在工作流设计时围绕确认步骤做规划。

MCP 安全迎来企业级管控

MCP 2026-07-28 规范转向无状态协议,正在催生首批真正的安全工具。Cloudflare 推出了两项重要能力:

  • Gateway MCP 检测(beta): Cloudflare Gateway 中的 experimental.is_mcp == true 选择器可让企业在网络层检测、记录和阻止 MCP 流量。无状态模型意味着每个请求的元数据都可见——无需解析 JSON 请求体。
  • WriteGuard(私有 beta): 在网关层面精细控制特定 MCP 服务器可以做什么——只读、限制写入等。

这是针对 MCP 流量的首批企业级安全管控。如果你在受监管环境中部署 MCP,请将 Cloudflare 的管控与 MCP 项目发布的安全最佳实践指南(强调沙箱化进程、严格的文件系统访问控制,以及无状态模型的逐请求授权)结合评估。

新规范的采用尚处于早期:目录中 755 个服务器和客户端里,只有 13 个已验证支持 2026-07-28 修订版。但仅在 2026-W33 这一周,GitHub 上就新增了 2,501 个与 MCP 相关的仓库,MCP npm SDK 月下载量已达 1.959 亿次——超过了所追踪的所有其他 AI 集成包。

自托管 Claude Code Runner:公开测试

Claude Code 的自托管环境面向 Team 和 Enterprise 套餐进入公开测试阶段。一条 claude self-hosted-runner 命令即可将会话保留在客户自有的基础设施上。仓库检出、构建产物、密钥,以及会话创建或修改的任何文件都留在你的硬件上。只有模型推理调用会发送到 Anthropic。

Runner 模式包括固定模式(设定固定数量的常驻 runner)和按需模式(自动扩缩容编排器)。支持的会话来源:Web、移动端、桌面应用、claude --cloud 和定时 Routine。ZDR 组织不可用。

对于有数据驻留或网络隔离需求的受监管行业,这是本季度值得评估的功能。

生态信号

这些数据讲述了一个超高速增长平台的故事。Anthropic 的收入年化运行率(run rate)在 7 月底达到 650 亿美元,2026 年 Q2 初步收入为 115 亿美元——同比增长 14 倍。保密 S-1 文件已于 6 月 1 日提交给美国证券交易委员会(SEC),目标是在 10 月登陆纳斯达克,这可能是史上最大的 IPO。

MCP 生态现已覆盖每月 4 亿+ 次 SDK 下载、Claude 连接器目录中的 950+ 个服务器,以及每月处理 10 亿+ 次工具调用。Claude Code 技能生态已爆炸式增长至 23,500+ 个插件和 4,000+ 项技能,目前有 16 个代理客户端读取同一种 SKILL.md 格式。GitHub trending 上满是 Claude Code 项目——从知识图谱可视化器到记忆方案,再到安全审查工具。

但增长也伴随着摩擦。独立审计发现,52% 已收录的 MCP 服务器处于废弃状态,只有 17% 达到合理的生产标准。r/ClaudeCode(37.2 万成员)上的 Reddit 情绪喜忧参半——对 2,611 个热门帖子进行的元分析发现,该子版块"更像投诉论坛而非粉丝俱乐部”,常见抱怨集中在模型能力退化、定价和审核方面。发现的便捷性和信任才是瓶颈,而不是服务器数量。

破坏性变更与截止日期

日期事件需要采取的行动
8 月 17 日(已过)旧版 Workbench 访问结束9 月 1 日前从 Console 设置导出已保存的提示词/变量/评估(JSON)
2026 年 9 月 1 日Workbench 数据导出截止从 Console 设置导出剩余数据
2026 年 9 月 1 日Sonnet 5 涨价已取消——$2/$10 现为永久价格
2026 年 8 月 31 日Claude Code +50% 用量提升延期结束关注是否有进一步延期
2026 年 9 月 29 日Claude Sonnet 4.5 计划退役迁移到受支持的模型
2026 年 10 月 15 日Claude Haiku 4.5 计划退役迁移到受支持的模型
2026 年 11 月 24 日Claude Opus 4.5 计划退役迁移到受支持的模型
持续进行MCP 2026-07-28 迁移评估哪些 MCP 服务器使用了 Roots、Sampling 或 HTTP+SSE——这些均已弃用。12 个月窗口期。

行动清单

  1. 修订预算预测——Sonnet 5 涨价已取消。$2/$10 为永久价格。从你的预测中移除原计划的 9 月成本增加。
  2. 更新 AI 披露政策——水印已上线且覆盖全球。如果客户交付物包含 Claude 生成的文本,请确保你的披露做法考虑到了可检测的 AI 生成内容。
  3. 在 Enterprise 推广前制定自动模式策略——自动模式现已是 Pro/Max/Team 的默认设置。如果你在 Enterprise 上,请在更广泛推广之前确定你的立场。审查 .claude/settings.json 中的拒绝规则。
  4. 在 9 月 1 日前导出 Workbench 资产——已保存的提示词、变量和评估将在该日期后被永久删除。
  5. 按需重新启用 todo 工具——v2.1.233 默认禁用了 TaskCreate/TodoWrite。如果你的工作流依赖它们,请设置 CLAUDE_CODE_ENABLE_TODO_TOOLS=1
  6. 评估 Cloudflare MCP 安全管控——如果你在受监管环境中部署 MCP,Gateway MCP 检测和 WriteGuard 是目前可用的首批企业级管控。
  7. 规划自托管 runner 评估——如果你的组织有数据驻留或网络隔离需求,公开测试已在 Team 和 Enterprise 套餐上开放。
  8. 评估 MCP 2026-07-28 迁移——识别你的哪些 MCP 服务器使用了已弃用功能(Roots、Sampling、HTTP+SSE)。新服务器应从第一天起就面向无状态协议。

这个平台正在加速复利增长。自动模式、永久定价、全球水印和企业级 MCP 安全管控并非孤立的更新——它们共同构成了一股推动自主、合规、企业就绪的 AI 基础设施的合力。10 月的 IPO 将带来更多审视和更快的节奏。对工程领导者而言,问题在于你的架构和治理框架能否跟得上这个速度。

x.com/kkaminsk 关注我们,获取每周 Claude 生态分析。