Anthropic 本周发布了自六月以来最重要的版本。Claude Fable 5.1 和 Mythos 5.1 于 9 月 1 日上线,缓存读取价格降低 75%,使长时间运行的代理大幅降本。企业前沿安全框架(EFS)解决了阻碍受监管行业采用的数据留存僵局。Claude Code 新增跨会话消息功能。IPO 机器正在运转——S-1 已提交,招股书预计劳工节后发布,目标估值 2 万亿美元,将打破 SpaceX 的纪录。

对工程领导者来说,问题不再是是否采用 Claude,而是你的架构能以多快的速度消化这种迭代节奏。

Fable 5.1 与 Mythos 5.1:两个模型,一个引擎

Anthropic 于 9 月 1 日发布了 Claude Fable 5.1(全面可用)和 Claude Mythos 5.1(受限访问)。两者共享同一底层引擎,但具有不同的安全配置文件。Fable 5.1 是通用前沿模型:API ID 为 claude-fable-5-1,100 万 token 上下文,最大输出 128K,自适应思考始终开启,知识截止期延长至 2026 年 6 月。Mythos 5.1——仅通过网络安全验证计划和新的生命科学验证计划提供——可以发现软件漏洞但不能开发漏洞利用,并能处理 Fable 安全限制会阻止的生物查询。

定价:缓存革命

列表价格不变,每百万 token 输入 $10/输出 $50。真正的故事是缓存读取:从每百万 token $1.00 降至 $0.25——降幅 75%。净效果:典型工作负载便宜约 25%,缓存密集型代理运行最多便宜 45%。如果你按 token 计费或管理每代理预算,请重新评估任何 Fable 5 自动化;新的成本结构可能会改变模型选择。

三个破坏性变更

强制工具调用已移除。 tool_choice: {"type": "any"} 或命名工具现在返回 400 错误——自适应思考在每轮都运行,强制调用会跳过思考。请切换到 {"type": "auto"} 配合严格工具使用或结构化输出。

思考块是单向的。 Fable 5.1 可以读取早期模型的思考块;但没有早期模型能读取它的思考块。混合模型的管道需要重新设计。

历史编辑会使思考块失效。 在思考块之前编辑任何内容(系统提示、工具、早期消息)会导致出错或静默丢弃该块。默认对 2026 年 8 月 31 日之后创建的 API 账户启用强制执行。保持对话历史仅追加,并原样传回思考块。

基准测试

Fable 5.1 在 Anthropic 发布的每个基准测试上都领先 Claude Opus 5。亮点:Terminal-Bench-Science 达到 52.6%——是 Fable 5 的 24.7% 的两倍多——AutomationBench 几乎翻倍,编程基准 55.8%。Anthropic 表示低/中等努力设置现已匹配 Fable 5 的结果。DataCamp 的建议仍然适用:日常聊天继续使用 Sonnet 5 或 Opus 5;Fable 5.1 专为长时间跨度、无人值守的代理运行而构建,缓存节省会复利累积。

企业前沿安全框架:数据留存问题已解决

对企业采用而言,EFS 可能比模型发布更重要。Anthropic 的 30 天数据留存政策引发了受监管行业的强烈反弹。EFS 取代了它:滥用检测数据保留在客户自己的云基础设施(AWS S3、Azure Blob、Google Cloud Storage)上,使用客户管理的密钥。Anthropic 的自动化系统标记模式;警报路由到客户的审查团队——默认无 Anthropic 人工审查。免费,与 100 多家企业合作开发,2026 年秋季起在 API、Bedrock、Vertex 和 Microsoft Foundry 分阶段推出。在此之前,符合条件的客户在 Fable 5.1 上获得零数据留存。这是那种能解除银行、医疗和政府采购封锁的治理基础设施。

合规说明: 所有 Fable 5.1 文本输出携带不可见的统计水印(Files API 媒体带 C2PA 凭证)——符合欧盟 AI 法案行为准则,输出质量无降级。检测 API 处于私有预览阶段。

Claude Code:跨会话消息

8 月 7 日至 9 月 3 日发布了九个版本(v2.1.224–v2.1.260)。亮点:会话现在可以直接相互消息。ListAgents 发现活跃会话;SendMessage 向命名会话传递文本(在提示中使用 @name)。只有消息本身传输——无历史、无文件;同机流量使用本地套接字或命名管道,从不经过 Anthropic 服务器。控制项:crossSessionInbound(接受/待批准/拒绝,按会话设置)、notify_when_idle,组织可完全禁用这两个工具。

自 v2.1.252 以来的亮点:Fable 5.1 成为 Fable 模型的默认选择;/effort s 仅更改当前会话努力;/doctor 警告陈旧的沙箱掩码;/code-review --comment 评论 GitLab MR;全屏 /diff 面板;--permission-prompts none 用于无人值守的无头运行。分叉子代理默认继承完整上下文和提示缓存(自 v2.1.232 起),支持五级嵌套,默认 20 个并发。正在形成的多代理模式:并行会话加 git worktree

关注速率限制: 9 月 14 日起每周限制在原始基线基础上提高 25%——但这取代了临时的 50% 提升,实际容量下降约 17%。请相应规划高强度的 Claude Code 周。

MCP:事实代理标准走向成熟

MCP 已跨越鸿沟:10,000+ 公共服务器,每月 4 亿次以上 SDK 下载(2026 年增长 4 倍),Linux 基金会治理——AWS、Google、Microsoft 和 OpenAI 为白金成员——并被 Claude、ChatGPT、Cursor、Copilot Chat 和 Gemini CLI 广泛采用。

2026-07-28 规范——自发布以来最大的修订——使协议无状态化:无 initialize 握手、无会话 ID,每个请求在 _meta 中自包含。服务器可在标准负载均衡器后水平扩展。Roots、sampling 和 logging 进入 12 个月退出期。

8 月 22 日的路线图优先关注代理身份和企业安全:DPoP、工作负载身份联合和企业托管授权将取代基于浏览器的人工批准——因为调用方越来越多地是云工作负载。渐进式发现让服务器逐步展示工具,而不是将整个目录倾倒到上下文中。FastMCP 4.0 于 8 月 31 日基于无状态规范发布,GitHub 的 MCP 服务器转向按工具授予 OAuth 范围——一项真正的安全改进。

连接器的企业托管授权已 GA(Asana、Atlassian、Canva、Datadog、Figma、Linear、Notion、Slack、Supabase;Exa、Miro、Zoom 即将推出):授权一次,员工通过 IdP 组继承访问权限。

生态系统:采用、收入、IPO

JetBrains 2026 年调查(15,000+ 开发者)显示 Claude Code 全球采用率达 39%——美国开发者中为 47%——而 GitHub Copilot 从 29% 下滑至 21%。企业采用以 78% 领先(LeadDev)。

业务数据前所未有:650 亿美元收入运行率(2026 年 7 月,高于 12 月的 90 亿),任何前沿实验室的首个调整后营业利润(Q2 约 5.59 亿美元),1,000+ 年消费 100 万美元以上的企业客户。S-1 已提交;招股书预计劳工节后发布;9 月底或 10 月中旬上市,目标估值 2 万亿美元以上,募集 750–1,000 亿美元——史上最大 IPO,超越 SpaceX。Fortune 的警示:2 万亿美元估值意味着需要 590–790 亿美元年利润才能匹配纳斯达克 100 倍数;Anthropic 才刚刚盈利。仅 2026 年的算力承诺就超过 2,000 亿美元(Nscale 450 亿、SpaceX 450 亿、Fluidstack 500 亿、Lambda 350 亿),另有 Macquarie/GIC 的 Theseus Infrastructure 合资项目。

截止日期与行动项

本周: 将 Claude Code 更新至 v2.1.260;审计 tool_choice: {"type": "any"} 用法(在 Fable 5.1 上会出错);检查 Python SDK 1.x 要求(httpx2、Python 3.10+)。

本月: 基于缓存成本经济学评估 Fable 5.1 用于生产代理管道;围绕 9 月 14 日速率限制下调做规划;通过 IdP 配置企业托管 MCP 授权;检查 API 代码中的思考块处理。

战略层面: 受监管行业应与 Anthropic 接洽 EFS——留存障碍已消除。为 MCP 的无状态迁移、DPoP 和渐进式发现做预算。关注 IPO:预计 Q4 定价压力、功能加速和企业定位将加剧。试点 git worktree 加并行 Claude Code 会话用于多代理开发。

Anthropic 正在以面向公开市场审视的节奏构建全栈——模型、工具、协议标准、治理、生态系统、基础设施。问题在于你的路线图能否跟上。

x.com/kkaminsk 关注每周 Claude 生态系统分析。