2026 年 8 月 29 日至 9 月 5 日这一周,工程负责人需要关注三条主线:SpaceXAI 的 Grok 4.7 距离发布仅剩十天,2.1 万亿参数模型使用航空航天遥测数据训练;ChatGPT、Claude 和 Grok 在 9 月 3 日 90 分钟内相继宕机;Grok Bot 企业版将持久 AI 智能体的入门价降至 $20/月。

面向工程负责人的 TL;DR: (1) Grok 4.7 目标 9 月 12 日发布——2.1T 参数,比 4.6 大 40%,训练数据包含 SpaceX 工程记录;请立即准备模型评估流程。(2) 同时宕机事件暴露了云集中化风险——三个独立平台在 90 分钟内先后失败,这不是你可以提前规划的巧合;请在智能体基础设施中构建多供应商容灾。(3) Grok Bot 企业版以 $20/月(Cursor Pro)起步,提供隔离 VM、审计控制和两周免费试用——这是目前市场上最便宜的持久智能体方案。(4) Tesla 夏季更新让 Grok 控制车辆——语音控制功能、三个月内 FSD 监督模式。(5) Grok 4.6 在生物安全基准测试中 outright 获胜——唯一在拒绝危险生物请求和完成合法生物工作两项指标上均超过 50% 的模型。

Grok 4.7:2.1 万亿参数,SpaceX 数据,9 月 12 日目标

马斯克于 9 月 2 日在 X 上发帖称"Grok 4.7 还有 10 天出来",将 9 月 12 日定为目标日期。该模型为 2.1 万亿参数——比 Grok 4.6 的 1.5T 增长 40%。初始预训练于 8 月 12 日完成;最终训练阶段正在注入 SpaceX 工程记录、遥测数据、内部文档和 Starlink 卫星数据。

没有其他 AI 实验室能以这种规模获取航空航天工程遥测数据。补充训练数据足够新颖,既可以成为竞争护城河,也可能带来新型风险——取决于物理系统推理能力是否能迁移到软件和智能体任务上。

已知信息: 比 4.6 大 40%,声称更高 token 效率,推理速度可能略慢。未知信息: 截至 9 月 5 日,尚未发布模型 ID、定价、上下文窗口或基准测试卡。xAI 开发者文档仍将 Grok 4.6 列为最新模型。时间线已两次推迟(8 月 22 日 → “3-4 周” → “10 天”),因此请将 9 月 12 日视为目标,而非承诺。

行动项: 为新前沿模型发布准备评估流水线。如果你通过 API、Bedrock、Vertex 或 Foundry 使用 Grok 4.6,请检查供应商的推出时间线——4.6 很可能与 4.7 并行提供。计划使用自己的评估套件运行基准测试,而非依赖 xAI 发布的数字。

9 月 3 日 AI 大宕机

美国东部时间 9 月 3 日星期四上午 9:30,Grok 开始返回"模型不可用"错误。10:30,Claude 跟进。11:00,ChatGPT 开始失败。约下午 3:00,三个服务全部恢复。

Grok 的宕机追溯到 xAI 的孟菲斯计算中心(Colossus 数据中心)——据 xAI 官方声明为硬件问题。OpenAI 和 Anthropic 分别引用了不同原因。尚未确认共同根因,尽管有人推测指向共享的 Azure East US 云基础设施。没有供应商确认这一点。

该事件立即引发了关于云基础设施集中化的质疑。当三个拥有不同架构、不同模型和不同服务栈的独立 AI 平台在 90 分钟内先后失败时,独立故障模式的假设就站不住脚了。如果你的智能体基础设施依赖单一 LLM 供应商——或多个供应商共享同一云骨干——9 月 3 日就是你的警告。

行动项: 在智能体基础设施中构建多供应商路由。OpenClaw 的模型回退链和供应商无关路由是正确模式。在需要之前测试故障切换。独立跟踪供应商状态页面——Downdetector 在官方渠道承认之前就捕获了此次事件。

Grok Bot 企业版:$20/月入门,隔离 VM,做真实工作

xAI 于 9 月 3 日与宕机同时推出了 Grok Bot 企业版。定价结构极具攻击性:

  • 两周免费试用,面向 Grok 和 Cursor 企业客户
  • Cursor Pro $20/月是包含 Grok Bot 访问权限的最低付费层级
  • SuperGrok $30/月Cursor Teams Standard $40/seat/月构成入门级选项
  • 最高层级:SuperGrok Heavy $300/月

Grok Bot 智能体在隔离的云计算机上运行,配备专用虚拟机。它们可以执行命令、浏览网页、交互应用程序,并在用户离线时继续工作。企业治理包括访问控制、网络控制和审计控制。你可以邀请整个组织,包括没有现有席位的人。

用例定位是"初级队友"——起草销售跟进邮件、通宵筛选候选人、跟踪供应商费用、审计代码。每个计划有每周使用额度限制,超额按需按 token 消费计费。

行动项: $20/月的入门价让试点变得轻而易举。从非生产工作流开始——代码审计、文档摘要或研究分拣。在给智能体生产系统访问权限之前,评估审计日志和隔离保障。两周试用是目前企业智能体市场中风险评估成本最低的窗口。

Grok Bot 的 X 集成与插件生态扩展

8 月 29 日,xAI 发布了首个 Grok Bot 原生 X 连接器——只读,但功能完备。智能体可以搜索 X 帖子、阅读用户时间线、查看提及、汇总平台活动和管理书签。xAI 为没有开发者账号的用户自动创建 X 开发者账号,付费 Grok Bot 用户获得免费 X API 额度。

连接器为只读——不支持通过原生集成发帖、回复、点赞或私信。xAI 称之为"第一个版本"。智能体仍可通过外部发布层(如 Blotato 等 MCP 服务器)在 X 上发帖,因此只读限制仅适用于原生连接器,而非平台整体。

X 之外,插件生态系统显著扩展:

  • Microsoft 插件(9 月 1 日):直接访问 Outlook、日历和 OneDrive
  • Firecrawl 插件:完整的智能体网页爬虫和搜索检索
  • Stripe Link 集成:智能体可以在互联网上购物
  • Webhook 触发器:智能体可通过例程中的 webhook 触发器从任何地方被唤醒
  • 模板共享:用户可创建并分享自定义 Bot 模板
  • Android 应用于 9 月 2 日上线
  • X Ads MCP:用自然语言创建、编辑、暂停和检查广告活动

Stripe Link 集成值得关注。能购物的智能体引入了新的威胁面——在启用前评估消费限制和审批工作流。

Tesla 夏季更新:Grok 作为车辆控制器

Tesla 的 2026.26 软件更新将 Grok Voice Think Fast 2.0 引入车内,使其成为真正的车辆控制器。语音命令现在可以处理电话、音乐、空调、加热座椅、方向盘加热、狗模式、露营模式、生物武器防御模式、手套箱、后视镜、雨刷、超充搜索、导航、胎压、行车记录仪、哨兵模式和充电口控制。

该模型为语音到语音架构——在说话时推理,而非说完再推理。硬件要求为 AMD 架构信息娱乐系统,软件 2025.26+。需要 Premium Connectivity 或 Wi-Fi;没有端侧回退。车内使用计入 Grok 账户速率限制。仍标记为 Beta。

马斯克表示,语音输入将在约三个月内进入 FSD 规划层——首次实现语音影响驾驶行为。Robotaxi 的对话式"监督者"模式即将到来:“把我放在入口,然后去停车。“Grok Bot 车内集成正在准备中。

相同的 Grok 模型运行 Optimus 人形机器人的语音界面。Starlink 每天使用 Grok Voice 处理 15,000+ 入线支持和销售电话——诊断硬件问题、运送替换件、每周完成 3,000+ 订单。Cybercab(无方向盘版)于 9 月 3 日在奥斯汀发布。

行动项: 对于构建语音界面的团队,Grok Voice Think Fast 2.0 的语音到语音架构是值得关注的方向——生成时推理消除了让对话式语音智能体感觉机械的延迟。如果你在汽车或机器人领域,Tesla 的集成证明了前沿 LLM 可以处理实时控制界面。

Grok 4.6 生物安全基准测试

9 月 1 日,xAI 公布了 LatchBio 独立 BioSecBench-Refusal 分析结果。Grok 4.6 是唯一在两项指标上均超过 50% 的测试模型:拒绝伪装的危险生物请求约 59.2%,完成常规生物工作约 64.8%。加权调和均值约 62.1%。

在 BioSecBench-Surveillance(约 53.5%)上,Grok 4.6 落后于 Anthropic Opus 5,但超过 GPT-5.6 Sol。LatchBio 指出,拒绝主要由模型推理驱动,而非 API 过滤器——在其他生物基准测试上没有明显退化。

这很重要,因为生物安全正在成为竞争性评估前沿。如果你在医疗、制药或生物技术领域,没有误报瘫痪的拒绝率是决定模型能否在生产中使用的指标。

SpaceXAI 公司背景

公司结构现已完全整合。SpaceX 于 2026 年 2 月以约 $2500 亿全股票交易收购 xAI(合并估值约 $1.25 万亿)。SpaceXAI 于 2026 年 8 月收购 Cursor(Anysphere)。SpaceX 于 2026 年 6 月 IPO——史上最大 IPO。Grok 4.6 分布在 xAI API、Cursor、Grok Build、GitHub Copilot、Amazon Bedrock、Google Vertex AI、Microsoft Foundry、OpenRouter、Vercel 和 Cloudflare 上。

Grok 4.6 API 定价:$2/M 输入,$6/M 输出(200K token 以下);$4/M 输入,$12/M 输出(200K token 以上)。缓存输入:xAI API 和 OpenRouter 上 $0.50/M,Vertex AI 上 $0.30/M。

关注什么

  • 9 月 12 日——Grok 4.7 目标发布日期。预期可能推迟;为此做好规划。
  • 未来 3 个月——Tesla FSD 语音输入进入规划层。首次语音到驾驶行为集成。
  • Grok 5——目标在 2026 年底前。除马斯克的月度前沿模型发布承诺外,暂无细节。
  • Stripe Link——随着智能体获得购买能力,监控消费控制事件。

展望

本周的故事汇聚于一个主题:数字 AI 与物理 AI 之间的边界正在消融。Grok 4.7 用航天器遥测数据训练。Grok Voice 控制 Tesla。Grok Bot 通过 Stripe 花钱。Starlink 的支持热线由 Grok 接听。同时宕机证明了这种融合带来系统性风险——当你的车、你的编程智能体、你的支持热线和你的研究助手都依赖同一模型家族通过同一云骨干运行时,一个数据中心的故障就会让一切瘫痪。

管理好这件事的团队会将多供应商路由视为基础设施,而非可选项。他们会在下一次集群事件之前而非之后评估智能体隔离。他们会以 $20/月试点 Grok Bot——因为了解企业智能体能做什么和不能做什么,最便宜的方式就是本周对一个真实工作流运行一个。

请在 X 上关注持续分析:https://x.com/kkaminsk