DeepSeek 正式发布 V4 Pro,价格最高上调14倍,并重新开启80亿美元融资轮,估值达740亿美元。Moonshot AI 发布了 Kimi K3——一个2.8万亿参数的开源权重模型,成为首个登顶主要编程基准的中国模型。字节跳动 正在悄然预训练一个10万亿参数的模型——有史以来任何人尝试过的最大模型。中国现已占据全球AI模型前十名中的四席,中美AI差距在大多数任务上已缩小到统计上不可区分的程度。以下是本周的 China AI Weekly。


DeepSeek:V4 Pro、定价转型与740亿美元融资

V4 Pro 正式发布

DeepSeek 于8月13日正式发布 V4-Pro-0813,取代了4月的预览版——该预览版在某些独立测试中曾被自己更便宜的 sibling(V4 Flash)超越。正式版本带来重大升级:

  • 智能体能力——AI智能体工作流、终端操作和网络安全任务
  • 软件工程——DeepSWE 基准从预览版的12.8跃升至62.7
  • 100万token上下文窗口,最大输出384K,支持思考和非思考模式
  • Responses API 和 Codex 集成,面向开发者工具

根据 DeepSeek 自身报告的基准亮点:

基准V4 Pro 分数上下文
Terminal-Bench87.9略低于 Claude Fable 5 的88
CyberGym(网络安全)超越 Fable 5
AutomationBench超越 Fable 5
DeepSWE62.7预览版为12.8
Artificial Analysis 智能指数53(推理版)V4 Flash 为40

该模型可通过 API、应用、网页和合作平台的"专家模式"使用。

从价格杀手到高端定价

以"便宜AI"为品牌标签的实验室现在开始收取高端价格。DeepSeek 宣布自8月17日起大幅上调 API 价格

  • V4 Pro: 每百万输入token $1.32,每百万输出token $3.96(据 Artificial Analysis)
  • 相比 V4 Flash($0.14/$0.28),输入涨价9倍,输出涨价14倍
  • 峰值/非峰值定价:工作日峰值时段(北京时间9–12、14–18),输出token价格升至¥27/百万;非峰值为半价
  • 不同模型、token类型和时段的涨幅从**50%到1100%**不等

这标志着 DeepSeek 超低价阶段的终结。实验室需要变现——而现在的定价反映了实际能力。

740亿美元估值下的80亿美元融资

DeepSeek 于8月6–7日左右重新开启第二轮外部融资,此前在7月底暂停。暂停因创始人梁文锋关于英伟达依赖和中美AI差距的言论泄露而触发。

  • 目标: 约80亿美元,投前估值接近¥5000亿(约740亿美元)
  • 作为对比:2026年6月第一轮外部融资约74亿美元,估值约520亿美元——三个月内跳升至740亿美元,令人瞩目
  • Monolith Management 正在洽谈加入;现有投资方包括中国国家AI基金、网易、京东、IDG资本、忠朴资本和石象资本
  • 创始人梁文锋据报个人出资30亿美元
  • 协议预计8月底签署;2027年有望在上海IPO

DeepSeek Harness 团队——挑战 Claude Code

DeepSeek 成立了 “DeepSeek Harness Team”,开通了经腾讯认证的微信公众号,招聘构建智能体开发者工具的人才,目标是与 Anthropic 的 Claude Code 竞争。这表明 DeepSeek 的野心已超越原始模型,进入了智能体开发者工具领域——这个市场此前主要由 Anthropic 占据。

DeepSeek × 宇树科技——具身智能布局

DeepSeek 投资 ¥1.408亿(约2080万美元) 参与宇树科技上海IPO,计划联合开发人形机器人AI模型。这是 DeepSeek 首次公开进入具身智能和机器人领域——表明该实验室将物理世界AI视为下一个前沿。


Kimi K3:开源权重地震

2.8万亿参数,免费下载

Moonshot AI 发布了 Kimi K3——有史以来发布的最大开源权重模型:

  • 2.8万亿参数,采用 Stable LatentMoE 架构(896个专家,每token激活16个,约1040亿活跃参数)
  • 100万token上下文窗口,原生多模态(文本+图像)
  • 关键创新:Kimi Delta Attention (KDA)——混合线性注意力,将计算复杂度从二次方降至近线性;Attention Residuals (AttnRes)
  • 相比 Kimi K2 的扩展效率提升2.5倍
  • 使用约2万块英伟达芯片训练——考虑到美国出口管制,这一点值得注意

完整权重(1.56TB,分96个分片)于7月27日在 Hugging Face 上以修改版 MIT 许可证发布,30分钟内即登顶趋势榜。基础模型已开源;后训练流程(RLHF、工具使用、安全)仍为专有。

基准表现——首个登顶主要编程基准的中国模型

基准分数全球排名
Artificial Analysis 智能指数57.1全球第4
Frontend Code Arena1679 Elo第1——首个登顶主要编程基准的中国模型
SWE Marathon42.0%第1
Terminal-Bench 2.188.8%前三
MMMU-Pro(多模态)89.2%第2
BrowseComp91.2前三

定价:缓存输入token $0.30/百万,缓存未命中输入 $3/百万,输出token $15/百万——在混合工作负载上比 Claude Fable 5 便宜约40%。

需求过载

Moonshot 在发布48小时内暂停了所有新消费者订阅。需求将容量推至极限。现有订阅用户优先;新名额分批开放。公司声明:“Kimi K3 收到的爱远超我们的预期。”

全球排行榜现实

Artificial Analysis 2026年8月智能指数说明了情况:

模型分数实验室国家开源权重
Claude Fable 5(Opus 4.8回退)59.9Anthropic美国
GPT-5.6 Sol Max58.9OpenAI美国
Claude Fable 558.2Anthropic美国
Kimi K357.1Moonshot AI中国
GPT-5.556.4OpenAI美国
GLM-5.255.8Z.ai中国
Claude Opus 4.855.2Anthropic美国
DeepSeek V4-Pro54.6DeepSeek中国
Qwen3.8-Max53.9阿里巴巴中国部分
Gemini 3.1 Pro53.7Google美国

中国模型现已占据全球前十名中的四席。 中美前沿模型之间的差距已缩小到分析师所说的"在大多数任务上统计上不可区分"。这是当前现实,不是未来预测。


字节跳动:10万亿参数豪赌

有史以来尝试的最大模型

《金融时报》8月7日报道,字节跳动正在预训练一个高达10万亿参数的模型——有史以来任何人尝试的最大模型:

  • 架构:混合专家模型;约3万块GPU用于训练
  • 时间线:预训练3–6个月,意味着最早内部评估约在2026年11月至2027年2月;产品发布可能在2027年中后期
  • 最终参数量未锁定——10万亿是上限目标,不是最终确定数字

规模对比:

模型参数实验室
字节跳动(训练中)~10万亿(上限)字节跳动
Anthropic Mythos 5(估)~8万亿Anthropic
Anthropic Fable 5(估)~5万亿Anthropic
Kimi K32.8万亿Moonshot AI
Qwen3.8-Max2.4万亿阿里巴巴

该项目由字节跳动 Seed AI研究组织(约2000人)负责,由吴永辉(前Google DeepMind)领导。创始人张一鸣据报指示团队追求真正的技术突破,而非依赖西方AI系统的蒸馏——“不复制西方”。

没有模型名称,没有发布日期,没有基准成绩。这是一次泄露,不是发布。但规模表明了意图。


阿里巴巴:Qwen3.8-Max、苹果合作与开源权重收入分成

Qwen3.8-Max

阿里巴巴最大、最强模型:2.4万亿参数,Artificial Analysis 初步得分53.9。已在阿里云灵骏真武M890超节点上 powering 商业服务。

开源权重收入分成模式——业内首创

阿里巴巴计划要求 Qwen3.8-Max 的大型商业用户分享收入——这与行业惯例(开源权重发布可自由部署)有重大差异。这标志着中国开源权重战略从技术挑战向商业模式颠覆的成熟。如果该模式成功,预计其他中国实验室将跟进。

苹果合作——Qwen 驱动中国版 Apple Intelligence

苹果于8月8日发布了中文版Mac用户指南,指导用户将阿里巴巴 Qwen 连接到 Siri 和写作工具(macOS 26.6+)。该指南在约24小时内被撤下——苹果客服称功能未正式上线,监管流程可能仍在进行中。

另外,路透社8月14日报道,苹果已在阿里巴巴支持下训练了一个中国专属大语言模型——这背离了苹果依赖第三方模型的策略。网信办已于7月注册了苹果的生成式AI服务,为中国版 iPhone 上的 Apple Intelligence 扫清了道路。根据安排,Qwen 驱动 Siri 和写作工具;百度也贡献技术;阿里巴巴被禁止使用提交的材料进行训练。

世界上市值最高的公司现在在中国境内依赖中国AI。

阿里云超节点

8月12日在内蒙古乌兰察布启动灵骏真武M890超节点——中国首个成功运行超过2万亿参数大语言模型的超节点。设计支持高达10万亿参数的MoE模型推理。已在商业上为 Kimi K3 和 Qwen3.8-Max 提供服务。

QwenWork——办公AI整合

阿里巴巴于8月3日将 QoderWork、Wukong 和 MuleRun 合并为 QwenWork——桌面控制、云端执行和企业智能体在一个平台上。网页和PC公开测试版已上线;钉钉集成即将推出。这结束了内部"赛马"(平行竞争团队),转向集中化平台。

AI支出

阿里巴巴承诺3年内投入**¥3800亿(约530亿美元)用于云/AI基础设施(2025年2月宣布),现在表示将超过**这一承诺。过去四个季度在AI/云上已投入超过¥1000亿。2026年6月季度业绩将于8月20日发布。


腾讯:资本支出翻三倍,WorkBuddy 达2000万月活

2026年Q2财报——AI支出激增

腾讯8月12日发布的Q2业绩:

  • 营收:¥2048亿(304亿美元),同比增长11%
  • 资本支出:¥528亿(78亿美元),同比增长176%——接近三倍
  • 运营资本支出:¥518亿,同比增长190%
  • 规模之大足以使自由现金流转负(-¥138亿,而去年同期为+¥430亿)
  • 支出投向混元模型增强、推理、产品AI功能及外部云需求

腾讯股价在披露后下跌——市场担忧AI支出能否产生回报。AI基础设施军备竞赛正在以前所未有的速度消耗现金。

WorkBuddy——2000万月活用户

腾讯的 WorkBuddy AI智能体已突破2000万月活用户——在AI办公平台市场排名第一。7月20日的内部重组将 QClaw 产品中心(基于 OpenClaw 的桌面助手)并入 WorkBuddy 所在的云事业部。8月3日推出新功能。策略:轻量化、开放平台,面向中小企业——最低进入门槛,最广服务覆盖。


BAT 办公AI整合:两周内全部落子

大约两周内,BAT三巨头全部结束内部赛马,集中化办公AI产品:

公司整合平台日期策略
阿里巴巴QwenWork(QoderWork + Wukong + MuleRun)8月3日基础设施+钉钉集成
腾讯WorkBuddy(吸收QClaw)7月20日轻量化、聚焦中小企业、最广覆盖
百度百度搭子(吸收dodo)8月初智能体矩阵+内容生成+无代码
字节跳动豆包(吸收Lark)7月底高端、封闭生态

企业AI是新战场。整合表明实验阶段已经结束——这些公司现在正在争夺市场份额。


百度:AI营收超50%,8月18日发布财报

2026年Q1,AI相关业务首次占百度核心营收的52%——同比增长49%至¥136亿。AI云营收达¥113亿,基础设施部分增长79%,GPU云增长184%。自2023年3月推出文心以来,百度已在AI基础设施和模型上投入超过¥1000亿。

天池256卡超节点(基于昆仑芯片)已启动,支持文心、DeepSeek、GLM和MiniMax模型。百度正在将内部办公智能体"dodo"整合到百度搭子——会议、文档和知识库功能归入搭子的企业版。

Q2 2026业绩将于8月18日发布——将更新AI营收情况。管理层将其策略定位为"保持战略投资强度同时维护财务纪律"。他们不会试图以更大的资产负债表去拼支出。


中国AI监管:首个规范AI情感交互的国家

拟人化AI交互服务管理办法(7月15日生效)

中国颁布了**《拟人化人工智能交互服务管理暂行办法》**——首批规范AI与用户情感交互的全国性法规:

  • 要求生命周期风险评估、伦理审查、内容监控和事件响应程序
  • 强制"未成年模式":14岁以下用户需监护人同意、消费/使用限制;禁止向未成年人提供虚拟伴侣/亲属服务;禁止情感操纵设计
  • AI必须向显示过度依赖迹象的用户发送警告;每2小时提醒用户正在与AI对话
  • 执法是动真格的:首周即有12家公司因涉及情感依赖风险和未成年人保护的违规被罚款合计¥420万
  • 影响: 字节跳动、阿里巴巴和腾讯全部下架了其AI陪伴应用

北京是首个大规模规范AI情感交互的政府。执法速度——首周即开罚单——表明这不是纸老虎。

跨境和银行业规则

  • 国家金融监督管理总局(6月18日):银行业保险业AI安全发展和应用指导意见——7大支柱32项原则,包括高风险用例部署前需风险控制委员会审批、禁止将个人信息作为AI训练数据、外部采购AI模型须向网信办备案
  • 网信办跨境传输问答指引:澄清"单独同意"披露要求和常规传输的"必要性"测试
  • 出口管制: 商务部对美国无人机出口实施逐案审查(8月5日);新出入境条例(9月15日生效)允许当局阻止涉及出口管制/技术转移违规的公民出境

WAICO:中国全球AI治理机构扩展至37个成员

世界人工智能合作组织(WAICO)于7月16日在上海启动,来自29个国家的代表出席,截至8月中旬已扩展至37个成员国。中国的AI+国际合作倡议涵盖8个领域,包括共享开源生态系统、联合规则/标准和安全治理。该组织正在获得牵引力,成为中国对全球AI治理的回应。

WAIC 2026——史上最大规模

世界人工智能大会(7月17–19日,上海)为史上最大规模:1100+家企业,4400+件AI产品/服务展出。习近平发表主旨演讲,强调以人类智慧和国际共识引导AI,强调"智能经济"。中国核心AI产业在2025年超过**¥1.2万亿(1739亿美元),首次突破万亿大关,拥有6200+家AI相关企业。AI在关键行业(制造、医疗、金融、物流)的渗透率已达80%+**。

其他监管动态

  • 《反网络暴力法》草案(7月29日公开征求意见):禁止深度伪造和基于画像的定向骚扰
  • L3/L4自动驾驶强制安全标准(GB 44721-2026,2027年7月1日生效):生命周期管理、驾驶员接管、确认测试
  • AI内容标注自2025年9月起强制执行(显式+隐式元数据水印)
  • 9月1日缓解阀: 处理少于10万人个人信息的企业可认定为"小规模处理者",享受简化通知、同意和更长审计周期
  • 国家安全部两个月内第二次发布关于使用外国AI服务风险的警告
  • AI智能体安全分类分级标准草案——针对数据泄露、权限失控、工具滥用和行为偏离用户意图

基础设施与生态

全国AI算力建设

截至6月底,中国AI算力同比增长177%,达到2185 EFLOPS。首个由10万块国产芯片构建的AI超级集群已投入运营。国家监控调度平台处于试运行阶段,60%+的算力对其可见,跨区域调度任务。中国预计在"十五五"期间(2026–2030年)新增直接AI投资**¥4万亿(约5600亿美元)**,主要为民间资本。

初创企业注册激增(2026年上半年)

  • 5.5万家新生成式AI企业注册(同比增长28%)
  • 11.6万家新人形机器人企业(增长9.5%)——是新生成式AI企业数量的两倍多
  • 中国生成式AI用户基数:6.02亿(人口渗透率42.8%,年增长141.7%)
  • 796个生成式AI服务完成网信办备案;481个应用完成注册

资本市场助推AI

中国正在动员28万亿美元资本市场助推AI发展——从补贴转向股权/债券融资。企业自2024年以来已融资2170亿美元(对比美国竞争对手的1.4万亿美元,但中国融资成本远低,平均债券票息1.9%)。保险资金正在加深对硬科技IPO的投资。DeepSeek 对宇树科技的2080万美元投资恰逢宇树里程碑式的上海IPO。

GPU/芯片约束

美国对先进AI芯片的出口管制仍是主要约束——而非关税。中国采取双轨策略:通过MoE架构最大化计算效率,同时在国产芯片(华为、昆仑)上构建生态系统。据亚洲协会:“算力稀缺现在是一种可控状态,而非危机。”


地缘政治与国际

  • Manus AI 回购: 中国初创公司 Manus AI 的前投资者在监管机构命令解除交易后从 Meta 手中回购了公司——表明北京正在围绕本土技术建立防火墙
  • 美国正在审查中国AI公司如何在海外获取英伟达芯片以堵住漏洞
  • Palo Alto Networks 在中国接受网络安全审查——可能是对美限制的跨部门回应
  • 中国将14个欧洲实体列入出口管制清单——禁止未经授权供应两用品(包括稀土和永磁体)
  • 中国无人机出口2026年上半年增长26%至242万台(由东南亚、非洲、中东驱动);美国销售在出口管制下暴跌40%+
  • 欧盟AI法案2026年8月2日全面生效——执法权现已激活
  • 欧盟启动300亿欧元招标建设最多7个AI超级工厂(100亿公共+200亿私人资金)
  • 特朗普政府最终确定前沿AI模型自愿预发布测试框架——开发者在公开发布前自愿向政府提供约30天的早期访问
  • OpenAI 公开披露其即将推出的 Astra 模型可能已越过"关键"网络安全阈值——前沿AI短暂历史上最重要的安全披露

关注要点

  • DeepSeek 8月17日定价切换。 9–14倍的提价是中国AI实验室从补贴式颠覆转向商业可持续发展的最明确信号。关注 V4 Pro 需求在新价位是否能够维持——以及竞争对手是否跟进。
  • 阿里巴巴Q2业绩(8月20日)。 承诺¥3800亿且支出将超预期,阿里巴巴的财报将显示AI基础设施投资是否正在转化为云营收增长。
  • 百度Q2业绩(8月18日)。 AI已占百度核心营收50%以上。这一轨迹是否持续将决定整个BAT的AI变现基调。
  • 字节跳动10万亿模型时间线。 如果10万亿模型在11月至2月的内部评估窗口内达成,预计会有基准泄露——以及全球排行榜的潜在阶跃变化。
  • AI陪伴监管执法。 首批罚单在第一周开出。关注监管机构是否将范围从陪伴应用扩展到更广泛的AI交互服务。
  • Apple Intelligence 中国上线。 指南发布后24小时内被撤下。监管审批已到位,但功能未正式上线。关注激活它的 iOS 更新。

本周的 China AI Weekly 由三个构造性转变定义:DeepSeek 从价格杀手到商业实体的转型,Kimi K3 证明开源前沿现在在中国,以及字节跳动押注10万亿参数于"不复制西方"的未来。中美AI差距不再是差距——这是一场比赛,在大多数指标上,势均力敌。

正在构建能够经受下一次监管转变的AI架构? Big Hat Group 提供企业AI咨询和Azure原生部署,为需要厂商中立编排、模型网关模式和跨开源与专有模型文档化治理的团队服务。无论您是在评估 Kimi K3、制定 DeepSeek 集成策略,还是应对中国AI监管环境,预约探索性会议来明确工作范围。

X 上关注我们,获取这些故事发展的实时分析。


来源:

  • 路透社(8月13日、8月14日):DeepSeek V4 Pro发布、苹果-阿里巴巴合作
  • 彭博社(8月14日):DeepSeek 80亿美元融资、腾讯财报
  • 《金融时报》(8月7日):字节跳动10万亿参数模型
  • Artificial Analysis(2026年8月):全球AI智能指数
  • CGTN(8月9日、8月14日):中国AI算力、DeepSeek发布
  • Global Times(8月9日、8月12日、8月13日):WAIC 2026、阿里超节点、监管
  • China Daily(8月13日):DeepSeek V4 Pro报道
  • CSIS PacTech Pulse(2026年8月):WAICO、出口管制
  • Semafor(8月13日):Manus AI回购、芯片获取审查
  • 亚洲协会(8月13日):算力稀缺评估
  • Kiteworks(8月12日):AI监管合规
  • Rest of World(8月10日):AI陪伴应用监管
  • 韩国经济日报(8月14日):中国AI人才池、资本市场
  • AIN China(8月9日、8月11日):Kimi K3基准、DeepSeek Harness团队
  • LongYield Substack(8月14日):BAT办公AI整合、百度分析