DeepSeek 正式发布 V4 Pro,价格最高上调14倍,并重新开启80亿美元融资轮,估值达740亿美元。Moonshot AI 发布了 Kimi K3——一个2.8万亿参数的开源权重模型,成为首个登顶主要编程基准的中国模型。字节跳动 正在悄然预训练一个10万亿参数的模型——有史以来任何人尝试过的最大模型。中国现已占据全球AI模型前十名中的四席,中美AI差距在大多数任务上已缩小到统计上不可区分的程度。以下是本周的 China AI Weekly。
DeepSeek:V4 Pro、定价转型与740亿美元融资
V4 Pro 正式发布
DeepSeek 于8月13日正式发布 V4-Pro-0813,取代了4月的预览版——该预览版在某些独立测试中曾被自己更便宜的 sibling(V4 Flash)超越。正式版本带来重大升级:
- 智能体能力——AI智能体工作流、终端操作和网络安全任务
- 软件工程——DeepSWE 基准从预览版的12.8跃升至62.7
- 100万token上下文窗口,最大输出384K,支持思考和非思考模式
- Responses API 和 Codex 集成,面向开发者工具
根据 DeepSeek 自身报告的基准亮点:
| 基准 | V4 Pro 分数 | 上下文 |
|---|---|---|
| Terminal-Bench | 87.9 | 略低于 Claude Fable 5 的88 |
| CyberGym(网络安全) | 超越 Fable 5 | — |
| AutomationBench | 超越 Fable 5 | — |
| DeepSWE | 62.7 | 预览版为12.8 |
| Artificial Analysis 智能指数 | 53(推理版) | V4 Flash 为40 |
该模型可通过 API、应用、网页和合作平台的"专家模式"使用。
从价格杀手到高端定价
以"便宜AI"为品牌标签的实验室现在开始收取高端价格。DeepSeek 宣布自8月17日起大幅上调 API 价格:
- V4 Pro: 每百万输入token $1.32,每百万输出token $3.96(据 Artificial Analysis)
- 相比 V4 Flash($0.14/$0.28),输入涨价9倍,输出涨价14倍
- 峰值/非峰值定价:工作日峰值时段(北京时间9–12、14–18),输出token价格升至¥27/百万;非峰值为半价
- 不同模型、token类型和时段的涨幅从**50%到1100%**不等
这标志着 DeepSeek 超低价阶段的终结。实验室需要变现——而现在的定价反映了实际能力。
740亿美元估值下的80亿美元融资
DeepSeek 于8月6–7日左右重新开启第二轮外部融资,此前在7月底暂停。暂停因创始人梁文锋关于英伟达依赖和中美AI差距的言论泄露而触发。
- 目标: 约80亿美元,投前估值接近¥5000亿(约740亿美元)
- 作为对比:2026年6月第一轮外部融资约74亿美元,估值约520亿美元——三个月内跳升至740亿美元,令人瞩目
- Monolith Management 正在洽谈加入;现有投资方包括中国国家AI基金、网易、京东、IDG资本、忠朴资本和石象资本
- 创始人梁文锋据报个人出资30亿美元
- 协议预计8月底签署;2027年有望在上海IPO
DeepSeek Harness 团队——挑战 Claude Code
DeepSeek 成立了 “DeepSeek Harness Team”,开通了经腾讯认证的微信公众号,招聘构建智能体开发者工具的人才,目标是与 Anthropic 的 Claude Code 竞争。这表明 DeepSeek 的野心已超越原始模型,进入了智能体开发者工具领域——这个市场此前主要由 Anthropic 占据。
DeepSeek × 宇树科技——具身智能布局
DeepSeek 投资 ¥1.408亿(约2080万美元) 参与宇树科技上海IPO,计划联合开发人形机器人AI模型。这是 DeepSeek 首次公开进入具身智能和机器人领域——表明该实验室将物理世界AI视为下一个前沿。
Kimi K3:开源权重地震
2.8万亿参数,免费下载
Moonshot AI 发布了 Kimi K3——有史以来发布的最大开源权重模型:
- 2.8万亿参数,采用 Stable LatentMoE 架构(896个专家,每token激活16个,约1040亿活跃参数)
- 100万token上下文窗口,原生多模态(文本+图像)
- 关键创新:Kimi Delta Attention (KDA)——混合线性注意力,将计算复杂度从二次方降至近线性;Attention Residuals (AttnRes)
- 相比 Kimi K2 的扩展效率提升2.5倍
- 使用约2万块英伟达芯片训练——考虑到美国出口管制,这一点值得注意
完整权重(1.56TB,分96个分片)于7月27日在 Hugging Face 上以修改版 MIT 许可证发布,30分钟内即登顶趋势榜。基础模型已开源;后训练流程(RLHF、工具使用、安全)仍为专有。
基准表现——首个登顶主要编程基准的中国模型
| 基准 | 分数 | 全球排名 |
|---|---|---|
| Artificial Analysis 智能指数 | 57.1 | 全球第4 |
| Frontend Code Arena | 1679 Elo | 第1——首个登顶主要编程基准的中国模型 |
| SWE Marathon | 42.0% | 第1 |
| Terminal-Bench 2.1 | 88.8% | 前三 |
| MMMU-Pro(多模态) | 89.2% | 第2 |
| BrowseComp | 91.2 | 前三 |
定价:缓存输入token $0.30/百万,缓存未命中输入 $3/百万,输出token $15/百万——在混合工作负载上比 Claude Fable 5 便宜约40%。
需求过载
Moonshot 在发布48小时内暂停了所有新消费者订阅。需求将容量推至极限。现有订阅用户优先;新名额分批开放。公司声明:“Kimi K3 收到的爱远超我们的预期。”
全球排行榜现实
Artificial Analysis 2026年8月智能指数说明了情况:
| 模型 | 分数 | 实验室 | 国家 | 开源权重 |
|---|---|---|---|---|
| Claude Fable 5(Opus 4.8回退) | 59.9 | Anthropic | 美国 | 否 |
| GPT-5.6 Sol Max | 58.9 | OpenAI | 美国 | 否 |
| Claude Fable 5 | 58.2 | Anthropic | 美国 | 否 |
| Kimi K3 | 57.1 | Moonshot AI | 中国 | 是 |
| GPT-5.5 | 56.4 | OpenAI | 美国 | 否 |
| GLM-5.2 | 55.8 | Z.ai | 中国 | 是 |
| Claude Opus 4.8 | 55.2 | Anthropic | 美国 | 否 |
| DeepSeek V4-Pro | 54.6 | DeepSeek | 中国 | 是 |
| Qwen3.8-Max | 53.9 | 阿里巴巴 | 中国 | 部分 |
| Gemini 3.1 Pro | 53.7 | 美国 | 否 |
中国模型现已占据全球前十名中的四席。 中美前沿模型之间的差距已缩小到分析师所说的"在大多数任务上统计上不可区分"。这是当前现实,不是未来预测。
字节跳动:10万亿参数豪赌
有史以来尝试的最大模型
《金融时报》8月7日报道,字节跳动正在预训练一个高达10万亿参数的模型——有史以来任何人尝试的最大模型:
- 架构:混合专家模型;约3万块GPU用于训练
- 时间线:预训练3–6个月,意味着最早内部评估约在2026年11月至2027年2月;产品发布可能在2027年中后期
- 最终参数量未锁定——10万亿是上限目标,不是最终确定数字
规模对比:
| 模型 | 参数 | 实验室 |
|---|---|---|
| 字节跳动(训练中) | ~10万亿(上限) | 字节跳动 |
| Anthropic Mythos 5(估) | ~8万亿 | Anthropic |
| Anthropic Fable 5(估) | ~5万亿 | Anthropic |
| Kimi K3 | 2.8万亿 | Moonshot AI |
| Qwen3.8-Max | 2.4万亿 | 阿里巴巴 |
该项目由字节跳动 Seed AI研究组织(约2000人)负责,由吴永辉(前Google DeepMind)领导。创始人张一鸣据报指示团队追求真正的技术突破,而非依赖西方AI系统的蒸馏——“不复制西方”。
没有模型名称,没有发布日期,没有基准成绩。这是一次泄露,不是发布。但规模表明了意图。
阿里巴巴:Qwen3.8-Max、苹果合作与开源权重收入分成
Qwen3.8-Max
阿里巴巴最大、最强模型:2.4万亿参数,Artificial Analysis 初步得分53.9。已在阿里云灵骏真武M890超节点上 powering 商业服务。
开源权重收入分成模式——业内首创
阿里巴巴计划要求 Qwen3.8-Max 的大型商业用户分享收入——这与行业惯例(开源权重发布可自由部署)有重大差异。这标志着中国开源权重战略从技术挑战向商业模式颠覆的成熟。如果该模式成功,预计其他中国实验室将跟进。
苹果合作——Qwen 驱动中国版 Apple Intelligence
苹果于8月8日发布了中文版Mac用户指南,指导用户将阿里巴巴 Qwen 连接到 Siri 和写作工具(macOS 26.6+)。该指南在约24小时内被撤下——苹果客服称功能未正式上线,监管流程可能仍在进行中。
另外,路透社8月14日报道,苹果已在阿里巴巴支持下训练了一个中国专属大语言模型——这背离了苹果依赖第三方模型的策略。网信办已于7月注册了苹果的生成式AI服务,为中国版 iPhone 上的 Apple Intelligence 扫清了道路。根据安排,Qwen 驱动 Siri 和写作工具;百度也贡献技术;阿里巴巴被禁止使用提交的材料进行训练。
世界上市值最高的公司现在在中国境内依赖中国AI。
阿里云超节点
8月12日在内蒙古乌兰察布启动灵骏真武M890超节点——中国首个成功运行超过2万亿参数大语言模型的超节点。设计支持高达10万亿参数的MoE模型推理。已在商业上为 Kimi K3 和 Qwen3.8-Max 提供服务。
QwenWork——办公AI整合
阿里巴巴于8月3日将 QoderWork、Wukong 和 MuleRun 合并为 QwenWork——桌面控制、云端执行和企业智能体在一个平台上。网页和PC公开测试版已上线;钉钉集成即将推出。这结束了内部"赛马"(平行竞争团队),转向集中化平台。
AI支出
阿里巴巴承诺3年内投入**¥3800亿(约530亿美元)用于云/AI基础设施(2025年2月宣布),现在表示将超过**这一承诺。过去四个季度在AI/云上已投入超过¥1000亿。2026年6月季度业绩将于8月20日发布。
腾讯:资本支出翻三倍,WorkBuddy 达2000万月活
2026年Q2财报——AI支出激增
腾讯8月12日发布的Q2业绩:
- 营收:¥2048亿(304亿美元),同比增长11%
- 资本支出:¥528亿(78亿美元),同比增长176%——接近三倍
- 运营资本支出:¥518亿,同比增长190%
- 规模之大足以使自由现金流转负(-¥138亿,而去年同期为+¥430亿)
- 支出投向混元模型增强、推理、产品AI功能及外部云需求
腾讯股价在披露后下跌——市场担忧AI支出能否产生回报。AI基础设施军备竞赛正在以前所未有的速度消耗现金。
WorkBuddy——2000万月活用户
腾讯的 WorkBuddy AI智能体已突破2000万月活用户——在AI办公平台市场排名第一。7月20日的内部重组将 QClaw 产品中心(基于 OpenClaw 的桌面助手)并入 WorkBuddy 所在的云事业部。8月3日推出新功能。策略:轻量化、开放平台,面向中小企业——最低进入门槛,最广服务覆盖。
BAT 办公AI整合:两周内全部落子
大约两周内,BAT三巨头全部结束内部赛马,集中化办公AI产品:
| 公司 | 整合平台 | 日期 | 策略 |
|---|---|---|---|
| 阿里巴巴 | QwenWork(QoderWork + Wukong + MuleRun) | 8月3日 | 基础设施+钉钉集成 |
| 腾讯 | WorkBuddy(吸收QClaw) | 7月20日 | 轻量化、聚焦中小企业、最广覆盖 |
| 百度 | 百度搭子(吸收dodo) | 8月初 | 智能体矩阵+内容生成+无代码 |
| 字节跳动 | 豆包(吸收Lark) | 7月底 | 高端、封闭生态 |
企业AI是新战场。整合表明实验阶段已经结束——这些公司现在正在争夺市场份额。
百度:AI营收超50%,8月18日发布财报
2026年Q1,AI相关业务首次占百度核心营收的52%——同比增长49%至¥136亿。AI云营收达¥113亿,基础设施部分增长79%,GPU云增长184%。自2023年3月推出文心以来,百度已在AI基础设施和模型上投入超过¥1000亿。
天池256卡超节点(基于昆仑芯片)已启动,支持文心、DeepSeek、GLM和MiniMax模型。百度正在将内部办公智能体"dodo"整合到百度搭子——会议、文档和知识库功能归入搭子的企业版。
Q2 2026业绩将于8月18日发布——将更新AI营收情况。管理层将其策略定位为"保持战略投资强度同时维护财务纪律"。他们不会试图以更大的资产负债表去拼支出。
中国AI监管:首个规范AI情感交互的国家
拟人化AI交互服务管理办法(7月15日生效)
中国颁布了**《拟人化人工智能交互服务管理暂行办法》**——首批规范AI与用户情感交互的全国性法规:
- 要求生命周期风险评估、伦理审查、内容监控和事件响应程序
- 强制"未成年模式":14岁以下用户需监护人同意、消费/使用限制;禁止向未成年人提供虚拟伴侣/亲属服务;禁止情感操纵设计
- AI必须向显示过度依赖迹象的用户发送警告;每2小时提醒用户正在与AI对话
- 执法是动真格的:首周即有12家公司因涉及情感依赖风险和未成年人保护的违规被罚款合计¥420万
- 影响: 字节跳动、阿里巴巴和腾讯全部下架了其AI陪伴应用
北京是首个大规模规范AI情感交互的政府。执法速度——首周即开罚单——表明这不是纸老虎。
跨境和银行业规则
- 国家金融监督管理总局(6月18日):银行业保险业AI安全发展和应用指导意见——7大支柱32项原则,包括高风险用例部署前需风险控制委员会审批、禁止将个人信息作为AI训练数据、外部采购AI模型须向网信办备案
- 网信办跨境传输问答指引:澄清"单独同意"披露要求和常规传输的"必要性"测试
- 出口管制: 商务部对美国无人机出口实施逐案审查(8月5日);新出入境条例(9月15日生效)允许当局阻止涉及出口管制/技术转移违规的公民出境
WAICO:中国全球AI治理机构扩展至37个成员
世界人工智能合作组织(WAICO)于7月16日在上海启动,来自29个国家的代表出席,截至8月中旬已扩展至37个成员国。中国的AI+国际合作倡议涵盖8个领域,包括共享开源生态系统、联合规则/标准和安全治理。该组织正在获得牵引力,成为中国对全球AI治理的回应。
WAIC 2026——史上最大规模
世界人工智能大会(7月17–19日,上海)为史上最大规模:1100+家企业,4400+件AI产品/服务展出。习近平发表主旨演讲,强调以人类智慧和国际共识引导AI,强调"智能经济"。中国核心AI产业在2025年超过**¥1.2万亿(1739亿美元),首次突破万亿大关,拥有6200+家AI相关企业。AI在关键行业(制造、医疗、金融、物流)的渗透率已达80%+**。
其他监管动态
- 《反网络暴力法》草案(7月29日公开征求意见):禁止深度伪造和基于画像的定向骚扰
- L3/L4自动驾驶强制安全标准(GB 44721-2026,2027年7月1日生效):生命周期管理、驾驶员接管、确认测试
- AI内容标注自2025年9月起强制执行(显式+隐式元数据水印)
- 9月1日缓解阀: 处理少于10万人个人信息的企业可认定为"小规模处理者",享受简化通知、同意和更长审计周期
- 国家安全部两个月内第二次发布关于使用外国AI服务风险的警告
- AI智能体安全分类分级标准草案——针对数据泄露、权限失控、工具滥用和行为偏离用户意图
基础设施与生态
全国AI算力建设
截至6月底,中国AI算力同比增长177%,达到2185 EFLOPS。首个由10万块国产芯片构建的AI超级集群已投入运营。国家监控调度平台处于试运行阶段,60%+的算力对其可见,跨区域调度任务。中国预计在"十五五"期间(2026–2030年)新增直接AI投资**¥4万亿(约5600亿美元)**,主要为民间资本。
初创企业注册激增(2026年上半年)
- 5.5万家新生成式AI企业注册(同比增长28%)
- 11.6万家新人形机器人企业(增长9.5%)——是新生成式AI企业数量的两倍多
- 中国生成式AI用户基数:6.02亿(人口渗透率42.8%,年增长141.7%)
- 796个生成式AI服务完成网信办备案;481个应用完成注册
资本市场助推AI
中国正在动员28万亿美元资本市场助推AI发展——从补贴转向股权/债券融资。企业自2024年以来已融资2170亿美元(对比美国竞争对手的1.4万亿美元,但中国融资成本远低,平均债券票息1.9%)。保险资金正在加深对硬科技IPO的投资。DeepSeek 对宇树科技的2080万美元投资恰逢宇树里程碑式的上海IPO。
GPU/芯片约束
美国对先进AI芯片的出口管制仍是主要约束——而非关税。中国采取双轨策略:通过MoE架构最大化计算效率,同时在国产芯片(华为、昆仑)上构建生态系统。据亚洲协会:“算力稀缺现在是一种可控状态,而非危机。”
地缘政治与国际
- Manus AI 回购: 中国初创公司 Manus AI 的前投资者在监管机构命令解除交易后从 Meta 手中回购了公司——表明北京正在围绕本土技术建立防火墙
- 美国正在审查中国AI公司如何在海外获取英伟达芯片以堵住漏洞
- Palo Alto Networks 在中国接受网络安全审查——可能是对美限制的跨部门回应
- 中国将14个欧洲实体列入出口管制清单——禁止未经授权供应两用品(包括稀土和永磁体)
- 中国无人机出口2026年上半年增长26%至242万台(由东南亚、非洲、中东驱动);美国销售在出口管制下暴跌40%+
- 欧盟AI法案2026年8月2日全面生效——执法权现已激活
- 欧盟启动300亿欧元招标建设最多7个AI超级工厂(100亿公共+200亿私人资金)
- 特朗普政府最终确定前沿AI模型自愿预发布测试框架——开发者在公开发布前自愿向政府提供约30天的早期访问
- OpenAI 公开披露其即将推出的 Astra 模型可能已越过"关键"网络安全阈值——前沿AI短暂历史上最重要的安全披露
关注要点
- DeepSeek 8月17日定价切换。 9–14倍的提价是中国AI实验室从补贴式颠覆转向商业可持续发展的最明确信号。关注 V4 Pro 需求在新价位是否能够维持——以及竞争对手是否跟进。
- 阿里巴巴Q2业绩(8月20日)。 承诺¥3800亿且支出将超预期,阿里巴巴的财报将显示AI基础设施投资是否正在转化为云营收增长。
- 百度Q2业绩(8月18日)。 AI已占百度核心营收50%以上。这一轨迹是否持续将决定整个BAT的AI变现基调。
- 字节跳动10万亿模型时间线。 如果10万亿模型在11月至2月的内部评估窗口内达成,预计会有基准泄露——以及全球排行榜的潜在阶跃变化。
- AI陪伴监管执法。 首批罚单在第一周开出。关注监管机构是否将范围从陪伴应用扩展到更广泛的AI交互服务。
- Apple Intelligence 中国上线。 指南发布后24小时内被撤下。监管审批已到位,但功能未正式上线。关注激活它的 iOS 更新。
本周的 China AI Weekly 由三个构造性转变定义:DeepSeek 从价格杀手到商业实体的转型,Kimi K3 证明开源前沿现在在中国,以及字节跳动押注10万亿参数于"不复制西方"的未来。中美AI差距不再是差距——这是一场比赛,在大多数指标上,势均力敌。
正在构建能够经受下一次监管转变的AI架构? Big Hat Group 提供企业AI咨询和Azure原生部署,为需要厂商中立编排、模型网关模式和跨开源与专有模型文档化治理的团队服务。无论您是在评估 Kimi K3、制定 DeepSeek 集成策略,还是应对中国AI监管环境,预约探索性会议来明确工作范围。
在 X 上关注我们,获取这些故事发展的实时分析。
来源:
- 路透社(8月13日、8月14日):DeepSeek V4 Pro发布、苹果-阿里巴巴合作
- 彭博社(8月14日):DeepSeek 80亿美元融资、腾讯财报
- 《金融时报》(8月7日):字节跳动10万亿参数模型
- Artificial Analysis(2026年8月):全球AI智能指数
- CGTN(8月9日、8月14日):中国AI算力、DeepSeek发布
- Global Times(8月9日、8月12日、8月13日):WAIC 2026、阿里超节点、监管
- China Daily(8月13日):DeepSeek V4 Pro报道
- CSIS PacTech Pulse(2026年8月):WAICO、出口管制
- Semafor(8月13日):Manus AI回购、芯片获取审查
- 亚洲协会(8月13日):算力稀缺评估
- Kiteworks(8月12日):AI监管合规
- Rest of World(8月10日):AI陪伴应用监管
- 韩国经济日报(8月14日):中国AI人才池、资本市场
- AIN China(8月9日、8月11日):Kimi K3基准、DeepSeek Harness团队
- LongYield Substack(8月14日):BAT办公AI整合、百度分析