DeepSeek 正式發布 V4 Pro,價格最高上調14倍,並重新開啟80億美元融資輪,估值達740億美元。Moonshot AI 發布了 Kimi K3——一個2.8萬億參數的開源權重模型,成為首個登頂主要程式設計基準的中國模型。字節跳動 正在悄然預訓練一個10萬億參數的模型——有史以來任何人嘗試過的最大模型。中國現已佔據全球AI模型前十名中的四席,中美AI差距在大多數任務上已縮小到統計上不可區分的程度。以下是本週的 China AI Weekly。


DeepSeek:V4 Pro、定價轉型與740億美元融資

V4 Pro 正式發布

DeepSeek 於8月13日正式發布 V4-Pro-0813,取代了4月的預覽版——該預覽版在某些獨立測試中曾被自己更便宜的 sibling(V4 Flash)超越。正式版本帶來重大升級:

  • 智能體能力——AI智能體工作流、終端操作和網路安全任務
  • 軟體工程——DeepSWE 基準從預覽版的12.8躍升至62.7
  • 100萬token上下文視窗,最大輸出384K,支援思考和非思考模式
  • Responses API 和 Codex 整合,面向開發者工具

根據 DeepSeek 自身報告的基準亮點:

基準V4 Pro 分數上下文
Terminal-Bench87.9略低於 Claude Fable 5 的88
CyberGym(網路安全)超越 Fable 5
AutomationBench超越 Fable 5
DeepSWE62.7預覽版為12.8
Artificial Analysis 智能指數53(推理版)V4 Flash 為40

該模型可透過 API、應用、網頁和合作平台的「專家模式」使用。

從價格殺手到高端定價

以「便宜AI」為品牌標籤的實驗室現在開始收取高端價格。DeepSeek 宣布自8月17日起大幅上調 API 價格

  • V4 Pro: 每百萬輸入token $1.32,每百萬輸出token $3.96(據 Artificial Analysis)
  • 相比 V4 Flash($0.14/$0.28),輸入漲價9倍,輸出漲價14倍
  • 峰值/非峰值定價:工作日峰值時段(北京時間9–12、14–18),輸出token價格升至¥27/百萬;非峰值為半價
  • 不同模型、token類型和時段的漲幅從**50%到1100%**不等

這標誌著 DeepSeek 超低價階段的終結。實驗室需要變現——而現在的定價反映了實際能力。

740億美元估值下的80億美元融資

DeepSeek 於8月6–7日左右重新開啟第二輪外部融資,此前在7月底暫停。暫停因創辦人梁文鋒關於輝達依賴和中美AI差距的言論洩露而觸發。

  • 目標: 約80億美元,投前估值接近¥5000億(約740億美元)
  • 作為對比:2026年6月第一輪外部融資約74億美元,估值約520億美元——三個月內跳升至740億美元,令人矚目
  • Monolith Management 正在洽談加入;現有投資方包括中國國家AI基金、網易、京東、IDG資本、忠樸資本和石象資本
  • 創辦人梁文鋒據報個人出資30億美元
  • 協議預計8月底簽署;2027年有望在上海IPO

DeepSeek Harness 團隊——挑戰 Claude Code

DeepSeek 成立了 「DeepSeek Harness Team」,開通了經騰訊認證的微信公眾號,招聘構建智能體開發者工具的人才,目標是與 Anthropic 的 Claude Code 競爭。這表明 DeepSeek 的野心已超越原始模型,進入了智能體開發者工具領域——這個市場此前主要由 Anthropic 占據。

DeepSeek × 宇樹科技——具身智能佈局

DeepSeek 投资 ¥1.408億(約2080萬美元) 參與宇樹科技上海IPO,計畫聯合開發人形機器人AI模型。這是 DeepSeek 首次公開進入具身智能和機器人領域——表明該實驗室將物理世界AI視為下一個前沿。


Kimi K3:開源權重地震

2.8萬億參數,免費下載

Moonshot AI 發布了 Kimi K3——有史以來發布的最大開源權重模型:

  • 2.8萬億參數,採用 Stable LatentMoE 架構(896個專家,每token啟動16個,約1040億活躍參數)
  • 100萬token上下文視窗,原生多模態(文字+圖像)
  • 關鍵創新:Kimi Delta Attention (KDA)——混合線性注意力,將計算複雜度從二次方降至近線性;Attention Residuals (AttnRes)
  • 相比 Kimi K2 的擴展效率提升2.5倍
  • 使用約2萬塊輝達晶片訓練——考慮到美國出口管制,這一點值得注意

完整權重(1.56TB,分96個分片)於7月27日在 Hugging Face 上以修改版 MIT 授權發布,30分鐘內即登頂趨勢榜。基礎模型已開源;後訓練流程(RLHF、工具使用、安全)仍為專有。

基準表現——首個登頂主要程式設計基準的中國模型

基準分數全球排名
Artificial Analysis 智能指數57.1全球第4
Frontend Code Arena1679 Elo第1——首個登頂主要程式設計基準的中國模型
SWE Marathon42.0%第1
Terminal-Bench 2.188.8%前三
MMMU-Pro(多模態)89.2%第2
BrowseComp91.2前三

定價:快取輸入token $0.30/百萬,快取未命中輸入 $3/百萬,輸出token $15/百萬——在混合工作負載上比 Claude Fable 5 便宜約40%。

需求過載

Moonshot 在發布48小時內暫停了所有新消費者訂閱。需求將容量推至極限。現有訂閱用戶優先;新名額分批開放。公司聲明:「Kimi K3 收到的愛遠超我們的預期。」

全球排行榜現實

Artificial Analysis 2026年8月智能指數說明了情況:

模型分數實驗室國家開源權重
Claude Fable 5(Opus 4.8回退)59.9Anthropic美國
GPT-5.6 Sol Max58.9OpenAI美國
Claude Fable 558.2Anthropic美國
Kimi K357.1Moonshot AI中國
GPT-5.556.4OpenAI美國
GLM-5.255.8Z.ai中國
Claude Opus 4.855.2Anthropic美國
DeepSeek V4-Pro54.6DeepSeek中國
Qwen3.8-Max53.9阿里巴巴中國部分
Gemini 3.1 Pro53.7Google美國

中國模型現已佔據全球前十名中的四席。 中美前沿模型之間的差距已縮小到分析師所說的「在大多數任務上統計上不可區分」。這是當前現實,不是未來預測。


字節跳動:10萬億參數豪賭

有史以來嘗試的最大模型

《金融時報》8月7日報導,字節跳動正在預訓練一個高達10萬億參數的模型——有史以來任何人嘗試過的最大模型:

  • 架構:混合專家模型;約3萬塊GPU用於訓練
  • 時間線:預訓練3–6個月,意味著最早內部評估約在2026年11月至2027年2月;產品發布可能在2027年中後期
  • 最終參數量未鎖定——10萬億是上限目標,不是最終確定數字

規模對比:

模型參數實驗室
字節跳動(訓練中)~10萬億(上限)字節跳動
Anthropic Mythos 5(估)~8萬億Anthropic
Anthropic Fable 5(估)~5萬億Anthropic
Kimi K32.8萬億Moonshot AI
Qwen3.8-Max2.4萬億阿里巴巴

該專案由字節跳動 Seed AI研究組織(約2000人)負責,由吳永輝(前Google DeepMind)領導。創辦人張一鳴據報指示團隊追求真正的技術突破,而非依賴西方AI系統的蒸餾——「不複製西方」。

沒有模型名稱,沒有發布日期,沒有基準成績。這是一次洩露,不是發布。但規模表明了意圖。


阿里巴巴:Qwen3.8-Max、蘋果合作與開源權重收入分成

Qwen3.8-Max

阿里巴巴最大、最強模型:2.4萬億參數,Artificial Analysis 初步得分53.9。已在阿里雲靈駿真武M890超節點上提供商業服務。

開源權重收入分成模式——業內首創

阿里巴巴計畫要求 Qwen3.8-Max 的大型商業用戶分享收入——這與行業慣例(開源權重發布可自由部署)有重大差異。這標誌著中國開源權重策略從技術挑戰向商業模式顛覆的成熟。如果該模式成功,預計其他中國實驗室將跟進。

蘋果合作——Qwen 驅動中國版 Apple Intelligence

蘋果於8月8日發布了中文版Mac用戶指南,指導用戶將阿里巴巴 Qwen 連接到 Siri 和寫作工具(macOS 26.6+)。該指南在約24小時內被撤下——蘋果客服稱功能未正式上線,監管流程可能仍在進行中。

另外,路透社8月14日報導,蘋果已在阿里巴巴支援下訓練了一個中國專屬大語言模型——這背離了蘋果依賴第三方模型的策略。網信辦已於7月註冊了蘋果的生成式AI服務,為中國版 iPhone 上的 Apple Intelligence 扫清了道路。根據安排,Qwen 驅動 Siri 和寫作工具;百度也貢獻技術;阿里巴巴被禁止使用提交的材料進行訓練。

世界上市值最高的公司現在中國境內依賴中國AI。

阿里雲超節點

8月12日在內蒙古烏蘭察布啟動靈駿真武M890超節點——中國首個成功運行超過2萬億參數大語言模型的超節點。設計支援高達10萬億參數的MoE模型推理。已在商業上為 Kimi K3 和 Qwen3.8-Max 提供服務。

QwenWork——辦公AI整合

阿里巴巴於8月3日將 QoderWork、Wukong 和 MuleRun 合併為 QwenWork——桌面控制、雲端執行和企業智能體在一個平台上。網頁和PC公開測試版已上線;釘釘整合即將推出。這結束了內部「賽馬」(平行競爭團隊),轉向集中化平台。

AI支出

阿里巴巴承諾3年內投入**¥3800億(約530億美元)用於雲/AI基礎設施(2025年2月宣布),現在表示將超過**這一承諾。過去四個季度在AI/雲上已投入超過¥1000億。2026年6月季度業績將於8月20日發布。


騰訊:資本支出翻三倍,WorkBuddy 達2000萬月活

2026年Q2財報——AI支出激增

騰訊8月12日發布的Q2業績:

  • 營收:¥2048億(304億美元),年增11%
  • 資本支出:¥528億(78億美元),年增176%——接近三倍
  • 營運資本支出:¥518億,年增190%
  • 規模之大足以使自由現金流轉負(-¥138億,而去年同期為+¥430億)
  • 支出投向混元模型增強、推理、產品AI功能及外部雲需求

騰訊股價在披露後下跌——市場擔憂AI支出能否產生回報。AI基礎設施軍備競賽正在以前所未有的速度消耗現金。

WorkBuddy——2000萬月活用戶

騰訊的 WorkBuddy AI智能體已突破2000萬月活用戶——在AI辦公平台市場排名第一。7月20日的內部重組將 QClaw 產品中心(基於 OpenClaw 的桌面助手)併入 WorkBuddy 所在的雲事業部。8月3日推出新功能。策略:輕量化、開放平台,面向中小企業——最低進入門檻,最廣服務覆蓋。


BAT 辦公AI整合:兩週內全部落子

大約兩週內,BAT三巨頭全部結束內部賽馬,集中化辦公AI產品:

公司整合平台日期策略
阿里巴巴QwenWork(QoderWork + Wukong + MuleRun)8月3日基礎設施+釘釘整合
騰訊WorkBuddy(吸收QClaw)7月20日輕量化、聚焦中小企業、最廣覆蓋
百度百度搭子(吸收dodo)8月初智能體矩陣+內容生成+無程式碼
字節跳動豆包(吸收Lark)7月底高端、封閉生態

企業AI是新戰場。整合表明實驗階段已經結束——這些公司現在正在爭奪市場份額。


百度:AI營收超50%,8月18日發布財報

2026年Q1,AI相關業務首次佔百度核心營收的52%——年增49%至¥136億。AI雲營收達¥113億,基礎設施部分增長79%,GPU雲增長184%。自2023年3月推出文心以來,百度已在AI基礎設施和模型上投入超過¥1000億。

天池256卡超節點(基於崑崙晶片)已啟動,支援文心、DeepSeek、GLM和MiniMax模型。百度正在將內部辦公智能體「dodo」整合到百度搭子——會議、文件和知識庫功能歸入搭子的企業版。

Q2 2026業績將於8月18日發布——將更新AI營收情況。管理層將其策略定位為「保持戰略投資強度同時維護財務紀律」。他們不會試圖以更大的資產負債表去拼支出。


中國AI監管:首個規範AI情感交互的國家

擬人化AI互動服務管理辦法(7月15日生效)

中國頒布了**《擬人化人工智能互動服務管理暫行辦法》**——首批規範AI與用戶情感互動的全國性法規:

  • 要求生命週期風險評估、倫理審查、內容監控和事件回應程序
  • 強制「未成年模式」:14歲以下用戶需監護人同意、消費/使用限制;禁止向未成年人提供虛擬伴侶/親屬服務;禁止情感操縱設計
  • AI必須向顯示過度依賴跡象的用戶發送警告;每2小時提醒用戶正在與AI對話
  • 執法是動真格的:首週即有12家公司因涉及情感依賴風險和未成年人保護的違規被罰款合計¥420萬
  • 影響: 字節跳動、阿里巴巴和騰訊全部下架了其AI陪伴應用

北京是首個大規模規範AI情感互動的政府。執法速度——首週即開罰單——表明這不是紙老虎。

跨境和銀行業規則

  • 國家金融監督管理總局(6月18日):銀行業保險業AI安全發展和應用指導意見——7大支柱32項原則,包括高風險用例部署前需風險控制委員會審批、禁止將個人資訊作為AI訓練資料、外部採購AI模型須向網信辦備案
  • 網信辦跨境傳輸問答指引:澄清「單獨同意」揭露要求和常規傳輸的「必要性」測試
  • 出口管制: 商務部對美國無人機出口實施逐案審查(8月5日);新出入境條例(9月15日生效)允許當局阻止涉及出口管制/技術轉移違規的公民出境

WAICO:中國全球AI治理機構擴展至37個成員

世界人工智能合作組織(WAICO)於7月16日在上海啟動,來自29個國家的代表出席,截至8月中旬已擴展至37個成員國。中國的AI+國際合作倡議涵蓋8個領域,包括共享開源生態系統、聯合規則/標準和安全治理。該組織正在獲得牽引力,成為中國對全球AI治理的回應。

WAIC 2026——史上最大規模

世界人工智能大會(7月17–19日,上海)為史上最大規模:1100+家企業,4400+件AI產品/服務展出。習近平發表主旨演講,強調以人類智慧和國際共識引導AI,強調「智能經濟」。中國核心AI產業在2025年超過**¥1.2萬億(1739億美元),首次突破萬億大關,擁有6200+家AI相關企業。AI在關鍵行業(製造、醫療、金融、物流)的滲透率已達80%+**。

其他監管動態

  • 《反網路暴力法》草案(7月29日公開徵求意見):禁止深度偽造和基於畫像的定向騷擾
  • L3/L4自動駕駛強制安全標準(GB 44721-2026,2027年7月1日生效):生命週期管理、駕駛員接管、確認測試
  • AI內容標註自2025年9月起強制執行(顯式+隱式元資料水印)
  • 9月1日緩解閥: 處理少於10萬人個人資料的企業可認定為「小規模處理者」,享受簡化通知、同意和更長審計週期
  • 國家安全部兩個月內第二次發布關於使用外國AI服務風險的警告
  • AI智能體安全分類分級標準草案——針對資料洩露、權限失控、工具濫用和行為偏離用戶意圖

基礎設施與生態

全國AI算力建設

截至6月底,中國AI算力年增177%,達到2185 EFLOPS。首個由10萬塊國產晶片構建的AI超級集群已投入營運。國家監控調度平台處於試運行階段,60%+的算力對其可見,跨區域調度任務。中國預計在「十五五」期間(2026–2030年)新增直接AI投資**¥4萬億(約5600億美元)**,主要為民間資本。

新創企業註冊激增(2026年上半年)

  • 5.5萬家新生成式AI企業註冊(年增28%)
  • 11.6萬家新人形機器人企業(增長9.5%)——是新生成式AI企業數量的兩倍多
  • 中國生成式AI用戶基數:6.02億(人口滲透率42.8%,年增141.7%)
  • 796個生成式AI服務完成網信辦備案;481個應用完成註冊

資本市場助推AI

中國正在動員28萬億美元資本市場助推AI發展——從補貼轉向股權/債券融資。企業自2024年以來已融資2170億美元(對比美國競爭對手的1.4萬億美元,但中國融資成本遠低,平均債券票息1.9%)。保險資金正在加深對硬科技IPO的投資。DeepSeek 對宇樹科技的2080萬美元投資恰逢宇樹里程碑式的上海IPO。

GPU/晶片約束

美國對先進AI晶片的出口管制仍是主要約束——而非關稅。中國採取雙軌策略:通過MoE架構最大化計算效率,同時在國產晶片(華為、崑崙)上構建生態系統。據亞洲協會:「算力稀缺現在是一種可控狀態,而非危機。」


地緣政治與國際

  • Manus AI 回購: 中國新創公司 Manus AI 的前投資者在監管機構命令解除交易後從 Meta 手中回購了公司——表明北京正在圍繞本土技術建立防火牆
  • 美國正在審查中國AI公司如何在海外獲取輝達晶片以堵住漏洞
  • Palo Alto Networks 在中國接受網路安全審查——可能是對美限制的跨部門回應
  • 中國將14個歐洲實體列入出口管制清單——禁止未經授權供應兩用品(包括稀土和永磁體)
  • 中國無人機出口2026年上半年增長26%至242萬台(由東南亞、非洲、中東驅動);美國銷售在出口管制下暴跌40%+
  • 歐盟AI法案2026年8月2日全面生效——執法權現已啟動
  • 歐盟啟動300億歐元招標建設最多7個AI超級工廠(100億公共+200億私人資金)
  • 川普政府最終確定前沿AI模型自願預發布測試框架——開發者在公開發布前自願向政府提供約30天的早期存取
  • OpenAI 公開揭露其即將推出的 Astra 模型可能已越過「關鍵」網路安全閾值——前沿AI短暫歷史上最重要的安全揭露

關注要點

  • DeepSeek 8月17日定價切換。 9–14倍的提價是中國AI實驗室從補貼式顛覆轉向商業可持續發展的最明確信號。關注 V4 Pro 需求在新價位是否能夠維持——以及競爭對手是否跟進。
  • 阿里巴巴Q2業績(8月20日)。 承諾¥3800億且支出將超預期,阿里巴巴的財報將顯示AI基礎設施投資是否正在轉化為雲營收增長。
  • 百度Q2業績(8月18日)。 AI已佔百度核心營收50%以上。這一軌跡是否持續將決定整個BAT的AI變現基調。
  • 字節跳動10萬億模型時間線。 如果10萬億模型在11月至2月的內部評估視窗內達成,預計會有基準洩露——以及全球排行榜的潛在階躍變化。
  • AI陪伴監管執法。 首批罰單在第一週開出。關注監管機構是否將範圍從陪伴應用擴展到更廣泛的AI互動服務。
  • Apple Intelligence 中國上線。 指南發布後24小時內被撤下。監管審批已到位,但功能未正式上線。關注啟動它的 iOS 更新。

本週的 China AI Weekly 由三個構造性轉變定義:DeepSeek 從價格殺手到商業實體的轉型,Kimi K3 證明開源前沿現在中國,以及字節跳動押注10萬億參數於「不複製西方」的未來。中美AI差距不再是差距——這是一場比賽,在大多數指標上,勢均力敵。

正在構建能夠經受下一次監管轉變的AI架構? Big Hat Group 提供企業AI諮詢和Azure原生部署,為需要廠商中立編排、模型閘道模式和跨開源與專有模型文件化治理的團隊服務。無論您是在評估 Kimi K3、制定 DeepSeek 整合策略,還是應對中國AI監管環境,預約探索性會議來明確工作範圍。

X 上關注我們,獲取這些故事發展的即時分析。


來源:

  • 路透社(8月13日、8月14日):DeepSeek V4 Pro發布、蘋果-阿里巴巴合作
  • 彭博社(8月14日):DeepSeek 80億美元融資、騰訊財報
  • 《金融時報》(8月7日):字節跳動10萬億參數模型
  • Artificial Analysis(2026年8月):全球AI智能指數
  • CGTN(8月9日、8月14日):中國AI算力、DeepSeek發布
  • Global Times(8月9日、8月12日、8月13日):WAIC 2026、阿里超節點、監管
  • China Daily(8月13日):DeepSeek V4 Pro報導
  • CSIS PacTech Pulse(2026年8月):WAICO、出口管制
  • Semafor(8月13日):Manus AI回購、晶片獲取審查
  • 亞洲協會(8月13日):算力稀缺評估
  • Kiteworks(8月12日):AI監管合規
  • Rest of World(8月10日):AI陪伴應用監管
  • 韓國經濟日報(8月14日):中國AI人才池、資本市場
  • AIN China(8月9日、8月11日):Kimi K3基準、DeepSeek Harness團隊
  • LongYield Substack(8月14日):BAT辦公AI整合、百度分析