DeepSeek 正式發布 V4 Pro,價格最高上調14倍,並重新開啟80億美元融資輪,估值達740億美元。Moonshot AI 發布了 Kimi K3——一個2.8萬億參數的開源權重模型,成為首個登頂主要程式設計基準的中國模型。字節跳動 正在悄然預訓練一個10萬億參數的模型——有史以來任何人嘗試過的最大模型。中國現已佔據全球AI模型前十名中的四席,中美AI差距在大多數任務上已縮小到統計上不可區分的程度。以下是本週的 China AI Weekly。
DeepSeek:V4 Pro、定價轉型與740億美元融資
V4 Pro 正式發布
DeepSeek 於8月13日正式發布 V4-Pro-0813,取代了4月的預覽版——該預覽版在某些獨立測試中曾被自己更便宜的 sibling(V4 Flash)超越。正式版本帶來重大升級:
- 智能體能力——AI智能體工作流、終端操作和網路安全任務
- 軟體工程——DeepSWE 基準從預覽版的12.8躍升至62.7
- 100萬token上下文視窗,最大輸出384K,支援思考和非思考模式
- Responses API 和 Codex 整合,面向開發者工具
根據 DeepSeek 自身報告的基準亮點:
| 基準 | V4 Pro 分數 | 上下文 |
|---|---|---|
| Terminal-Bench | 87.9 | 略低於 Claude Fable 5 的88 |
| CyberGym(網路安全) | 超越 Fable 5 | — |
| AutomationBench | 超越 Fable 5 | — |
| DeepSWE | 62.7 | 預覽版為12.8 |
| Artificial Analysis 智能指數 | 53(推理版) | V4 Flash 為40 |
該模型可透過 API、應用、網頁和合作平台的「專家模式」使用。
從價格殺手到高端定價
以「便宜AI」為品牌標籤的實驗室現在開始收取高端價格。DeepSeek 宣布自8月17日起大幅上調 API 價格:
- V4 Pro: 每百萬輸入token $1.32,每百萬輸出token $3.96(據 Artificial Analysis)
- 相比 V4 Flash($0.14/$0.28),輸入漲價9倍,輸出漲價14倍
- 峰值/非峰值定價:工作日峰值時段(北京時間9–12、14–18),輸出token價格升至¥27/百萬;非峰值為半價
- 不同模型、token類型和時段的漲幅從**50%到1100%**不等
這標誌著 DeepSeek 超低價階段的終結。實驗室需要變現——而現在的定價反映了實際能力。
740億美元估值下的80億美元融資
DeepSeek 於8月6–7日左右重新開啟第二輪外部融資,此前在7月底暫停。暫停因創辦人梁文鋒關於輝達依賴和中美AI差距的言論洩露而觸發。
- 目標: 約80億美元,投前估值接近¥5000億(約740億美元)
- 作為對比:2026年6月第一輪外部融資約74億美元,估值約520億美元——三個月內跳升至740億美元,令人矚目
- Monolith Management 正在洽談加入;現有投資方包括中國國家AI基金、網易、京東、IDG資本、忠樸資本和石象資本
- 創辦人梁文鋒據報個人出資30億美元
- 協議預計8月底簽署;2027年有望在上海IPO
DeepSeek Harness 團隊——挑戰 Claude Code
DeepSeek 成立了 「DeepSeek Harness Team」,開通了經騰訊認證的微信公眾號,招聘構建智能體開發者工具的人才,目標是與 Anthropic 的 Claude Code 競爭。這表明 DeepSeek 的野心已超越原始模型,進入了智能體開發者工具領域——這個市場此前主要由 Anthropic 占據。
DeepSeek × 宇樹科技——具身智能佈局
DeepSeek 投资 ¥1.408億(約2080萬美元) 參與宇樹科技上海IPO,計畫聯合開發人形機器人AI模型。這是 DeepSeek 首次公開進入具身智能和機器人領域——表明該實驗室將物理世界AI視為下一個前沿。
Kimi K3:開源權重地震
2.8萬億參數,免費下載
Moonshot AI 發布了 Kimi K3——有史以來發布的最大開源權重模型:
- 2.8萬億參數,採用 Stable LatentMoE 架構(896個專家,每token啟動16個,約1040億活躍參數)
- 100萬token上下文視窗,原生多模態(文字+圖像)
- 關鍵創新:Kimi Delta Attention (KDA)——混合線性注意力,將計算複雜度從二次方降至近線性;Attention Residuals (AttnRes)
- 相比 Kimi K2 的擴展效率提升2.5倍
- 使用約2萬塊輝達晶片訓練——考慮到美國出口管制,這一點值得注意
完整權重(1.56TB,分96個分片)於7月27日在 Hugging Face 上以修改版 MIT 授權發布,30分鐘內即登頂趨勢榜。基礎模型已開源;後訓練流程(RLHF、工具使用、安全)仍為專有。
基準表現——首個登頂主要程式設計基準的中國模型
| 基準 | 分數 | 全球排名 |
|---|---|---|
| Artificial Analysis 智能指數 | 57.1 | 全球第4 |
| Frontend Code Arena | 1679 Elo | 第1——首個登頂主要程式設計基準的中國模型 |
| SWE Marathon | 42.0% | 第1 |
| Terminal-Bench 2.1 | 88.8% | 前三 |
| MMMU-Pro(多模態) | 89.2% | 第2 |
| BrowseComp | 91.2 | 前三 |
定價:快取輸入token $0.30/百萬,快取未命中輸入 $3/百萬,輸出token $15/百萬——在混合工作負載上比 Claude Fable 5 便宜約40%。
需求過載
Moonshot 在發布48小時內暫停了所有新消費者訂閱。需求將容量推至極限。現有訂閱用戶優先;新名額分批開放。公司聲明:「Kimi K3 收到的愛遠超我們的預期。」
全球排行榜現實
Artificial Analysis 2026年8月智能指數說明了情況:
| 模型 | 分數 | 實驗室 | 國家 | 開源權重 |
|---|---|---|---|---|
| Claude Fable 5(Opus 4.8回退) | 59.9 | Anthropic | 美國 | 否 |
| GPT-5.6 Sol Max | 58.9 | OpenAI | 美國 | 否 |
| Claude Fable 5 | 58.2 | Anthropic | 美國 | 否 |
| Kimi K3 | 57.1 | Moonshot AI | 中國 | 是 |
| GPT-5.5 | 56.4 | OpenAI | 美國 | 否 |
| GLM-5.2 | 55.8 | Z.ai | 中國 | 是 |
| Claude Opus 4.8 | 55.2 | Anthropic | 美國 | 否 |
| DeepSeek V4-Pro | 54.6 | DeepSeek | 中國 | 是 |
| Qwen3.8-Max | 53.9 | 阿里巴巴 | 中國 | 部分 |
| Gemini 3.1 Pro | 53.7 | 美國 | 否 |
中國模型現已佔據全球前十名中的四席。 中美前沿模型之間的差距已縮小到分析師所說的「在大多數任務上統計上不可區分」。這是當前現實,不是未來預測。
字節跳動:10萬億參數豪賭
有史以來嘗試的最大模型
《金融時報》8月7日報導,字節跳動正在預訓練一個高達10萬億參數的模型——有史以來任何人嘗試過的最大模型:
- 架構:混合專家模型;約3萬塊GPU用於訓練
- 時間線:預訓練3–6個月,意味著最早內部評估約在2026年11月至2027年2月;產品發布可能在2027年中後期
- 最終參數量未鎖定——10萬億是上限目標,不是最終確定數字
規模對比:
| 模型 | 參數 | 實驗室 |
|---|---|---|
| 字節跳動(訓練中) | ~10萬億(上限) | 字節跳動 |
| Anthropic Mythos 5(估) | ~8萬億 | Anthropic |
| Anthropic Fable 5(估) | ~5萬億 | Anthropic |
| Kimi K3 | 2.8萬億 | Moonshot AI |
| Qwen3.8-Max | 2.4萬億 | 阿里巴巴 |
該專案由字節跳動 Seed AI研究組織(約2000人)負責,由吳永輝(前Google DeepMind)領導。創辦人張一鳴據報指示團隊追求真正的技術突破,而非依賴西方AI系統的蒸餾——「不複製西方」。
沒有模型名稱,沒有發布日期,沒有基準成績。這是一次洩露,不是發布。但規模表明了意圖。
阿里巴巴:Qwen3.8-Max、蘋果合作與開源權重收入分成
Qwen3.8-Max
阿里巴巴最大、最強模型:2.4萬億參數,Artificial Analysis 初步得分53.9。已在阿里雲靈駿真武M890超節點上提供商業服務。
開源權重收入分成模式——業內首創
阿里巴巴計畫要求 Qwen3.8-Max 的大型商業用戶分享收入——這與行業慣例(開源權重發布可自由部署)有重大差異。這標誌著中國開源權重策略從技術挑戰向商業模式顛覆的成熟。如果該模式成功,預計其他中國實驗室將跟進。
蘋果合作——Qwen 驅動中國版 Apple Intelligence
蘋果於8月8日發布了中文版Mac用戶指南,指導用戶將阿里巴巴 Qwen 連接到 Siri 和寫作工具(macOS 26.6+)。該指南在約24小時內被撤下——蘋果客服稱功能未正式上線,監管流程可能仍在進行中。
另外,路透社8月14日報導,蘋果已在阿里巴巴支援下訓練了一個中國專屬大語言模型——這背離了蘋果依賴第三方模型的策略。網信辦已於7月註冊了蘋果的生成式AI服務,為中國版 iPhone 上的 Apple Intelligence 扫清了道路。根據安排,Qwen 驅動 Siri 和寫作工具;百度也貢獻技術;阿里巴巴被禁止使用提交的材料進行訓練。
世界上市值最高的公司現在中國境內依賴中國AI。
阿里雲超節點
8月12日在內蒙古烏蘭察布啟動靈駿真武M890超節點——中國首個成功運行超過2萬億參數大語言模型的超節點。設計支援高達10萬億參數的MoE模型推理。已在商業上為 Kimi K3 和 Qwen3.8-Max 提供服務。
QwenWork——辦公AI整合
阿里巴巴於8月3日將 QoderWork、Wukong 和 MuleRun 合併為 QwenWork——桌面控制、雲端執行和企業智能體在一個平台上。網頁和PC公開測試版已上線;釘釘整合即將推出。這結束了內部「賽馬」(平行競爭團隊),轉向集中化平台。
AI支出
阿里巴巴承諾3年內投入**¥3800億(約530億美元)用於雲/AI基礎設施(2025年2月宣布),現在表示將超過**這一承諾。過去四個季度在AI/雲上已投入超過¥1000億。2026年6月季度業績將於8月20日發布。
騰訊:資本支出翻三倍,WorkBuddy 達2000萬月活
2026年Q2財報——AI支出激增
騰訊8月12日發布的Q2業績:
- 營收:¥2048億(304億美元),年增11%
- 資本支出:¥528億(78億美元),年增176%——接近三倍
- 營運資本支出:¥518億,年增190%
- 規模之大足以使自由現金流轉負(-¥138億,而去年同期為+¥430億)
- 支出投向混元模型增強、推理、產品AI功能及外部雲需求
騰訊股價在披露後下跌——市場擔憂AI支出能否產生回報。AI基礎設施軍備競賽正在以前所未有的速度消耗現金。
WorkBuddy——2000萬月活用戶
騰訊的 WorkBuddy AI智能體已突破2000萬月活用戶——在AI辦公平台市場排名第一。7月20日的內部重組將 QClaw 產品中心(基於 OpenClaw 的桌面助手)併入 WorkBuddy 所在的雲事業部。8月3日推出新功能。策略:輕量化、開放平台,面向中小企業——最低進入門檻,最廣服務覆蓋。
BAT 辦公AI整合:兩週內全部落子
大約兩週內,BAT三巨頭全部結束內部賽馬,集中化辦公AI產品:
| 公司 | 整合平台 | 日期 | 策略 |
|---|---|---|---|
| 阿里巴巴 | QwenWork(QoderWork + Wukong + MuleRun) | 8月3日 | 基礎設施+釘釘整合 |
| 騰訊 | WorkBuddy(吸收QClaw) | 7月20日 | 輕量化、聚焦中小企業、最廣覆蓋 |
| 百度 | 百度搭子(吸收dodo) | 8月初 | 智能體矩陣+內容生成+無程式碼 |
| 字節跳動 | 豆包(吸收Lark) | 7月底 | 高端、封閉生態 |
企業AI是新戰場。整合表明實驗階段已經結束——這些公司現在正在爭奪市場份額。
百度:AI營收超50%,8月18日發布財報
2026年Q1,AI相關業務首次佔百度核心營收的52%——年增49%至¥136億。AI雲營收達¥113億,基礎設施部分增長79%,GPU雲增長184%。自2023年3月推出文心以來,百度已在AI基礎設施和模型上投入超過¥1000億。
天池256卡超節點(基於崑崙晶片)已啟動,支援文心、DeepSeek、GLM和MiniMax模型。百度正在將內部辦公智能體「dodo」整合到百度搭子——會議、文件和知識庫功能歸入搭子的企業版。
Q2 2026業績將於8月18日發布——將更新AI營收情況。管理層將其策略定位為「保持戰略投資強度同時維護財務紀律」。他們不會試圖以更大的資產負債表去拼支出。
中國AI監管:首個規範AI情感交互的國家
擬人化AI互動服務管理辦法(7月15日生效)
中國頒布了**《擬人化人工智能互動服務管理暫行辦法》**——首批規範AI與用戶情感互動的全國性法規:
- 要求生命週期風險評估、倫理審查、內容監控和事件回應程序
- 強制「未成年模式」:14歲以下用戶需監護人同意、消費/使用限制;禁止向未成年人提供虛擬伴侶/親屬服務;禁止情感操縱設計
- AI必須向顯示過度依賴跡象的用戶發送警告;每2小時提醒用戶正在與AI對話
- 執法是動真格的:首週即有12家公司因涉及情感依賴風險和未成年人保護的違規被罰款合計¥420萬
- 影響: 字節跳動、阿里巴巴和騰訊全部下架了其AI陪伴應用
北京是首個大規模規範AI情感互動的政府。執法速度——首週即開罰單——表明這不是紙老虎。
跨境和銀行業規則
- 國家金融監督管理總局(6月18日):銀行業保險業AI安全發展和應用指導意見——7大支柱32項原則,包括高風險用例部署前需風險控制委員會審批、禁止將個人資訊作為AI訓練資料、外部採購AI模型須向網信辦備案
- 網信辦跨境傳輸問答指引:澄清「單獨同意」揭露要求和常規傳輸的「必要性」測試
- 出口管制: 商務部對美國無人機出口實施逐案審查(8月5日);新出入境條例(9月15日生效)允許當局阻止涉及出口管制/技術轉移違規的公民出境
WAICO:中國全球AI治理機構擴展至37個成員
世界人工智能合作組織(WAICO)於7月16日在上海啟動,來自29個國家的代表出席,截至8月中旬已擴展至37個成員國。中國的AI+國際合作倡議涵蓋8個領域,包括共享開源生態系統、聯合規則/標準和安全治理。該組織正在獲得牽引力,成為中國對全球AI治理的回應。
WAIC 2026——史上最大規模
世界人工智能大會(7月17–19日,上海)為史上最大規模:1100+家企業,4400+件AI產品/服務展出。習近平發表主旨演講,強調以人類智慧和國際共識引導AI,強調「智能經濟」。中國核心AI產業在2025年超過**¥1.2萬億(1739億美元),首次突破萬億大關,擁有6200+家AI相關企業。AI在關鍵行業(製造、醫療、金融、物流)的滲透率已達80%+**。
其他監管動態
- 《反網路暴力法》草案(7月29日公開徵求意見):禁止深度偽造和基於畫像的定向騷擾
- L3/L4自動駕駛強制安全標準(GB 44721-2026,2027年7月1日生效):生命週期管理、駕駛員接管、確認測試
- AI內容標註自2025年9月起強制執行(顯式+隱式元資料水印)
- 9月1日緩解閥: 處理少於10萬人個人資料的企業可認定為「小規模處理者」,享受簡化通知、同意和更長審計週期
- 國家安全部兩個月內第二次發布關於使用外國AI服務風險的警告
- AI智能體安全分類分級標準草案——針對資料洩露、權限失控、工具濫用和行為偏離用戶意圖
基礎設施與生態
全國AI算力建設
截至6月底,中國AI算力年增177%,達到2185 EFLOPS。首個由10萬塊國產晶片構建的AI超級集群已投入營運。國家監控調度平台處於試運行階段,60%+的算力對其可見,跨區域調度任務。中國預計在「十五五」期間(2026–2030年)新增直接AI投資**¥4萬億(約5600億美元)**,主要為民間資本。
新創企業註冊激增(2026年上半年)
- 5.5萬家新生成式AI企業註冊(年增28%)
- 11.6萬家新人形機器人企業(增長9.5%)——是新生成式AI企業數量的兩倍多
- 中國生成式AI用戶基數:6.02億(人口滲透率42.8%,年增141.7%)
- 796個生成式AI服務完成網信辦備案;481個應用完成註冊
資本市場助推AI
中國正在動員28萬億美元資本市場助推AI發展——從補貼轉向股權/債券融資。企業自2024年以來已融資2170億美元(對比美國競爭對手的1.4萬億美元,但中國融資成本遠低,平均債券票息1.9%)。保險資金正在加深對硬科技IPO的投資。DeepSeek 對宇樹科技的2080萬美元投資恰逢宇樹里程碑式的上海IPO。
GPU/晶片約束
美國對先進AI晶片的出口管制仍是主要約束——而非關稅。中國採取雙軌策略:通過MoE架構最大化計算效率,同時在國產晶片(華為、崑崙)上構建生態系統。據亞洲協會:「算力稀缺現在是一種可控狀態,而非危機。」
地緣政治與國際
- Manus AI 回購: 中國新創公司 Manus AI 的前投資者在監管機構命令解除交易後從 Meta 手中回購了公司——表明北京正在圍繞本土技術建立防火牆
- 美國正在審查中國AI公司如何在海外獲取輝達晶片以堵住漏洞
- Palo Alto Networks 在中國接受網路安全審查——可能是對美限制的跨部門回應
- 中國將14個歐洲實體列入出口管制清單——禁止未經授權供應兩用品(包括稀土和永磁體)
- 中國無人機出口2026年上半年增長26%至242萬台(由東南亞、非洲、中東驅動);美國銷售在出口管制下暴跌40%+
- 歐盟AI法案2026年8月2日全面生效——執法權現已啟動
- 歐盟啟動300億歐元招標建設最多7個AI超級工廠(100億公共+200億私人資金)
- 川普政府最終確定前沿AI模型自願預發布測試框架——開發者在公開發布前自願向政府提供約30天的早期存取
- OpenAI 公開揭露其即將推出的 Astra 模型可能已越過「關鍵」網路安全閾值——前沿AI短暫歷史上最重要的安全揭露
關注要點
- DeepSeek 8月17日定價切換。 9–14倍的提價是中國AI實驗室從補貼式顛覆轉向商業可持續發展的最明確信號。關注 V4 Pro 需求在新價位是否能夠維持——以及競爭對手是否跟進。
- 阿里巴巴Q2業績(8月20日)。 承諾¥3800億且支出將超預期,阿里巴巴的財報將顯示AI基礎設施投資是否正在轉化為雲營收增長。
- 百度Q2業績(8月18日)。 AI已佔百度核心營收50%以上。這一軌跡是否持續將決定整個BAT的AI變現基調。
- 字節跳動10萬億模型時間線。 如果10萬億模型在11月至2月的內部評估視窗內達成,預計會有基準洩露——以及全球排行榜的潛在階躍變化。
- AI陪伴監管執法。 首批罰單在第一週開出。關注監管機構是否將範圍從陪伴應用擴展到更廣泛的AI互動服務。
- Apple Intelligence 中國上線。 指南發布後24小時內被撤下。監管審批已到位,但功能未正式上線。關注啟動它的 iOS 更新。
本週的 China AI Weekly 由三個構造性轉變定義:DeepSeek 從價格殺手到商業實體的轉型,Kimi K3 證明開源前沿現在中國,以及字節跳動押注10萬億參數於「不複製西方」的未來。中美AI差距不再是差距——這是一場比賽,在大多數指標上,勢均力敵。
正在構建能夠經受下一次監管轉變的AI架構? Big Hat Group 提供企業AI諮詢和Azure原生部署,為需要廠商中立編排、模型閘道模式和跨開源與專有模型文件化治理的團隊服務。無論您是在評估 Kimi K3、制定 DeepSeek 整合策略,還是應對中國AI監管環境,預約探索性會議來明確工作範圍。
在 X 上關注我們,獲取這些故事發展的即時分析。
來源:
- 路透社(8月13日、8月14日):DeepSeek V4 Pro發布、蘋果-阿里巴巴合作
- 彭博社(8月14日):DeepSeek 80億美元融資、騰訊財報
- 《金融時報》(8月7日):字節跳動10萬億參數模型
- Artificial Analysis(2026年8月):全球AI智能指數
- CGTN(8月9日、8月14日):中國AI算力、DeepSeek發布
- Global Times(8月9日、8月12日、8月13日):WAIC 2026、阿里超節點、監管
- China Daily(8月13日):DeepSeek V4 Pro報導
- CSIS PacTech Pulse(2026年8月):WAICO、出口管制
- Semafor(8月13日):Manus AI回購、晶片獲取審查
- 亞洲協會(8月13日):算力稀缺評估
- Kiteworks(8月12日):AI監管合規
- Rest of World(8月10日):AI陪伴應用監管
- 韓國經濟日報(8月14日):中國AI人才池、資本市場
- AIN China(8月9日、8月11日):Kimi K3基準、DeepSeek Harness團隊
- LongYield Substack(8月14日):BAT辦公AI整合、百度分析