DeepSeek 本週從模型實驗室轉型為平台公司——將 V4-Pro 正式發布(GA)、開源其 Harness 代理框架、導入 AI 業界首見的尖峰計價模式、推出實驗性視覺模型,並推進 IPO 籌備,目標 2027 年掛牌。阿里巴巴的 Qwen 下載量突破 30 億次,成為全球下載量最高的開放權重模型系列——超過 Meta 的 Llama 與 Google 的 Gemini 兩者合計。中國迫使 Meta 放棄 20 億美元收購後,騰訊 成為 Manus 的最大股東——這是北京首度運用投資安全審查來逆轉一筆已完成的 AI 交易。此外,中國首部專屬 AI 代理治理框架已正式運作,同時新的網路空間與資料安全法規也開始生效。以下是本週的中國 AI 週報。
DeepSeek:平台公司轉型
V4-Pro 正式發布(GA)
DeepSeek 於 8 月 13 日將 V4-Pro(build 0813) 從預覽版正式升級為一般可用(GA)。這款旗艦模型具備 100 萬 token 的上下文視窗、最高 384K token 的輸出上限、可選擇的推理強度(低、高、最高),並原生支援 OpenAI Responses API 格式。
其架構為 MoE——總參數量約 1.6 兆,每個 token 約啟動 490 億個參數。基準測試成績相較 4 月預覽版有顯著提升:
| 基準測試 | V4-Pro GA | 4 月預覽版 |
|---|---|---|
| Terminal-Bench 2.1 | 87.9 | 72.1 |
| DeepSWE | 62.7 | 12.8 |
| CyberGym | 83.3 | — |
| Humanity’s Last Exam(無工具) | 42.7% | — |
| Humanity’s Last Exam(有工具) | 60.0% | — |
在 Artificial Analysis Intelligence Index 上,V4-Pro 得分 53——高於預覽版的 45,但仍落後 Kimi K3(60)、Qwen3.8-Max(58)與 Claude Opus 5(63)。評價好壞參半:網路安全與程式碼能力提升顯著,但部分報導稱其非代理任務的表現「令人失望」。
值得注意的是,本次版本並未釋出權重。4 月的 V4-Pro 預覽版仍是 Hugging Face 上最新的版本。
Harness:DeepSeek 的開源代理框架
伴隨 V4-Pro GA,DeepSeek 同時開源了 Harness——其模型所使用的內部代理執行框架。Harness 以 MIT 授權釋出,定位為 OpenAI Codex 與 Anthropic Claude Code 的開放替代方案,可讓模型直接與程式碼庫互動:定位檔案、修改程式碼、執行測試,並反覆修正錯誤。
市場反應立即湧現。Harness 在上線 96 小時內累積 141,000 顆 GitHub 星號,成為史上成長最快的開源 AI 專案之一。8 月 21 日,Harness 更新至 v0.1.1-rc.1,加入視覺模型支援,並與 DeepSeek 新的 V4-Flash-Vision-Exp 開箱即用整合。
這是一步戰略棋。透過開源基礎設施層,DeepSeek 正在圍繞其模型打造開發者生態系——不只是販售 API 呼叫,而是打造讓這些 API 呼叫真正有用的工具。這正是讓 Claude Code 與 CodEx 具有黏著性的同一套劇本,只是這次是開放的。
尖峰計價:價格戰的終結
DeepSeek 於 8 月 16–17 日成為首家導入尖峰計價的主要 AI 供應商,從固定費率改為尖峰/離峰分級。尖峰時段為 UTC 01:00–04:00 與 06:00–10:00,尖峰費率為離峰的 2 倍。
| 費率級別 | 輸入(美元/百萬 token) | 輸出(美元/百萬 token) |
|---|---|---|
| V4-Pro 離峰 | $0.66 | $1.98 |
| V4-Pro 尖峰 | $1.32 | $3.96 |
漲幅最大的是快取命中:離峰時段從每百萬 token $0.003625 漲至 $0.022(暴增 12 倍),尖峰時段為 $0.044。在中國境內定價方面,V4-Pro 輸出尖峰價為每百萬 token 27 元人民幣。
8 月 22 日,DeepSeek 宣布週末優惠:星期六與星期日統一按離峰費率計價,自 8 月 23 日起生效。
這並非單一事件。Morgan Stanley 指出,中國 LLM API 價格全面上漲——相較 2025 年第一季,平均輸入價格上漲約 48%、輸出上漲約 80%。價格戰已經結束,獲利時代來臨。
V4-Flash-Vision-Exp:多模態登場
8 月 21 日,DeepSeek 發布 V4-Flash-Vision-Exp——V4 Flash 的實驗性多模態版本,新增影像與螢幕截圖分析能力。該模型在文字能力(代理、推理、世界知識)上與 V4-Flash 相當,在多模態代理基準測試中接近 Anthropic Opus 4.8 的水準。
影像以每張最多 384 個 token 進行分詞,並按 V4-Flash 價格計費。DeepSeek 也推出 Files API(免費使用——上傳一次,以 file_id 參照),Harness 0.1.1 亦原生支援該視覺模型。
視覺模型可透過 API 使用:model='deepseek-v4-flash-vision-exp'。
募資與 IPO 進程
DeepSeek 的第二輪募資於 8 月 6 日重啟,目標募得約 80 億美元,估值接近 5,000 億人民幣(約 740 億美元)。2026 年稍早完成的第一輪募資約募得 70 億美元、估值約 500 億美元,投資人包括騰訊(100 億人民幣)、寧德時代(50 億人民幣)、網易與京東(各 30 億人民幣),以及一支國家級 AI 基金。
第二輪每位投資人的最低投資額為 500 億人民幣。據報導,第一輪的認購需求是實際募得 500 億人民幣的 2 倍。
IPO 籌備正在進行中,預計 2026 年送件,最快 2027 年掛牌。DeepSeek 正與會計師事務所及投資銀行洽談。
DeepSeek 同時也是 Unitree 上市時的戰略投資人——這家機器人公司上市首日即大漲。DeepSeek 以每股 150.80 元人民幣獲配 933,399 股,收盤時市值約 7.886 億人民幣——未實現獲利約 6.48 億人民幣,須遵守 36 個月閉鎖期。
阿里巴巴:Qwen 的開源主導地位
30 億次下載
據阿里巴巴表示,Qwen 系列在六個月內全球下載量突破 30 億次。Hugging Face 的《開放模型現況:2026 夏季報告》(8 月 14 日)顯示,僅 Hugging Face 平台上的 Qwen 下載量即達 20.45 億次——相比之下,Google 為 4.18 億、Meta 為 2.27 億。
Qwen 現在是全球下載量最高的開放權重模型系列,超越 Meta 的 Llama 與 Google 的 Gemini。其生態系包含 460 多款獨立的開源模型與 30 萬個以上的衍生模型(僅 Hugging Face 上就有 151,448 個——是 Meta 的 2.6 倍)。
一個需要注意的點:Hugging Face 的下載數統計的是拉取(pull)事件,包含 CI 管線、鏡像同步與重複下載,會使數字膨脹。阿里巴巴的 30 億數字也涵蓋 Hugging Face 以外的 ModelScope 等平台。但即使扣除重複計算,Qwen 的領先幅度依然可觀。
這就是所謂的**「開源大逆轉」**——美國沒有預見到。兩年前,Meta 的 Llama 還是開放權重 AI 無可爭議的王者。今天,一個中國模型系列的下載量超過 Meta 與 Google 的總和。
Qwen3.8-Max 與 Qwen3.8-27B
8 月 14 日,阿里巴巴發布兩款新模型:
- Qwen3.8-Max(Qwen3.8-2.4T-A95B):總參數量 2.4 兆、啟動參數 95B(MoE)。第一款開放權重的 Max 級 Qwen。Artificial Analysis Intelligence Index:58。
- Qwen3.8-27B:稠密(Dense)27B 參數視覺語言模型,原生 262K 上下文(可透過 YaRN 擴展至 1M)。Apache 2.0 授權。
一個值得注意的授權轉變:Qwen3.8-Max 採用客製化的 qwen3.8-max 授權,附帶非商業用途限制與營收分潤要求——對於一個向來大力擁抱寬鬆 Apache 2.0 授權的產品線而言,這是明顯的收緊。27B 版本仍維持 Apache 2.0。
同時推出的還有筆電級模型,顯示在消費級硬體上運行前沿 AI 將是下一個戰場。
辦公 AI 整併
阿里巴巴的 Qianwen Office 於 8 月 18 日整合 WeCom(企業微信),完成對中國三大辦公平台的全面覆蓋:DingTalk(釘釘)、Feishu(飛書)與 WeCom(國際用戶另支援 Slack)。阿里巴巴也將 MyContext 以開源方式釋出——這是一套為 AI 代理處理即時通訊、文件與會議資料而設計的本地端上下文方案。
外部模型(GLM-5.3、DeepSeek V4 Pro)現已整合進 Qianwen Office 的「Frontier Models」層級。多模型已是常態,而非例外。
Reuters Breakingviews:「中國的 AI 落後者可能很快就會成為領先者」
8 月 19 日一篇 Reuters Breakingviews 評論指出,現金充裕的阿里巴巴可以倚賴電商與雲端獲利來挹注 AI 投資,而騰訊則仰賴遊戲與廣告收入。百度曾領先的 Ernie 已經落後,促使執行長李彥宏(Robin Li)誓言要重返前沿。
騰訊:Manus 收購逆轉與 WorkBuddy 擴張
Manus 事件始末:AI 併購史上的首例
2026 年最具戲劇性的 AI 併購故事,本週迎來結局。
Meta 以 20 億美元收購 AI 代理新創 Manus。 中國國家發改委於 4 月 27 日以國家安全與技術出口為由否決該交易。Meta 取消收購後,騰訊領投一個投資人團體——與真格基金(ZhenFund)和 HSG 合作——以相同 20 億美元估值向 Meta 回購 Manus。先前最大的外部股東 Benchmark 未參與;騰訊買下了 Benchmark 的持股。
騰訊如今是 Manus 的最大股東(少數股權)。Manus 從新加坡恢復獨立營運。
這是中國首度公開運用其外資安全審查逆轉一筆已完成之 AI 收購的案例。這顯示北京的監管觸角不限於阻擋未來的交易——它也能推翻已經完成的交易。
Manus 的年化營收(ARR)從 Meta 收購時的約 1 億美元,在分離期間成長至 4–5 億美元。作為合規措施,2025 年 12 月 29 日起產生的用戶資料將於 8 月 23–24 日刪除。
WorkBuddy 進軍區域市場
騰訊 WorkBuddy v5.0.10 於 8 月 18 日開放 WeCom API 供 AI 代理使用,讓第三方代理可取用 10 項核心辦公功能。模型池包括 Hunyuan Hy3、智譜 GLM、MiniMax、Kimi 與 DeepSeek。
WorkBuddy 也於 8 月 15 日在泰國上線,Hy3 模型免費使用至 8 月 31 日。這是騰訊 AI 辦公產品首次大規模進軍國際市場。
百度:Ernie 落後了
曾是中國無可爭議的 AI 龍頭,百度如今在追趕。Reuters/Breakingviews 於 8 月 19 日報導,百度的 Ernie 模型已落後於前沿,執行長李彥宏誓言要讓它重返前沿。
百度旗下雲端儲存 AI 辦公工具 Wenku 於 8 月 14 日更名為「Kuku AI」,並推出獨立桌面客戶端。Kuku AI 宣稱 AI 辦公功能擁有 2,500 萬以上月活躍用戶(全平台 MAU 超過 1 億),並與競爭對手一樣,現已整合包括 DeepSeek 與智譜 GLM 在內的外部模型。
百度目標在年底前於香港主要上市,以挹注其 AI/ERNIE 戰略。其晶片子公司崑崙芯(Kunlunxin)正分別遞件申請香港 IPO。Ernie Bot 於 2026 年 1 月突破 2 億 MAU——用戶數字亮眼,但問題在於模型本身能否縮小能力差距。
Moonshot AI:Kimi K3 與算力漏洞
Kimi K3:「第二波」訊號
Moonshot AI 於 7 月發布的 Kimi K3,仍是迄今公開的最大開放權重模型——2.8 兆參數的 MoE,具備 1M token 上下文視窗與原生視覺支援。權重於 7 月 27 日上傳至 Hugging Face。
Kimi K3 在 Artificial Analysis Intelligence Index 上得分 57——整體第 4 名、開放權重模型第 1 名。整體排名落後 Claude Opus 5(61)、Claude Fable 5(60)與 GPT-5.6 Sol(59),但在 LMArena Frontend Code Arena 以 1,679 Elo 奪冠——擊敗 Fable 5 與 GPT-5.6 Sol。
程式碼與代理能力表現強勁:Terminal-Bench 2.1 達 88.3(自行回報)、SWE-bench 73.8%、Program Bench 77.8%(第 1 名)。
一個隱憂:幻覺率從(K2.6 的)39% 升至 51%,準確率則從 33% 提升至 46%。英國 AISI/CAISI 的網路安全評估發現,Kimi K3 的網路安全能力明顯低於美國最強的前沿模型,但優於 GLM-5.2。
定價:輸入每百萬 token $3、輸出 $15、快取命中 $0.30。
Nvidia 晶片漏洞
白宮指控 Moonshot 利用泰國的設施使用 Nvidia GB300 晶片訓練 Kimi K3。這是更大模式的一部分:中國 AI 公司——包括 ByteDance、阿里巴巴、騰訊與 Moonshot——正透過泰國、馬來西亞與日本的資料中心取得被禁的 Nvidia 晶片。
此手法利用美國出口管制的一個缺口:現行制度規範的是實體晶片的擁有權,而非對算力的遠端雲端存取。雲端供應商 Aolani(總部位於新加坡)在馬來西亞提供 Nvidia 晶片存取服務,並明確表示客戶「不擁有晶片、對晶片沒有潛在的未來主張權,也無法實體接觸晶片」。
DC Byte 數據顯示,馬來西亞、印尼與泰國共有 31 座規劃中的資料中心(100MW 以上)——而目前僅 2 座。這是一條 15 倍的成長管線。
《遠端存取安全法案》(Remote Access Security Act, RASA) 於 2026 年 1 月通過美國眾議院,但在參議院卡關。即使通過,執法細則也需要時間。美中之間的算力差距正透過多條路徑縮小,而立法腳步跟不上。
監管總覽:代理治理、資料安全與網路空間 2030
AI 代理治理框架(已上路)
中國的網信辦、發改委與工信部於 2026 年 5 月發布**《智慧代理標準化應用與創新發展實施意見》**——全球首部專屬的 AI 代理治理框架。目前已進入落地執行階段。
主要規定:
- 分層決策授權:僅限人類決策/需使用者核准/代理自主決策
- 敏感應用(醫療、交通、媒體、公共安全):申報、合規測試與產品召回機制
- 全生命週期風險評估與倫理審查要求
這是一套先行者的框架。歐盟 AI 法案(EU AI Act)是廣泛涵蓋 AI 系統,美國則依賴各機構的個別指引,而中國率先針對自主 AI 代理這一具體問題出手。
《網路資料安全風險評估辦法》(8 月 20 日生效)
國家級資料風險評估制度如今具有約束力。重要資料處理者必須:
- 每年進行風險評估
- 報告保存 3 年
- 被要求時於 20 個工作日內提交
主管機關可以檢查、要求經認證的評估、命令整改,或強制停止重要資料處理。
《網路空間行動計畫 2026–2030》(8 月 21 日)
中央網路安全和信息化委員會發布針對網路空間與資訊企業的五年計畫。重點領域包括:
- 高階晶片、基礎/工業軟體、量子計算、區塊鏈、腦機介面、數位孿生
- AI 重點:高階 AI 晶片、大語言模型效能,以及自主式 AI(agentic AI)技術
- 開源參與、智慧財產權快速通道、產學研合作
- 支持運算、雲端與 AI 領域具競爭力企業的全球化擴張
- 加速新興領域的 AI 立法
備案與註冊統計
- 全國備案的生成式 AI 服務達 538 項(較 2025 年 3 月的 346 項成長 55.5%)
- 263 項應用/功能完成註冊(新揭露)
- 北京以 242 件備案領先,其次為江蘇(80)與山東(49)
杭州市級規定(9 月 1 日生效)
杭州成為中國第一個實施地方性生成式 AI 服務規定的城市。內容安全與智慧財產權違規罰款最高達 500 萬人民幣。規定要求服務上線前完成演算法備案,並建立內容安全審查機制。
「AI+」行動計畫與勞動力
國務院的「AI+」行動計畫目標是 2027 年 AI 滲透率達 70%、2030 年達 90%。教育部推動 2030 年達成全民 AI 素養,在各教育階段導入 AI 教育。各省政策跟進:上海將 AI 培訓師納入 A 類職業(補貼增加 30%),揚州提供 20 萬人民幣培訓補貼與算力券。
數位主權立場
8 月 19 日,外交部發言人林劍表示,中國反對在 AI 議題上「選邊站隊」與「拉幫結派」——這是回應美國將要求各國在美中 AI 競賽中選邊的報導。
美國一個國會顧問機構於 8 月 18 日報告指出,中國正系統性地收集國內企業、營運與實體世界資料,這些資料「無法透過爬蟲取得」——而這些資料對企業 AI、自駕車與人形機器人至關重要。中國已將資料提升為與土地、勞動力、資本和技術並列的關鍵**「生產要素」**。
AI 辦公領域:BAT 整併競賽
中國 AI 辦公領域正在快速整併,格局是一場四方競賽:DeepSeek(性價比)、阿里巴巴(生態系)、ByteDance(規模),外加追趕中的 Moonshot/百度/騰訊。
過去一個月:
- 騰訊:7 月 20 日將 QClaw 併入 WorkBuddy
- ByteDance:7 月 30 日將 Feishu 併入 Doubao
- 阿里巴巴:8 月 3 日將 QoderWork、MuleRun 與 Wukong 整合為 Qianwen Office
- 百度:8 月 14 日將 GenFlow 更名為 Kuku AI
所有平台現在都整合多個第三方模型——DeepSeek、智譜 GLM 等。多模型已是常態。問題不再是「哪個模型?」,而是「哪個平台整合得最好?」
WorldClaw:與川普有關聯的 AI 新創
8 月 17 日,據報導 World Liberty Financial——這家獲川普支持的加密貨幣公司——正與 WorldClaw 合作。WorldClaw 是一家總部位於香港的平台,提供美國以國家安全為由標記之中國公司的 AI 模型。
WorldClaw 上 90 個模型中有 43 個來自阿里巴巴、百度、Z.ai、DeepSeek 與 Moonshot——這些公司都在美國國防部的中國軍方關聯企業名單上,或被指控竊取智慧財產權。WorldClaw 接受 World Liberty 的加密貨幣代幣付款。
這凸顯一個根本性的矛盾:美國的國家安全認定限制了美國公司使用某些中國 AI 供應商,但同樣的模型卻可透過第三方平台商業取得——如今更與美國總統家族有關聯的企業扯上關係。
本週回顧
本週有三條主線:
1. DeepSeek 的平台轉型。 大約十天內,DeepSeek 發布 V4-Pro GA、開源 Harness、導入尖峰計價、推出視覺模型,並推進 IPO 籌備。這不再是模型實驗室——而是一家擁有基礎設施、定價權與開發者生態系的平台公司。Harness 在 96 小時內獲得 141,000 顆 GitHub 星號,顯示開發者市場正在回應。
2. 開源逆轉是真的。 光 Qwen 的下載量就超過 Meta 與 Google 的總和。DeepSeek 的 Harness 是史上成長最快的開源專案之一。中國在開源 AI 上不只是追趕——而是領先,且領先幅度巨大。這對開發者生態系、企業採用與地緣政治影響力都有重大意義。
3. 監管進展比市場預期更快。 中國的 AI 代理治理框架是全球首部。具約束力的資料風險評估本週生效。杭州於 9 月 1 日推出市級 AI 規定。直到 2030 年的網路空間行動計畫明確將自主式 AI 與新興領域立法列為優先。在中國 AI 領域營運的公司,面對的監管環境比任何地方都同時更具規範性、也更具支持性。
貫穿其中的主線是:中國 AI 正在成熟。從 DeepSeek 的尖峰計價、Qwen 的授權收緊,到 IPO 管線,這個產業正從顛覆轉向整併、從免費轉向付費、從模型轉向平台。西方觀察者的問題不再是中國能否競爭——而是西方能否跟上中國在模型、基礎設施與治理上的成熟速度。
追蹤 @kkaminsk 的 X 獲取每日中國 AI 更新。本文是 China AI Weekly 系列的一部分。