8月12日到17日這五天,中國大模型圈連續做了三件看起來互相打架、實則彼此呼應的事:DeepSeek宣布 API 調漲最高超過 1100%;阿里把從未開源過的 Qwen-Max 級旗艦——2.4 兆參數權重——直接放出來;智譜則守住同一個基座,只靠後訓練把程式評測成績拉高數倍。三家公司、三種打法,指向同一個訊號——國產大模型正從「拚價格」轉向「拚定價權」。本文涵蓋完整時間軸、調漲明細、Qwen 規格與授權條款、GLM-5.3 分數、三種策略拆解、價格橫評、爭議標註、六步核對與 FAQ。可與 DeepSeek V4 滿血版、Qwen3.8-Max 發布解讀、GPT-5.6 Luna 降價 交叉閱讀。節點方案見 定價頁。
[ SECTION_01 ] // TIMELINE 這兩週發生了什麼:時間線與讀者真正卡住的痛點
讀者真正卡關的地方通常疊了三層:① 「漲 11 倍」「漲超 1100%」「漲 350%」到底對應哪一檔?② 阿里開源權重是否等於免費商用、有沒有地域禁令?③ 調漲之後 DeepSeek 還是不是全場最便宜的旗艦?先把時間軸釘死:
| 日期 | 事件 |
|---|---|
| 7月16日 | 月之暗面 Kimi K3(2.8 兆參數)開源,此前已引發美方安全關注 |
| 7月30日 | OpenAI 把最便宜檔 GPT-5.6 Luna 降價 80% |
| 8月2日–3日 | 阿里 Qwen3.8-Max 先預告、後上線雲端 API |
| 8月6日–7日 | OpenAI 把 Luna 設為免費使用者的預設模型,並開放無限文字對話 |
| 8月10日 | Meta 發布開源模型 Muse Glimmer(300 億參數,Apache 2.0),預告旗艦 Muse Spark 1.2 權重「即將開源」 |
| 8月12日 | 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 開源權重;同日 xAI 發布 Grok 4.6 |
| 8月13日 | DeepSeek-V4-Pro 正式版上線,同步公告 8月17日起 API 調漲;Google 發布降價的 Gemini 3.7 Flash |
| 8月14日 | 智譜發布 GLM-5.3,沿用 GLM-5.2 的 7430 億參數基座 |
| 8月17日 0點(北京時間) | DeepSeek 新定價正式生效 |
把鏡頭再拉遠一點:中國廠商在漲價與開源上做加法的同一時間,美國廠商正在免費與降價上做加法。這不是巧合,而是同一場定價博弈的兩面。國內財經媒體普遍把這波密集發布讀成「一週三更」——DeepSeek、阿里、智譜之外,還有 Kimi K3、MiniMax H3 輪番登場。
- 痛點一·口徑對不上:不同媒體分別寫「漲 11 倍」「漲超 1100%」「漲 350%」,這些說法都對,但對應的是不同計費維度(快取命中輸入 vs 輸出 vs 快取未命中輸入)。
- 痛點二·授權條款被誤讀:網路上一度傳阿里授權條款禁止美國、歐盟、英國、韓國使用者下載,這是不實資訊;官方原文並無地域限制,真正門檻是營收與產品形態。
- 痛點三·「官方最便宜」被打破:尖峰時段 DeepSeek 官方 API 價格已反超部分第三方轉售平台(例如 GMI Cloud、Novita 目前報價仍低於官方尖峰價)。
[ SECTION_02 ] // MATRIX 核心數據一覽:漲價明細、Qwen規格與價格橫評
先把可核對數字壓成表。DeepSeek 新價自北京時間 8月17日 0 點生效;尖峰時段為北京時間 9–12 點、14–18 點(對應 UTC 01:00–04:00 與 06:00–10:00)。
| 計費項 | 調漲前 | 離峰時段(新) | 尖峰時段(新) | 漲幅(尖峰) |
|---|---|---|---|---|
| V4-Flash 快取命中輸入 | ¥0.02 | ¥0.05 | ¥0.10 | 約400% |
| V4-Flash 快取未命中輸入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 輸出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 快取命中輸入 | ¥0.025 | ¥0.15 | ¥0.30 | 約1100% |
| V4-Pro 快取未命中輸入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 輸出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
頭條「1100%」對應的是尖峰時段快取命中輸入——這一檔原先最接近免費,絕對金額仍然很小。對重度呼叫者衝擊更大的其實是輸出價格(350%)與快取未命中輸入。有分析估算:約 8400 萬 tokens/月、多半落在離峰、約一半快取命中的重度使用者,真實帳單漲幅更接近 1.8 倍。
| 項目 | 數據 |
|---|---|
| 參數規模 | 2.4 兆總參數,950 億啟用參數(MoE,512 個專家,10 路由+1 共享) |
| 上下文視窗 | 開源權重原生 262144 tokens,可擴至約 101 萬;雲端 Max 版預設 100 萬 tokens |
| 發布節奏 | 8月2日預告 → 8月3日 API 上線 → 8月12日開源權重 |
| API 定價(國際站) | 輸入 $2 / M tokens,輸出 $6 / M tokens |
| 授權條款 | 非 Apache 2.0,自訂「Qwen3.8-Max License」 |
| 意義 | 阿里歷史上首次把 Max 級(旗艦)模型開源;此前 Qwen3.5 / 3.6 / 3.7 Max 均為閉源 API |
| 基準測試 | GLM-5.2 | GLM-5.3 | 變化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
GLM-5.3 在 Terminal-Bench 3.0 上仍落後 GPT-5.6 Sol(34.6%)與 Claude Fable 5(33.7%),並非全面登頂,而是站上「開源模型第一梯隊」。
| 模型 | 輸入(每百萬 tokens) | 輸出(每百萬 tokens) | 開源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(尖峰) | ¥9.0(約 $1.26) | ¥27.0(約 $3.78) | 權重未開源 |
| DeepSeek V4-Pro(離峰) | ¥4.5(約 $0.63) | ¥13.5(約 $1.89) | 權重未開源 |
| Qwen3.8-Max(國際站) | $2 | $6 | 開源(自訂授權條款) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 閉源 |
| Claude Opus 5(據阿里披露的倍數關係推算) | 約 $5 | 約 $25 | 閉源 |
調漲後 DeepSeek V4-Pro 離峰時段價格仍明顯低於 Claude Opus 5,但已經不再是「全場最低」——阿里國際站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的離峰價更便宜。「國產=最便宜」的等式正在瓦解,價格競爭進入分層階段。
[ SECTION_03 ] // DEEP_DIVE 三種打法、兩線戰爭,以及哪些說法尚未獨立驗證
1. DeepSeek:從「貼地價」走到「分時定價」,本質是算力吃緊被攤到檯面上。這次調漲最容易被讀成「跟漲」,細看結構更像一次「算力帳單透明化」。此前長期採用不分時段的統一低價,用低價換使用者規模,再靠快取命中率與錯峰調度攤薄成本。當呼叫量指數級成長、GPU 產能跟不上時,這套模式撐不住了——公告裡「鼓勵更靈活的工作負載調度」,翻譯過來就是「我們的算力已經不夠用,請你自己錯峰」。尖峰時段官方價反超部分第三方轉售,意味著「官方價格最便宜」這個曾經支撐 DeepSeek 護城河的假設,第一次被打破。
2. 阿里:開源權重圈住生態,自訂授權條款圈住收入。Qwen3.8-Max 的開源不是單純的「慈善」。阿里同時做了兩件事:把 2.4 兆參數權重公開下載,同時配一份不同於以往 Apache 2.0 的自訂授權條款——年營收超過 5000 萬美元的「模型即服務」或「AI 工作助理」業務,必須另行找阿里談商業授權;月活躍使用者超過 1 億或月收入超過 2000 萬美元的產品,必須在介面上顯著展示模型名稱。邏輯是:用開源換開發者生態與口碑(尤其是海外),但在真正能產生現金流的大客戶身上繼續保留議價權。這也是為什麼它和 Meta 的 Muse Glimmer(完全 Apache 2.0,無附加條款)在「開源程度」上不是同一個量級。
需要澄清一則流傳較廣的謠言:網路上一度傳阿里的授權條款禁止美國、歐盟、英國、韓國使用者下載,這是不實資訊,官方授權條款原文中並無任何地域限制。
3. 智譜 GLM-5.3:不換基座,只換「後訓練配方」。最值得盯住的不是分數本身,而是分數怎麼來的——基座與 GLM-5.2 完全相同(7430 億參數),沒有重新預訓練,只靠擴大強化學習環境規模做後訓練,就把 Terminal-Bench 3.0 從 4.6% 拉到 28.3%,接近 6 倍提升。這印證了近半年逐漸清晰的趨勢:當預訓練 Scaling Law 邊際收益放緩,「後訓練強化學習規模化」正在成為新的效能槓桿,門檻明顯低於重新訓練一個千億級基座,意味著更多中小型廠商也有機會靠「精裝修」追上頭部模型。
爭議點與需要留意的細節:
- 調漲幅度的口徑混亂:「漲 11 倍」「漲超 1100%」「漲 350%」都對,但對應不同計費維度,閱讀時必須看清具體是哪一項。
- 阿里「震悟 M890 國產晶片」服務的說法:多家中文財經媒體報導稱 Qwen3.8-Max 部分推理服務跑在阿里自研的震悟 M890 晶片與「盤古 AL128」超節點上,但這一細節目前僅見於中文媒體轉述,未見阿里官方獨立技術文件或第三方基準測試確認,建議標註為未經獨立驗證。
- GLM-5.3「發現 Cursor 嚴重漏洞」的說法:來自 VentureBeat 報導及智譜方面透露,具體漏洞細節未公開披露,真實性與影響範圍有待第三方安全機構確認,屬於廠商單方面披露。
- 中國商務部可能醞釀反制出口管制:部分報導提及中國官方可能針對 AI/半導體技術醞釀反制性出口管制措施,這一說法目前未見官方正式確認,屬於媒體推測/傳聞性質,僅供背景參考。
影響與背景:這不是孤立事件,而是一場「兩線戰爭」。過去一個月,中國頭部模型廠商呈現「一週三更」的密集發布節奏。同一時間,美國廠商走的是另一條路:OpenAI 7月30日大幅降價,8月6日–7日把降價後的 Luna 設為免費使用者預設並開放無限文字對話;Google 8月13日發布價格減半的 Gemini 3.7 Flash。中國廠商在「開源旗艦+梯度漲價」,美國廠商在「消費端免費+降價防守」——兩條路徑同時發生,共同把 2026年8月變成大模型行業定價邏輯重構的一個關鍵節點。
另一層背景是地緣政治:月之暗面 Kimi K3 的開源此前已引發美方安全審查關注,阿里選擇在這個窗口把 2.4 兆參數旗艦開源,被部分分析解讀為「在潛在監管收緊前,搶先鞏固國產模型的國際影響力與技術對等敘事」。這一判斷帶有一定推測成分,但確實是理解這波開源潮時機選擇時不可忽略的背景。可與 Kimi K3 開源解讀 對照。
[ SECTION_04 ] // CHECKLIST 面對開源漲價潮:團隊六步核對清單
- 先分清調漲口徑:把「快取命中輸入約 1100%」「輸出 350%」「快取未命中輸入 200%」拆開寫進內部簡報,禁止用單一頭條數字做預算。
- 對照官方價與第三方轉售:尖峰時段核對 GMI Cloud、Novita 等轉售報價是否低於官方;「官方最便宜」不再是預設假設。
- 讀 Qwen 授權條款原文,而不是公告串:確認無地域限制;核對本業務是否觸及「模型即服務/AI 工作助理+12 個月累計收入超過 5000 萬美元」或「月活躍 1 億/月收入 2000 萬美元」門檻。
- 把 GLM-5.3 分數標為廠商自測:Terminal-Bench 3.0 的 28.3% 尚未見獨立第三方複測;對標 GPT-5.6 Sol 34.6%、Claude Fable 5 33.7% 時寫明來源。
- 用錯峰與快取命中率重算帳單:把批次處理、評測、夜間 Agent 迴圈挪到離峰時段;對重度使用者用「約 1.8 倍」而不是「11 倍」做現金流預估。
- 自託管開放權重需要穩定宿主:Qwen3.8-2.4T-A95B 與後續 GLM 權重落地後,長時推理、Agent 編排與授權條款合規稽核需要 7×24 可複現環境;筆電合蓋與雲端虛擬機漂移會破壞複現視窗——對照定價與訂購頁拉起試驗節點並記錄版本、授權條款與日誌。
China open-weight + pricing cluster — triage sketch (verify against primary sources)
deepseek V4-Pro peak cache-hit input ~1100% · output +350% · effective Aug 17 00:00 CST
peak Beijing 09:00-12:00 and 14:00-18:00 · UTC 01:00-04:00 and 06:00-10:00
qwen 2.4T-A95B weights live Aug 12 · custom license · no geo ban
glm53 same 743B base · TB3.0 4.6% → 28.3% · vendor-run, no 3rd-party rerun
rumor Zhenwu M890 / Cursor vuln / MOFCOM export controls = unverified
[ SECTION_05 ] // FACTS_FAQ 可引用硬核數據、FAQ 與 Agent 宿主收束
- DeepSeek V4-Pro 尖峰快取命中輸入:¥0.025 → ¥0.30,約 1100%;輸出 ¥6.0 → ¥27.0,350%。
- Qwen3.8-2.4T-A95B:2.4 兆總參數/950 億啟用;原生 262,144 tokens,可擴至約 101 萬;國際站 API $2/$6。
- Qwen 授權門檻:MaaS/AI 工作助理 12 個月累計收入超過 $5000 萬須另行授權;月活躍 1 億或月收入 $2000 萬須顯著標註模型名;無地域限制。
- GLM-5.3:與 5.2 同為 7430 億基座;Terminal-Bench 3.0 4.6% → 28.3%;仍落後 Sol 34.6%、Fable 5 33.7%。
- 重度使用者帳單:第三方估算約 1.8 倍,遠低於頭條的 11 倍。
- 匯率參考:約 ¥7.15/$1,僅供對照,實際以官方公告為準。
FAQ 精選:
- Q:DeepSeek 調漲後是不是一定更貴?A:離峰時段+高快取命中,實際漲幅可明顯低於頭條;尖峰+低命中才會逼近 350%/1100%。
- Q:個人開發者能免費商用 Qwen3.8-Max 開源權重嗎?A:個人與內部使用基本上不受影響;觸及 $5000 萬 MaaS/AI 助理門檻才須另行授權。
- Q:GLM-5.3 和 5.2 是同一個模型嗎?A:基座完全相同,沒有重新預訓練;變強來自後訓練強化學習規模化。
- Q:授權條款禁止美歐使用者下載嗎?A:不是。官方原文無地域條款,限制按營收與產品形態,不按地區。
- Q:Meta 開源 Muse Glimmer 等於旗艦回歸開源嗎?A:還不是。Glimmer 是 300 億蒸餾小模型,Muse Spark 1.2 僅「預告」開放權重,尚未落地。
下列為撰寫時依據的公開來源入口;價格、授權條款、基準測試分數建議發布前再次核實最新官方公告。晶片服務、安全漏洞發現、出口管制傳聞已在正文標註為未經獨立驗證。資訊截至2026年8月17日整理。
DeepSeek 官方定價頁(請以站內最新公告為準):
https://api-docs.deepseek.com/quick_start/pricing
阿里 Qwen 官方模型倉庫(Hugging Face):
ModelScope 模型倉庫:
智譜 GLM-5.3 官方技術頁面:
替代方案的真實缺點(工程視角):① 用單一「漲 1100%」數字做年度預算,會高估離峰時段重度使用者的真實帳單,也會低估尖峰批次處理的衝擊;② 把 Qwen 開源權重當成 Apache 2.0 直接上「模型即服務」,可能在營收門檻處踩中自訂授權條款;③ 用筆電硬撐 2.4 兆級權重評測與長時 Agent 迴圈,合蓋 sleep 與雲端虛擬機漂移會讓複現視窗與授權稽核鏈斷裂。
對需要獨占 Apple Silicon、7×24 線上、按天/週/月彈性擴容、在穩定 macOS 宿主上跑開放權重評測、Agent 編排與長時推理對照的開發與自動化團隊,NOVAKVM 的 Mac Mini 雲端裸金屬租賃通常是更優解:把「定價敘事」與「工程執行面」分層——模型價格走各家官方價目,評測與自託管落在常駐裸金屬節點。請在 NOVAKVM 定價頁 對照檔位,在 訂購頁 拉起試驗機;遠端連線見 幫助中心。