8月12日到17日的五天里,中国大模型圈接连做了三件互相矛盾又互相呼应的事:DeepSeek宣布API涨价最高超1100%,阿里同步把从未开源过的Qwen-Max级旗舰模型2.4万亿参数权重放出来,智谱则用同一个基座、纯靠后训练把编程测试成绩拉高数倍。三家公司、三种打法,共同指向同一个信号——国产大模型正在从「卷价格」转向「卷定价权」。本文覆盖完整时间线、涨价明细、Qwen规格与许可证、GLM-5.3分数、三种策略拆解、价格横评、争议标注、六步核对与FAQ。可与 DeepSeek V4 满血版、Qwen3.8-Max 发布解读、GPT-5.6 Luna 降价 交叉阅读。节点方案见 定价页。
[ SECTION_01 ] // TIMELINE 这两周发生了什么:时间线与读者真正卡住的痛点
读者真正卡住的痛点通常有三层:① 「涨11倍」「涨超1100%」「涨350%」到底指哪一档?② 阿里开源权重是不是等于免费商用、有没有地域禁令?③ 涨价后 DeepSeek 还是不是全场最便宜的旗舰?先把时间线钉死:
| 日期 | 事件 |
|---|---|
| 7月16日 | 月之暗面 Kimi K3(2.8万亿参数)开源,此前已引发美方安全关注 |
| 7月30日 | OpenAI 把最便宜档 GPT-5.6 Luna 降价 80% |
| 8月2日–3日 | 阿里 Qwen3.8-Max 先预告、后上线云端 API |
| 8月6日–7日 | OpenAI 把 Luna 设为免费用户默认模型并开放无限文本对话 |
| 8月10日 | Meta 发布开源模型 Muse Glimmer(300亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重「即将开源」 |
| 8月12日 | 阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6 |
| 8月13日 | DeepSeek-V4-Pro 正式版上线,同步公告 8月17日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash |
| 8月14日 | 智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430亿参数基座 |
| 8月17日 0点(北京时间) | DeepSeek 新定价正式生效 |
把镜头拉远一点:中国厂商在涨价和开源上做加法的同一时间,美国厂商正在免费和降价上做加法。这不是巧合,而是同一场定价博弈的两个侧面。国内财经媒体普遍将密集发布解读为「一周三更」——DeepSeek、阿里、智谱之外,还有 Kimi K3、MiniMax H3 轮番登场。
- 痛点一·口径混乱:不同媒体分别报道「涨11倍」「涨超1100%」「涨350%」,这些说法都对,但对应的是不同计费维度(缓存命中输入 vs 输出 vs 缓存未命中输入)。
- 痛点二·许可证被误读:网上一度传阿里许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息;官方原文并无地域限制,真正门槛是营收与产品形态。
- 痛点三·「官方最便宜」被打破:高峰时段 DeepSeek 官方 API 价格已反超部分第三方转售平台(如 GMI Cloud、Novita 目前报价仍低于官方高峰价)。
[ SECTION_02 ] // MATRIX 核心数据一览:涨价明细、Qwen规格与价格横评
先把可核对数字压成表。DeepSeek 新价自北京时间 8月17日 0 点生效;高峰时段为北京时间 9–12 点、14–18 点(对应 UTC 01:00–04:00 与 06:00–10:00)。
| 计费项 | 涨价前 | 空闲时段(新) | 高峰时段(新) | 涨幅(高峰) |
|---|---|---|---|---|
| V4-Flash 缓存命中输入 | ¥0.02 | ¥0.05 | ¥0.10 | 约400% |
| V4-Flash 缓存未命中输入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 输出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 缓存命中输入 | ¥0.025 | ¥0.15 | ¥0.30 | 约1100% |
| V4-Pro 缓存未命中输入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 输出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
headline「1100%」对应的是高峰时段缓存命中输入——这一档原来最接近免费,绝对金额仍很小。对重度调用者影响更大的其实是输出价格(350%)和缓存未命中输入。有分析测算:约 8400 万 tokens/月、多在空闲时段、约一半缓存命中的重度用户,实际账单涨幅更接近 1.8 倍。
| 项目 | 数据 |
|---|---|
| 参数规模 | 2.4万亿总参数,950亿激活参数(MoE,512个专家,10路由+1共享) |
| 上下文窗口 | 开源权重原生 26.2万 tokens,可扩展至约 101万;云端 Max 版默认 100万 tokens |
| 发布节奏 | 8月2日预告 → 8月3日 API 上线 → 8月12日开源权重 |
| API 定价(国际站) | 输入 $2 / M tokens,输出 $6 / M tokens |
| 许可证 | 非 Apache 2.0,自定义「Qwen3.8-Max License」 |
| 意义 | 阿里历史上首次把 Max 级(旗舰)模型开源;此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API |
| 基准测试 | GLM-5.2 | GLM-5.3 | 变化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),并非全面登顶,而是「开源模型第一梯队」。
| 模型 | 输入(每百万 tokens) | 输出(每百万 tokens) | 开源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(高峰) | ¥9.0(约 $1.26) | ¥27.0(约 $3.78) | 权重未开源 |
| DeepSeek V4-Pro(空闲) | ¥4.5(约 $0.63) | ¥13.5(约 $1.89) | 权重未开源 |
| Qwen3.8-Max(国际站) | $2 | $6 | 开源(自定义许可证) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 闭源 |
| Claude Opus 5(据阿里披露的倍数关系推算) | 约 $5 | 约 $25 | 闭源 |
涨价后 DeepSeek V4-Pro 空闲时段价格仍明显低于 Claude Opus 5,但已经不再是「全场最低」——阿里国际站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的空闲价更便宜。「国产=最便宜」的等式正在瓦解,价格竞争进入分层阶段。
[ SECTION_03 ] // DEEP_DIVE 三种打法、两线战争,以及哪些说法尚未独立验证
1. DeepSeek:从「贴地价」到「分时定价」,本质是算力紧张的显性化。这次涨价最容易被误读为「跟涨」,细看结构更像一次「算力账单透明化」。此前长期采用不分时段的统一低价,用低价换用户规模,再靠缓存命中率和错峰调度摊薄成本。当调用量指数级增长、GPU 产能跟不上时,这套模式撑不住了——公告里「鼓励更灵活的工作负载调度」,翻译过来就是「我们的算力已经不够用了,请你自己错峰」。高峰时段官方价反超部分第三方转售,意味着「官方价格最便宜」这个曾经支撑 DeepSeek 护城河的假设,第一次被打破。
2. 阿里:开源权重圈住生态,自定义许可证圈住收入。Qwen3.8-Max 的开源不是简单的「慈善」。阿里同时做了两件事:把 2.4万亿参数权重公开下载,同时配一份不同于以往 Apache 2.0 的自定义许可证——年营收超 5000万美元的「模型即服务」或「AI工作助手」业务,必须单独找阿里谈商业授权;月活超 1亿或月收入超 2000万美元的产品,必须在界面上显著展示模型名称。逻辑是:用开源换开发者生态和口碑(尤其是海外),但在真正能产生现金流的大客户身上继续保留议价权。这也是为什么它和 Meta 的 Muse Glimmer(完全 Apache 2.0,无附加条款)在「开源程度」上不是一个量级。
需要澄清一个流传较广的谣言:网上一度传阿里的许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文中并无任何地域限制条款。
3. 智谱 GLM-5.3:不换基座,只换「后训练配方」。最值得关注的不是分数本身,而是怎么拿到这个分数——基座与 GLM-5.2 完全相同(7430亿参数),没有重新预训练,仅靠扩大强化学习环境规模做后训练,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍提升。这印证了近半年逐渐清晰的趋势:当预训练 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新的性能杠杆,门槛显著低于重新训练一个千亿级基座,意味着更多中小厂商也有机会靠「精装修」追上头部模型。
争议点与需要注意的细节:
- 涨价幅度的口径混乱:「涨11倍」「涨超1100%」「涨350%」都对,但对应不同计费维度,阅读时需要看清具体是哪一项。
- 阿里「震悟 M890 国产芯片」服务的说法:多家中文财经媒体报道称 Qwen3.8-Max 部分推理服务跑在阿里自研的震悟 M890 芯片和「盘古 AL128」超节点上,但这一细节目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准测试确认,建议标注为未经独立验证。
- GLM-5.3「发现 Cursor 严重漏洞」的说法:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开披露,真实性和影响范围有待第三方安全机构确认,属于厂商单方面披露。
- 中国商务部可能酝酿反制出口管制:部分报道提及中国官方可能针对 AI/半导体技术酝酿反制性出口管制措施,这一说法目前未见官方正式确认,属于媒体推测/传闻性质,仅供背景参考。
影响与背景:这不是孤立事件,而是一场「两线战争」。 过去一个月,中国头部模型厂商呈现出「一周三更」的密集发布节奏。与此同时,美国厂商走的是另一条路径:OpenAI 7月30日大幅降价,8月6日–7日把降价后的 Luna 设为免费用户默认并开放无限文本对话;谷歌 8月13日发布价格减半的 Gemini 3.7 Flash。中国厂商在「开源旗舰+梯度涨价」,美国厂商在「消费端免费+降价防守」——两条路径同时发生,共同把 2026年8月变成大模型行业定价逻辑重构的一个关键节点。
另一层背景是地缘政治:月之暗面 Kimi K3 的开源此前已引发美方安全审查关注,阿里选择在这个窗口把 2.4万亿参数旗舰开源,被部分分析解读为「在潜在监管收紧前,抢先巩固国产模型的国际影响力和技术对等叙事」。这一判断带有一定推测性质,但确实是理解这波开源潮时机选择时不可忽略的背景。可与 Kimi K3 开源解读 对照。
[ SECTION_04 ] // CHECKLIST 面对开源涨价潮:团队六步核对清单
- 先分清涨价口径:把「缓存命中输入约1100%」「输出 350%」「缓存未命中输入 200%」拆开写进内部简报,禁止用单一 headline 数字做预算。
- 对照官方价与第三方转售:高峰时段核对 GMI Cloud、Novita 等转售报价是否低于官方;「官方最便宜」不再是默认假设。
- 读 Qwen 许可证原文,而不是公告线程:确认无地域限制;核对本业务是否触及「模型即服务 / AI工作助手 + 12个月累计收入超 5000万美元」或「月活 1亿 / 月收入 2000万美元」门槛。
- 把 GLM-5.3 分数标为厂商自测:Terminal-Bench 3.0 的 28.3% 尚未见独立第三方复测;对标 GPT-5.6 Sol 34.6%、Claude Fable 5 33.7% 时写明来源。
- 用错峰与缓存命中率重算账单:把批处理、评测、夜间 Agent 循环挪到空闲时段;对重度用户用「约 1.8 倍」而不是「11 倍」做现金流预估。
- 自托管开放权重需要稳定宿主:Qwen3.8-2.4T-A95B 与后续 GLM 权重落地后,长时推理、Agent 编排与许可证合规审计需要 7×24 可复现环境;笔记本合盖与云虚拟机漂移会破坏复现窗口——对照定价与订购页拉起试验节点并记录版本、许可证条款与日志。
China open-weight + pricing cluster — triage sketch (verify against primary sources)
deepseek V4-Pro peak cache-hit input ~1100% · output +350% · effective Aug 17 00:00 CST
peak Beijing 09:00-12:00 and 14:00-18:00 · UTC 01:00-04:00 and 06:00-10:00
qwen 2.4T-A95B weights live Aug 12 · custom license · no geo ban
glm53 same 743B base · TB3.0 4.6% → 28.3% · vendor-run, no 3rd-party rerun
rumor Zhenwu M890 / Cursor vuln / MOFCOM export controls = unverified
[ SECTION_05 ] // FACTS_FAQ 可引用硬核数据、FAQ 与 Agent 宿主收束
- DeepSeek V4-Pro 高峰缓存命中输入:¥0.025 → ¥0.30,约 1100%;输出 ¥6.0 → ¥27.0,350%。
- Qwen3.8-2.4T-A95B:2.4万亿总参数 / 950亿激活;原生 262,144 tokens,可扩至约 101万;国际站 API $2 / $6。
- Qwen 许可证门槛:MaaS / AI工作助手 12个月累计收入超 $5000万须单独授权;月活 1亿或月收入 $2000万须显著标注模型名;无地域限制。
- GLM-5.3:与 5.2 同为 7430亿基座;Terminal-Bench 3.0 4.6% → 28.3%;仍落后 Sol 34.6%、Fable 5 33.7%。
- 重度用户账单:第三方测算约 1.8 倍,远低于 headline 的 11 倍。
- 汇率参考:约 ¥7.15 / $1,仅供对照,实际以官方公告为准。
FAQ 精选:
- Q:DeepSeek 涨价后是不是一定更贵?A:空闲时段 + 高缓存命中,实际涨幅可明显低于 headline;高峰 + 低命中才会接近 350% / 1100%。
- Q:个人开发者能免费商用 Qwen3.8-Max 开源权重吗?A:个人与内部使用基本不受影响;触及 $5000万 MaaS / AI助手门槛才需单独授权。
- Q:GLM-5.3 和 5.2 是同一个模型吗?A:基座完全相同,没有重新预训练;变强来自后训练强化学习规模化。
- Q:许可证禁止美欧用户下载吗?A:不是。官方原文无地域条款,限制按营收与产品形态,不按地区。
- Q:Meta 开源 Muse Glimmer 等于旗舰回归开源吗?A:还不是。Glimmer 是 300亿蒸馏小模型,Muse Spark 1.2 仅「预告」开放权重,尚未落地。
下列为撰写时依据的公开来源入口;价格、许可证条款、基准测试分数建议发布前再次核实最新官方公告。芯片服务、安全漏洞发现、出口管制传闻已在正文标注为未经独立验证。信息截至2026年8月17日整理。
DeepSeek 官方定价页(请以站内最新公告为准):
https://api-docs.deepseek.com/quick_start/pricing
阿里 Qwen 官方模型仓库(Hugging Face):
ModelScope 模型仓库:
智谱 GLM-5.3 官方技术页面:
替代方案的真实缺点(工程视角):① 用单一「涨 1100%」数字做年度预算,会高估空闲时段重度用户的真实账单,也会低估高峰批处理的冲击;② 把 Qwen 开源权重当成 Apache 2.0 直接上「模型即服务」,可能在营收门槛处踩中自定义许可证;③ 用笔记本硬撑 2.4万亿级权重评测与长时 Agent 循环,合盖 sleep 与云虚拟机漂移会让复现窗口与许可证审计链断裂。
对需要独占 Apple Silicon、7×24 在线、按天/周/月弹性扩容、在稳定 macOS 宿主上跑开放权重评测、Agent 编排与长时推理对照的开发与自动化团队,NOVAKVM 的 Mac Mini 云端裸金属租赁通常是更优解:把「定价叙事」与「工程执行面」分层——模型价格走各家官方价目,评测与自托管落在常驻裸金属节点。请在 NOVAKVM 定价页 对照档位,在 订购页 拉起试验机;远程会话见 帮助中心。