五日間に、中国の上位ラボ三社が、一見かみ合わない手を同時に打ちました。DeepSeekは一部課金項目を最大1,100%引き上げました。同じ週にAlibabaは、これまで出していなかった2.4兆パラメータの旗艦をオープンウェイトで公開しました。智譜AIはGLM-5.3を投入し、同じベースモデルのままコーディング系ベンチを約6倍まで伸ばしました。再学習はありません。三手を並べると、単価競争から価格決定力の競争へ軸が移っていることが見えます。本稿では経緯、料金表、Qwenライセンス、GLM-5.3の点数、戦略の読み分け、横断単価、未確認主張、六ステップ確認手順、FAQを扱います。併読は DeepSeek V4 GA、Qwen3.8-Max公開、GPT-5.6 Luna値下げです。ノード単価は料金ページにあります。
[ SECTION_01 ] // TIMELINE 二週間で何が起き、どこで判断が止まるか
現場で繰り返し止まる問いは三つです。1,100%の見出しはどの課金行を指すのか。オープンウェイトは無料商用なのか、それとも地域禁止なのか。値上げ後もDeepSeekは最安のフロンティア級APIなのか。日付を先に固定します。
| 日付 | 出来事 |
|---|---|
| 2026年7月16日 | Moonshot AIがKimi K3(2.8Tパラメータ)をオープンウェイト公開。米国の安全保障論議を呼びました |
| 2026年7月30日 | OpenAIが最安帯GPT-5.6 Lunaを80%値下げしました |
| 2026年8月2–3日 | AlibabaがQwen3.8-Maxをプレビューし、続けてホストAPIとして投入しました |
| 2026年8月6–7日 | OpenAIがLunaを無料の既定にし、テキストチャットを無制限にしました |
| 2026年8月10日 | MetaがMuse Glimmer(30B、Apache 2.0)を出し、旗艦Muse Spark 1.2のオープンウェイトを予告しました |
| 2026年8月12日 | AlibabaがQwen3.8-2.4T-A95Bの重みをHugging Face / ModelScopeへ公開。xAIがGrok 4.6を出荷しました |
| 2026年8月13日 | DeepSeek-V4-ProがGA。8月17日発効の値上げを告知。Googleが値下げしたGemini 3.7 Flashを投入しました |
| 2026年8月14日 | 智譜がGLM-5.3を出荷。ベースモデルはGLM-5.2と同じ743Bです |
| 2026年8月17日 北京時間 00:00 | DeepSeekの新料金が発効しました |
距離を取ると構図がはっきりします。中国側は旗艦の重みを開きつつ上位帯の単価を上げ、米国側は消費者層で値下げと無料化を進めました。同じ価格戦争の裏表です。国内金融メディアは更新密度を「一周三更」——週に大型更新が三つ——と呼び、MiniMax H3もDeepSeek・Alibaba・智譜と同じ回転に入っています。
- 詰まり1 — 見出しの算数:「11倍」「1,100%超」「350%」はいずれも正しいです。指す行が違います。キャッシュヒット入力、出力、キャッシュミス入力です。
- 詰まり2 — ライセンスの伝聞:Alibabaが米・EU・英・韓国からのダウンロードを禁じた、という話は誤りです。公開文に領域条項はありません。実際の門は売上と製品類型です。
- 詰まり3 — 公式が最安ではなくなった:ピーク時間帯では、公式APIが一部再販(GMI Cloud、Novitaほか。現時点でV4 Proを公式ピークより安く掲げています)を上回ります。
[ SECTION_02 ] // MATRIX 数字:DeepSeek単価、Qwen仕様、横断料金表
新料金は北京時間8月17日 00:00に発効しました。ピークは北京時間9時–12時と14時–18時(UTC 01:00–04:00 および 06:00–10:00)です。
| 課金項目 | 旧単価 | 新・閑散 | 新・ピーク | ピーク上昇 |
|---|---|---|---|---|
| V4-Flash キャッシュヒット(入力) | ¥0.02 | ¥0.05 | ¥0.10 | ~400% |
| V4-Flash キャッシュミス(入力) | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 出力 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro キャッシュヒット(入力) | ¥0.025 | ¥0.15 | ¥0.30 | ~1,100% |
| V4-Pro キャッシュミス(入力) | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 出力 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
1,100%はピーク時間帯のキャッシュヒット入力にだけ当てはまります。もともと無料に近い行です。実請求の大半を占める出力は350%です。第三者のコスト試算では、現実的な高負荷(おおよそ月8,400万トークン、閑散中心、ヒット率半分)の請求増は約1.8倍に寄ります。
| 項目 | 内容 |
|---|---|
| パラメータ | 総量2.4T、トークンあたり活性95B(MoE、512エキスパート、ルーティング10+共有1) |
| コンテキスト窓 | ネイティブ262,144トークン(公開チェックポイント)、延長は約1.01M。ホストMaxの既定は1M |
| 公開手順 | 8月2日プレビュー → 8月3日API稼働 → 8月12日オープンウェイト |
| API料金(国際) | 入力 $2/M、出力 $6/M |
| ライセンス | Apache 2.0ではありません。独自のQwen3.8-Max Licenseです |
| 位置づけ | AlibabaがMax級旗艦を初めてオープンウェイト化した事例です。Qwen3.5 / 3.6 / 3.7 MaxはAPIのみでした |
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 pts |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 pts |
| Agents' Last Exam (CLI) | 23.8% | 28.5% | +4.7 pts |
| CyberGym | 77.2% | 84.5% | +7.3 pts |
| AutomationBench | 26.2% | 48.2% | +22.0 pts |
GLM-5.3はTerminal-Bench 3.0でGPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)の後ろにいます。オープンウェイト上位ではあっても、フロンティア全体の首位ではありません。
| モデル | 入力(100万トークン) | 出力(100万トークン) | オープンウェイト |
|---|---|---|---|
| DeepSeek V4-Pro(ピーク) | ¥9.0(~$1.26) | ¥27.0(~$3.78) | いいえ |
| DeepSeek V4-Pro(閑散) | ¥4.5(~$0.63) | ¥13.5(~$1.89) | いいえ |
| Qwen3.8-Max(国際API) | $2.00 | $6.00 | はい(独自ライセンス) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | いいえ |
| Claude Opus 5(Alibaba比較比からの含意) | ~$5.00 | ~$25.00 | いいえ |
値上げ後も、DeepSeek V4-Proの閑散単価はClaude Opus 5を大きく下回ります。ただし最安の一択ではありません。Qwen3.8-Maxの国際単価とOpenAI Lunaは、いずれも閑散DeepSeekを下回ります。「中国モデル=最安モデル」は2025年から2026年初頭までおおむね成立していました。いまは前提として使えません。
[ SECTION_03 ] // DEEP_DIVE 三つの打ち手、二つの価格戦争、未確認のまま残る話
1. DeepSeek:一律安値から時間帯課金へ。戦略転換というより供給制約の可視化です。「中国最安がついに利幅に屈した」と読むのは簡単です。料金表の形は、計算資源の逼迫を価格に出した会社に見えます。GPU供給が需要に追いついていた時期は、終日の安値が獲得装置として機能しました。利用が指数的に伸び、供給が追いつかなくなると、どこかを明示する必要が出ます。「柔軟な負荷スケジューリングを促す」は、ピーク帯の計算が不足している、という社内表現です。ピークでは公式APIが複数の再販より高くなりました。DeepSeekを公式APIで走らせるのが常に最安、という前提は今回初めて崩れました。
2. Alibaba:重み公開で生態系の好意を買い、独自ライセンスで売上天井を守ります。2.4Tチェックポイントの公開と、Apache 2.0ではない独自ライセンスの添付は同時です。Model-as-a-ServiceまたはAI Work Assistantで、連続12か月のいずれかに売上 $50 million を超えた事業は、別途の商用ライセンス交渉が必要です。月間アクティブ1億超、または月次売上 $20 million 超の製品は、モデル名を目立つ位置に出す必要があります。狙いは、海外の開発者マインドシェアを取りつつ、推論事業で対抗できる規模の企業にはレバレッジを残すことです。制限なしのApache 2.0で出すMetaのMuse Glimmerとは賭け方が違います。
流布した一説はここで切ります。ライセンスが米・EU・英・韓国からのダウンロードを禁じる、という主張は誤りです。公開LICENSEファイルに地理条項はありません。更新が週単位で重なる局面では、告知スレッドではなくLICENSEファイルが一次資料です。
3. GLM-5.3:新しいベースモデルはありません。後学習の賭けを大きくしただけです。パラメータ743BのベースモデルはGLM-5.2と同じです。再学習はなく、Terminal-Bench 3.0の約6倍(4.6% → 28.3%)は強化学習環境の拡大から来ています。事前学習のスケーリングが収穫逓減に入るほど、後学習のRL規模は独立したレバーになり、新しい基盤を作り直すよりコスト床が低いです。OpenAI級の計算を持たない中堅ラボでも、エージェント系とコーディング系では差を詰められます。
争点または未確認のままのもの:
- 1,100%の見出しは正確であり、同時に不完全です。対象はピーク時間帯のキャッシュヒット入力だけです。実請求の中心となる出力は350%です。
- Qwen3.8-MaxがAlibaba内製のZhenwu M890と「Pangu AL128」スーパーノードで動く、という主張は中国金融メディアに出ています。Alibabaの技術文書や第三者ベンチでの独立確認はありません。ベンダー隣接の未確認報道として扱ってください。
- GLM-5.3がCursorの重大脆弱性を発見した、という話はVentureBeatと智譜自身の開示に依ります。技術詳細は未公開です。ベンダー発信であり、独立監査ではありません。
- 中国商務部(MOFCOM)がAIまたは半導体技術で報復的輸出規制を準備している、という報道は推測です。未確認メディアに依り、公式発表ではありません。
なぜ重要か:価格戦争は二本同時に走っています。直近一か月、中国上位ラボの出荷密度を国内メディアは週三更新と呼びます。米国ラボは消費者層で逆を行きました。OpenAIは7月30日にLunaを80%下げ、8月6–7日に無料かつ無制限にしました。Googleは8月13日、三週間前の先行モデルの半額でコーディング寄りモデルを出しました。中国側は旗艦をオープンウェイト化し、計算が逼迫する上位帯に段階の高い料金を入れます。米国側は消費者端で無料と安値へ走ります。
地政学の層もあります。MoonshotのKimi K3はすでに米国の安全保障論議を呼びました。Alibabaがこの窓で2.4T旗艦を開いたのを、規制が締まる前に国際マインドシェアを固定する動きとして読む分析があります。根拠のある解釈であり、確認済み事実ではありません。関連は Kimi K3オープンウェイト解説 です。
[ SECTION_04 ] // CHECKLIST 支出を動かす前に、価格戦争を六手順で確認する
- 見出しを課金行に分解します。キャッシュヒット入力(~1,100%)、出力(350%)、キャッシュミス入力(200%)を別行に書きます。単一の倍率で予算を組まないでください。
- 公式ピークと再販を並べます。GMI Cloud、Novita、その他の掲示をDeepSeekのピーク表と突合します。公式は既定の最安経路ではありません。
- 告知スレッドではなくQwenのLICENSEファイルを読みます。地理禁止がないことを確認します。自社製品がModel-as-a-Service / AI Work Assistantかつ12か月のいずれかで $50M に達するか、100M MAU / 月次売上 $20M に触れるかを見ます。
- GLM-5.3の点数はベンダー走行とラベルします。Terminal-Bench 3.0の28.3%に独立再走の公開はありません。Sol 34.6%とFable 5 33.7%を引用するときは出典を残します。
- 閑散とキャッシュヒット率で請求を再計算します。バッチ、評価、夜間エージェントループをピークから外します。高負荷ユーザーは11倍ではなく約1.8倍で見積もります。
- オープンウェイトの自己ホストには安定したホストが必要です。長時間評価、エージェントオーケストレーション、ライセンス遵守ログは、再現可能な24時間環境を要します。ノートPCのスリープと漂流するVMは監査連鎖を切ります。料金と注文から試験ノードを起動し、版、ライセンス本文、ログを残してください。
China open-weight + pricing cluster — triage sketch (verify against primary sources)
deepseek V4-Pro peak cache-hit input ~1100% · output +350% · effective Aug 17 00:00 CST
peak Beijing 09:00-12:00 and 14:00-18:00 · UTC 01:00-04:00 and 06:00-10:00
qwen 2.4T-A95B weights live Aug 12 · custom license · no geo ban
glm53 same 743B base · TB3.0 4.6% → 28.3% · vendor-run, no 3rd-party rerun
rumor Zhenwu M890 / Cursor vuln / MOFCOM export controls = unverified
[ SECTION_05 ] // FACTS_FAQ 引用できる数字、FAQ、評価ループ用のホスト
- DeepSeek V4-Pro ピーク・キャッシュヒット入力:¥0.025 → ¥0.30、約1,100%。出力は ¥6.0 → ¥27.0、350%。
- Qwen3.8-2.4T-A95B:総量2.4T / 活性95B。ネイティブ262,144トークン、延長約1.01M。国際APIは $2 / $6。
- Qwenライセンスの門:MaaS / AI Work Assistantで12か月のいずれか $50M 超は別ライセンス。100M MAUまたは月次売上 $20M は名称の明示表示。地理禁止はありません。
- GLM-5.3:ベースモデルは5.2と同じ743B。Terminal-Bench 3.0は 4.6% → 28.3%。Sol 34.6% と Fable 5 33.7% の後ろです。
- 高負荷の請求:第三者試算は約1.8倍。見出しの11倍よりかなり低いです。
- 為替の参照:約 ¥7.15 / $1。概算です。
FAQ:
- Q:DeepSeekは値上げ後もGPT-5.6やClaudeより安いですか? A:閑散帯はClaude Opus 5を下回ります。Luna($0.20 / $1.20)とQwen3.8-Max国際($2 / $6)は、少なくとも一方の軸で閑散DeepSeekを下回ります。
- Q:Qwen3.8-Maxのオープンウェイトは商用で無料利用できますか? A:個人と社内は問題ありません。引っかかるのは $50M の MaaS / AI Work Assistant 門です。
- Q:Qwen3.8-Maxは米・EU・英の利用者に禁止されていますか? A:禁止されていません。公開ライセンスに地理制限はありません。
- Q:GLM-5.3とGLM-5.2で何が変わりましたか? A:ベースモデルは同じ743Bです。伸びは新しい基盤ではなく、後学習RLの拡大です。
- Q:MetaはGlimmerだけでなくMuse Spark 1.2もオープンソースにしますか? A:まだです。Glimmerは30Bの蒸留です。Spark 1.2は表明にとどまります。
執筆時に使った一次資料です。転載前に公式の最新料金とライセンス条項を確認してください。上で未確認とした項目(国内チップ主張、Cursor脆弱性報告、輸出規制の噂)は独立確認がありません。数値は2026年8月17日時点の公開情報です。
DeepSeek公式料金ページ(ライブページを正とします):
https://api-docs.deepseek.com/quick_start/pricing
Alibaba Qwen公式モデルリポジトリ(Hugging Face):
ModelScopeのモデルリポジトリ:
智譜 GLM-5.3 公式技術ページ:
よくある回避策の実限界:1,100%という単一倍率で予算を組むと、閑散帯の高負荷請求を過大に見積もり、ピーク帯のバッチ衝撃を過小に見ます。Qwenの重みをApache 2.0扱いしてModel-as-a-Serviceを立てると、独自ライセンスに抵触し得ます。2.4T級の評価と長いエージェントループを、スリープするノートPCや漂流するVMで回すと、再現性とライセンス監査の連鎖が切れます。
オープンウェイト評価、エージェントオーケストレーション、長時間推論を専用Apple Silicon、7×24稼働、日/週/月の弾力で安定したmacOSホストに載せたいチームには、NOVAKVMのMac Mini裸金属レンタルが通常は本番向きの経路です。料金の物語は各社の料金表に残し、実行は常駐の裸金属ノードに置いてください。段階はNOVAKVM料金ページで比較し、注文ページから試験を始め、ヘルプセンターでリモートセッションを確認してください。