닷새 안에 중국 상위 연구소 세 곳이 서로 어긋나 보이는 수를 동시에 뒀습니다. DeepSeek는 일부 과금 항목을 최대 1,100% 올렸습니다. 같은 주 Alibaba는 한 번도 내놓지 않았던 2.4조 파라미터 플래그십을 오픈웨이트로 공개했습니다. 지푸 AI는 GLM-5.3을 출고해, 같은 기반에서 코딩 벤치를 약 6배로 끌어올렸습니다. 재학습은 없습니다. 세 수를 겹치면 단가 경쟁에서 가격 결정력 경쟁으로 축이 이동합니다. 본문은 일정, 요금표, Qwen 라이선스, GLM-5.3 점수, 전략 분해, 횡단 단가, 미확인 주장, 6단계 점검, FAQ를 다룹니다. DeepSeek V4 GA, Qwen3.8-Max 출시, GPT-5.6 Luna 인하와 교차 읽기를 권합니다. 노드 단가는 가격 페이지에 있습니다.
[ SECTION_01 ] // TIMELINE 2주 동안 일어난 일과 팀이 멈추는 지점
의사결정을 막는 질문은 세 개입니다. 1,100% 헤드라인이 가리키는 과금 행이 어디인지, 오픈웨이트가 무료 상용인지 아니면 지역 금지인지, 인상 후에도 DeepSeek가 최저 프론티어급 API인지. 날짜를 먼저 고정합니다.
| 일자 | 사건 |
|---|---|
| 2026년 7월 16일 | Moonshot AI가 Kimi K3(2.8T 파라미터)를 오픈웨이트 공개. 미국 안보 논의를 불렀습니다 |
| 2026년 7월 30일 | OpenAI가 최저 티어 GPT-5.6 Luna를 80% 인하했습니다 |
| 2026년 8월 2–3일 | Alibaba가 Qwen3.8-Max를 프리뷰한 뒤 호스티드 API로 출시했습니다 |
| 2026년 8월 6–7일 | OpenAI가 Luna를 무료 기본값으로 두고 텍스트 채팅을 무제한으로 열었습니다 |
| 2026년 8월 10일 | Meta가 Muse Glimmer(30B, Apache 2.0)를 내고 플래그십 Muse Spark 1.2 오픈웨이트를 예고했습니다 |
| 2026년 8월 12일 | Alibaba가 Qwen3.8-2.4T-A95B 가중치를 Hugging Face / ModelScope에 올렸고, xAI가 Grok 4.6을 출고했습니다 |
| 2026년 8월 13일 | DeepSeek-V4-Pro GA. 8월 17일 발효 인상을 공지. Google이 할인 Gemini 3.7 Flash를 냈습니다 |
| 2026년 8월 14일 | 지푸가 GLM-5.3을 출고. 기반은 GLM-5.2와 같은 743B입니다 |
| 2026년 8월 17일 베이징 시간 00:00 | DeepSeek 신규 요금이 발효했습니다 |
거리를 두면 그림이 선명합니다. 중국 연구소는 플래그십 가중치를 열면서 상위 대역 단가를 올렸고, 미국 연구소는 소비자 층에서 인하와 무료화를 밀었습니다. 같은 가격 전쟁의 양면입니다. 중국 금융 매체는 국내 템포를 「一周三更」—주 3회 대형 업데이트—로 부르며, MiniMax H3도 DeepSeek·Alibaba·지푸와 같은 회전에 들어 있습니다.
- 병목 1 — 헤드라인 산수: 「11배」, 「1,100% 초과」, 「350%」는 모두 맞습니다. 행이 다릅니다. 캐시 히트 입력, 출력, 캐시 미스 입력입니다.
- 병목 2 — 라이선스 풍문: Alibaba가 미국·EU·영국·한국 다운로드를 막았다는 주장은 거짓입니다. 공개문에 영토 조항이 없습니다. 실제 문은 매출과 제품 유형입니다.
- 병목 3 — 공식이 더 이상 최저가 아님: 피크 시간대에는 공식 API가 일부 리셀러(GMI Cloud, Novita 등. 현재 V4 Pro를 공식 피크보다 싸게 게시)보다 비쌉니다.
[ SECTION_02 ] // MATRIX 수치: DeepSeek 단가, Qwen 스펙, 횡단 요금표
신규 DeepSeek 요금은 베이징 시간 8월 17일 00:00에 발효했습니다. 피크는 베이징 시간 오전 9시–12시, 오후 2시–6시(UTC 01:00–04:00 및 06:00–10:00)입니다.
| 과금 항목 | 기존 | 신규 비피크 | 신규 피크 | 피크 상승 |
|---|---|---|---|---|
| V4-Flash 캐시 히트 (입력) | ¥0.02 | ¥0.05 | ¥0.10 | ~400% |
| V4-Flash 캐시 미스 (입력) | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 출력 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 캐시 히트 (입력) | ¥0.025 | ¥0.15 | ¥0.30 | ~1,100% |
| V4-Pro 캐시 미스 (입력) | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 출력 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
1,100%는 피크 시간 캐시 히트 입력에만 적용됩니다. 원래 공짜에 가깝던 행입니다. 실제 청구를 지배하는 출력은 350%입니다. 독립 비용 모형은 현실적 고부하(대략 월 8,400만 토큰, 비피크 중심, 히트율 절반)의 청구 증가를 약 1.8배로 잡습니다.
| 항목 | 내용 |
|---|---|
| 파라미터 | 총 2.4T, 토큰당 활성 95B (MoE, 전문가 512, 라우팅 10 + 공유 1) |
| 컨텍스트 창 | 네이티브 262,144 토큰(공개 체크포인트), 연장은 약 1.01M. 호스티드 Max 기본값은 1M |
| 공개 순서 | 8월 2일 프리뷰 → 8월 3일 API 가동 → 8월 12일 오픈웨이트 |
| API 요금 (국제) | 입력 $2/M, 출력 $6/M |
| 라이선스 | Apache 2.0이 아닙니다. 자체 Qwen3.8-Max License입니다 |
| 의미 | Alibaba가 Max급 플래그십을 처음 오픈웨이트로 연 사례입니다. Qwen3.5 / 3.6 / 3.7 Max는 API만 있었습니다 |
| 벤치마크 | GLM-5.2 | GLM-5.3 | 변화 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 pts |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 pts |
| Agents' Last Exam (CLI) | 23.8% | 28.5% | +4.7 pts |
| CyberGym | 77.2% | 84.5% | +7.3 pts |
| AutomationBench | 26.2% | 48.2% | +22.0 pts |
GLM-5.3은 Terminal-Bench 3.0에서 GPT-5.6 Sol(34.6%)과 Claude Fable 5(33.7%) 뒤에 있습니다. 오픈웨이트 상위 결과이지, 프론티어 전체 1위가 아닙니다.
| 모델 | 입력 (100만 토큰) | 출력 (100만 토큰) | 오픈웨이트 |
|---|---|---|---|
| DeepSeek V4-Pro (피크) | ¥9.0 (~$1.26) | ¥27.0 (~$3.78) | 아니오 |
| DeepSeek V4-Pro (비피크) | ¥4.5 (~$0.63) | ¥13.5 (~$1.89) | 아니오 |
| Qwen3.8-Max (국제 API) | $2.00 | $6.00 | 예 (자체 라이선스) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 아니오 |
| Claude Opus 5 (Alibaba 비교비 함의) | ~$5.00 | ~$25.00 | 아니오 |
인상 후에도 DeepSeek V4-Pro 비피크는 Claude Opus 5를 크게 밑돕니다. 단독 최저가는 아닙니다. Qwen3.8-Max 국제 단가와 OpenAI Luna는 모두 비피크 DeepSeek를 밑돕니다. 「중국 모델 = 최저가 모델」은 2025년과 2026년 초까지 대체로 성립했습니다. 지금은 안전한 가정이 아닙니다.
[ SECTION_03 ] // DEEP_DIVE 세 가지 수, 두 개의 가격 전쟁, 아직 검증되지 않은 주장
1. DeepSeek: 정액 저가에서 시간대 요금으로. 전략 선회라기보다 용량 제약을 요금표에 올린 것입니다. 「중국 최저가가 마진 압박에 굴복했다」는 읽기는 쉽습니다. 구조는 연산 제약을 가격에 드러낸 회사에 가깝습니다. GPU 공급이 수요를 따라가던 시기에는 종일 저가가 획득 장치로 작동했습니다. 사용이 지수적으로 늘고 용량이 따라가지 못하면 어딘가를 명시해야 합니다. 「유연한 워크로드 스케줄링 장려」는 피크 시간 연산이 부족하다는 사내 표현입니다. 피크에서는 공식 API가 여러 리셀러보다 비싸졌습니다. DeepSeek를 공식 API로 돌리는 것이 항상 최저라는 전제는 이번에 처음 깨졌습니다.
2. Alibaba: 가중치 공개로 생태계 호의를 사고, 자체 라이선스로 매출 천장을 지킵니다. 2.4T 체크포인트 공개와 Apache 2.0이 아닌 자체 라이선스 첨부는 동시에 일어났습니다. Model-as-a-Service 또는 AI Work Assistant로 연속 12개월 중 어느 기간에 $50 million을 넘긴 사업은 별도 상용 라이선스를 협상해야 합니다. 월간 활성 1억 초과 또는 월 매출 $20 million 초과 제품은 모델명을 눈에 띄게 표시해야 합니다. 베팅은 해외 개발자 마인드셰어를 가져가면서, 경쟁 추론 사업을 세울 수 있는 규모에는 레버리지를 남기는 것입니다. 제한 없는 Apache 2.0으로 내는 Meta Muse Glimmer와는 다른 내기입니다.
유포된 한 소문은 여기서 끊습니다. 라이선스가 미국·EU·영국·한국 다운로드를 금지한다는 주장은 거짓입니다. 공개 LICENSE 파일에 지리 조항이 없습니다. 주 단위로 업데이트가 겹치는 주기에서는 공지 스레드가 아니라 LICENSE 파일이 1차 자료입니다.
3. GLM-5.3: 새 기반은 없습니다. 후학습 판돈을 키운 것입니다. 743B 파라미터 기반은 GLM-5.2와 같습니다. 재학습은 없고, Terminal-Bench 3.0의 약 6배(4.6% → 28.3%)는 강화학습 환경 확대에서 옵니다. 사전학습 스케일링이 수확 체감에 들어갈수록 후학습 RL 규모는 독립 레버가 되며, 새 기반을 다시 만드는 것보다 비용 바닥이 낮습니다. OpenAI급 연산을 갖지 못한 중견 연구소도 에이전트·코딩 벤치에서는 격차를 좁힐 수 있습니다.
쟁점이거나 미확인인 항목:
- 1,100% 헤드라인은 정확하고 동시에 불완전합니다. 대상은 피크 시간 캐시 히트 입력뿐입니다. 실제 청구의 중심인 출력은 350%입니다.
- Qwen3.8-Max가 Alibaba 자체 Zhenwu M890와 「Pangu AL128」 슈퍼노드에서 돈다는 주장은 중국 금융 매체에 나옵니다. Alibaba 기술 문서나 제3자 벤치의 독립 확인은 없습니다. 벤더 인접 미확인 보도로 다루십시오.
- GLM-5.3이 Cursor의 심각한 취약점을 발견했다는 보도는 VentureBeat와 지푸 자체 공개에 의존합니다. 기술 세부는 미공개입니다. 벤더 출처이며 독립 감사가 아닙니다.
- 중국 상무부(MOFCOM)가 AI 또는 반도체 기술에 보복 수출 통제를 준비한다는 보도는 추측입니다. 미확인 매체에 의존하며 공식 발표가 아닙니다.
왜 중요한가: 가격 전쟁이 두 갈래로 동시에 달립니다. 지난 한 달 중국 상위 연구소 출고 밀도를 국내 매체는 주 3회로 부릅니다. 미국 연구소는 소비자 층에서 반대로 갔습니다. OpenAI는 7월 30일 Luna를 80% 내린 뒤 8월 6–7일 무료·무제한으로 열었습니다. Google은 8월 13일, 3주 전 선행 모델의 절반 가격으로 코딩 중심 모델을 냈습니다. 중국 쪽은 플래그십을 오픈웨이트로 열고, 연산이 부족한 상단에 단계형 고단가를 넣습니다. 미국 쪽은 소비자 끝에서 무료와 저가로 달립니다.
지정학 층도 있습니다. Moonshot Kimi K3는 이미 미국 안보 논의를 불렀습니다. Alibaba가 이 창에서 2.4T 플래그십을 연 것을, 규제 강화 전에 국제 마인드셰어를 고정하려는 수로 읽는 분석이 있습니다. 근거 있는 해석이지 확인된 사실이 아닙니다. 관련 글은 Kimi K3 오픈웨이트 해설입니다.
[ SECTION_04 ] // CHECKLIST 지출을 바꾸기 전에 가격 전쟁을 6단계로 검증합니다
- 헤드라인을 과금 행으로 분해합니다. 캐시 히트 입력(~1,100%), 출력(350%), 캐시 미스 입력(200%)을 별도 행으로 씁니다. 단일 배수로 예산을 짜지 마십시오.
- 공식 피크와 리셀러를 나란히 둡니다. GMI Cloud, Novita, 기타 게시를 DeepSeek 피크표와 대조합니다. 공식은 기본 최저 경로가 아닙니다.
- 출시 스레드가 아니라 Qwen LICENSE 파일을 읽습니다. 지역 금지가 없음을 확인합니다. 제품이 Model-as-a-Service / AI Work Assistant이면서 12개월 중 $50M에 닿는지, 또는 100M MAU / 월 매출 $20M에 닿는지 봅니다.
- GLM-5.3 점수는 벤더 실행으로 라벨합니다. Terminal-Bench 3.0 28.3%에는 공개된 독립 재실행이 없습니다. Sol 34.6%와 Fable 5 33.7%를 인용할 때 출처를 남깁니다.
- 비피크와 캐시 히트율로 청구를 다시 셉니다. 배치, 평가, 야간 에이전트 루프를 피크에서 뺍니다. 고부하 사용자는 11배가 아니라 약 1.8배로 봅니다.
- 오픈웨이트 자체 호스팅에는 안정 호스트가 필요합니다. 장기 평가, 에이전트 오케스트레이션, 라이선스 준수 로그는 재현 가능한 24시간 환경을 요구합니다. 노트북 슬립과 표류하는 VM은 감사 사슬을 끊습니다. 가격과 주문에서 시험 노드를 올리고 버전, 라이선스 원문, 로그를 남기십시오.
China open-weight + pricing cluster — triage sketch (verify against primary sources)
deepseek V4-Pro peak cache-hit input ~1100% · output +350% · effective Aug 17 00:00 CST
peak Beijing 09:00-12:00 and 14:00-18:00 · UTC 01:00-04:00 and 06:00-10:00
qwen 2.4T-A95B weights live Aug 12 · custom license · no geo ban
glm53 same 743B base · TB3.0 4.6% → 28.3% · vendor-run, no 3rd-party rerun
rumor Zhenwu M890 / Cursor vuln / MOFCOM export controls = unverified
[ SECTION_05 ] // FACTS_FAQ 인용 가능한 수치, FAQ, 평가 루프용 호스트
- DeepSeek V4-Pro 피크 캐시 히트 입력: ¥0.025 → ¥0.30, 약 1,100%. 출력 ¥6.0 → ¥27.0, 350%.
- Qwen3.8-2.4T-A95B: 총 2.4T / 활성 95B. 네이티브 262,144 토큰, 연장 약 1.01M. 국제 API $2 / $6.
- Qwen 라이선스 문턱: MaaS / AI Work Assistant가 12개월 중 $50M 초과면 별도 라이선스. 100M MAU 또는 월 매출 $20M은 명칭 명시 표시. 지리적 금지는 없습니다.
- GLM-5.3: 기반은 5.2와 같은 743B. Terminal-Bench 3.0 4.6% → 28.3%. Sol 34.6%, Fable 5 33.7% 뒤입니다.
- 고부하 청구: 제3자 모형 약 1.8배. 헤드라인 11배보다 훨씬 낮습니다.
- 환율 참조: 약 ¥7.15 / $1. 참고용 대략치입니다.
FAQ:
- Q: DeepSeek는 인상 이후에도 GPT-5.6이나 Claude보다 저렴합니까? A: 비피크는 여전히 Claude Opus 5를 밑돕니다. Luna($0.20 / $1.20)와 Qwen3.8-Max 국제($2 / $6)는 적어도 한 축에서 비피크 DeepSeek를 밑돕니다.
- Q: Qwen3.8-Max 오픈웨이트를 상용으로 무료 사용할 수 있습니까? A: 개인·사내는 문제 없습니다. 걸리는 지점은 $50M MaaS / AI Work Assistant 문턱입니다.
- Q: Qwen3.8-Max는 미국·EU·영국 사용자에게 금지되어 있습니까? A: 아닙니다. 공개 라이선스에 지리적 제한이 없습니다.
- Q: GLM-5.3과 GLM-5.2에서 무엇이 바뀌었습니까? A: 기반은 같은 743B입니다. 상승분은 새 기반이 아니라 후학습 RL 확대입니다.
- Q: Meta는 Glimmer뿐 아니라 Muse Spark 1.2도 오픈소스합니까? A: 아직입니다. Glimmer는 30B 증류입니다. Spark 1.2는 표명에 머뭅니다.
집필 시 사용한 1차 자료입니다. 전재 전에 공식 최신 요금과 라이선스 조항을 확인하십시오. 위에서 미확인으로 표시한 항목(국내 칩 주장, Cursor 취약점 보고, 수출 통제 소문)은 독립 확인이 없습니다. 수치는 2026년 8월 17일 기준 공개 정보입니다.
DeepSeek 공식 요금 페이지(라이브 페이지를 정본으로 둡니다):
https://api-docs.deepseek.com/quick_start/pricing
Alibaba Qwen 공식 모델 저장소(Hugging Face):
ModelScope 모델 저장소:
지푸 GLM-5.3 공식 기술 페이지:
흔한 우회의 실제 한계: 1,100% 단일 배수로 예산을 짜면 비피크 고부하 청구를 과대 계상하고 피크 배치 충격을 과소 계상합니다. Qwen 가중치를 Apache 2.0으로 취급해 Model-as-a-Service를 세우면 자체 라이선스에 걸릴 수 있습니다. 2.4T급 평가와 긴 에이전트 루프를 슬립하는 노트북이나 표류하는 VM에서 돌리면 재현성과 라이선스 감사 사슬이 끊깁니다.
오픈웨이트 평가, 에이전트 오케스트레이션, 장시간 추론을 전용 Apple Silicon, 7×24 가동, 일·주·월 탄력으로 안정적인 macOS 호스트에 올려야 하는 팀에게 NOVAKVM Mac Mini 베어메탈 대여가 보통 프로덕션에 맞는 경로입니다. 요금 서사는 각사 요금표에 두고, 실행은 상주 베어메탈 노드에 두십시오. 티어는 NOVAKVM 가격 페이지에서 비교하고, 주문 페이지에서 시험을 시작하며, 고객 센터에서 원격 세션을 확인하십시오.