xAI Grok 시리즈 출시 페이스를 추적하고 Agent 코딩 모델을 평가하는 개발자·기술 의사결정자에게 7월 28일 머스크의 Vercel CEO Guillermo Rauch 답글은 향후 2개월 모델 스택 계획에 직접 영향을 줍니다. Grok 4.6은 8월 7일 전후 1.5T 파라미터로 출시 예정이며, 몇 주 뒤 2.1T 파라미터 Grok 4.7이 이어집니다. Grok 4.5 출시 후 불과 1개월입니다. 본문은 타임라인, 핵심 데이터 표, SFT/RL 업그레이드 논리, Kimi K3·Claude Fable 5.1 횡단 비교, 쟁점, 출시 전 6단계 체크리스트를 다룹니다. Grok 4.5 리뷰, Kimi K3 오픈웨이트 해설과 함께 읽어보세요. 요금은 가격 페이지를 참고하세요.
[ SECTION_01 ] // TIMELINE Grok 4.5에서 4.6·4.7까지: 페이스는 얼마나 빠른가, 무엇이 미확인인가
현재 xAI는 Grok 4.6 벤치마크 점수와 가격을 공개하지 않았습니다. 아래는 머스크의 공개 발언과 업계 보도를 바탕으로 정리한 내용이며, 출시 전 xAI 공식 채널에서 반드시 확인해야 합니다.
- 단일 정보원 리스크: 현재 1차 출처는 7월 28일 머스크 X 답글뿐입니다. xAI 공식 블로그·제품 페이지에 미동기화되어 일정이 앞당겨지거나 지연될 수 있습니다.
- 「Musk time」 여유: xAI, Tesla, SpaceX 일정은 역사적으로 며칠~수주 밀린 전례가 많습니다. 「약 8월 7일」은 목표이지 보장이 아닙니다.
- 벤치마크·가격 공백: Grok 4.5 출시 시 상세 모델 카드·15개 벤치마크와 달리 Grok 4.6에는 독립 평가나 공식 모델 카드가 없습니다.
- 경쟁 압박 윈도우: Grok 4.6 목표일은 Kimi K3 완전 오픈웨이트 약 10일 후로, 오픈 모델의 코딩 리더보드 충격이 xAI 반복 주기를 압축하고 있습니다.
- 업계 페이스 분열: 7월 28일 OpenAI·Anthropic 등 1200명 이상이 「Pacing the Frontier」 공개서한으로 프론티어 AI 감속을 촉구했습니다. xAI는 서명자에 없습니다.
- 안전·컴플라이언스 배경: 7월 xAI는 안전 제한 우회 CSAM 생성으로 첫 사용자 소송을 제기했습니다. Common Sense Media 1월 보고서는 Grok을 미성년자 보호 최하위 AI로 평가했습니다.
핵심 결론: Grok 4.6의 「1.5T 파라미터」「SFT/RL 대폭 강화」는 현재 벤더 단독 주장입니다. 모델 카드 공개 전까지 Kimi K3, Claude Fable 5.1 등 대체 라우트를 유지해야 합니다.
주요 타임라인:
- 2026년 7월 8일: xAI Grok 4.5 정식 출시. 코딩·Agent 플래그십, Cursor 공동 학습, 실제 개발자 세션 데이터 사용. 50만 Token 컨텍스트, 100만 Token당 입력 2달러/출력 6달러.
- 2026년 7월 16일: 경쟁사 Moonshot AI Kimi K3 호스팅 서비스 시작.
- 2026년 7월 26일: Kimi K3 하루 일찍 완전 오픈웨이트 공개. 2.8T 파라미터, 100만 Token 컨텍스트.
- 2026년 7월 28일: 머스크가 Rauch 게시물에 Grok 4.6/4.7 로드맵 최초 공개. 동일일 「Pacing the Frontier」 공개.
- 약 2026년 8월 7일(목표): Grok 4.6 예정. 1.5T 파라미터, SFT·RL 강화 중심.
- 약 2026년 8월 말~9월 초(추정): Grok 4.7 예정. 2.1T 파라미터. 머스크는 「추론 속도는 약간 느리나 나머지는 4.6 상회, Token 효율 더 높음」이라고 밝혔습니다.
[ SECTION_02 ] // SPECS_SFT_RL 핵심 데이터: 이번 업그레이드의 초점은 「더 크게」가 아니라 「더 잘 배우기」
| 모델 | 출시/목표일 | 파라미터 규모 | 포지셔닝 | 상태 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026년 4월 17일 | 미공개 | 이전 세대 기준선 | 출시됨 |
| Grok 4.5 | 2026년 7월 8일 | 미공개(비 MoE 단일 SKU) | 코딩·Agent, Cursor 공동 학습 | 출시됨 |
| Grok 4.6 | 약 2026년 8월 7일 | 1.5T | SFT/RL 대폭 강화 | 공식 예고, 미출시 |
| Grok 4.7 | 약 8월 말~9월 초 | 2.1T | 4.6 전반 상회, Token 효율 향상 | 공식 예고, 미출시 |
참고: 파라미터·가격·벤치마크는 벤더/머스크 진술입니다. Grok 4.6·4.7은 제3자 평가가 없으며 「공식 예고」 행은 정식 출시까지 참고용으로 취급하세요.
지도 미세조정(SFT)과 강화학습(RL)이 해결하는 문제: SFT는 고품질 샘플로 출력 습관을 교정합니다. RL은 보상 신호로 다단계 Agent 작업에서 올바른 행동 순서를 학습시킵니다. 머스크는 Grok 4.6 강화점을 파라미터 규모가 아닌 「SFT & RL」로 강조했으며, Grok 4.5 전략의 연장입니다. Grok 4.5는 Cursor 공동 학습 실세션으로 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 달성했고, Claude Opus 4.8(약 6.7만 Token) 대비 약 1.9만 Token으로 유사 작업을 처리합니다.
xAI 「규모 확대 + 후학습 정밀화」 이중 전략: Grok 4.6의 1.5T는 Grok 4.5 대비 명확한 규모 도약이나, Grok 4.7은 2.1T이면서 「추론 약간 느림」으로 보완되어 「더 강함」과 「더 빠름」을 별도 SKU로 충족하는 방향을 시사합니다.
Kimi K3와의 동시기 경쟁 압력: Kimi K3는 Frontend Code Arena 1679점 1위, 모든 클로즈드 모델을 넘은 최초 오픈웨이트 모델이며 Artificial Analysis Intelligence Index 세계 3위입니다. 머스크도 「인상적」이라고 댓글을 남겼습니다. Grok 4.6/4.7 가속은 OpenAI·Anthropic·중국 업체와의 경쟁 심화에 대한 대응으로 해석됩니다.
[ SECTION_03 ] // COMPARE 횡단 비교: Grok 시리즈 vs 동기 경쟁 모델
| 모델 | 벤더 | 파라미터 | 컨텍스트 | 가격(입력/출력, 100만 Token) | 주요 출처 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 미공개 | 50만 Token | $2 / $6 | xAI 공식 |
| Grok 4.6(예고) | xAI | 1.5T | 미공개 | 미공개 | 머스크 X 게시(미검증) |
| Kimi K3 | Moonshot AI | 2.8T(MoE, 약 16/896 전문가 활성) | 100만 Token | 입력 $0.30(캐시 히트)/$3(미스), 출력 $15 | Moonshot+Hugging Face |
| Claude Fable 5.1(루머) | Anthropic | 미공개 | 미공개 | Fable 5 유지 루머($10입력/$50출력) | 36kr, WinCentral, Anthropic 미확인 |
| GPT-5.6 Sol | OpenAI | 미공개 | 미공개 | 미공개 | OpenAI 공식 |
Grok 4.6·Claude Fable 5.1 행은 예고·루머이며 공식 벤치마크 비교가 아닙니다. 출시 타이밍과 대략적 포지셔닝 참고용입니다.
머스크 일정이 맞다면 Grok 4.6·4.7은 루머의 Claude Fable 5.1(36kr·WinCentral 등 8월, OpenAI GPT-6 선점 목적 보도)과 같은 달에 등장하고, 7월 Kimi K3 오픈웨이트 충격과 겹칩니다. 2026년 8월은 프론티어 모델 출시 밀도가 극히 높은 달이 될 수 있습니다. 개발자·기업에게 선정 윈도우는 극도로 짧아지며, Token 효율과 실제 작업 비용이 파라미터 수나 단순 점수보다 실무적 의사결정 기준이 됩니다.
[ SECTION_04 ] // PREP_STEPS Grok 4.6 출시 전 6단계 엔지니어링 준비 체크리스트
- 공식 정보원 고정: xAI 공식 블로그, X @xai·@elonmusk 구독, Grok Build·API 콘솔 공지 알림 활성화. 정식 출시 전 머스크 트윗을 SLA로 간주하지 마세요.
- Grok 4.5 비용 기준선 구축: 현재 Agent 워크플로의 입출력 Token 분포·청구 집계. SWE-Bench Pro급 평균 출력 Token(공식 약 1.9만/작업) 기록, 4.6 가격 변동에 20%~40% 버퍼 확보.
- SFT/RL 강화가 Agent 체인에 미치는 영향 정리: 다단계 Coding Agent 실패 모드(도구 호출 환각, 컨텍스트 절단, 장체인 보상 희소) 나열, 4.6 후학습 수혜 구간과 수동 검토 필요 구간 표시.
- 계층 라우팅 사전 설정: 일상 배치는 Kimi K3·DeepSeek V4 Flash로 처리량 확보, 복잡 추론은 Claude Fable 5.1/GPT-5.6 Sol 예약. Grok 4.6은 비프로덕션 A/B 비교. OpenRouter 7월 계층 선정 참고.
- Cursor/API 클라이언트 연동 슬롯 확보: Grok 4.5 배포 경로에 따라 Cursor·OpenRouter·xAI API 직연결 설정에 모델 ID 전환 로직 사전 구현, 출시일 model 문자열만 변경.
- 7×24 macOS Agent 오케스트레이션 환경 고정: 출시 윈도우는 회귀 테스트·멀티모델 병행 평가가 집중됩니다. Agent 게이트웨이, CI Runner, 평가 스크립트를 상시 macOS 노드에서 실행. 고객 센터·주문 페이지 참고.
GROK_PRIMARY=grok-4.5
GROK_FALLBACK=kimi-k3
GROK_COMPLEX=claude-fable-5
XAI_API_BASE=https://api.x.ai/v1
[ SECTION_05 ] // FACTS_FAQ 인용 가능 하드 데이터, FAQ, 7×24 Agent 호스트 마무리
- Grok 4.6 목표 출시일: 머스크 「약 8월 7일」, xAI 공식 미확인(출처: 2026-07-28 X 게시).
- 파라미터 규모: Grok 4.6 예고 1.5T, Grok 4.7 예고 2.1T(출처: 동일, 제3자 미검증).
- Grok 4.5 컨텍스트·가격: 50만 Token, 입력 $2/출력 $6(100만 Token)(출처: xAI Grok 4.5 모델 카드).
- Grok 4.5 Token 효율: SWE-Bench Pro 작업당 평균 약 1.9만 출력 Token, Claude Opus 4.8 약 6.7만(출처: xAI 모델 카드).
- Grok 4.5 코딩 벤치마크: Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%(출처: xAI 공식).
- Kimi K3 코딩 리더보드: Frontend Code Arena 1679점, Artificial Analysis Intelligence Index 세계 3위(출처: Arena.ai/Artificial Analysis).
- 업계 배경: 7월 28일 1200명+ 「Pacing the Frontier」 서명, OpenAI·Anthropic 회사 명의 지지(출처: The Verge, TechTimes).
FAQ 요약:
- Q: Grok 4.6 정확한 출시일? A: 머스크 「약 8월 7일」 비공식 발언. xAI 미확인, 일정 변동 가능.
- Q: Grok 4.6 vs 4.7? A: 4.6은 1.5T·SFT/RL 후학습. 4.7은 2.1T·수주 후. 4.6 상회하나 추론 속도 약간 느리고 Token 효율 더 높음.
- Q: Kimi K3·Fable 5.1 대비 우위? A: 판단 불가. 4.6 공개 벤치마크 없음. K3 실측 있음. Fable 5.1 Anthropic 미확인.
- Q: 가격? A: 미공개. 4.5 $2/$6 참고 가능, 변경 가능.
- Q: 어디서 사용? A: 4.5 경로상 Grok Build·xAI API·콘솔 우선 예상, 4.6 미확인.
작성 시 인용한 공개 출처입니다. 상류 문서 갱신 시 링크를 확인하세요.
https://huggingface.co/moonshotai
정보 기준일 2026년 7월 30일. Grok 4.6/4.7 세부는 공식 예고 또는 업계 루머입니다. 출시 전 xAI 공식 채널에서 최신 데이터를 확인하세요.
대안의 실제 단점(엔지니어링 관점): ①출시 윈도우에 개인 노트북으로 Grok 4.6 회귀 테스트 시 뚜껑 닫힘 sleep 후 OAuth·장시간 Agent 배치 중단, 7×24 파이프라인 불가;②초일 평가용 고사양 Mac Studio 일시 구매, 추론은 xAI API·로컬은 macOS Agent 편성만, 3개월 유휴 감가상각이 주 단위 대여를 크게 상회;③모든 Agent 워크플로를 단일 Grok SKU에 고정, Kimi K3 오픈웨이트 충격·8월 Fable 5.1 루머 무시 시 수주 내 Token 효율·청구 통제 불가.
전용 Apple Silicon, 7×24 상시 가동, 일/주/월 탄력 확장으로 macOS 호스트에서 Grok/Kimi K3/Claude 멀티모델 라우팅과 iOS CI를 동시 검증하는 개발자·AI 자동화 팀에게 NOVAKVM Mac Mini 클라우드 베어메탈 대여가 일반적으로 더 나은 선택입니다. 6개 지역 노드, 고메모리 티어, SSH 직접 연결로 클라우드 API 추론과 베어메탈 macOS 실행면을 분리, 출시 윈도우 집중 회귀를 노트북 sleep으로 중단하지 않습니다. NOVAKVM 가격 페이지에서 M4 Pro·스토리지 확장 비교, 주문 페이지에서 시험 노드 기동, 고객 센터에서 원격 세션을 확인하세요.