Grok 4.6 본격 도입을 기다리며 Agent나 프로그래밍 워크플로를 업그레이드하려는 AI 개발자·기술 선정 담당자에게 7월 28일 일론 머스크의 X 게시물은 중요한 단서입니다. Vercel CEO Guillermo Rauch에 대한 답글에서 xAI는 8월 7일 전후에 1.5조 파라미터 Grok 4.6을 출시하고, 수 주 후 2.1조 파라미터 Grok 4.7을 연달아 투입할 계획을 밝혔습니다. 전작 Grok 4.5 출시 이후 불과 1개월——xAI는 이 여름에 3개의 프론티어 모델을 연속 투입하는 속도입니다. 본 글은 타임라인, SFT/RL 업그레이드 논리, Kimi K3 및 Claude Fable 5.1 소문과의 가로 비교를 정리하고 제3자 미검증 정보를 명시합니다. 결론부터 말하면, 현재 신뢰할 수 있는 1차 정보는 머스크의 X 답글만——벤치마크·가격·실제 출시일은 모두 「Musk time」의 변동을 포함하며, xAI 공식 발표를 기다려야 합니다.
01 Grok 4.6 예고 전, 기술 팀이 직면하는 4가지 선정 리스크
Grok 4.5는 모델 카드와 함께 출시되었지만, Grok 4.6/4.7에는 독립 평가나 공식 제품 페이지가 아직 없습니다. 소셜 미디어 소문만으로 프로덕션에 베팅하면 다음 리스크에 직면합니다.
- 정보원이 단일하고 공식 미확인: 현재 유일한 정보원은 머스크의 X 답글입니다. xAI 공식 블로그·제품 페이지는 미동기화 상태입니다. 「1.5조 파라미터」「SFT/RL 대폭 강화」는 모두 벤더 측 주장입니다.
- 「Musk time」의 역사적 변동: xAI, Tesla, SpaceX 스케줄은 역사적으로 유연하여, 실제 출시가 예고보다 며칠~2주 늦는 것은 드물지 않습니다. 「8월 7일 전후」는 보장이 아닌 목표로 보아야 합니다.
- 벤치마크와 가격이 모두 공백: Grok 4.5 출시 시 상세 모델 카드·15개 벤치 표와 달리 Grok 4.6에는 제3자 독립 평가가 전무합니다. 실측 데이터가 있는 Kimi K3와 직접 비교는 불가능합니다.
- 안전·컴플라이언스와 업계 페이스의 불일치: 7월 28일——머스크가 로드맵을 공개한 당일, OpenAI·Anthropic 등 1,200명 이상의 직원이 「Pacing the Frontier」 공개 서한으로 프론티어 AI 개발 속도 조절을 호출했습니다. xAI는 서명자에 포함되지 않았습니다. 같은 달 xAI는 Grok 안전 제한을 우회하여 CSAM을 생성했다며 사용자를 고소했습니다——벤더 리스크도 선정에 반영해야 합니다.
한 줄 요약: Grok 4.6의 기술 내러티브는 명확하지만 검증 가능한 데이터는 제로——공식 모델 카드 이전의 「최강 모델」 결론은 모두 추측입니다.
02 Grok 4.5에서 4.7까지: 출시 속도는 얼마나 빠른가?
주요 타임라인:
- 2026년 7월 8일: xAI가 Grok 4.5를 정식 출시. 「프로그래밍·Agent 태스크 전용」 플래그십. Cursor와 공동, 실제 개발자 세션 데이터로 학습. 50만 token 컨텍스트. 가격은 100만 token당 입력 $2·출력 $6.
- 2026년 7월 16–26일: 경쟁사 Moonshot AI의 Kimi K3가 호스팅 서비스로 선행하고, 7월 26일에 하루 일찍 전체 오픈 웨이트를 공개. 2.8조 파라미터·100만 token 컨텍스트로 오픈 모델의 규모와 능력을 밀어 올렸습니다.
- 2026년 7월 28일: 머스크가 Rauch 답글에서 Grok 4.6·4.7 로드맵과 개략 스케줄을 최초 공개——본 글의 주요 정보원입니다.
- 2026년 8월 7일 전후(목표): Grok 4.6 출시 예정. 1.5조 파라미터. 파라미터 적층이 아닌 SFT(지도 미세조정)와 RL(강화학습) 업그레이드가 핵심.
- 2026년 8월 말~9월 초(예상): Grok 4.7이 뒤따를 예정. 2.1조 파라미터. 머스크는 「추론 속도는 약간 느리지만 다른 면은 4.6을 전면 능가하고 token 효율도 더 높다」고 말했습니다.
| 모델 | 출시/목표일 | 파라미터 규모 | 핵심 영역 | 상태 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026-04-17 | 비공개 | 전세대 베이스라인 | 출시 완료 |
| Grok 4.5 | 2026-07-08 | 비공개(비 MoE 단일 SKU) | 프로그래밍·Agent, Cursor 공동 학습 | 출시 완료 |
| Grok 4.6 | 약 2026-08-07 | 1.5조 | SFT/RL 대폭 강화 | 공식 예고, 미출시 |
| Grok 4.7 | 약 8월 말–9월 초 | 2.1조 | 4.6 전면 능가, token 효율 향상 | 공식 예고, 미출시 |
참고: 파라미터 규모·가격·벤치마크는 벤더/머스크 주장입니다. Grok 4.6·4.7은 제3자 독립 평가가 없으며, 표의 「공식 예고」 정보는 정식 출시에서 확인하세요.
03 이번 업그레이드의 핵심은 「더 크게」가 아니라 「더 똑똑하게 학습」
SFT와 RL이 해결하는 과제: 지도 미세조정(SFT)은 수동 주석이나 엄선된 고품질 샘플으로 출력 습관을 교정합니다. 강화학습(RL)은 보상 신호로 실제 태스크 체인에서 「올바른 행동」을 학습시키며, 특히 다단계 Agent 태스크에 유효합니다. 머스크는 Grok 4.6 업그레이드 핵심이 파라미터 규모가 아닌 「SFT & RL」이라고 강조——Grok 4.5 방침의 연속입니다. Grok 4.5는 Cursor와의 공동으로 실제 개발자 세션 데이터를 활용하여 출력 token 소비를 억제한 채 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 기록했습니다. 동종 태스크 출력 token은 Claude Opus 4.8(약 6.7만 token)의 약 1/4(약 1.9만 token)였습니다.
xAI가 「파라미터 적층 + 포스트트레이닝 정밀화」 이중 전략을 택한 이유: Grok 4.6의 1.5조 파라미터는 Grok 4.5에서 명확한 규모 점프이지만, 머스크는 Grok 4.7이 더 크고(2.1조) 「추론은 약간 느리다」고 보완——xAI는 파라미터 규모와 추론 속도의 트레이드오프를 인식하고 「더 강함」과 「더 빠름」에 다른 모델로 대응하는 방침을 보여줍니다.
Kimi K3와의 동시 경쟁이 가져오는 현실적 압력: Grok 4.6 출시 스케줄은 Kimi K3 전체 오픈 웨이트가 업계를 흔든 약 10일 후에 위치합니다. Kimi K3는 Frontend Code Arena 프로그래밍 랭킹 1679점 1위, 모든 폐쇄 모델을 넘은 최초의 오픈 모델입니다. Artificial Analysis 인텔리전스 지수 전 세계 3위. 머스크도 Kimi K3 관련 평가에 「인상적」이라고 댓글을 달았습니다. 업계는 xAI가 Grok 4.6/4.7 투입 속도를 높이는 배경에 OpenAI·Anthropic·중국 제조사와의 경쟁 격화가 있다고 해석합니다.
| 모델 | 벤더 | 파라미터 규모 | 컨텍스트 | 가격(입력/출력, 100만 token) |
|---|---|---|---|---|
| Grok 4.5 | xAI | 비공개 | 50만 token | $2 / $6 |
| Grok 4.6(예고) | xAI | 1.5조 | 비공개 | 비공개 |
| Kimi K3 | 월지암면 | 2.8조(MoE, 16/896 expert 활성화) | 100만 token | $0.30(캐시 히트)/$3 입력, $15 출력 |
| Claude Fable 5.1(소문) | Anthropic | 비공개 | 비공개 | 소문은 Fable 5 유지($10/$50) |
| GPT-5.6 Sol | OpenAI | 비공개 | 비공개 | 비공개 |
표의 Grok 4.6·Claude Fable 5.1 데이터는 예고 또는 소문이며, 정식 벤치 비교가 아닙니다. 출시 페이스와 대략적 포지션 참고용입니다.
04 Grok 4.6 출시 전: 6단계 모델 선정 준비 가이드
- 정보 검증 체크리스트를 정비합니다: 머스크 X 게시물·xAI 공식 블로그·모델 카드를 모니터링 대상으로 설정합니다. Grok 4.6 정식 발표 전에 「1.5조 파라미터」 등 숫자를 SLA나 대외 약속에 쓰지 마세요.
- Grok 4.5를 현행 베이스라인으로 A/B합니다: 미연결 시 Cursor 또는 xAI API(입력 $2/출력 $6, 100만 token)에서 실제 태스크 세트를 돌려 token 소비와 통과율을 기록하고, 4.6 출시 후 비교 기준으로 둡니다.
- Kimi K3와 기존 플래그십을 병행 평가합니다: Kimi K3에는 독립 제3자 벤치(SWE-bench Verified 93.4%, Frontend Code Arena 1679점)가 있습니다. Grok 4.6 모델 카드 공백기에는 실측 데이터로 병행 비교하여 「신제품 대기」로 선정 창이 공회전하지 않게 합니다.
- 듀얼 SKU 라우팅 아키텍처를 예약합니다: 머스크는 4.6(고속)과 4.7(강력하지만 약간 느림)의 역할 분담을 시사했습니다. Agent 게이트웨이 계층에 지연/품질 분기 fallback 로직을 예약하고, OpenRouter 듀얼 라우팅 연동안을 참고하세요.
- 벤더 안전·컴플라이언스 리스크를 평가합니다: xAI의 최근 CSAM 소송과 Common Sense Media 미성년자 보호 평가를 확인합니다. 기밀 데이터나 일반 사용자 대상 비즈니스에서는 스코어만이 아니라 안전 투자를 TCO에 포함합니다.
- Agent 프로덕션 환경의 안정 연산 기반을 준비합니다: 최종적으로 Grok 4.6 API나 하이브리드 라우팅을 선택하든, 로컬 Claude Code·Cursor Agent·CI 파이프라인에는 7×24 안정 환경이 필요합니다. 베어메탈 vs 가상화 Hypervisor 손실을 사전 평가합니다.
05 2026년 8월 집중 출시, 인용 데이터와 FAQ
머스크의 스케줄이 성사되면 Grok 4.6·Grok 4.7은 소문의 Claude Fable 5.1(36kr·WinCentral 등 다수 매체가 8월을 지목하고, Anthropic은 OpenAI GPT-6보다 먼저 출시하려 한다고 보도)과 같은 달에 잇따라 등장합니다. 7월에 오픈소스화된 Kimi K3의 충격도 겹쳐 2026년 8월은 대규모 모델 출시 밀도가 가장 높은 달 중 하나가 될 수 있습니다. 개발자·기업 사용자에게 선정 창은 극히 짧습니다——전세대 플래그십이 출시 1개월 만에 차세대 경쟁에 직면하는 상황입니다.
- Grok 4.5 프로그래밍 벤치(출시 완료): Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%. 출력 token 효율은 Claude Opus 4.8의 약 4.2배(약 1.9만 vs 6.7만 token/태스크).
- Grok 4.6 예고 파라미터: 1.5조, SFT/RL 포스트트레이닝 업——제3자 미검증.
- Grok 4.7 예고 파라미터: 2.1조, 「4.6 전면 능가하지만 추론 약간 느리고 token 효율 더 높음」——제3자 미검증.
- Kimi K3 대조 벤치(실측 완료): Frontend Code Arena 1679점(오픈 모델 1위), Artificial Analysis 인텔리전스 지수 전 세계 3위.
자주 묻는 질문 FAQ
Grok 4.6의 구체적인 출시일은 언제인가요?
머스크는 「8월 7일 전후」라고 말했지만, 이는 비공식 발언이며 xAI가 공식 확인한 날짜가 아닙니다. 실제 출시는 전후로 달라질 수 있습니다.
Grok 4.6과 Grok 4.7의 차이는 무엇인가요?
Grok 4.6은 1.5조 파라미터로 SFT와 RL 포스트트레이닝 강화가 핵심입니다. Grok 4.7은 2.1조 파라미터로 4.6 출시 수 주 후에 뒤따를 예정입니다. 머스크는 4.6을 전면적으로 능가하지만 추론 속도는 약간 느리고 token 효율은 더 높다고 말했습니다.
Grok 4.6이 Kimi K3나 Claude Fable 5.1보다 강할까요?
현재로서는 판단할 수 없습니다. Grok 4.6에는 공개 벤치마크가 없고, Kimi K3는 실측 데이터가 있으며, Claude Fable 5.1은 Anthropic 공식 미확인 소문 단계입니다.
Grok 4.6 가격은 얼마일까요?
공식 미발표입니다. Grok 4.5 가격(입력 $2/출력 $6, 100만 token당)을 참고할 수 있지만, 신세대 모델에서는 변경될 수 있습니다. 정식 발표를 기다려야 합니다.
일반 사용자는 어디서 Grok 4.6을 쓸 수 있을까요?
Grok 4.5 배포 경로로 보면 Grok Build·xAI 공식 API·콘솔이 먼저 열리고 이후 서드파티 연동이 뒤따를 것으로 예상되지만, 4.6에 대해서는 미확인입니다.
아래는 주요 참고 출처입니다. Grok 4.6/4.7 관련 세부는 공식 예고 또는 업계 소문이며, 출시 전 xAI 공식 채널에서 최신 데이터를 확인하세요.
xAI 공식 블로그: Introducing Grok 4.5
xAI Grok 4.5 모델 카드(media.x.ai)
The Verge: 「Pacing the Frontier」 공개 서한 보도
Cursor Agent·Grok API 하이브리드 라우팅·iOS CI/CD를 7×24 가동하는 프로덕션 팀에게 순수 클라우드 API만으로는 로컬 Metal 컴파일 체인과 안정 온라인 문제를 해결할 수 없습니다. 가상화 Mac은 Hypervisor 손실과 호환성 리스크를 동반하고, 잦은 모델 교체는 기반 환경 안정성을 더 시험합니다. 제로 오버헤드 네이티브 연산, 안정적 iOS CI/CD, AI Agent 7×24 자동화가 필요한 프로덕션 환경에서는 ZUKCLOUD 베어메탈 Mac mini 클라우드 노드가 더 적합한 선택입니다: 전용 Apple Silicon 물리 머신, Hypervisor 세금 없음, 상시 가동, 일·주·월 유연 과금. 자세한 내용은 베어메탈 아키텍처 선언을 참고하세요.