/ 블로그 / Grok 4.6
ENGINEERING BLOG · 2026.07.30

Grok 4.6는 언제 출시?
머스크 8월 7일 예고, 1.5조 파라미터 확대

Grok 4.6 본격 도입을 기다리며 Agent나 프로그래밍 워크플로를 업그레이드하려는 AI 개발자·기술 선정 담당자에게 7월 28일 일론 머스크의 X 게시물은 중요한 단서입니다. Vercel CEO Guillermo Rauch에 대한 답글에서 xAI는 8월 7일 전후1.5조 파라미터 Grok 4.6을 출시하고, 수 주 후 2.1조 파라미터 Grok 4.7을 연달아 투입할 계획을 밝혔습니다. 전작 Grok 4.5 출시 이후 불과 1개월——xAI는 이 여름에 3개의 프론티어 모델을 연속 투입하는 속도입니다. 본 글은 타임라인, SFT/RL 업그레이드 논리, Kimi K3 및 Claude Fable 5.1 소문과의 가로 비교를 정리하고 제3자 미검증 정보를 명시합니다. 결론부터 말하면, 현재 신뢰할 수 있는 1차 정보는 머스크의 X 답글만——벤치마크·가격·실제 출시일은 모두 「Musk time」의 변동을 포함하며, xAI 공식 발표를 기다려야 합니다.

01

Grok 4.5는 모델 카드와 함께 출시되었지만, Grok 4.6/4.7에는 독립 평가나 공식 제품 페이지가 아직 없습니다. 소셜 미디어 소문만으로 프로덕션에 베팅하면 다음 리스크에 직면합니다.

  • 정보원이 단일하고 공식 미확인: 현재 유일한 정보원은 머스크의 X 답글입니다. xAI 공식 블로그·제품 페이지는 미동기화 상태입니다. 「1.5조 파라미터」「SFT/RL 대폭 강화」는 모두 벤더 측 주장입니다.
  • 「Musk time」의 역사적 변동: xAI, Tesla, SpaceX 스케줄은 역사적으로 유연하여, 실제 출시가 예고보다 며칠~2주 늦는 것은 드물지 않습니다. 「8월 7일 전후」는 보장이 아닌 목표로 보아야 합니다.
  • 벤치마크와 가격이 모두 공백: Grok 4.5 출시 시 상세 모델 카드·15개 벤치 표와 달리 Grok 4.6에는 제3자 독립 평가가 전무합니다. 실측 데이터가 있는 Kimi K3와 직접 비교는 불가능합니다.
  • 안전·컴플라이언스와 업계 페이스의 불일치: 7월 28일——머스크가 로드맵을 공개한 당일, OpenAI·Anthropic 등 1,200명 이상의 직원이 「Pacing the Frontier」 공개 서한으로 프론티어 AI 개발 속도 조절을 호출했습니다. xAI는 서명자에 포함되지 않았습니다. 같은 달 xAI는 Grok 안전 제한을 우회하여 CSAM을 생성했다며 사용자를 고소했습니다——벤더 리스크도 선정에 반영해야 합니다.

한 줄 요약: Grok 4.6의 기술 내러티브는 명확하지만 검증 가능한 데이터는 제로——공식 모델 카드 이전의 「최강 모델」 결론은 모두 추측입니다.

02

주요 타임라인:

  • 2026년 7월 8일: xAI가 Grok 4.5를 정식 출시. 「프로그래밍·Agent 태스크 전용」 플래그십. Cursor와 공동, 실제 개발자 세션 데이터로 학습. 50만 token 컨텍스트. 가격은 100만 token당 입력 $2·출력 $6.
  • 2026년 7월 16–26일: 경쟁사 Moonshot AI의 Kimi K3가 호스팅 서비스로 선행하고, 7월 26일에 하루 일찍 전체 오픈 웨이트를 공개. 2.8조 파라미터·100만 token 컨텍스트로 오픈 모델의 규모와 능력을 밀어 올렸습니다.
  • 2026년 7월 28일: 머스크가 Rauch 답글에서 Grok 4.6·4.7 로드맵과 개략 스케줄을 최초 공개——본 글의 주요 정보원입니다.
  • 2026년 8월 7일 전후(목표): Grok 4.6 출시 예정. 1.5조 파라미터. 파라미터 적층이 아닌 SFT(지도 미세조정)와 RL(강화학습) 업그레이드가 핵심.
  • 2026년 8월 말~9월 초(예상): Grok 4.7이 뒤따를 예정. 2.1조 파라미터. 머스크는 「추론 속도는 약간 느리지만 다른 면은 4.6을 전면 능가하고 token 효율도 더 높다」고 말했습니다.
Grok 시리즈 핵심 데이터(공식 예고 포함)
모델 출시/목표일 파라미터 규모 핵심 영역 상태
Grok 4.3 Beta2026-04-17비공개전세대 베이스라인출시 완료
Grok 4.52026-07-08비공개(비 MoE 단일 SKU)프로그래밍·Agent, Cursor 공동 학습출시 완료
Grok 4.6약 2026-08-071.5조SFT/RL 대폭 강화공식 예고, 미출시
Grok 4.7약 8월 말–9월 초2.1조4.6 전면 능가, token 효율 향상공식 예고, 미출시

참고: 파라미터 규모·가격·벤치마크는 벤더/머스크 주장입니다. Grok 4.6·4.7은 제3자 독립 평가가 없으며, 표의 「공식 예고」 정보는 정식 출시에서 확인하세요.

03

SFT와 RL이 해결하는 과제: 지도 미세조정(SFT)은 수동 주석이나 엄선된 고품질 샘플으로 출력 습관을 교정합니다. 강화학습(RL)은 보상 신호로 실제 태스크 체인에서 「올바른 행동」을 학습시키며, 특히 다단계 Agent 태스크에 유효합니다. 머스크는 Grok 4.6 업그레이드 핵심이 파라미터 규모가 아닌 「SFT & RL」이라고 강조——Grok 4.5 방침의 연속입니다. Grok 4.5는 Cursor와의 공동으로 실제 개발자 세션 데이터를 활용하여 출력 token 소비를 억제한 채 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 기록했습니다. 동종 태스크 출력 token은 Claude Opus 4.8(약 6.7만 token)의 약 1/4(약 1.9만 token)였습니다.

xAI가 「파라미터 적층 + 포스트트레이닝 정밀화」 이중 전략을 택한 이유: Grok 4.6의 1.5조 파라미터는 Grok 4.5에서 명확한 규모 점프이지만, 머스크는 Grok 4.7이 더 크고(2.1조) 「추론은 약간 느리다」고 보완——xAI는 파라미터 규모와 추론 속도의 트레이드오프를 인식하고 「더 강함」과 「더 빠름」에 다른 모델로 대응하는 방침을 보여줍니다.

Kimi K3와의 동시 경쟁이 가져오는 현실적 압력: Grok 4.6 출시 스케줄은 Kimi K3 전체 오픈 웨이트가 업계를 흔든 약 10일 후에 위치합니다. Kimi K3는 Frontend Code Arena 프로그래밍 랭킹 1679점 1위, 모든 폐쇄 모델을 넘은 최초의 오픈 모델입니다. Artificial Analysis 인텔리전스 지수 전 세계 3위. 머스크도 Kimi K3 관련 평가에 「인상적」이라고 댓글을 달았습니다. 업계는 xAI가 Grok 4.6/4.7 투입 속도를 높이는 배경에 OpenAI·Anthropic·중국 제조사와의 경쟁 격화가 있다고 해석합니다.

Grok 시리즈 vs 동기 경쟁(예고/소문 포함, 비공식 벤치 비교)
모델 벤더 파라미터 규모 컨텍스트 가격(입력/출력, 100만 token)
Grok 4.5xAI비공개50만 token$2 / $6
Grok 4.6(예고)xAI1.5조비공개비공개
Kimi K3월지암면2.8조(MoE, 16/896 expert 활성화)100만 token$0.30(캐시 히트)/$3 입력, $15 출력
Claude Fable 5.1(소문)Anthropic비공개비공개소문은 Fable 5 유지($10/$50)
GPT-5.6 SolOpenAI비공개비공개비공개

표의 Grok 4.6·Claude Fable 5.1 데이터는 예고 또는 소문이며, 정식 벤치 비교가 아닙니다. 출시 페이스와 대략적 포지션 참고용입니다.

04

  1. 정보 검증 체크리스트를 정비합니다: 머스크 X 게시물·xAI 공식 블로그·모델 카드를 모니터링 대상으로 설정합니다. Grok 4.6 정식 발표 전에 「1.5조 파라미터」 등 숫자를 SLA나 대외 약속에 쓰지 마세요.
  2. Grok 4.5를 현행 베이스라인으로 A/B합니다: 미연결 시 Cursor 또는 xAI API(입력 $2/출력 $6, 100만 token)에서 실제 태스크 세트를 돌려 token 소비와 통과율을 기록하고, 4.6 출시 후 비교 기준으로 둡니다.
  3. Kimi K3와 기존 플래그십을 병행 평가합니다: Kimi K3에는 독립 제3자 벤치(SWE-bench Verified 93.4%, Frontend Code Arena 1679점)가 있습니다. Grok 4.6 모델 카드 공백기에는 실측 데이터로 병행 비교하여 「신제품 대기」로 선정 창이 공회전하지 않게 합니다.
  4. 듀얼 SKU 라우팅 아키텍처를 예약합니다: 머스크는 4.6(고속)과 4.7(강력하지만 약간 느림)의 역할 분담을 시사했습니다. Agent 게이트웨이 계층에 지연/품질 분기 fallback 로직을 예약하고, OpenRouter 듀얼 라우팅 연동안을 참고하세요.
  5. 벤더 안전·컴플라이언스 리스크를 평가합니다: xAI의 최근 CSAM 소송과 Common Sense Media 미성년자 보호 평가를 확인합니다. 기밀 데이터나 일반 사용자 대상 비즈니스에서는 스코어만이 아니라 안전 투자를 TCO에 포함합니다.
  6. Agent 프로덕션 환경의 안정 연산 기반을 준비합니다: 최종적으로 Grok 4.6 API나 하이브리드 라우팅을 선택하든, 로컬 Claude Code·Cursor Agent·CI 파이프라인에는 7×24 안정 환경이 필요합니다. 베어메탈 vs 가상화 Hypervisor 손실을 사전 평가합니다.

05

머스크의 스케줄이 성사되면 Grok 4.6·Grok 4.7은 소문의 Claude Fable 5.1(36kr·WinCentral 등 다수 매체가 8월을 지목하고, Anthropic은 OpenAI GPT-6보다 먼저 출시하려 한다고 보도)과 같은 달에 잇따라 등장합니다. 7월에 오픈소스화된 Kimi K3의 충격도 겹쳐 2026년 8월은 대규모 모델 출시 밀도가 가장 높은 달 중 하나가 될 수 있습니다. 개발자·기업 사용자에게 선정 창은 극히 짧습니다——전세대 플래그십이 출시 1개월 만에 차세대 경쟁에 직면하는 상황입니다.

  • Grok 4.5 프로그래밍 벤치(출시 완료): Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%. 출력 token 효율은 Claude Opus 4.8의 약 4.2배(약 1.9만 vs 6.7만 token/태스크).
  • Grok 4.6 예고 파라미터: 1.5조, SFT/RL 포스트트레이닝 업——제3자 미검증.
  • Grok 4.7 예고 파라미터: 2.1조, 「4.6 전면 능가하지만 추론 약간 느리고 token 효율 더 높음」——제3자 미검증.
  • Kimi K3 대조 벤치(실측 완료): Frontend Code Arena 1679점(오픈 모델 1위), Artificial Analysis 인텔리전스 지수 전 세계 3위.

자주 묻는 질문 FAQ

Grok 4.6의 구체적인 출시일은 언제인가요?

머스크는 「8월 7일 전후」라고 말했지만, 이는 비공식 발언이며 xAI가 공식 확인한 날짜가 아닙니다. 실제 출시는 전후로 달라질 수 있습니다.

Grok 4.6과 Grok 4.7의 차이는 무엇인가요?

Grok 4.6은 1.5조 파라미터로 SFT와 RL 포스트트레이닝 강화가 핵심입니다. Grok 4.7은 2.1조 파라미터로 4.6 출시 수 주 후에 뒤따를 예정입니다. 머스크는 4.6을 전면적으로 능가하지만 추론 속도는 약간 느리고 token 효율은 더 높다고 말했습니다.

Grok 4.6이 Kimi K3나 Claude Fable 5.1보다 강할까요?

현재로서는 판단할 수 없습니다. Grok 4.6에는 공개 벤치마크가 없고, Kimi K3는 실측 데이터가 있으며, Claude Fable 5.1은 Anthropic 공식 미확인 소문 단계입니다.

Grok 4.6 가격은 얼마일까요?

공식 미발표입니다. Grok 4.5 가격(입력 $2/출력 $6, 100만 token당)을 참고할 수 있지만, 신세대 모델에서는 변경될 수 있습니다. 정식 발표를 기다려야 합니다.

일반 사용자는 어디서 Grok 4.6을 쓸 수 있을까요?

Grok 4.5 배포 경로로 보면 Grok Build·xAI 공식 API·콘솔이 먼저 열리고 이후 서드파티 연동이 뒤따를 것으로 예상되지만, 4.6에 대해서는 미확인입니다.

아래는 주요 참고 출처입니다. Grok 4.6/4.7 관련 세부는 공식 예고 또는 업계 소문이며, 출시 전 xAI 공식 채널에서 최신 데이터를 확인하세요.

xAI 공식 블로그: Introducing Grok 4.5

xAI Grok 4.5 모델 카드(media.x.ai)

Moonshot AI 공식 블로그: Kimi K3

The Verge: 「Pacing the Frontier」 공개 서한 보도

Cursor Agent·Grok API 하이브리드 라우팅·iOS CI/CD를 7×24 가동하는 프로덕션 팀에게 순수 클라우드 API만으로는 로컬 Metal 컴파일 체인과 안정 온라인 문제를 해결할 수 없습니다. 가상화 Mac은 Hypervisor 손실과 호환성 리스크를 동반하고, 잦은 모델 교체는 기반 환경 안정성을 더 시험합니다. 제로 오버헤드 네이티브 연산, 안정적 iOS CI/CD, AI Agent 7×24 자동화가 필요한 프로덕션 환경에서는 ZUKCLOUD 베어메탈 Mac mini 클라우드 노드가 더 적합한 선택입니다: 전용 Apple Silicon 물리 머신, Hypervisor 세금 없음, 상시 가동, 일·주·월 유연 과금. 자세한 내용은 베어메탈 아키텍처 선언을 참고하세요.