Главная / Блог / Grok 4.6
ENGINEERING BLOG · 2026.07.30

Grok 4.6: дата релиза —
реалистичен ли дедлайн 7 августа от Musk?

Если вы ML-инженер или tech lead и ждёте Grok 4.6 для апгрейда agent/coding workflow, единственный on-the-record source на сегодня — ответ Elon Musk Guillermo Rauch (CEO Vercel) в X 28 июля 2026: xAI целится в Grok 4.6 около 7 августа с 1,5 трлн params, через несколько недель — Grok 4.7 на 2,1 трлн. Это примерно месяц после релиза Grok 4.5 — три frontier-модели за два месяца. Разбираем timeline, почему xAI делает ставку на SFT/RL вместо чистого scale-up, сравниваем announced specs с Kimi K3 и rumor Claude Fable 5.1, и явно помечаем непроверенное. TL;DR: нет benchmarks, pricing и model card — «около 7 августа» это target, не guarantee.

01

В отличие от Grok 4.5 — full model card и 15 tracked benchmarks при launch — у Grok 4.6 и 4.7 нет ни independent evaluation, ни official product page. Ставить production stack на social-media leaks — measurable exposure:

  • Single-source, unconfirmed: всё — «1,5 трлн params», «significantly improved SFT & RL», follow-up Grok 4.7 на 2,1T — из одного X-post. Ни xAI blog, ни model card не corroborate.
  • «Musk time» имеет track record: timelines Musk-led companies исторически сдвигаются на дни–недели. «Около 7 августа» — target date, не contract SLA.
  • Benchmarks и pricing — blank: Grok 4.5 вышел с детальными scores; у Grok 4.6 zero third-party data. Head-to-head с Kimi K3, у которого уже verified numbers, пока невозможен.
  • Safety и industry pacing collide: в тот же день, когда Musk опубликовал roadmap, 1200+ сотрудников OpenAI, Anthropic, Google DeepMind и Meta выпустили письмо «Pacing the Frontier» с просьбой к US government замедлить automated AI development — corporate endorsement от OpenAI и Anthropic. xAI в списке подписантов отсутствует. В июле xAI также подала иск против пользователя за alleged use Grok для генерации CSAM — vendor-risk context для enterprise buyers и security/compliance teams.

Коротко: narrative ясен, verifiable data — ноль; любой «best model» claim до official model card — speculation.

02

Ключевой timeline:

  • 8 июля 2026: xAI ship Grok 4.5 — coding и agentic work, co-training с Cursor на real developer sessions. 500K-token context, $2/$6 per million input/output tokens, published model card.
  • 16–26 июля 2026: Kimi K3 Moonshot AI переходит от hosted preview к full open-weight release — 2,8T params, 1M-token context, #1 на Hugging Face trending.
  • 28 июля 2026: Musk публикует Grok 4.6/4.7 roadmap в ответ Rauch — primary source этой статьи.
  • ~7 августа 2026 (target): Grok 4.6, 1,5T params, позиционируется как SFT/RL upgrade, не raw scale-up.
  • Конец августа–начало сентября 2026 (estimate): Grok 4.7, 2,1T params — Musk: «better than 4.6 in every way, except slightly slower to serve, albeit with even better token efficiency.»
Семейство Grok: specs (включая announced, unshipped models)
Модель Дата Params Фокус Статус
Grok 4.3 Beta17 апр. 2026UndisclosedBaselineShipped
Grok 4.58 июл. 2026Undisclosed (single SKU, not MoE)Coding/agentic, Cursor co-trainingShipped, benchmarked
Grok 4.6~7 авг. 20261,5TSFT/RL upgradeAnnounced via tweet, unshipped
Grok 4.7~конец авг.–нач. сент. 20262,1TBroad upgrade over 4.6, better token efficiencyAnnounced via tweet, unshipped

Все цифры Grok 4.6/4.7 — unverified vendor claims из одного social post; treat as directional, not confirmed specs.

03

SFT и RL в двух словах: supervised fine-tuning (SFT) обучает модель на curated example outputs для behavior shaping; reinforcement learning (RL) использует reward signals, чтобы учить, какие action sequences реально работают — критично для multi-step agentic tasks. Формулировка Musk — «significantly improved SFT & RL» — сигнализирует тот же playbook, что сделал Grok 4.5 competitive на agentic benchmarks: ~15 954 output tokens per SWE-Bench Pro task vs. 67 020 у Opus 4.8 — 4,2× efficiency gap, в основном credited post-training на real Cursor developer sessions.

Scale-vs-speed trade-off: jump Grok 4.6 до 1,5T — реальный scale increase, но framing Grok 4.7 — bigger at 2,1T, «better in every way except slightly slower to serve» — намекает на два SKU с разными trade-offs, как Sonnet/Opus split у Anthropic или mini/full tiers у OpenAI.

Competitive pressure, которую timeline не упоминает: target Grok 4.6 попадает почти ровно через 10 дней после full open-weight release Kimi K3. Модель Moonshot возглавила Frontend Code Arena leaderboard с 1 679 points — первый open-weight model, обогнавший все closed models на board — и заняла #3 на Artificial Analysis Intelligence Index. Musk прокомментировал Kimi K3 benchmark posts словом «impressive». Китайские финансовые СМИ передали оценку ~$314B wiped off combined OpenAI/Anthropic valuation expectations — analyst estimates через media, не independently confirmed, но sentiment direction ясен.

Grok vs. contemporaries (pre-release claims — not verified benchmarks)
Модель Vendor Params Context Pricing (input/output per 1M tokens)
Grok 4.5xAIUndisclosed500K$2 / $6
Grok 4.6 (announced)xAI1,5TUndisclosedUndisclosed
Kimi K3Moonshot AI2,8T (MoE, ~16/896 experts active)1M$0.30 (cache hit) / $3 (cache miss) in, $15 out
Claude Fable 5.1 (rumor)AnthropicUndisclosedUndisclosedRumor: unchanged from Fable 5 ($10 / $50)
GPT-5.6 SolOpenAIUndisclosedUndisclosedUndisclosed

04

  1. Собрать verification checklist: мониторить X Musk, xAI blog и model card page. Не bake «1,5T params» в SLA до official announcement.
  2. Baseline на Grok 4.5 сегодня: если Grok 4.5 ещё не интегрирован — прогнать real task set на Cursor или xAI API ($2/$6 per million tokens), зафиксировать token usage и pass rates как comparison baseline.
  3. Benchmark Kimi K3 параллельно: у K3 уже third-party scores (SWE-bench Verified 93,4%, Frontend Code Arena 1 679). Не idle selection window в ожидании unshipped model card.
  4. Зарезервировать dual-SKU routing: Musk уже hinted 4.6 (faster) vs. 4.7 (stronger, slightly slower). Добавить latency/quality fallback logic в agent gateway — см. наш OpenRouter dual-route integration guide.
  5. Оценить vendor safety risk: разобрать recent xAI CSAM lawsuit и child-safety ratings Common Sense Media. Для consumer-facing продуктов или sensitive data — compliance в TCO, не только leaderboard rank.
  6. Secure stable compute для agent production: route к Grok 4.6 API или mixed stack — local Cursor Agent и CI pipelines всё равно нуждаются в 24/7 stable environments. Оценить bare-metal vs. virtualized Mac на hypervisor overhead.

05

Если timeline Musk сработает, Grok 4.6 и Grok 4.7 выйдут в том же месяце, что rumor Claude Fable 5.1 (по leaks 36kr и WinCentral, timed to beat anticipated GPT-6 OpenAI), и через недели после open-weight shock Kimi K3. Для команд в model evaluation useful shelf life любого single flagship сжимается до недель — token efficiency и real-world task cost важнее leaderboard rank alone.

  • Grok 4.5 coding benchmarks (shipped): Terminal-Bench 2.1 83,3%, SWE-Bench Pro 64,7%; ~4,2× output-token efficiency vs. Claude Opus 4.8 (~15 954 vs. 67 020 tokens/task).
  • Grok 4.6 announced specs: 1,5T params, SFT/RL post-training upgrade — unverified by third parties.
  • Grok 4.7 announced specs: 2,1T params, «better than 4.6 except slightly slower, better token efficiency» — unverified.
  • Kimi K3 reference benchmarks (verified): Frontend Code Arena 1 679 points (top open-weight), Artificial Analysis Intelligence Index rank #3 globally.

FAQ

Когда именно выйдет Grok 4.6?

Musk написал в X «около 7 августа 2026», но xAI официально дату не подтвердила. Считайте target date, который может сдвинуться.

Чем Grok 4.6 отличается от Grok 4.7?

Grok 4.6 — 1,5T params, фокус на SFT/RL post-training. Grok 4.7, через несколько недель, — 2,1T params; по Musk, лучше 4.6 везде, кроме serving speed, где trade latency на token efficiency.

Победит ли Grok 4.6 Kimi K3 или Claude Fable 5.1?

Рано. У Grok 4.6 нет published benchmarks, у Kimi K3 verified third-party scores, Claude Fable 5.1 Anthropic не подтвердила.

Сколько будет стоить Grok 4.6?

Неизвестно. Grok 4.5 — $2/M input, $6/M output; разумный reference, но xAI pricing для 4.6 не раскрыла.

Где можно будет использовать Grok 4.6?

По rollout Grok 4.5: Grok Build, xAI API, xAI console first, затем third-party integrations — для 4.6 не подтверждено.

Primary sources ниже. Все детали Grok 4.6/4.7 — vendor announcements или industry leaks; verify против official xAI channels перед reliance на date, spec или price.

Официальный блог xAI: Introducing Grok 4.5

xAI Grok 4.5 model card (media.x.ai)

Официальный блог Moonshot AI: Kimi K3

The Verge: coverage письма «Pacing the Frontier»

Для команд с Cursor Agent, Grok API mixed routing или iOS CI/CD 24/7 cloud APIs alone не решают local Metal toolchain stability — virtualized Mac setups несут hypervisor overhead и compatibility risk, rapid model churn stressит underlying environment. Для production workloads с zero-loss native compute, stable iOS CI/CD и 24/7 AI Agent automation bare-metal Mac mini cloud nodes ZUKCLOUD — обычно лучший fit: dedicated Apple Silicon, no hypervisor tax, always-on, flexible day/week/month billing. См. манифест bare-metal архитектуры.