Grok 4.6の本番投入を待ち、AgentやプログラミングワークフローをアップグレードしようとするAI開発者・技術選定担当者にとって、7月28日のイーロン・マスクのX投稿は重要な手がかりです。Vercel CEO Guillermo Rauchへの返信で、xAIは8月7日前後に1.5兆パラメータのGrok 4.6をリリースし、数週間後に2.1兆パラメータのGrok 4.7を続けて投入する計画を示しました。前作Grok 4.5からわずか1か月——xAIはこの夏に3つのフロンティアモデルを連続投入するペースです。本記事はタイムライン、SFT/RLアップグレードの論理、Kimi K3およびClaude Fable 5.1噂との横並び比較を整理し、第三者未検証の情報を明示します。結論を先に述べると、現時点で信頼できる一次情報はマスクのX返信のみ——ベンチマーク・料金・実際のリリース日はすべて「Musk time」の揺らぎを含み、xAI公式発表を待つべきです。
01 Grok 4.6予告前、技術チームが直面する4つの選定リスク
Grok 4.5はモデルカード付きでリリースされましたが、Grok 4.6/4.7には独立評価や公式製品ページがまだありません。ソーシャルメディアの噂だけで本番環境に賭けると、以下のリスクに直面します。
- 情報源が単一で公式未確認:現時点の唯一の情報源はマスクのX返信です。xAI公式ブログ・製品ページは未同期。「1.5兆パラメータ」「SFT/RL大幅アップ」はすべてベンダー側の主張です。
- 「Musk time」の歴史的揺らぎ:xAI、Tesla、SpaceXのスケジュールは歴史的に柔軟で、実際のリリースが予告より数日〜2週間遅れることは珍しくありません。「8月7日頃」は保証ではなく目標と見なすべきです。
- ベンチマークと料金がすべて空白:Grok 4.5リリース時の詳細モデルカード・15項目ベンチ表と異なり、Grok 4.6には第三者独立評価がゼロ。実測データがあるKimi K3との直接比較は不可能です。
- 安全・コンプライアンスと業界ペースのずれ:7月28日——マスクがロードマップを公開した同日、OpenAI・Anthropicなど1,200名超の従業員が「Pacing the Frontier」公開書簡でフロンティアAI開発のペースダウンを呼びかけました。xAIは署名者に含まれていません。同月、xAIはGrokの安全制限を迂回してCSAMを生成したとしてユーザーを提訴——ベンダーリスクも選定に組み込む必要があります。
一言で言えば、Grok 4.6の技術ナラティブは明確だが、検証可能なデータはゼロ——公式モデルカード前の「最強モデル」結論はすべて推測です。
02 Grok 4.5から4.7まで:リリースペースはどれほど速い?
主要タイムライン:
- 2026年7月8日:xAIがGrok 4.5を正式リリース。「プログラミングとAgentタスク専用」の旗艦モデル。Cursorと共同、実開発者セッションデータで学習。50万tokenコンテキスト。料金は100万tokenあたり入力$2・出力$6。
- 2026年7月16–26日:競合Moonshot AIのKimi K3がホスト型サービスで先行し、7月26日に1日早く完全オープンウェイトを公開。2.8兆パラメータ・100万tokenコンテキストでオープンモデルの規模と能力を押し上げました。
- 2026年7月28日:マスクがRauchへの返信でGrok 4.6・4.7のロードマップと概略スケジュールを初公開——本記事の主要情報源です。
- 2026年8月7日前後(目標):Grok 4.6リリース予定。1.5兆パラメータ。パラメータ積み上げではなくSFT(教師あり微調整)とRL(強化学習)のアップグレードが重点。
- 2026年8月末〜9月初(見込み):Grok 4.7が続く予定。2.1兆パラメータ。マスクは「推論速度はやや遅いが他は4.6を全面的に上回り、token効率も高い」と述べています。
| モデル | リリース/目標日 | パラメータ規模 | 重点領域 | 状態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026-04-17 | 非公開 | 前世代ベースライン | リリース済 |
| Grok 4.5 | 2026-07-08 | 非公開(非MoE単一SKU) | プログラミング・Agent、Cursor共同学習 | リリース済 |
| Grok 4.6 | 約2026-08-07 | 1.5兆 | SFT/RL大幅アップ | 公式予告、未リリース |
| Grok 4.7 | 約8月末–9月初 | 2.1兆 | 4.6全面上回り、token効率向上 | 公式予告、未リリース |
注:パラメータ規模・料金・ベンチマークはベンダー/マスクの主張です。Grok 4.6・4.7は第三者独立評価がなく、表中の「公式予告」情報は正式リリースで確認してください。
03 今回のアップグレード重点は「より大きい」ではなく「より賢く学ぶ」
SFTとRLが解く課題:教師あり微調整(SFT)は人手アノテーションや厳選高品質サンプルで出力習慣を矯正します。強化学習(RL)は報酬信号で実タスクチェーンにおける「正しい行動」を学習させ、特に多段階Agentタスクに有効です。マスクはGrok 4.6のアップグレード重点がパラメータ規模ではなく「SFT & RL」と強調——Grok 4.5の方針の継続です。Grok 4.5はCursorとの共同で実開発者セッションデータを活用し、出力token消費を抑えながらTerminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%を記録。同種タスクの出力tokenはClaude Opus 4.8(約6.7万token)の約1/4(約1.9万token)でした。
なぜxAIは「パラメータ積み上げ+ポストトレーニング精修」の二本柱を選ぶのか:Grok 4.6の1.5兆パラメータはGrok 4.5から明確な規模ジャンプですが、マスクはGrok 4.7がさらに大きく(2.1兆)ながら「推論はやや遅い」と補足——xAIはパラメータ規模と推論速度のトレードオフを認識し、「より強い」と「より速い」に異なるモデルで対応する方針を示しています。
Kimi K3との同時競争がもたらす現実的圧力:Grok 4.6のリリーススケジュールは、Kimi K3完全オープンウェイトが業界を揺さぶった約10日後に位置します。Kimi K3はFrontend Code Arenaプログラミングランキングで1679点トップ、全閉源モデルを超えた初のオープンモデル。Artificial Analysisインテリジェンス指数で世界第3。マスク自身もKimi K3関連評価に「印象的」とコメント。業界はxAIがGrok 4.6/4.7の投入ペースを加速している背景に、OpenAI・Anthropic・中国メーカーとの競争激化があると解釈しています。
| モデル | ベンダー | パラメータ規模 | コンテキスト | 料金(入力/出力、100万token) |
|---|---|---|---|---|
| Grok 4.5 | xAI | 非公開 | 50万token | $2 / $6 |
| Grok 4.6(予告) | xAI | 1.5兆 | 非公開 | 非公開 |
| Kimi K3 | 月之暗面 | 2.8兆(MoE、16/896 expert活性化) | 100万token | $0.30(キャッシュヒット)/$3入力、$15出力 |
| Claude Fable 5.1(噂) | Anthropic | 非公開 | 非公開 | 噂はFable 5維持($10/$50) |
| GPT-5.6 Sol | OpenAI | 非公開 | 非公開 | 非公開 |
表中のGrok 4.6・Claude Fable 5.1データは予告または噂であり、正式ベンチ比較ではありません。リリースペースとおおよそのポジションの参考用です。
04 Grok 4.6リリース前:6ステップモデル選定準備ガイド
- 情報検証チェックリストを整備:マスクのX投稿・xAI公式ブログ・モデルカードを監視対象に設定します。Grok 4.6正式発表前に「1.5兆パラメータ」等の数字をSLAや対外約束に書き込まないでください。
- Grok 4.5を現行ベースラインでA/B:未接続ならCursorまたはxAI API(入力$2/出力$6、100万token)で実タスクセットを走らせ、token消費と通過率を記録し、4.6リリース後の比較基準にします。
- Kimi K3と既存旗艦を並行評価:Kimi K3には独立第三者ベンチ(SWE-bench Verified 93.4%、Frontend Code Arena 1679点)があります。Grok 4.6モデルカード空白期は実測データで並行比較し、「新製品待ち」による選定窓の空転を避けます。
- デュアルSKUルーティングアーキテクチャを予約:マスクは4.6(高速)と4.7(強力だがやや遅い)の役割分担を示唆しています。Agentゲートウェイ層に遅延/品質分流のfallbackロジックを予約し、OpenRouterデュアルルーティング接続案を参考にしてください。
- ベンダー安全・コンプライアンスリスクを評価:xAIの最近のCSAM訴訟とCommon Sense Mediaの未成年保護評価を確認します。機密データやC向けビジネスでは、スコアだけでなく安全投資をTCOに組み込みます。
- Agent本番環境の安定算力基盤を準備:最終的にGrok 4.6 APIかハイブリッドルーティングを選ぶかにかかわらず、ローカルClaude Code・Cursor Agent・CIパイプラインには7×24安定環境が必要です。裸金属 vs 仮想化のHypervisor損耗を事前評価します。
05 2026年8月の集中リリース、引用データとFAQ
マスクのスケジュールが成立すれば、Grok 4.6・Grok 4.7は噂のClaude Fable 5.1(36kr・WinCentralなど複数メディアが8月を指し、AnthropicはOpenAI GPT-6より先の投入を狙うと報じられています)と同月に相次ぎ登場します。7月にオープンソース化したKimi K3の衝撃も重なり、2026年8月は大規模モデルリリース密度が最も高い月の一つになる可能性があります。開発者・企業ユーザーにとって選定窓は極めて短く——前代旗艦がリリース1か月で次世代競合に直面する状況です。
- Grok 4.5プログラミングベンチ(リリース済):Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%。出力token効率はClaude Opus 4.8の約4.2倍(約1.9万 vs 6.7万token/タスク)。
- Grok 4.6予告パラメータ:1.5兆、SFT/RLポストトレーニングアップ——第三者未検証。
- Grok 4.7予告パラメータ:2.1兆、「4.6全面上回りだが推論やや遅く、token効率は高い」——第三者未検証。
- Kimi K3対照ベンチ(実測済):Frontend Code Arena 1679点(オープンモデル第1)、Artificial Analysisインテリジェンス指数世界第3。
よくある質問 FAQ
Grok 4.6の具体的なリリース日はいつですか?
マスクは「8月7日頃」と述べましたが、これは非公式の発言でありxAI公式が確認した日付ではありません。実際のリリースは前後する可能性があります。
Grok 4.6とGrok 4.7の違いは何ですか?
Grok 4.6は1.5兆パラメータで、SFTとRLのポストトレーニング強化が重点です。Grok 4.7は2.1兆パラメータで、4.6の数週間後に続く予定。マスクは4.6を全面的に上回るが推論速度はやや遅く、token効率は高いと述べています。
Grok 4.6はKimi K3やClaude Fable 5.1より強いですか?
現時点では判断できません。Grok 4.6には公開ベンチマークがなく、Kimi K3は実測データがあり、Claude Fable 5.1はAnthropic公式未確認の噂段階です。
Grok 4.6の料金はどのくらいですか?
公式未発表です。Grok 4.5の料金(入力$2/出力$6、100万tokenあたり)を参考にできますが、新世代モデルでは変更される可能性があります。正式発表を待つべきです。
一般ユーザーはどこでGrok 4.6を使えますか?
Grok 4.5の展開経路から、Grok Build・xAI公式API・コンソールが先行し、その後サードパーティ連携が続くと推測されますが、4.6については未確認です。
以下は主要参考ソースです。Grok 4.6/4.7関連の詳細は公式予告または業界噂であり、リリース前はxAI公式チャネルで最新データを確認してください。
xAI Grok 4.5モデルカード(media.x.ai)
The Verge:「Pacing the Frontier」公開書簡報道
Cursor Agent・Grok APIハイブリッドルーティング・iOS CI/CDを7×24稼働させる本番チームにとって、純クラウドAPIだけではローカルMetalコンパイルチェーンと安定オンラインの課題は解決しません。仮想化MacはHypervisor損耗と互換性リスクを伴い、頻繁なモデル切替は基盤環境の安定性をさらに試します。ゼロオーバーヘッドのネイティブ算力、安定したiOS CI/CD、AI Agentの7×24自動化が必要な本番環境では、ZUKCLOUDの裸金属Mac miniクラウドノードがより適した選択です:専用Apple Silicon物理機、Hypervisor税なし、常時稼働、日次・週次・月次の柔軟課金。詳細は裸金属アーキテクチャ宣言をご参照ください。