Accueil / Blog / Grok 4.6
ENGINEERING BLOG · 2026.07.30

Date de sortie de Grok 4.6 :
le 7 août annoncé par xAI est-il réaliste ?

Pour un ingénieur IA ou un tech lead qui attend Grok 4.6 pour faire évoluer son agent ou son workflow de code, la réponse d'Elon Musk à Guillermo Rauch (CEO de Vercel) sur X, le 28 juillet 2026, reste la seule source on-the-record à ce jour : xAI vise Grok 4.6 autour du 7 août avec 1,5 billion de paramètres, suivi quelques semaines plus tard par Grok 4.7 à 2,1 billions — soit un mois après la sortie du Grok 4.5, trois modèles frontier en deux mois. Cet article cartographie la chronologie, explique pourquoi xAI met l'accent sur le SFT/RL plutôt que sur la seule échelle, compare les specs annoncées à Kimi K3 et au Claude Fable 5.1 présumé, et signale ce qui reste non vérifié. Conclusion d'entrée : aucun benchmark, tarif ou model card publié — traitez « autour du 7 août » comme un objectif, pas une garantie.

01

Contrairement à Grok 4.5, lancé avec une model card complète et 15 benchmarks suivis, Grok 4.6 et 4.7 n'ont ni évaluation indépendante ni page produit officielle. Parier sa stack de production sur des fuites sociales crée une exposition réelle :

  • Source unique, non confirmée : tout — « 1,5 billion de paramètres », « significantly improved SFT & RL », le suivi Grok 4.7 à 2,1T — provient d'un seul post X. Aucun billet xAI ni model card ne l'a corroboré.
  • Le « Musk time » a un historique : les calendriers des entreprises dirigées par Musk glissent typiquement de quelques jours à quelques semaines. « Autour du 7 août » est une cible, pas une date contractuelle.
  • Benchmarks et tarifs vides : Grok 4.5 est sorti avec des scores détaillés ; Grok 4.6 n'a aucune donnée tierce. Impossible de le comparer head-to-head à Kimi K3, qui dispose déjà de chiffres vérifiés.
  • Sécurité et rythme industriel en collision : le jour même de la roadmap de Musk, plus de 1 200 employés d'OpenAI, Anthropic, Google DeepMind et Meta ont publié la lettre « Pacing the Frontier », demandant au gouvernement américain d'aider à ralentir le développement automatisé de l'IA — soutenue au niveau corporate par OpenAI et Anthropic. xAI est absente de la liste. En juillet, xAI a également poursuivi un utilisateur pour usage présumé de Grok à des fins de CSAM — contexte vendor-risk pertinent pour les acheteurs enterprise.

En une phrase : le récit est clair, les données vérifiables sont nulles — toute affirmation « meilleur modèle » avant model card officielle relève de la spéculation.

02

Chronologie clé :

  • 8 juillet 2026 : xAI sort Grok 4.5 — conçu pour le code et le travail agentique, co-entraîné avec Cursor sur de vraies sessions développeur. Contexte 500K tokens, 2/6 $ par million de tokens entrée/sortie, model card publiée.
  • 16–26 juillet 2026 : Kimi K3 de Moonshot AI passe de la preview hébergée au release open weight complet — 2,8T paramètres, contexte 1M tokens, en tête du trending Hugging Face.
  • 28 juillet 2026 : Musk publie la roadmap Grok 4.6/4.7 en réponse à Rauch — source primaire de cet article.
  • ~7 août 2026 (objectif) : Grok 4.6, 1,5T paramètres, positionné comme upgrade SFT/RL plutôt que simple scale-up.
  • Fin août–début septembre 2026 (estimé) : Grok 4.7, 2,1T paramètres — Musk : « meilleur que 4.6 à tous égards, sauf légèrement plus lent à servir, mais avec une efficacité token encore supérieure. »
Famille Grok : specs (modèles annoncés non sortis inclus)
Modèle Date Paramètres Focus Statut
Grok 4.3 Beta17 avr. 2026Non divulguéBaselineSorti
Grok 4.58 juil. 2026Non divulgué (SKU unique, pas MoE)Code/agentique, co-training CursorSorti, benchmarké
Grok 4.6~7 août 20261,5TUpgrade SFT/RLAnnoncé par tweet, non sorti
Grok 4.7~fin août–déb. sept. 20262,1TUpgrade large sur 4.6, meilleure efficacité tokenAnnoncé par tweet, non sorti

Tous les chiffres Grok 4.6/4.7 sont des claims vendor non vérifiés issus d'un seul post social — à traiter comme indicatifs, pas comme specs confirmées.

03

SFT et RL, en termes simples : le supervised fine-tuning (SFT) entraîne le modèle sur des sorties exemples curatées pour façonner le comportement ; le reinforcement learning (RL) utilise des signaux de récompense pour apprendre quelles séquences d'actions fonctionnent — critique pour les tâches agentiques multi-étapes. La formulation de Musk — « significantly improved SFT & RL » — signale que xAI poursuit la même stratégie que Grok 4.5 : environ 15 954 tokens de sortie par tâche SWE-Bench Pro contre 67 020 pour Opus 4.8 — un écart d'efficacité de 4,2×, largement attribué au post-entraînement sur de vraies sessions Cursor.

Le compromis échelle vs. vitesse : le passage de Grok 4.6 à 1,5T est un vrai scale-up, mais le cadrage de Grok 4.7 — plus grand à 2,1T, « meilleur à tous égards sauf légèrement plus lent à servir » — suggère deux SKU à compromis différents, comme le split Sonnet/Opus d'Anthropic ou les tiers mini/full d'OpenAI.

La pression concurrentielle absente de la timeline : la cible Grok 4.6 tombe presque exactement 10 jours après le release open weight complet de Kimi K3. Le modèle Moonshot a mené le Frontend Code Arena à 1 679 points — premier open weight à battre tous les modèles fermés sur ce board — et s'est classé 3e mondial sur l'Intelligence Index d'Artificial Analysis. Musk a commenté « impressive » sur les posts de benchmarks Kimi K3. Les médias financiers chinois ont relayé une estimation de 314 milliards de dollars de valeur OpenAI/Anthropic effacée — chiffres d'analystes via presse, non confirmés indépendamment, mais la direction du sentiment est claire.

Grok vs. contemporains (claims pré-release — pas de benchmarks vérifiés)
Modèle Éditeur Paramètres Contexte Tarif (entrée/sortie par 1M tokens)
Grok 4.5xAINon divulgué500K2 / 6 $
Grok 4.6 (annoncé)xAI1,5TNon divulguéNon divulgué
Kimi K3Moonshot AI2,8T (MoE, ~16/896 experts actifs)1M0,30 (cache hit) / 3 (cache miss) in, 15 out
Claude Fable 5.1 (rumeur)AnthropicNon divulguéNon divulguéRumeur : inchangé vs Fable 5 (10 / 50 $)
GPT-5.6 SolOpenAINon divulguéNon divulguéNon divulgué

04

  1. Construire une checklist de vérification : surveillez le compte X de Musk, le blog xAI et la page model card. N'intégrez pas « 1,5T paramètres » dans vos SLA tant qu'une annonce officielle n'est pas publiée.
  2. Établir une baseline sur Grok 4.5 dès maintenant : si Grok 4.5 n'est pas encore intégré, exécutez votre jeu de tâches réel sur Cursor ou l'API xAI (2/6 $ par million de tokens) et enregistrez consommation de tokens et taux de réussite comme référence comparative.
  3. Benchmarker Kimi K3 en parallèle : Kimi K3 dispose déjà de scores tiers (SWE-bench Verified 93,4 %, Frontend Code Arena 1 679). Ne laissez pas votre fenêtre de sélection inactive en attendant une model card non sortie.
  4. Prévoir un routage dual-SKU : Musk a déjà évoqué 4.6 (plus rapide) vs. 4.7 (plus fort, légèrement plus lent). Ajoutez une logique de fallback latence/qualité dans votre gateway agent — voir notre guide d'intégration OpenRouter dual-route.
  5. Évaluer le risque sécurité vendor : examinez le récent procès CSAM de xAI et les notations child-safety de Common Sense Media. Si votre produit est grand public ou traite des données sensibles, intégrez la conformité au TCO, pas seulement le rang au leaderboard.
  6. Sécuriser un compute stable pour la production agent : que vous routiez vers l'API Grok 4.6 ou un stack mixte, Cursor Agent local et pipelines CI nécessitent des environnements stables 24/7. Évaluez bare-metal vs. Mac virtualisé pour l'overhead hyperviseur.

05

Si le calendrier de Musk tient, Grok 4.6 et Grok 4.7 arriveront le même mois que le Claude Fable 5.1 présumé (selon des fuites 36kr et WinCentral, calé pour devancer le GPT-6 anticipé d'OpenAI) et quelques semaines seulement après le choc open weight de Kimi K3. Pour les équipes en évaluation, la durée de vie utile de chaque flagship se compresse à quelques semaines — l'efficacité token et le coût réel par tâche comptent plus que le rang seul au leaderboard.

  • Benchmarks code Grok 4.5 (sorti) : Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 % ; ~4,2× efficacité tokens de sortie vs. Claude Opus 4.8 (~15 954 vs. 67 020 tokens/tâche).
  • Specs annoncées Grok 4.6 : 1,5T paramètres, upgrade post-entraînement SFT/RL — non vérifié par des tiers.
  • Specs annoncées Grok 4.7 : 2,1T paramètres, « meilleur que 4.6 sauf légèrement plus lent, meilleure efficacité token » — non vérifié.
  • Benchmarks de référence Kimi K3 (vérifiés) : Frontend Code Arena 1 679 points (top open weight), Intelligence Index Artificial Analysis rang #3 mondial.

FAQ

Quand sort exactement Grok 4.6 ?

Musk a indiqué « autour du 7 août 2026 » dans un post X, mais xAI n'a pas confirmé officiellement la date. Traitez-la comme un objectif susceptible de glisser.

Quelle différence entre Grok 4.6 et Grok 4.7 ?

Grok 4.6 est un modèle 1,5T focalisé sur les améliorations SFT/RL. Grok 4.7, attendu quelques semaines plus tard, compte 2,1T paramètres et devrait selon Musk surpasser 4.6 sur tous les axes sauf la vitesse de serving.

Grok 4.6 battra-t-il Kimi K3 ou Claude Fable 5.1 ?

Trop tôt. Grok 4.6 n'a pas de benchmarks publiés, Kimi K3 a des scores tiers vérifiés, Claude Fable 5.1 n'est pas officiellement confirmé par Anthropic.

Combien coûtera Grok 4.6 ?

Inconnu. Grok 4.5 a été lancé à 2 $/M en entrée et 6 $/M en sortie — référence raisonnable, mais xAI n'a pas communiqué de tarifs Grok 4.6.

Où pourrai-je utiliser Grok 4.6 ?

Sur la base de Grok 4.5 : Grok Build, API xAI et console xAI en premier, puis intégrations tierces — non confirmé pour la 4.6.

Sources primaires ci-dessous. Tous les détails Grok 4.6/4.7 sont des annonces vendor ou fuites sectorielles — vérifiez les canaux officiels xAI avant de vous fier à une date, spec ou prix précis.

Blog officiel xAI : Introducing Grok 4.5

Model card Grok 4.5 xAI (media.x.ai)

Blog officiel Moonshot AI : Kimi K3

The Verge : couverture de la lettre « Pacing the Frontier »

Pour les équipes qui font tourner Cursor Agent, un routage mixte API Grok ou une CI/CD iOS en continu, les API cloud seules ne résolvent ni la stabilité toolchain Metal locale, ni la compatibilité iOS — les Mac virtualisés imposent une taxe hyperviseur et des risques de compatibilité, et la rotation rapide des modèles stress l'environnement sous-jacent. Pour des charges de production nécessitant un compute natif sans perte, une CI iOS stable et une automatisation agent IA 24/7, les nœuds cloud Mac mini bare-metal ZUKCLOUD constituent généralement la meilleure option : Apple Silicon dédié, pas de couche hyperviseur, disponibilité permanente, facturation jour/semaine/mois. Voir notre manifeste d'architecture bare-metal.