Accueil / Blog / Grok 4.6
ENGINEERING_BLOG · 2026.07.30

Date de sortie de Grok 4.6 : la cible du 7 août d'xAI est-elle réaliste ?

GROK 4.6 · FENÊTRE CIBLE
7/08±

1,5T de paramètres · upgrade SFT/RL · Grok 4.7 2,1T quelques semaines après

Pour les équipes qui attendent la date de sortie de Grok 4.6, hésitent entre rester sur Grok 4.5 ou basculer vers Kimi K3, ou cherchent à comprendre ce que signifient concrètement « 1,5 billion de paramètres », ce dossier rassemble les déclarations publiques d'Elon Musk du 28 juillet et le contexte industriel en un plan d'action lisible. En répondant sur X au PDG de Vercel Guillermo Rauch, Musk a indiqué qu'xAI prévoit de livrer Grok 4.6 vers le 7 août avec 1,5 billion de paramètres, suivi de Grok 4.7 à 2,1 billions dans les semaines suivantes. Notre lecture : la seule source primaire disponible aujourd'hui est une réponse sur X — pas de fiche modèle, pas de benchmarks, et les calendriers annoncés par Musk ont historiquement glissé de quelques jours à quelques semaines. Vérifiez les canaux officiels xAI avant tout engagement.

SECTION 01 Cinq pièges avant de miser sur Grok 4.6

  • Un tweet n'est pas un communiqué : Les informations du 28 juillet proviennent de la réponse de Musk à @rauchg. Le blog et les pages produit xAI n'ont pas confirmé specs ni dates.
  • Les paramètres ne sont pas la capacité : Musk a insisté sur les upgrades SFT et RL plutôt que sur la seule échelle. Grok 4.5 rivalise déjà sur les benchmarks agents grâce au co-entraînement Cursor et à une forte efficacité token.
  • Aucun score benchmark publié : Contrairement à la fiche détaillée de Grok 4.5, les versions 4.6/4.7 n'ont aucune évaluation tierce — pas de comparaison solide avec Kimi K3 ou le Claude Fable 5.1 évoqué dans la rumeur.
  • Une cadence concurrentielle implacable : Kimi K3 a publié ses poids ouverts complets de 2,8T le 26 juillet et a atteint 1 679 points au Frontend Code Arena. Le calendrier serré 4.6/4.7 d'xAI s'inscrit dans cette pression.
  • Des ombres sur la sécurité : En juillet, xAI a poursuivi un utilisateur pour génération présumée de CSAM via Grok ; Common Sense Media avait déjà classé Grok parmi les pires modèles pour la protection des mineurs en janvier. La conformité doit peser autant que la performance.

SECTION 02 Chronologie et spécifications : de Grok 4.5 à 4.7

Cadence de sortie Grok (été 2026)
Date Événement
2026-07-08 xAI livre Grok 4.5 : flagship coding/agents, co-entraîné avec Cursor, contexte 500K, 2/6 $ par million de tokens entrée/sortie
2026-07-16–26 Kimi K3 de Moonshot AI passe en hébergé puis en open weights complet : 2,8T de paramètres, contexte 1M
2026-07-28 Musk publie la feuille de route Grok 4.6/4.7 en réponse à Rauch ; le même jour, 1 200+ employés publient la lettre « Pacing the Frontier »
~2026-08-07 Cible Grok 4.6 : 1,5T de paramètres, upgrade SFT/RL majeur (annoncé, non livré)
~fin août–début sept. 2026 Estimation Grok 4.7 : 2,1T de paramètres ; Musk indique meilleur que 4.6 sauf serving légèrement plus lent, meilleure efficacité token
Ligne de modèles Grok
Modèle Paramètres Focus Statut
Grok 4.3 Beta Non divulgué Baseline précédente Livré
Grok 4.5 Non divulgué (SKU unique, pas MoE) Coding/agents, co-entraînement Cursor Livré
Grok 4.6 1,5T Upgrade SFT/RL Annoncé
Grok 4.7 2,1T Upgrade global par rapport à 4.6 Annoncé

Les comptes de paramètres, tarifs et chiffres de benchmark proviennent des annonces fournisseurs ou de Musk. Grok 4.6 et 4.7 n'ont pas encore d'évaluations indépendantes — traitez les lignes « annoncé » comme indicatives jusqu'au lancement officiel.

SECTION 03 Pourquoi l'upgrade est du post-entraînement, pas seulement de l'échelle

Le supervised fine-tuning (SFT) façonne les sorties sur des exemples curés ; le reinforcement learning (RL) entraîne les tâches agents multi-étapes via des signaux de récompense. Le cadrage de Musk sur un « SFT & RL significativement amélioré » prolonge la stratégie de Grok 4.5 : de vraies sessions développeur Cursor ont produit Terminal-Bench 2.1 à 83,3 % et SWE-Bench Pro à 64,7 %, avec environ 15 954 tokens de sortie par tâche SWE contre 67 020 pour Opus 4.8 — un écart d'efficacité de 4,2×.

Le saut à 1,5T pour Grok 4.6 est une vraie montée en échelle, mais le positionnement de Grok 4.7 — plus grand à 2,1T, « meilleur sous tous les angles sauf serving légèrement plus lent » — suggère deux SKU pour qualité versus latence, à l'image du duo Sonnet/Opus d'Anthropic et des tiers mini/full d'OpenAI.

SECTION 04 Face à face : Grok vs Kimi K3 et concurrents

Specs et tarifs des modèles frontier (livré/annoncé mixte)
Modèle Paramètres Contexte Tarif ($/M in/out)
Grok 4.5 Non divulgué 500K 2 / 6 $
Grok 4.6 (annoncé) 1,5T Non divulgué Non divulgué
Kimi K3 2,8T MoE 1M 0,30–3 / 15 $
Claude Fable 5.1 (rumeur) Non divulgué Non divulgué Rumeur Fable 5 (10/50 $)
GPT-5.6 Sol Non divulgué Non divulgué Non divulgué

La cible Grok 4.6 tombe environ dix jours après la sortie open weights de Kimi K3. K3 a atteint 1 679 points au Frontend Code Arena — premier modèle open weights à devancer tous les modèles fermés sur ce classement. Musk a commenté « impressive » sur les fils de benchmarks K3. Contexte K3 : analyse des poids ouverts K3 ; ligne Fable : Opus 5 et controverse de distillation.

SECTION 05 Controverses : Musk time, procès et fracture industrielle

  • Calendrier non vérifié : Une seule réponse X comme source ; le glissement « Musk time » est fréquent chez xAI, Tesla et SpaceX.
  • Benchmarks et tarifs vides : « 1,5T » et « upgrade SFT/RL » sont des affirmations fournisseur sans preuve tierce.
  • Contentions sur la sécurité des contenus : En juillet 2026, xAI a poursuivi un utilisateur pour CSAM présumé via Grok — première action de ce type, reconnaissance implicite d'un risque de contournement. Common Sense Media avait déjà signalé des lacunes sur la protection des mineurs.
  • Collision de cadence : Le jour de l'annonce 4.6/4.7 de Musk, 1 200+ employés d'OpenAI, Anthropic, Google DeepMind et Meta ont publié « Pacing the Frontier » ; xAI absent des signataires. Voir face-à-face GPT-6 et course réglementaire.

Si le calendrier de Musk tient, Grok 4.6 et 4.7 entreront en collision avec le Claude Fable 5.1 évoqué (fuites d'août) et le choc open weights de Kimi K3 — août 2026 pourrait devenir le mois le plus dense en modèles frontier. La durée de vie de tout flagship se réduit à quelques semaines ; l'efficacité token et le coût réel par tâche priment sur le rang au classement seul.

SECTION 06 Checklist en six étapes avant la sortie de Grok 4.6

  1. S'abonner aux canaux officiels : blog x.ai, annonces Grok Build, @elonmusk — pas seulement les résumés de seconde main.
  2. Établir une baseline Grok 4.5 : Noter scores SWE-Bench, Terminal-Bench et consommation token pour un A/B post-lancement.
  3. Configurer des fallbacks Cursor/OpenRouter : Grok 4.5 est dans Cursor aujourd'hui ; réserver des routes Kimi K3 ou GPT-5.6 Sol pour la fenêtre de bascule.
  4. Surveiller la page tarifaire : 4.5 a démarré à 2/6 $ par million de tokens ; les prix 4.6 peuvent changer — lire le texte du jour J.
  5. Revoir sécurité et conformité : Pour les produits enterprise ou orientés jeunesse, auditer politiques xAI, journalisation et contentions récentes.
  6. Séparer inférence et chaîne de compilation : APIs LLM pour l'orchestration agents ; builds macOS natifs sur Apple Silicon physique — éviter risque EULA VM et surcoût de 20 à 40 %.

SECTION 07 Chiffres citables et sources primaires

  • Grok 4.5 : contexte 500K ; Terminal-Bench 2.1 83,3 % ; SWE-Bench Pro 64,7 % ; 2/6 $ par million de tokens
  • Grok 4.6 (annoncé) : 1,5T de paramètres ; focus post-entraînement SFT/RL ; cible ~7 août
  • Grok 4.7 (annoncé) : 2,1T de paramètres ; quelques semaines après 4.6 ; serving plus lent, meilleure efficacité token
  • Référence pairs : Kimi K3 2,8T, contexte 1M, Frontend Code Arena 1 679 ; Grok 4.5 ~4,2× efficacité token sortie vs Opus 4.8 sur tâches SWE

Rouvrir ces liens après toute mise à jour en amont :

xAI : Introducing Grok 4.5

Moonshot AI : Kimi K3 (Hugging Face)

The Verge : couverture Pacing the Frontier

Un upgrade SFT/RL de Grok 4.6 comprimera encore les fenêtres de choix d'API, mais il ne remplacera pas les builds Xcode, le débogage Metal ni les chaînes de signature iOS. Un macOS en VM porte un risque EULA et une perte de performance mesurable. Stack pragmatique : APIs frontier (Grok/Kimi) pour l'orchestration agents à millions de tokens ; nœuds physiques cloud VPSNIX M4/M4 Pro pour des builds Apple Silicon natifs — vrai matériel Apple, root complet, zéro surcoût d'hyperviseur, facturation journalière ou mensuelle flexible. Voir tarifs.

SECTION 08 FAQ

Quand sort exactement Grok 4.6 ?

Musk a dit « vers le 7 août 2026 » sur X. xAI n'a pas confirmé officiellement une date. Traitez-la comme une cible susceptible de glisser.

Quelle différence entre Grok 4.6 et Grok 4.7 ?

Grok 4.6 compte 1,5T de paramètres axés sur les améliorations SFT/RL. Grok 4.7, attendu quelques semaines plus tard, atteint 2,1T ; Musk indique qu'il surpasse 4.6 sauf en vitesse de serving — un peu de latence échangée contre une meilleure efficacité token.

Grok 4.6 battra-t-il Kimi K3 ou Claude Fable 5.1 ?

Trop tôt. Grok 4.6 n'a pas de benchmarks publiés ; Kimi K3 a des scores vérifiés dont la tête du Frontend Code Arena ; Claude Fable 5.1 n'est pas confirmé officiellement par Anthropic.

Combien coûtera Grok 4.6 ?

Inconnu. Grok 4.5 a démarré à 2 $ par million d'entrée et 6 $ par million de sortie — référence raisonnable, mais les tarifs 4.6 ne sont pas divulgués.

Où pourrai-je utiliser Grok 4.6 ?

D'après le déploiement de Grok 4.5 : Grok Build, API xAI et console en premier, puis plateformes tierces — non confirmé pour 4.6.