Le rythme de lancement de Grok 4.6 : un mois après la 4.5
xAI semble viser trois modèles frontier en deux mois cet été. Les benchmarks et tarifs de Grok 4.6 ne sont pas encore publics.
8 juillet 2026 : xAI lance Grok 4.5, co-entraîné avec Cursor sur de vraies sessions développeur. Contexte 500K tokens, tarification $2/$6 par million de tokens entrée/sortie.
16–26 juillet 2026 : Kimi K3 de Moonshot AI passe de l'hébergement à la publication complète des poids (2,8T, 1M tokens).
28 juillet 2026 : Musk dévoile la feuille de route Grok 4.6/4.7. Le même jour, plus de 1 200 employés publient la lettre ouverte « Pacing the Frontier ».
~7 août 2026 (cible) : Grok 4.6, 1,5T paramètres, upgrade SFT/RL plutôt que simple montée en échelle.
Fin août–début septembre 2026 (estimé) : Grok 4.7, 2,1T, meilleur que 4.6 selon Musk mais légèrement plus lent à servir.
Le « Musk time » est légendaire : des retards de quelques jours à deux semaines sont fréquents. Attendez l'annonce officielle xAI avant de figer votre planning.
Grok 4.6 en chiffres : comparaison avec Kimi K3 et Fable 5.1
| Modèle | Date | Paramètres | Focus | Statut |
|---|---|---|---|---|
| Grok 4.5 | 08/07/2026 | Non divulgué | Coding/agentique | Publié |
| Grok 4.6 | ~07/08/2026 | 1,5T | Upgrade SFT/RL | Annoncé via tweet |
| Grok 4.7 | ~fin août–déb. sept. | 2,1T | Supérieur à 4.6, meilleure efficacité token | Annoncé via tweet |
| Modèle | Éditeur | Paramètres | Contexte | Tarif (entrée/sortie par 1M tokens) |
|---|---|---|---|---|
| Grok 4.5 | xAI | Non divulgué | 500K | $2 / $6 |
| Grok 4.6 (annoncé) | xAI | 1,5T | Non divulgué | Non divulgué |
| Kimi K3 | Moonshot AI | 2,8T (MoE) | 1M | $0,30/$3 entrée, $15 sortie |
| Claude Fable 5.1 (rumeur) | Anthropic | Non divulgué | Non divulgué | Comme Fable 5 selon rumeurs |
La date cible de Grok 4.6 tombe environ 10 jours après la publication complète des poids de Kimi K3 — 1 679 points en tête du Frontend Code Arena, premier modèle open-weight à dépasser tous les modèles fermés.
Pourquoi xAI mise sur le post-entraînement, pas seulement la taille
Le fine-tuning supervisé (SFT) façonne le comportement du modèle via des exemples curatés ; l'apprentissage par renforcement (RL) enseigne quelles séquences d'actions fonctionnent dans les tâches agentiques multi-étapes.
Grok 4.5 a atteint 83,3 % sur Terminal-Bench 2.1 et 64,7 % sur SWE-Bench Pro grâce au post-entraînement sur de vraies sessions Cursor — environ 15 954 tokens de sortie par tâche SWE-Bench Pro contre 67 020 pour Opus 4.8, soit un écart d'efficacité de 4,2×.
À noter : Musk lui-même a commenté « impressionnant » sous les benchmarks de Kimi K3. L'indice Intelligence d'Artificial Analysis place K3 au 3e rang mondial.
Runbook pré-lancement en 6 étapes pour Grok 4.6
Fixer les sources : Classer le post X du 28 juillet comme « aperçu informel » et surveiller le blog xAI et les annonces Grok Build.
Établir une baseline : Documenter consommation de tokens et latence sur SWE-Bench, Terminal-Bench et vos tâches agent avec Grok 4.5, API Kimi K3 ou Claude Fable 5.
Préparer le routage A/B : Ajouter un placeholder d'ID modèle Grok 4.6 dans la passerelle API ou LiteLLM pour un déploiement gris en 24 h.
Mesurer l'efficacité token : Le coût réel sur tâches identiques prime sur le classement leaderboard après le lancement.
Anticiper la stratégie double SKU : Séparer workloads sensibles à la latence (4.6) et à la qualité (4.7) dans la politique de routage.
Mettre à jour l'évaluation fournisseur : En juillet 2026, xAI a intenté sa première action contre un utilisateur pour CSAM généré via Grok. Common Sense Media avait classé Grok parmi les pires chatbots pour la protection des mineurs en janvier 2026.
Points de vigilance et août 2026, mois de lancements concentrés
La seule source est un tweet : pas de billet de blog xAI, pas de fiche modèle, pas de page produit confirmant specs ou date.
Benchmarks et tarifs absents : contrairement à la fiche détaillée de Grok 4.5, aucune évaluation indépendante pour 4.6.
Divergence sectorielle sur le rythme : « Pacing the Frontier » et l'annonce Grok 4.6/4.7 le même jour — xAI absent de la liste des signataires.
Attention : si le calendrier de Musk tient, Grok 4.6, Grok 4.7 et le Claude Fable 5.1 évoqué pourraient sortir le même mois — août 2026 s'annonce comme l'un des mois les plus denses en lancements frontier.
La durée de vie utile de chaque flagship se compresse à quelques semaines. Sur un Mac local, veille, mises à jour et plafonds mémoire interrompent les pipelines agent longue durée et les builds iOS. Pour des environnements de production stables en CI/CD iOS et automatisation d'agents IA, la location cloud Mac Mini MESHLAUNCH est généralement le meilleur choix : Apple Silicon dédié, disponibilité 24/7, facturation jour/semaine/mois — inférence via API, builds et orchestration sur un nœud Mac cloud fiable.
Musk a indiqué « vers le 7 août 2026 » sur X, mais xAI n'a pas confirmé officiellement. Consultez notre page tarifs pour les environnements Mac cloud.
Grok 4.6 : 1,5T, focus SFT/RL. Grok 4.7 : 2,1T, supérieur à 4.6 selon Musk mais légèrement plus lent à servir, avec une meilleure efficacité token.
Trop tôt pour conclure. Grok 4.6 n'a pas de benchmarks publiés ; Kimi K3 a des scores tiers vérifiés. Voir le centre d'aide pour la configuration Mac cloud.
Inconnu. Grok 4.5 a démarré à $2 entrée / $6 sortie par million de tokens — référence raisonnable jusqu'à l'annonce officielle.
D'après le déploiement de Grok 4.5 : probablement Grok Build, API xAI et console xAI en premier, puis plateformes tierces comme Cursor — non confirmé pour 4.6.