Grok 4.5 : fonctionnalités et tarifs du modèle de codage IA

En juillet 2026, xAI a livré Grok 4.5 et en a fait le modèle de codage par défaut dans Cursor et Grok Build. La promesse : plus rapide, plus efficace en tokens, mieux pour les agents. Votre vraie question : ça vaut le coup de payer ? Ou continuer avec Claude, GPT ou Gemini ?

Du 20 juillet au 1er août 2026, nous avons exécuté le même pack de tâches agent (3 dépôts, 15 jobs longue durée chacun) contre Grok 4.5, Claude Sonnet 4, GPT-5 Codex et Gemini 2.5 Pro—mesure du coût par tâche réussie et du temps jusqu’à la première sortie mergeable. Ce guide couvre les fonctionnalités, les prix API, les benchmarks de codage et qui doit acheter maintenant vs attendre. Prix et specs au 2026-08-04 selon la documentation xAI.

Note : Ceci est un manuel de décision, pas un classement « Grok gagne ». En bref : utilisateurs Cursor—essayez le quota gratuit ; équipes API agent—un bake-off d’une semaine ; X Premium avec codage léger—l’abonnement suffit.

1. D’emblée : votre entrée × ça vaut le coup ?

EntréeTravail principalAcheter maintenant ?Première action
Cursor individuelTab + agents moyensEssayer le quota gratuitGrok 4.5 par défaut 1 semaine ; journaliser les surplus
API / agent customRuns marathon multi-dépôtsBake-off recommandéSuivre tokens + étapes ; surveiller prix >200k
X / app GrokChat, scripts légers, ExcelAbonnement suffisantUtiliser Grok Build ; pas d’API seule
Conformité entreprisePipelines productionRevue sécurité d’abordRésidence données, logs, rotation clés
Side projects sensibles au coûtBuilds week-endAttendre ou mixerPetit modèle pour routine ; Grok pour le dur

2. Ce qu’est Grok 4.5—et comment il diffère de 4.3

Sorti le 8 juillet 2026, Grok 4.5 est le flagship xAI pour l’ingénierie logicielle et les workflows agent, entraîné avec Cursor sur de vraies sessions développeur. vs Grok 4.3 : moins d’étapes par tâche (~2× efficacité tokens), ~80 TPS, optimisé pour prompt → app exécutable.

SpecGrok 4.5Grok 4.3Notes
Nom APIgrok-4.5grok-4.3Alias grok-build-latest
Contexte500k1M4.5 échange longueur pour efficacité engineering
ModalitésTexte + imageTexte + imageCaptures pour UI/erreurs
IntégrésOutils, sortie structurée, tiers reasoningSimilaireReasoning par défaut : high
Cutoff connaissances2026-02-01AntérieurRecherche web pour libs récentes

3. Couche d’entrée : App, Cursor, API, Grok Build

EntréeIdéal pourFacturationLimites
App Grok / XNews, chat, Q&A légerX Premium / SuperGrokFaible profondeur agent IDE
CursorCodage quotidien + panneau agentAbonnement Cursor + usage modèleSurplus selon modèle verrouillé
Grok BuildModèles Excel, livrables rechercheDans l’abo ; 4.5 gratuit limitéPas une entrée CI générique
API xAIAgents custom, pipelinesPar token + cacheClés & observabilité à votre charge

Début août 2026 : Grok 4.5 gratuit limité dans Grok Build et Cursor—la meilleure fenêtre pour décider avec vos dépôts, pas des captures de benchmark. Voir notre guide Claude Code vs Cursor vs Codex.

4. Couche exécution : tests codage & agents

Setup : Node ~38k LOC, microservice Go ~22k LOC, dépôt Swift mixte ; 15 jobs agent chacun—refactors cross-fichiers, fixes CI, portage Rust, petites apps full-stack. Mêmes prompts, tests, permissions outils.

MétriqueGrok 4.5Médiane quatre modèlesEnseignement
Taux de succès (tests verts)11/15 (73%)10/15Fort sur tâches style Rust/C++
Temps jusqu’à sortie mergeable6,8 min médiane9,2 minMoins d’étapes ; high reasoning ralentit parfois
Appels outils par tâche2431Aligné avec le narratif « moins d’étapes »
Apps UI one-shot4/4 exécutable3/4Layouts soignés
Édits destructifs hallucinés22Pas plus sûr—revue requise

Cas : Dev indie a livré admin Next.js avec auth en une nuit dans Cursor—ça tourne, mais JWT refresh/RBAC ont nécessité tests humains. Ingénieur backend a splitté service Go via agent API : ~38% moins de tokens que GPT-5 Codex, mais config staging a une fois atterri dans un .env sample—CI a détecté.

Verdict : Payez pour tester Grok 4.5 pour runs agent longs et engineering multi-fichiers. Si 80% de votre temps est tab-complete et Q&A mono-fichier, les gains peuvent ne pas justifier la facture.

5. Contexte & outils : 500k suffisent ?

CapacitéGrok 4.5Pratique
Cap contexte500 000 tokensSnapshot monorepo moyen—ne pas dumper tout l’arbre
Function callingOuiLogger chaque args outil
Sortie structuréeOuiParsers CI, JSON tickets
Reasoninglow / medium / highEssayer medium sur refactors routine
Recherche web / XIntégréeIdéal pour docs fraîches—vérifier sources

500k < 1M de Grok 4.3, mais le pari est moins de tokens par tâche. Si vous envoyez 800k d’historique chaque tour, 4.5 peut coûter plus—prompts ≥ 200k activent les prix long contexte (section suivante). Pour 1M voir notre guide Kimi K3 contexte 1M.

6. Couche coûts : prix API & factures cachées

Docs xAI, 2026-08-04. Les tiers d’abonnement changent souvent—le calcul tokens API est comment les équipes engineering budgètent.

Posteprompt < 200k (/1M)prompt ≥ 200k (/1M)
Input2,00 $4,00 $
Input cache0,30 $0,60 $
Output6,00 $12,00 $

Piège 1 : Dès qu’une requête atteint 200k tokens prompt, tous les tokens de cette requête sont facturés au tier supérieur.
Piège 2 : High reasoning ajoute du thinking interne—vous payez l’output à 6 $.
Piège 3 : Usage Grok Cursor ≠ API directe—ne comparez pas les lignes 1:1.

Médiane pack 15 tâches : API Grok 4.5 ~18–26 $ ; GPT-5 Codex ~31–42 $ ; Claude Sonnet 4 ~24–35 $. Comparaison abonnements : classement coûts codage IA 2026.

7. Sécurité avant production

  • Clés : Secret manager uniquement ; rotation ≤ 90 jours
  • Données : Pas de PII client ni dumps DB prod dans les prompts
  • Logs : Hasher prompts ; logger appels outils—pas le texte complet sans autorisation
  • Région : us-east-1 / us-west-2—vérifier politique transfrontalière
  • Supply chain : Les agents peuvent éditer deps & CI—protection branche + revue humaine

8. Matrice de scénarios

ProfilCodage hebdoStackRôle Grok 4.5
Dev IDE temps plein30h+Cursor Pro + défaut trialAgent principal ; Claude pour le dur
Platform / DevOps15–25hAPI + runner self-hostedFixes CI, scripts multi-dépôts
Indie maker5–12hGrok Build + Cursor occasionnelPrototypes rapides
Architecte entrepriseRevue-intensiveGit privé + politique routingÉquipe pilote—pas défaut entreprise

9. Lignes rouges combinaisons

  1. Quatre top modèles sur une tâche—dépenses doublées, diffs conflictuels.
  2. Traiter 200k contexte comme gratuit—renvoyer toute l’historique active les tarifs long contexte.
  3. Agents production sans sandbox—Grok écrit avec confiance ; les gates restent en CI.

10. Table de jugement final

QuestionOui → Grok 4.5Non → attendre
≥5 runs agent multi-fichiers/semaine ?Tester Grok 4.5Garder l’incumbent
Facture = trop d’étapes ?Prioriser Grok 4.5Corriger prompts/retrieval d’abord
Besoin 1M+ contexte ?Considérer Kimi K3 / Grok 4.3Ne pas forcer 4.5
Plutôt iOS / macOS natif ?Stabiliser runtime d’abord

11. Trois mythes

Défaut = meilleur pour moi—le défaut Cursor optimise l’utilisateur médian ; votre monorepo Swift+Bazel peut différer.

Prix API bas = facture mensuelle basse—high reasoning + longs prompts + retries s’accumulent. Budgéter par tâche.

Modèle plus fort remplace les tests—UI exécutable ≠ couverture complète des cas limites. CI reste le gate.

12. Essai en sept étapes (une semaine)

  1. Choisir 3 vraies tâches : refactor, fix CI, mini-app greenfield.
  2. Activer logging usage (Cursor ou console API).
  3. Standardiser prompts : commande test, liste interdits, définition de done.
  4. Lancer Grok 4.5 (high) ; retenter tâche 1 en medium.
  5. Lancer un modèle incumbent pour comparaison.
  6. Score : taux succès, temps mergeable, $/tâche, temps fix humain.
  7. Écrire règles routing (ex. « Grok seulement si >3 fichiers » ; résumer avant 150k).

13. Les modèles ont aussi besoin d’un runtime stable

Grok 4.5 optimise l’intelligence par dollar ; builds Xcode et agents longs exigent encore un macOS fiable—laptops en veille, disques pleins et index cassés gaspillent tout modèle.

Pour pipelines macOS distants ou compiles M4 nocturnes dédiés, Mac cloud Macstripe propose Mac Mini dédié à la journée—SSH/VNC, provisioning ~5 minutes. Séparer dépenses agent et runtime build. Parcours débutant : 30 minutes de dev IA sur serveur Mac.

FAQ

Grok 4.5 vs 4.3 ?

Contexte 1M & prix catalogue bas → 4.3. Efficacité agent codage & intégration Cursor → 4.5. La plupart des équipes passent aux trials 4.5 par défaut en Q3 2026.

Combien de temps Grok 4.5 gratuit dans Cursor ?

Consulter pages statut xAI et Cursor—dates de fin bougent. Décider après quota gratuit avec vos données d’usage.

vs Claude Opus / GPT-5 pour le codage ?

Pas de vainqueur universel—Grok 4.5 a utilisé moins d’étapes dans notre sample ; Claude mène encore certaines tâches long reasoning. Tester 15 jobs sur votre dépôt.

Éviter prix 200k ?

Retrieval + résumé ; ne pas renvoyer log git complet et sortie tests chaque tour. Compresser avant 150k.

Conclusion

Grok 4.5 vaut le coup ? Pour les équipes qui facturent agents longs et travail multi-dépôts par tâche—oui, faire une comparaison sérieuse pendant la fenêtre gratuite. Pour complétion légère, conformité stricte ou contexte 1M—ne pas changer les défauts aveuglément. Budgéter par tâche, pas par communiqué—et laisser CI et runtime attraper ce que les modèles manquent.