Grilles tarifaires API GPT-6 Astra, Claude Fable 5.1 et Gemini 3.8 Flash

Si vous arrivez via « prix API GPT-6 » ou « coût par million de tokens », vous voulez d’abord un tableau pour la finance — pas un classement en 15 chapitres. Les pages de comparaison séparent Input, Output, cache et Batch : un débutant ne voit pas quel SKU il achète.

En septembre 2026, l’écart public est déjà large : un fleuron peut coûter environ 50 fois un palier volume. Lisez les chiffres, puis décidez du routage.

Tous les montants sont des estimations à partir des tarifs publics au 2026-09-10. Rafraîchissez les cartes avant d’acheter. Ce n’est pas un classement, et nous n’utilisons pas de factures internes non publiées.

1. Tableau des prix API 2026

Tout en USD / million de tokens. Astra est le fleuron public GPT-6, pas Pro. Fable 5.1 est la révision coding / Agent. Flash est le SKU volume de Google.

Poste (au 2026-09-10)GPT-6 AstraClaude Fable 5.1Gemini 3.8 Flash
Input$5.00$6.00$0.10
Output$20.00$30.00$0.40
Input cache touché$0.50$0.60$0.01
Batch (hors temps réel)~50 %~50 %~50 %
Réponse en 5 secondes : si la qualité volume suffit, Flash est en général le moins cher. Un défaut fleuron sans routage est l’habitude coûteuse.

2. Comment chacun facture

Alignez le SKU avant de croire une capture. « GPT-6 » est presque toujours Astra ; Pro est une autre carte, plus chère. Fable 5 a disparu de certains IDE : mettez 5.1 dans la config, pas dans une constante. Contexte : Fable 5 et l’infra Agent.

Nom affichéBudgeter contreNe pas confondre
GPT-6 / AstraAstra : $5 / $20GPT-6 Pro, distillats bon marché
Claude Fable 5.1Fable 5.1 : $6 / $30Ancien Fable 5, classe Haiku
Gemini 3.8 FlashFlash : $0.10 / $0.40Fleuron Gemini / deep-think

L’Input est ce que vous envoyez, l’Output ce qui revient — souvent 4 à 5× plus cher. Un cache touché vaut environ 1/10 de l’Input. Le Batch sert aux jobs qui peuvent attendre la nuit. Les sièges sont une autre facture : coût du coding IA 2026.

3. Combien coûtent 1 M, 10 M et 100 M de tokens

Extrapolation linéaire des cartes publiques (hors taxe, hors passerelle). Ici « 100 M » = 100 M Input + 20 M Output — proche d’un mois d’équipe à intensité moyenne.

Usage (estimation)AstraFable 5.1Flash
1 M In + 1 M Out$25$36$0.50
10 M In + 2 M Out$90$120$1.80
100 M In + 20 M Out$900$1,200$18
30 M In + 6 M Out / mois~$270~$360~$5.40

Si 70 % de l’Input touche le cache, le même mois tombe vers $176 / $247 / $3.50. Un miss paie l’Input plein tarif.

4. Combien coûte un passage coding

Un « review » ≈ 80k Input + 8k Output. C’est de l’arithmétique de liste, pas une facture de labo.

Un review (estimation)AstraFable 5.1Flash
80k In + 8k Out~$0.56~$0.72~$0.011

Le même travail depuis un Agent IDE réinjecte souvent règles et arbre : les tokens peuvent ×2 ou ×3. Relancez dix fois dans votre dépôt, prenez la moyenne, multipliez.

Formule : coût ≈ (millions Input × tarif) + (millions Output × tarif).

5. Coding, API et CI

Un tarif bas ne compile pas le projet. Choisissez le défaut selon d’où part la requête.

TravailMeilleur défautSecoursPas en défaut
IDE / Agent, plusieurs fichiersFable 5.1AstraFlash seul pour un gros refactor
Discussion produit, multimodalAstraFable 5.1Flash comme seul cerveau
Logs CI, classer, résumer, traduireFlashAstra BatchFable sur chaque dépôt la nuit
Garder le mois à deux chiffres $Flash + promotion cibléeAstra + cacheTrois fleurons en parallèle

Appels d’outils Gemini : Agent Gemini 2026. Bande GPT-6 : prévision prix API GPT-6.

6. Réduire la facture

  • ☐ Défaut Flash ou « auto » ; n’élever que multi-fichiers / build cassé
  • ☐ Mettre en cache le prompt système et le résumé du dépôt
  • ☐ Plafonds journaliers Astra / Fable ; ne pas monter silencieusement vers Pro
  • ☐ Jobs de nuit en Batch, pas dans une boucle IDE fleuron
  • ☐ IDs de modèle dans la config, repli Flash
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";

Un routeur réduit les SDK. Il ne réduit pas l’argent si le défaut tape encore le SKU cher.

7. Comment choisir

SituationDépart
Étudiant / indie, déjà chez GoogleFlash d’abord ; Astra seulement pour l’inférence lourde
Agent tous les jours, beaucoup de fichiersQuota Fable 5.1 ; Flash pour le menu fretin
Expliquer le mois à la financeRemplacer §3 par vos tokens

Une phrase : Flash est bon marché et rapide, Fable 5.1 fait passer le correctif, Astra explique le plan. Empiler les trois sur un seul défaut fait exploser la facture.

FAQ

Combien coûte 1 million de tokens GPT-6 ?

Carte Astra au 2026-09-10 : 1 M Input = $5, 1 M Output = $20. Moitié-moitié ≈ $12.50. Pro n’est pas sur ce tableau quotidien.

Input ou Output, lequel est plus cher ?

Output, chez les trois : ≈ 4× Astra / Flash, 5× Fable. Les longues régénérations coûtent plus que les longs prompts.

Comment le cache est-il facturé ?

Input touché ≈ 1/10 ($0.50 / $0.60 / $0.01 par million). Un miss paie le plein tarif.

La moins chère de ces trois API ?

Gemini 3.8 Flash sur les cartes publiques. Pour classer, résumer, la CI — pas comme seul moteur de gros refactor.

Combien coûte un mois de coding IA ?

Ligne 30 M + 6 M : ~$270 Astra seul, ~$360 Fable seul, ~$5.40 Flash seul. Les équipes mélangent. Mesurez vos tokens, puis multipliez.

Conclusion

Pour vous si vous voulez les tarifs publics de septembre 2026 et une estimation mensuelle ouverte.

Pas pour vous si vous cherchez un seul « meilleur » champion. C’est en général le fleuron sans routage — la ligne la plus chère.

Tarifs sièges : coût du coding IA ou offres ChatGPT. Si la vraie question est Xcode ou un Agent local, lisez ce cluster — ce tableau n’a pas besoin de sauter vers une commande Mac.