Si vous arrivez via « prix API GPT-6 » ou « coût par million de tokens », vous voulez d’abord un tableau pour la finance — pas un classement en 15 chapitres. Les pages de comparaison séparent Input, Output, cache et Batch : un débutant ne voit pas quel SKU il achète.
En septembre 2026, l’écart public est déjà large : un fleuron peut coûter environ 50 fois un palier volume. Lisez les chiffres, puis décidez du routage.
Tous les montants sont des estimations à partir des tarifs publics au 2026-09-10. Rafraîchissez les cartes avant d’acheter. Ce n’est pas un classement, et nous n’utilisons pas de factures internes non publiées.
1. Tableau des prix API 2026
Tout en USD / million de tokens. Astra est le fleuron public GPT-6, pas Pro. Fable 5.1 est la révision coding / Agent. Flash est le SKU volume de Google.
| Poste (au 2026-09-10) | GPT-6 Astra | Claude Fable 5.1 | Gemini 3.8 Flash |
|---|---|---|---|
| Input | $5.00 | $6.00 | $0.10 |
| Output | $20.00 | $30.00 | $0.40 |
| Input cache touché | $0.50 | $0.60 | $0.01 |
| Batch (hors temps réel) | ~50 % | ~50 % | ~50 % |
2. Comment chacun facture
Alignez le SKU avant de croire une capture. « GPT-6 » est presque toujours Astra ; Pro est une autre carte, plus chère. Fable 5 a disparu de certains IDE : mettez 5.1 dans la config, pas dans une constante. Contexte : Fable 5 et l’infra Agent.
| Nom affiché | Budgeter contre | Ne pas confondre |
|---|---|---|
| GPT-6 / Astra | Astra : $5 / $20 | GPT-6 Pro, distillats bon marché |
| Claude Fable 5.1 | Fable 5.1 : $6 / $30 | Ancien Fable 5, classe Haiku |
| Gemini 3.8 Flash | Flash : $0.10 / $0.40 | Fleuron Gemini / deep-think |
L’Input est ce que vous envoyez, l’Output ce qui revient — souvent 4 à 5× plus cher. Un cache touché vaut environ 1/10 de l’Input. Le Batch sert aux jobs qui peuvent attendre la nuit. Les sièges sont une autre facture : coût du coding IA 2026.
3. Combien coûtent 1 M, 10 M et 100 M de tokens
Extrapolation linéaire des cartes publiques (hors taxe, hors passerelle). Ici « 100 M » = 100 M Input + 20 M Output — proche d’un mois d’équipe à intensité moyenne.
| Usage (estimation) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 1 M In + 1 M Out | $25 | $36 | $0.50 |
| 10 M In + 2 M Out | $90 | $120 | $1.80 |
| 100 M In + 20 M Out | $900 | $1,200 | $18 |
| 30 M In + 6 M Out / mois | ~$270 | ~$360 | ~$5.40 |
Si 70 % de l’Input touche le cache, le même mois tombe vers $176 / $247 / $3.50. Un miss paie l’Input plein tarif.
4. Combien coûte un passage coding
Un « review » ≈ 80k Input + 8k Output. C’est de l’arithmétique de liste, pas une facture de labo.
| Un review (estimation) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 80k In + 8k Out | ~$0.56 | ~$0.72 | ~$0.011 |
Le même travail depuis un Agent IDE réinjecte souvent règles et arbre : les tokens peuvent ×2 ou ×3. Relancez dix fois dans votre dépôt, prenez la moyenne, multipliez.
5. Coding, API et CI
Un tarif bas ne compile pas le projet. Choisissez le défaut selon d’où part la requête.
| Travail | Meilleur défaut | Secours | Pas en défaut |
|---|---|---|---|
| IDE / Agent, plusieurs fichiers | Fable 5.1 | Astra | Flash seul pour un gros refactor |
| Discussion produit, multimodal | Astra | Fable 5.1 | Flash comme seul cerveau |
| Logs CI, classer, résumer, traduire | Flash | Astra Batch | Fable sur chaque dépôt la nuit |
| Garder le mois à deux chiffres $ | Flash + promotion ciblée | Astra + cache | Trois fleurons en parallèle |
Appels d’outils Gemini : Agent Gemini 2026. Bande GPT-6 : prévision prix API GPT-6.
6. Réduire la facture
- ☐ Défaut Flash ou « auto » ; n’élever que multi-fichiers / build cassé
- ☐ Mettre en cache le prompt système et le résumé du dépôt
- ☐ Plafonds journaliers Astra / Fable ; ne pas monter silencieusement vers Pro
- ☐ Jobs de nuit en Batch, pas dans une boucle IDE fleuron
- ☐ IDs de modèle dans la config, repli Flash
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";
Un routeur réduit les SDK. Il ne réduit pas l’argent si le défaut tape encore le SKU cher.
7. Comment choisir
| Situation | Départ |
|---|---|
| Étudiant / indie, déjà chez Google | Flash d’abord ; Astra seulement pour l’inférence lourde |
| Agent tous les jours, beaucoup de fichiers | Quota Fable 5.1 ; Flash pour le menu fretin |
| Expliquer le mois à la finance | Remplacer §3 par vos tokens |
Une phrase : Flash est bon marché et rapide, Fable 5.1 fait passer le correctif, Astra explique le plan. Empiler les trois sur un seul défaut fait exploser la facture.
FAQ
Combien coûte 1 million de tokens GPT-6 ?
Carte Astra au 2026-09-10 : 1 M Input = $5, 1 M Output = $20. Moitié-moitié ≈ $12.50. Pro n’est pas sur ce tableau quotidien.
Input ou Output, lequel est plus cher ?
Output, chez les trois : ≈ 4× Astra / Flash, 5× Fable. Les longues régénérations coûtent plus que les longs prompts.
Comment le cache est-il facturé ?
Input touché ≈ 1/10 ($0.50 / $0.60 / $0.01 par million). Un miss paie le plein tarif.
La moins chère de ces trois API ?
Gemini 3.8 Flash sur les cartes publiques. Pour classer, résumer, la CI — pas comme seul moteur de gros refactor.
Combien coûte un mois de coding IA ?
Ligne 30 M + 6 M : ~$270 Astra seul, ~$360 Fable seul, ~$5.40 Flash seul. Les équipes mélangent. Mesurez vos tokens, puis multipliez.
Conclusion
Pour vous si vous voulez les tarifs publics de septembre 2026 et une estimation mensuelle ouverte.
Pas pour vous si vous cherchez un seul « meilleur » champion. C’est en général le fleuron sans routage — la ligne la plus chère.
Tarifs sièges : coût du coding IA ou offres ChatGPT. Si la vraie question est Xcode ou un Agent local, lisez ce cluster — ce tableau n’a pas besoin de sauter vers une commande Mac.