Séparez d’abord deux lignes : GPT-Live-1 facture $0.05 par minute vocale, GPT-6 Astra facture $10 / $50 par million de tokens (contexte court standard). Empiler le frontal vocal et le backend phare sur la même chaîne par défaut, c’est le geste qui fait exploser la facture Agent.
Trois critères : est-ce que quelqu’un parle, la tâche peut-elle descendre d’un palier, et l’Input d’une requête dépasse-t-il 272K. Les montants sont des estimations d’après la grille publique OpenAI. Rafraîchissez la page officielle avant de commander.
Combien coûtent respectivement GPT-Live-1 et GPT-6 Astra ?
| Poste | GPT-Live-1 | GPT-6 Astra | Comment choisir |
|---|---|---|---|
| Unité principale | $0.05 / minute vocale | $10 Input / $50 Output | Voix = minutes, raisonnement = tokens |
| Input en cache (hit) | Sans objet | $1.00 / million | Ça ne baisse que si le prompt système est fixe |
| Écriture cache | Sans objet | $12.50 / million | L’écriture vaut 1,25× l’Input |
| Batch / Flex | Session temps réel | Environ 50 % du tarif standard | Demi-tarif pour le travail de nuit, pas pour le quotidien |
| Fast / Priority | File d’attente à part | Environ 2× le tarif standard | N’accélérez que le dernier saut |
| Backend / outils | Selon le modèle choisi | Web Search et le reste à part | La couche vocale n’est jamais un forfait tout compris |
Le Batch / Flex d’Astra, c’est $5 / $25. Copier la ligne demi-tarif dans le budget du quotidien, c’est sous-estimer la facture d’environ la moitié. Au-delà de 272K d’Input, toute la requête passe à $20 / $75 — ce n’est pas un surplus seulement sur le dépassement.
Pourquoi ne pas comparer directement les minutes vocales et les tokens ?
Live-1 passe par POST /v1/live/sessions : écoute et parole en même temps, facturation à la seconde, sans arrondi à la minute. La création d’une session WebRTC compte 15 secondes d’initialisation, puis les déduit une fois la session lancée — n’ajoutez pas 15 secondes dans l’estimation.
Astra passe par Responses / Chat Completions, au token. OpenAI recommande de déléguer le raisonnement au backend : couche vocale = Live-1, réflexion et outils = GPT-5.6 Terra ou Luna. Une session, c’est la somme des deux lignes.
| Nom entendu | Budget du quotidien | Ne pas confondre avec |
|---|---|---|
| GPT-Live / Live-1 | $0.05 / minute de couche vocale | Le tarif audio token de gpt-realtime-2.1 |
| GPT-6 / Astra | $10 / $50, contexte court standard | Batch $5/$25, Fast $20/$100 |
| GPT-5.6 Terra / Luna | $2/$12 ou $0.20/$1.20 | Traiter « GPT-5.6 » comme un synonyme d’Astra |
Les endpoints de résidence des données ajoutent environ 10 % pour les modèles éligibles publiés le 5 mars 2026 ou après. En résidence UE, Fast n’est pas disponible sur Astra. Pour les trois grilles en regard, voir Astra vs Fable 5.1 vs Flash.
Combien coûtent 1 million, 10 millions, 100 millions de tokens, et 1 heure de voix ?
Ci-dessous : contexte court standard, sans cache, hors Batch, hors Fast. Ratio Agent courant : 80 % Input / 20 % Output.
| Volume | Astra (80/20) | Terra (80/20) | Luna (80/20) | Verdict |
|---|---|---|---|---|
| 1 million de tokens | $18 | $4.00 | $0.40 | Essai, évaluation |
| 10 millions de tokens | $180 | $40 | $4.00 | Ordre de grandeur d’une semaine intensive |
| 100 millions de tokens | $1,800 | $400 | $40 | Astra pour tout le monde, c’est ici que ça bloque |
| Durée vocale | Couche Live-1 | Lecture |
|---|---|---|
| 90 s | $0.075 | Un appel court |
| 10 min | $0.50 | Une session support complète |
| 1 h | $3.00 | À la seconde : 61 min = $3.05 |
| 40 h / mois | $120 | Sans les tokens backend |
Quelles erreurs de calcul font exploser la facture Agent ?
L’erreur la plus fréquente : prendre une seule « ligne phare », puis multiplier par un flou « quelques millions de tokens par mois ». Ce qui creuse vraiment l’écart, c’est le modèle par défaut, le franchissement de 272K, et une couche vocale laissée ouverte.
| Méthode | Ce que vous sous-estimez | Correction |
|---|---|---|
| Prendre $5/$25 comme tarif Astra du quotidien | C’est Batch/Flex ; un IDE temps réel paie $10/$50 | Budgettez au tarif standard, isolez le demi-tarif |
| Astra à chaque tour + Live-1 toujours ouvert | Minutes et tokens phare se multiplient | Voix = Live-1, backend par défaut = Terra |
| Fourrer tout le dépôt à chaque requête | Au-delà de 272K : 2× Input et 1,5× Output sur toute la requête | Résumez vers le cache ; au-delà, basculez sur Luna |
| Ne multiplier que l’Input, oublier l’Output | L’Output Astra vaut 5× l’Input | Utilisez votre vrai ratio, pas un 50/50 inventé |
Web Search facture environ $10 / 1 000 appels ; le texte récupéré compte aussi en tokens du modèle. Hosted Shell / Code Interpreter se facture à la session conteneur (1 Go ≈ $0.03 / 20 min). Les outils n’apparaissent pas sur la ligne « par million de tokens », mais ils arrivent sur la facture.
Comment estimer une session Agent d’après les tarifs publics ?
C’est un protocole de calcul, pas un test mesuré. Ouvrez la facture ou l’export Usage, et refaites la même addition avec vos chiffres.
- ☐ Notez la durée (secondes), divisez par 60, multipliez par $0.05 ; sans voix, mettez 0
- ☐ Isolez l’ID backend : Astra / Terra / Luna — pas un vague « GPT-6 »
- ☐ Notez à part Input, cache hit, écriture cache, Output
- ☐ Input > 272K ? Si oui, toute la requête au tarif long contexte
- ☐ Fast ou Batch ? Si oui, ×2 ou ×0.5
- ☐ Ajoutez les appels d’outils × le tarif public de l’outil
Total ≈ (secondes voix ÷ 60 × 0.05)
+ Input_M × prix Input du modèle
+ CacheHit_M × prix cache
+ CacheWrite_M × prix écriture
+ Output_M × prix Output du modèle
+ outils
| Exemple (estimation) | Live-1 | Backend | Total |
|---|---|---|---|
| 8 min support + Terra 8K/1.5K | $0.40 | ≈ $0.03 | ≈ $0.43 |
| Idem, backend passé sur Astra | $0.40 | ≈ $0.16 | ≈ $0.56 |
| 8 min + Astra avec 200K de contexte | $0.40 | ≈ $2.20 | ≈ $2.60 |
La troisième ligne, 10 fois par jour, 22 jours : rien que ce mode ≈ $572. Ce n’est pas Live-1 qui coûte cher, c’est « nourrir Astra avec le dépôt à chaque tour ».
Combien coûte un mois d’usage léger, moyen ou lourd ?
Les paliers servent à poser une table que la finance peut discuter — ce ne sont pas des factures internes. Texte : ratio 5:1. Un support vocal ajoute les minutes.
| Palier | Volume supposé | Tout sur Astra | Tout sur Terra | Lecture |
|---|---|---|---|---|
| Léger · texte | 5M in + 1M out | $100 | $22 | Essai perso, petit outil |
| Moyen · texte | 30M in + 6M out | $600 | $132 | Petite équipe : Terra d’abord |
| Lourd · texte | 100M in + 20M out | $2,000 | $440 | Routez avant de mettre tout le monde sur Astra |
| Léger · voix | 20 h + Terra 5M/1M | — | ≈ $82 | $60 minutes + $22 tokens |
| Moyen · voix | 80 h + Terra 20M/4M | — | ≈ $328 | $240 minutes + $88 tokens |
| Lourd · voix | 300 h + Astra 30M/6M | ≈ $1,500 | — | $900 minutes + $600 tokens |
Même palier texte moyen, Luna ≈ $13. L’abonnement (ChatGPT Work / Pro) n’est pas la même facture que l’API : voir tarifs ChatGPT Work.
Faut-il brancher le backend d’un Agent vocal sur Astra ou sur Terra ?
Le départ officiel, c’est GPT-5.6 Terra ; si le coût compte, Luna. Astra reste pour le refactor multi-fichiers, le raisonnement sur long document, l’usage ordinateur — les tâches où un échec se paie en reprise.
| Entrée | Couche vocale | Backend | Verdict |
|---|---|---|---|
| FAQ / rendez-vous / statut | Live-1 | Luna | Par défaut |
| Outils en plusieurs étapes, bon choix de fonction | Live-1 | Terra | Palier de départ officiel |
| Refactor multi-fichiers, longue recherche, usage ordinateur | Voix optionnelle | Astra | N’élevez que ce saut-là |
| Scan de nuit, résumés en lot | Pas de Live-1 | Terra Batch | Demi-tarif, sans occuper un siège temps réel |
| Couper la latence de fin | Live-1 | Terra Fast | 2× le prix, dernier saut seulement |
// Monter selon la tâche, pas selon la marque
if (task.voice) session.model = "gpt-live-1";
if (task.kind === "faq") backend = "gpt-5.6-luna";
else if (task.kind === "tool_agent") backend = "gpt-5.6-terra";
else if (task.kind === "hard_reason") backend = "gpt-6-astra";
If vous construisez un produit vocal, Then Live-1 + Terra, Astra en bouton d’upgrade. If vous construisez un Agent IDE et que chaque tour touche plusieurs fichiers, Then plafonnez Astra au jour, le reste sur Luna. If le contexte frôle souvent 272K, Then résumez avant d’envoyer : ne pariez pas sur la hausse de toute la requête.
gpt-6-astra en backend que si le coût d’une reprise dépasse l’écart de tarif phare.FAQ
Combien coûte l’API GPT-Live-1 ?
Couche vocale au tarif public : $0.05/minute, facturée à la seconde, sans arrondi à la minute. 10 minutes ≈ $0.50. Backend, outils et ligne téléphonique sont à part.
Combien coûte un million de tokens GPT-6 Astra ?
Contexte court standard : Input $10, Output $50, cache hit $1, écriture cache $12.50. Moitié-moitié ≈ $30 ; 80/20 ≈ $18. Pro n’est pas sur cette grille du quotidien.
GPT-Live-1 ou Astra, lequel est plus cher ?
Les unités diffèrent : on ne compare pas minute et token. Sur un court appel, la couche vocale est souvent moins chère que le backend. Dans les paliers de cet article, le plus cher est « Live-1 + Astra à chaque tour + très long contexte ».
Quelle API OpenAI est la moins chère ?
Parmi les paliers comparés ici, GPT-5.6 Luna a le prix public au token le plus bas. Il convient au classement et à la FAQ, pas comme seul moteur de refactor multi-fichiers.
Combien coûte un mois d’API pour un Agent IA ?
D’après le tableau léger / moyen / lourd : texte seul tout sur Astra ≈ $100 / $600 / $2,000. Exportez d’abord vos minutes et vos tokens, puis multipliez par les tarifs publics.
En résumé
Utile si vous devez d’abord lire la minute Live-1 et le token Astra, puis estimer un mois Agent avec la même addition.
Inutile si vous cherchez encore « un palier unique, le moins cher, qui fait tout ». Cette réponse, c’est en général le phare sans routage — donc la ligne la plus chère du tableau.
If l’entrée est vocale, Then Live-1 + Terra/Luna. If l’entrée est du raisonnement dur, Then Astra, et tenez 272K. Ensuite, comparez les trois phares dans Astra vs Fable vs Flash, ou l’abonnement dans tarifs ChatGPT Work. Inutile de sauter de cette grille API vers une page de location de Mac.