Bureau d’estimation : minutes vocales GPT-Live-1 face aux tokens GPT-6 Astra

Séparez d’abord deux lignes : GPT-Live-1 facture $0.05 par minute vocale, GPT-6 Astra facture $10 / $50 par million de tokens (contexte court standard). Empiler le frontal vocal et le backend phare sur la même chaîne par défaut, c’est le geste qui fait exploser la facture Agent.

Trois critères : est-ce que quelqu’un parle, la tâche peut-elle descendre d’un palier, et l’Input d’une requête dépasse-t-il 272K. Les montants sont des estimations d’après la grille publique OpenAI. Rafraîchissez la page officielle avant de commander.

Combien coûtent respectivement GPT-Live-1 et GPT-6 Astra ?

Poste GPT-Live-1 GPT-6 Astra Comment choisir
Unité principale $0.05 / minute vocale $10 Input / $50 Output Voix = minutes, raisonnement = tokens
Input en cache (hit) Sans objet $1.00 / million Ça ne baisse que si le prompt système est fixe
Écriture cache Sans objet $12.50 / million L’écriture vaut 1,25× l’Input
Batch / Flex Session temps réel Environ 50 % du tarif standard Demi-tarif pour le travail de nuit, pas pour le quotidien
Fast / Priority File d’attente à part Environ 2× le tarif standard N’accélérez que le dernier saut
Backend / outils Selon le modèle choisi Web Search et le reste à part La couche vocale n’est jamais un forfait tout compris
En bref : Live-1 est la couche vocale à $0.05/min ; Astra est le token phare à $10/$50. « Live-1 + Astra à chaque tour » est, dans les paliers de cet article, la combinaison la plus chère.

Le Batch / Flex d’Astra, c’est $5 / $25. Copier la ligne demi-tarif dans le budget du quotidien, c’est sous-estimer la facture d’environ la moitié. Au-delà de 272K d’Input, toute la requête passe à $20 / $75 — ce n’est pas un surplus seulement sur le dépassement.

Pourquoi ne pas comparer directement les minutes vocales et les tokens ?

Live-1 passe par POST /v1/live/sessions : écoute et parole en même temps, facturation à la seconde, sans arrondi à la minute. La création d’une session WebRTC compte 15 secondes d’initialisation, puis les déduit une fois la session lancée — n’ajoutez pas 15 secondes dans l’estimation.

Astra passe par Responses / Chat Completions, au token. OpenAI recommande de déléguer le raisonnement au backend : couche vocale = Live-1, réflexion et outils = GPT-5.6 Terra ou Luna. Une session, c’est la somme des deux lignes.

Nom entendu Budget du quotidien Ne pas confondre avec
GPT-Live / Live-1 $0.05 / minute de couche vocale Le tarif audio token de gpt-realtime-2.1
GPT-6 / Astra $10 / $50, contexte court standard Batch $5/$25, Fast $20/$100
GPT-5.6 Terra / Luna $2/$12 ou $0.20/$1.20 Traiter « GPT-5.6 » comme un synonyme d’Astra
Seuil : l’audio Realtime 2.1 est à $32 / $64 par million ; Live-1 est passé à la minute. Sur un produit vocal, alignez d’abord le SKU, ensuite les chiffres.

Les endpoints de résidence des données ajoutent environ 10 % pour les modèles éligibles publiés le 5 mars 2026 ou après. En résidence UE, Fast n’est pas disponible sur Astra. Pour les trois grilles en regard, voir Astra vs Fable 5.1 vs Flash.

Combien coûtent 1 million, 10 millions, 100 millions de tokens, et 1 heure de voix ?

Ci-dessous : contexte court standard, sans cache, hors Batch, hors Fast. Ratio Agent courant : 80 % Input / 20 % Output.

Volume Astra (80/20) Terra (80/20) Luna (80/20) Verdict
1 million de tokens $18 $4.00 $0.40 Essai, évaluation
10 millions de tokens $180 $40 $4.00 Ordre de grandeur d’une semaine intensive
100 millions de tokens $1,800 $400 $40 Astra pour tout le monde, c’est ici que ça bloque
Durée vocale Couche Live-1 Lecture
90 s $0.075 Un appel court
10 min $0.50 Une session support complète
1 h $3.00 À la seconde : 61 min = $3.05
40 h / mois $120 Sans les tokens backend
Lecture : 100 millions de tokens tout sur Astra ≈ $1,800 ; même structure sur Luna ≈ $40. L’écart vient du routage, pas d’un « OpenAI soudainement cher ».

Quelles erreurs de calcul font exploser la facture Agent ?

L’erreur la plus fréquente : prendre une seule « ligne phare », puis multiplier par un flou « quelques millions de tokens par mois ». Ce qui creuse vraiment l’écart, c’est le modèle par défaut, le franchissement de 272K, et une couche vocale laissée ouverte.

Méthode Ce que vous sous-estimez Correction
Prendre $5/$25 comme tarif Astra du quotidien C’est Batch/Flex ; un IDE temps réel paie $10/$50 Budgettez au tarif standard, isolez le demi-tarif
Astra à chaque tour + Live-1 toujours ouvert Minutes et tokens phare se multiplient Voix = Live-1, backend par défaut = Terra
Fourrer tout le dépôt à chaque requête Au-delà de 272K : 2× Input et 1,5× Output sur toute la requête Résumez vers le cache ; au-delà, basculez sur Luna
Ne multiplier que l’Input, oublier l’Output L’Output Astra vaut 5× l’Input Utilisez votre vrai ratio, pas un 50/50 inventé

Web Search facture environ $10 / 1 000 appels ; le texte récupéré compte aussi en tokens du modèle. Hosted Shell / Code Interpreter se facture à la session conteneur (1 Go ≈ $0.03 / 20 min). Les outils n’apparaissent pas sur la ligne « par million de tokens », mais ils arrivent sur la facture.

Erreur typique : « Live-1, ce n’est que cinq cents » oublie le backend ; « Astra, ce n’est que dix dollars le million » oublie l’Output, le long contexte et Fast.

Comment estimer une session Agent d’après les tarifs publics ?

C’est un protocole de calcul, pas un test mesuré. Ouvrez la facture ou l’export Usage, et refaites la même addition avec vos chiffres.

  • ☐ Notez la durée (secondes), divisez par 60, multipliez par $0.05 ; sans voix, mettez 0
  • ☐ Isolez l’ID backend : Astra / Terra / Luna — pas un vague « GPT-6 »
  • ☐ Notez à part Input, cache hit, écriture cache, Output
  • ☐ Input > 272K ? Si oui, toute la requête au tarif long contexte
  • ☐ Fast ou Batch ? Si oui, ×2 ou ×0.5
  • ☐ Ajoutez les appels d’outils × le tarif public de l’outil
Total ≈ (secondes voix ÷ 60 × 0.05)
     + Input_M × prix Input du modèle
     + CacheHit_M × prix cache
     + CacheWrite_M × prix écriture
     + Output_M × prix Output du modèle
     + outils
Exemple (estimation) Live-1 Backend Total
8 min support + Terra 8K/1.5K $0.40 ≈ $0.03 ≈ $0.43
Idem, backend passé sur Astra $0.40 ≈ $0.16 ≈ $0.56
8 min + Astra avec 200K de contexte $0.40 ≈ $2.20 ≈ $2.60

La troisième ligne, 10 fois par jour, 22 jours : rien que ce mode ≈ $572. Ce n’est pas Live-1 qui coûte cher, c’est « nourrir Astra avec le dépôt à chaque tour ».

Protocole : multipliez minutes et tokens à part, puis additionnez. Évitez la constante au doigt mouillé « un appel = un dollar ».

Combien coûte un mois d’usage léger, moyen ou lourd ?

Les paliers servent à poser une table que la finance peut discuter — ce ne sont pas des factures internes. Texte : ratio 5:1. Un support vocal ajoute les minutes.

Palier Volume supposé Tout sur Astra Tout sur Terra Lecture
Léger · texte 5M in + 1M out $100 $22 Essai perso, petit outil
Moyen · texte 30M in + 6M out $600 $132 Petite équipe : Terra d’abord
Lourd · texte 100M in + 20M out $2,000 $440 Routez avant de mettre tout le monde sur Astra
Léger · voix 20 h + Terra 5M/1M ≈ $82 $60 minutes + $22 tokens
Moyen · voix 80 h + Terra 20M/4M ≈ $328 $240 minutes + $88 tokens
Lourd · voix 300 h + Astra 30M/6M ≈ $1,500 $900 minutes + $600 tokens

Même palier texte moyen, Luna ≈ $13. L’abonnement (ChatGPT Work / Pro) n’est pas la même facture que l’API : voir tarifs ChatGPT Work.

Lecture : le palier léger peut tout tester sur Astra ; dès le palier moyen, le modèle par défaut pèse plus que « encore un peu moins de prompt ».

Faut-il brancher le backend d’un Agent vocal sur Astra ou sur Terra ?

Le départ officiel, c’est GPT-5.6 Terra ; si le coût compte, Luna. Astra reste pour le refactor multi-fichiers, le raisonnement sur long document, l’usage ordinateur — les tâches où un échec se paie en reprise.

Entrée Couche vocale Backend Verdict
FAQ / rendez-vous / statut Live-1 Luna Par défaut
Outils en plusieurs étapes, bon choix de fonction Live-1 Terra Palier de départ officiel
Refactor multi-fichiers, longue recherche, usage ordinateur Voix optionnelle Astra N’élevez que ce saut-là
Scan de nuit, résumés en lot Pas de Live-1 Terra Batch Demi-tarif, sans occuper un siège temps réel
Couper la latence de fin Live-1 Terra Fast 2× le prix, dernier saut seulement
// Monter selon la tâche, pas selon la marque
if (task.voice) session.model = "gpt-live-1";
if (task.kind === "faq") backend = "gpt-5.6-luna";
else if (task.kind === "tool_agent") backend = "gpt-5.6-terra";
else if (task.kind === "hard_reason") backend = "gpt-6-astra";

If vous construisez un produit vocal, Then Live-1 + Terra, Astra en bouton d’upgrade. If vous construisez un Agent IDE et que chaque tour touche plusieurs fichiers, Then plafonnez Astra au jour, le reste sur Luna. If le contexte frôle souvent 272K, Then résumez avant d’envoyer : ne pariez pas sur la hausse de toute la requête.

If→Then : descendez d’un palier dès que c’est possible ; n’écrivez gpt-6-astra en backend que si le coût d’une reprise dépasse l’écart de tarif phare.

FAQ

Combien coûte l’API GPT-Live-1 ?

Couche vocale au tarif public : $0.05/minute, facturée à la seconde, sans arrondi à la minute. 10 minutes ≈ $0.50. Backend, outils et ligne téléphonique sont à part.

Combien coûte un million de tokens GPT-6 Astra ?

Contexte court standard : Input $10, Output $50, cache hit $1, écriture cache $12.50. Moitié-moitié ≈ $30 ; 80/20 ≈ $18. Pro n’est pas sur cette grille du quotidien.

GPT-Live-1 ou Astra, lequel est plus cher ?

Les unités diffèrent : on ne compare pas minute et token. Sur un court appel, la couche vocale est souvent moins chère que le backend. Dans les paliers de cet article, le plus cher est « Live-1 + Astra à chaque tour + très long contexte ».

Quelle API OpenAI est la moins chère ?

Parmi les paliers comparés ici, GPT-5.6 Luna a le prix public au token le plus bas. Il convient au classement et à la FAQ, pas comme seul moteur de refactor multi-fichiers.

Combien coûte un mois d’API pour un Agent IA ?

D’après le tableau léger / moyen / lourd : texte seul tout sur Astra ≈ $100 / $600 / $2,000. Exportez d’abord vos minutes et vos tokens, puis multipliez par les tarifs publics.

En résumé

Utile si vous devez d’abord lire la minute Live-1 et le token Astra, puis estimer un mois Agent avec la même addition.

Inutile si vous cherchez encore « un palier unique, le moins cher, qui fait tout ». Cette réponse, c’est en général le phare sans routage — donc la ligne la plus chère du tableau.

If l’entrée est vocale, Then Live-1 + Terra/Luna. If l’entrée est du raisonnement dur, Then Astra, et tenez 272K. Ensuite, comparez les trois phares dans Astra vs Fable vs Flash, ou l’abonnement dans tarifs ChatGPT Work. Inutile de sauter de cette grille API vers une page de location de Mac.