Arbeitsplatz zum Schätzen von GPT-Live-1-Sprachminuten und GPT-6-Astra-Tokenpreisen

Zuerst zwei Rechnungen trennen: GPT-Live-1 nimmt $0.05 je Sprachminute, GPT-6 Astra nimmt $10 / $50 je Million Token (Standard, kurzer Kontext). Sprachfront und Flaggschiff-Backend auf derselben Default-Kette — das ist der übliche Grund, warum die Agent-Rechnung explodiert.

Drei Kriterien: Sprechen Sie? Lässt sich die Aufgabe herabstufen? Liegt ein einzelner Input über 272K? Die Zahlen sind Schätzungen nach der öffentlichen OpenAI-Preiskarte; vor der Bestellung die Karte aktualisieren.

Was kosten GPT-Live-1 und GPT-6 Astra jeweils?

Abrechnung GPT-Live-1 GPT-6 Astra Entscheidung
Haupteinheit $0.05 / Sprachminute $10 Input / $50 Output Sprache nach Minuten, Denken nach Token
Cache-Treffer Input entfällt $1.00 / Million Nur bei festem Systemprompt sparen
Cache-Schreiben entfällt $12.50 / Million Schreiben kostet das 1,25-Fache von Input
Batch / Flex Echtzeit-Session etwa halber Standardpreis Nur Übernacht-Jobs zum halben Preis; nicht mit dem Standardtarif in eine Karte mischen
Fast / Priority Queue extra etwa das Doppelte Nur den letzten Sprung beschleunigen
Backend / Tools nach gewähltem Modell extra Web Search u. a. extra Die Sprachschicht ist kein Komplettpreis
Kurzantwort: Live-1 ist die Sprachschicht zu $0.05/Minute; Astra ist das Flaggschiff zu $10/$50 je Million Token. Default „Live-1 + Astra in jeder Runde“ ist in diesem Vergleich am teuersten.

Astra Batch / Flex liegt bei $5 / $25. Wer die Halbpreis-Zeile als Alltagsbudget übernimmt, rechnet den Monat um die Hälfte zu niedrig. Langer Kontext (Input > 272K) setzt den ganzen Auftrag auf $20 / $75 — nicht nur das überschüssige Stück.

Warum lassen sich Sprachminuten und Token nicht direkt vergleichen?

Live-1 läuft über POST /v1/live/sessions: Hören und Sprechen gleichzeitig, sekundengenau, ohne Aufrunden auf volle Minuten. Beim Anlegen einer WebRTC-Session werden 15 Sekunden Initialisierung berechnet und nach dem Start verrechnet — in der Schätzung nicht extra addieren.

Astra läuft über Responses / Chat Completions, nach Token. Die Empfehlung: Denken an ein Backend-Modell delegieren. Sprachschicht bleibt Live-1; Denken und Tools wählen GPT-5.6 Terra oder Luna. Beide Posten zusammen sind eine Session.

Name, den Sie hören Alltagsbudget nach Nicht verwechseln mit
GPT-Live / Live-1 $0.05 / Minute Sprachschicht Audio-Tokenpreis von gpt-realtime-2.1
GPT-6 / Astra $10 / $50 Standard, kurzer Kontext Batch $5/$25, Fast $20/$100
GPT-5.6 Terra / Luna $2/$12 oder $0.20/$1.20 „GPT-5.6“ pauschal als Astra behandeln
Grenze: Realtime 2.1 Audio kostet $32 / $64 je Million; Live-1 rechnet nach Minuten. Bei Sprachprodukten zuerst das SKU klären, dann die Zahlen vergleichen.

Data-Residency-Endpunkte schlagen bei Modellen ab dem 5. März 2026, sofern berechtigt, etwa 10% auf. Unter EU-Residency ist Astra Fast nicht verfügbar. Drei-Anbieter-Preise stehen in Astra vs Fable 5.1 vs Flash.

Was kosten 1 Million, 10 Millionen, 100 Millionen Token und eine Stunde Sprache?

Unten gilt Standard, kurzer Kontext, ohne Cache, ohne Batch, ohne Fast. Typisches Agent-Verhältnis: 80% Input / 20% Output.

Volumen Astra (80/20) Terra (80/20) Luna (80/20) Urteil
1 Million Token $18 $4.00 $0.40 Testlauf, Auswertung
10 Millionen Token $180 $40 $4.00 eine schwere Einzelwoche
100 Millionen Token $1,800 $400 $40 Astra als Team-Default trifft hier zuerst
Sprachdauer Live-1 Sprachschicht Umrechnung
90 Sekunden $0.075 ein kurzer Anruf
10 Minuten $0.50 eine volle Support-Session
1 Stunde $3.00 sekundengenau, 61 Minuten = $3.05
40 Stunden / Monat $120 Backend-Token noch nicht dabei
Aus der Tabelle: 100 Millionen Token nur über Astra etwa $1,800; dieselbe Struktur über Luna etwa $40. Der Unterschied ist Routing, nicht „OpenAI ist plötzlich teuer“.

Welche Rechnungen machen die Agent-Kosten falsch?

Der häufigste Fehler: eine „Flaggschiff-Zeile“ nehmen und mit einem vagen „ein paar Millionen Token im Monat“ multiplizieren. Den Abstand machen Default-Modell, ob der Kontext 272K überschreitet, und ob die Sprachschicht dauerhaft offen bleibt.

Rechnung Was Sie unterschätzen Korrektur
$5/$25 als Astra-Alltagspreis Das ist Batch/Flex; die Echtzeit-IDE läuft $10/$50 Budget mit Standardpreis; Halbpreis extra führen
Default: Astra jede Runde + Live-1 dauerhaft an Minutenpreis und Flaggschiff-Token multiplizieren sich Sprache über Live-1, Backend-Default Terra
Jedes Mal das ganze Repo in den Kontext Über 272K: ganzer Auftrag 2× Input, 1,5× Output Zusammenfassung in den Cache, über dem Limit auf Luna
Nur Input multiplizieren, Output vergessen Astra-Output ist das Fünffache von Input Eigenes Ein-/Aus-Verhältnis, kein 50/50 aus dem Bauch

Web Search kostet extra etwa $10 / 1.000 Aufrufe; der abgerufene Text läuft weiter über Modell-Token. Hosted Shell / Code Interpreter rechnet nach Container-Session (1 GB etwa $0.03 / 20 Minuten). Tool-Gebühren stehen nicht in der „je Million Token“-Zeile, landen aber auf der Rechnung.

Falscher Satz: „Live-1 kostet nur fünf Cent“ lässt das Backend weg; „Astra kostet nur zehn Dollar je Million“ lässt Output, langen Kontext und Fast weg.

Wie schätzt man eine Agent-Session nach Listenpreis?

Das ist ein Rechenprotokoll, kein Messprotokoll. Rechnung oder Usage-Export öffnen und dieselben Summanden gegen die eigenen Zahlen halten.

  • ☐ Sessiondauer in Sekunden notieren, durch 60 teilen, mal $0.05; ohne Sprache 0 eintragen
  • ☐ Backend-Modell-ID trennen: Astra / Terra / Luna — nicht „GPT-6“ schreiben
  • ☐ Input, Cache-Treffer, Cache-Schreiben, Output getrennt notieren
  • ☐ Input > 272K? Dann gilt der Lange-Kontext-Preis für den ganzen Auftrag
  • ☐ Fast oder Batch? Dann ×2 oder ×0.5
  • ☐ Tool-Aufrufe × Listenpreis der Tools addieren
Gesamt ≈ (Sprachsekunden ÷ 60 × 0.05)
     + Input_M × Modell-Inputpreis
     + CacheHit_M × Cachepreis
     + CacheWrite_M × Schreibpreis
     + Output_M × Modell-Outputpreis
     + Toolgebühren
Beispiel (Schätzung) Live-1 Backend Summe
8 Minuten Support + Terra 8K/1.5K $0.40 etwa $0.03 etwa $0.43
dasselbe, Backend Astra $0.40 etwa $0.16 etwa $0.56
8 Minuten + Astra mit 200K Kontext $0.40 etwa $2.20 etwa $2.60

Zeile drei, 10-mal am Tag, 22 Tage im Monat: allein dieses Muster etwa $572. Teuer ist nicht Live-1, sondern „jede Runde das Repo an Astra füttern“.

Protokoll in einem Satz: Minutenpreis und Tokenpreis getrennt multiplizieren, dann addieren. Keine Bauchkonstante „ein Gespräch = ein Dollar“.

Was kosten leichte, mittlere und schwere Nutzung im Monat?

Die Stufen sollen der Finanzabteilung eine sprechbare Tabelle geben, keine interne Rechnung. Reiner Text im Verhältnis 5:1 Ein/Aus; Sprach-Support addiert Minuten.

Stufe Annahme Nur Astra Nur Terra So lesen
Leicht · Text 5M in + 1M out $100 $22 Einzeltest, kleines Tool
Mittel · Text 30M in + 6M out $600 $132 kleines Team kann zuerst Terra defaulten
Schwer · Text 100M in + 20M out $2,000 $440 vor Astra für alle erst Routing setzen
Leicht · Sprache 20 Stunden + Terra 5M/1M etwa $82 $60 Minuten + $22 Token
Mittel · Sprache 80 Stunden + Terra 20M/4M etwa $328 $240 Minuten + $88 Token
Schwer · Sprache 300 Stunden + Astra 30M/6M etwa $1,500 $900 Minuten + $600 Token

Derselbe mittlere Text über Luna etwa $13. Abo-Schicht (ChatGPT Work / Pro) und API sind nicht dieselbe Rechnung; der Vergleich steht in ChatGPT-Work-Preise.

So lesen: Leicht darf komplett über Astra testen; ab Mittel entscheidet das Default-Modell den Monatsbetrag stärker als „Prompts noch etwas kürzen“.

Soll der Sprach-Agent hinten an Astra oder Terra?

Der offizielle Start ist GPT-5.6 Terra; kostenempfindlich Luna. Astra bleibt für Refactoring über Dateigrenzen, langes Dokumentdenken und Computer Use — Arbeit, die falsch gemacht teurer nachgearbeitet wird als der Flaggschiff-Aufpreis.

Einstieg Sprachschicht Backend Urteil
FAQ / Termin / Status Live-1 Luna so defaulten
Mehrschritt-Tools, Funktionen müssen sitzen Live-1 Terra offizielle Startstufe
Code über Dateien, lange Recherche, Computer Use Sprache darf aus Astra nur diesen Sprung aufs Flaggschiff
Übernacht-Scan, Batch-Zusammenfassungen kein Live-1 Terra Batch halber Preis, kein Echtzeit-Platz
Tail-Latenz drücken Live-1 Terra Fast doppelter Preis, nur den letzten Sprung
// Nach Aufgabe hochstufen, nicht nach Marke
if (task.voice) session.model = "gpt-live-1";
if (task.kind === "faq") backend = "gpt-5.6-luna";
else if (task.kind === "tool_agent") backend = "gpt-5.6-terra";
else if (task.kind === "hard_reason") backend = "gpt-6-astra";

If Sie ein Sprachprodukt bauen, Then Live-1 + Terra, Astra als Upgrade-Taste. If Sie einen IDE-Agenten bauen und jede Runde mehrere Dateien berühren, Then setzen Sie für Astra ein Tageslimit, Routine läuft über Luna. If der Kontext oft nahe 272K liegt, Then zuerst zusammenfassen, nicht auf die Ganzauftrag-Preiserhöhung wetten.

If→Then: Herabstufen, wo es geht. Das Backend nur dann auf gpt-6-astra setzen, wenn Nacharbeit teurer ist als der Flaggschiff-Aufpreis.

Häufige Fragen FAQ

Was kostet die GPT-Live-1 API?

Die Sprachschicht kostet laut Listenpreis $0.05/Minute, sekundengenau, ohne Aufrunden. 10 Minuten etwa $0.50. Backend-Modell, Tools und Telefonleitung extra.

Was kostet eine Million GPT-6-Astra-Token?

Standard, kurzer Kontext: Input $10, Output $50, Cache-Treffer $1, Cache-Schreiben $12.50. Halb/halb etwa $30; 80/20 etwa $18. Pro steht nicht in dieser Alltagstabelle.

Ist GPT-Live-1 oder Astra teurer?

Die Einheiten sind verschieden, ein Direktvergleich geht nicht. Bei kurzen Gesprächen ist die Sprachschicht oft billiger als das Backend. Am teuersten in diesem Vergleich: „Live-1 + Astra in jeder Runde + sehr langer Kontext“.

Welche OpenAI-API-Stufe ist am günstigsten?

In den hier verglichenen Stufen hat GPT-5.6 Luna den niedrigsten öffentlichen Token-Preis. Geeignet für Klassifikation und FAQ, nicht als einzige Engine für Refactoring über Dateigrenzen.

Was kostet ein AI-Agent an API im Monat?

Nach der Tabelle oben, leicht/mittel/schwer: reiner Text nur über Astra etwa $100 / $600 / $2,000. Zuerst eigene Minuten und Token exportieren, dann mit dem Listenpreis multiplizieren.

Fazit

Geeignet, wenn Sie Live-1-Minuten und Astra-Token zuerst verstehen und mit derselben Addition die Agent-Monatskosten schätzen wollen.

Nicht geeignet, wenn Sie weiter nach „einem günstigsten Alleskönner“ suchen. Die Antwort ist meist das ungeroutete Flaggschiff-Default — die teuerste Zeile in der Tabelle.

If der Einstieg Sprache ist, Then Live-1 + Terra/Luna. If der Einstieg hartes Denken ist, Then Astra, und 272K halten. Der Drei-Anbieter-Vergleich steht in Astra vs Fable vs Flash, die Abo-Schicht in ChatGPT-Work-Preise. Von dieser API-Tabelle muss niemand in eine Mietseite springen.