Zuerst zwei Rechnungen trennen: GPT-Live-1 nimmt $0.05 je Sprachminute, GPT-6 Astra nimmt $10 / $50 je Million Token (Standard, kurzer Kontext). Sprachfront und Flaggschiff-Backend auf derselben Default-Kette — das ist der übliche Grund, warum die Agent-Rechnung explodiert.
Drei Kriterien: Sprechen Sie? Lässt sich die Aufgabe herabstufen? Liegt ein einzelner Input über 272K? Die Zahlen sind Schätzungen nach der öffentlichen OpenAI-Preiskarte; vor der Bestellung die Karte aktualisieren.
Was kosten GPT-Live-1 und GPT-6 Astra jeweils?
| Abrechnung | GPT-Live-1 | GPT-6 Astra | Entscheidung |
|---|---|---|---|
| Haupteinheit | $0.05 / Sprachminute | $10 Input / $50 Output | Sprache nach Minuten, Denken nach Token |
| Cache-Treffer Input | entfällt | $1.00 / Million | Nur bei festem Systemprompt sparen |
| Cache-Schreiben | entfällt | $12.50 / Million | Schreiben kostet das 1,25-Fache von Input |
| Batch / Flex | Echtzeit-Session | etwa halber Standardpreis | Nur Übernacht-Jobs zum halben Preis; nicht mit dem Standardtarif in eine Karte mischen |
| Fast / Priority | Queue extra | etwa das Doppelte | Nur den letzten Sprung beschleunigen |
| Backend / Tools | nach gewähltem Modell extra | Web Search u. a. extra | Die Sprachschicht ist kein Komplettpreis |
Astra Batch / Flex liegt bei $5 / $25. Wer die Halbpreis-Zeile als Alltagsbudget übernimmt, rechnet den Monat um die Hälfte zu niedrig. Langer Kontext (Input > 272K) setzt den ganzen Auftrag auf $20 / $75 — nicht nur das überschüssige Stück.
Warum lassen sich Sprachminuten und Token nicht direkt vergleichen?
Live-1 läuft über POST /v1/live/sessions: Hören und Sprechen gleichzeitig, sekundengenau, ohne Aufrunden auf volle Minuten. Beim Anlegen einer WebRTC-Session werden 15 Sekunden Initialisierung berechnet und nach dem Start verrechnet — in der Schätzung nicht extra addieren.
Astra läuft über Responses / Chat Completions, nach Token. Die Empfehlung: Denken an ein Backend-Modell delegieren. Sprachschicht bleibt Live-1; Denken und Tools wählen GPT-5.6 Terra oder Luna. Beide Posten zusammen sind eine Session.
| Name, den Sie hören | Alltagsbudget nach | Nicht verwechseln mit |
|---|---|---|
| GPT-Live / Live-1 | $0.05 / Minute Sprachschicht | Audio-Tokenpreis von gpt-realtime-2.1 |
| GPT-6 / Astra | $10 / $50 Standard, kurzer Kontext | Batch $5/$25, Fast $20/$100 |
| GPT-5.6 Terra / Luna | $2/$12 oder $0.20/$1.20 | „GPT-5.6“ pauschal als Astra behandeln |
Data-Residency-Endpunkte schlagen bei Modellen ab dem 5. März 2026, sofern berechtigt, etwa 10% auf. Unter EU-Residency ist Astra Fast nicht verfügbar. Drei-Anbieter-Preise stehen in Astra vs Fable 5.1 vs Flash.
Was kosten 1 Million, 10 Millionen, 100 Millionen Token und eine Stunde Sprache?
Unten gilt Standard, kurzer Kontext, ohne Cache, ohne Batch, ohne Fast. Typisches Agent-Verhältnis: 80% Input / 20% Output.
| Volumen | Astra (80/20) | Terra (80/20) | Luna (80/20) | Urteil |
|---|---|---|---|---|
| 1 Million Token | $18 | $4.00 | $0.40 | Testlauf, Auswertung |
| 10 Millionen Token | $180 | $40 | $4.00 | eine schwere Einzelwoche |
| 100 Millionen Token | $1,800 | $400 | $40 | Astra als Team-Default trifft hier zuerst |
| Sprachdauer | Live-1 Sprachschicht | Umrechnung |
|---|---|---|
| 90 Sekunden | $0.075 | ein kurzer Anruf |
| 10 Minuten | $0.50 | eine volle Support-Session |
| 1 Stunde | $3.00 | sekundengenau, 61 Minuten = $3.05 |
| 40 Stunden / Monat | $120 | Backend-Token noch nicht dabei |
Welche Rechnungen machen die Agent-Kosten falsch?
Der häufigste Fehler: eine „Flaggschiff-Zeile“ nehmen und mit einem vagen „ein paar Millionen Token im Monat“ multiplizieren. Den Abstand machen Default-Modell, ob der Kontext 272K überschreitet, und ob die Sprachschicht dauerhaft offen bleibt.
| Rechnung | Was Sie unterschätzen | Korrektur |
|---|---|---|
| $5/$25 als Astra-Alltagspreis | Das ist Batch/Flex; die Echtzeit-IDE läuft $10/$50 | Budget mit Standardpreis; Halbpreis extra führen |
| Default: Astra jede Runde + Live-1 dauerhaft an | Minutenpreis und Flaggschiff-Token multiplizieren sich | Sprache über Live-1, Backend-Default Terra |
| Jedes Mal das ganze Repo in den Kontext | Über 272K: ganzer Auftrag 2× Input, 1,5× Output | Zusammenfassung in den Cache, über dem Limit auf Luna |
| Nur Input multiplizieren, Output vergessen | Astra-Output ist das Fünffache von Input | Eigenes Ein-/Aus-Verhältnis, kein 50/50 aus dem Bauch |
Web Search kostet extra etwa $10 / 1.000 Aufrufe; der abgerufene Text läuft weiter über Modell-Token. Hosted Shell / Code Interpreter rechnet nach Container-Session (1 GB etwa $0.03 / 20 Minuten). Tool-Gebühren stehen nicht in der „je Million Token“-Zeile, landen aber auf der Rechnung.
Wie schätzt man eine Agent-Session nach Listenpreis?
Das ist ein Rechenprotokoll, kein Messprotokoll. Rechnung oder Usage-Export öffnen und dieselben Summanden gegen die eigenen Zahlen halten.
- ☐ Sessiondauer in Sekunden notieren, durch 60 teilen, mal $0.05; ohne Sprache 0 eintragen
- ☐ Backend-Modell-ID trennen: Astra / Terra / Luna — nicht „GPT-6“ schreiben
- ☐ Input, Cache-Treffer, Cache-Schreiben, Output getrennt notieren
- ☐ Input > 272K? Dann gilt der Lange-Kontext-Preis für den ganzen Auftrag
- ☐ Fast oder Batch? Dann ×2 oder ×0.5
- ☐ Tool-Aufrufe × Listenpreis der Tools addieren
Gesamt ≈ (Sprachsekunden ÷ 60 × 0.05)
+ Input_M × Modell-Inputpreis
+ CacheHit_M × Cachepreis
+ CacheWrite_M × Schreibpreis
+ Output_M × Modell-Outputpreis
+ Toolgebühren
| Beispiel (Schätzung) | Live-1 | Backend | Summe |
|---|---|---|---|
| 8 Minuten Support + Terra 8K/1.5K | $0.40 | etwa $0.03 | etwa $0.43 |
| dasselbe, Backend Astra | $0.40 | etwa $0.16 | etwa $0.56 |
| 8 Minuten + Astra mit 200K Kontext | $0.40 | etwa $2.20 | etwa $2.60 |
Zeile drei, 10-mal am Tag, 22 Tage im Monat: allein dieses Muster etwa $572. Teuer ist nicht Live-1, sondern „jede Runde das Repo an Astra füttern“.
Was kosten leichte, mittlere und schwere Nutzung im Monat?
Die Stufen sollen der Finanzabteilung eine sprechbare Tabelle geben, keine interne Rechnung. Reiner Text im Verhältnis 5:1 Ein/Aus; Sprach-Support addiert Minuten.
| Stufe | Annahme | Nur Astra | Nur Terra | So lesen |
|---|---|---|---|---|
| Leicht · Text | 5M in + 1M out | $100 | $22 | Einzeltest, kleines Tool |
| Mittel · Text | 30M in + 6M out | $600 | $132 | kleines Team kann zuerst Terra defaulten |
| Schwer · Text | 100M in + 20M out | $2,000 | $440 | vor Astra für alle erst Routing setzen |
| Leicht · Sprache | 20 Stunden + Terra 5M/1M | — | etwa $82 | $60 Minuten + $22 Token |
| Mittel · Sprache | 80 Stunden + Terra 20M/4M | — | etwa $328 | $240 Minuten + $88 Token |
| Schwer · Sprache | 300 Stunden + Astra 30M/6M | etwa $1,500 | — | $900 Minuten + $600 Token |
Derselbe mittlere Text über Luna etwa $13. Abo-Schicht (ChatGPT Work / Pro) und API sind nicht dieselbe Rechnung; der Vergleich steht in ChatGPT-Work-Preise.
Soll der Sprach-Agent hinten an Astra oder Terra?
Der offizielle Start ist GPT-5.6 Terra; kostenempfindlich Luna. Astra bleibt für Refactoring über Dateigrenzen, langes Dokumentdenken und Computer Use — Arbeit, die falsch gemacht teurer nachgearbeitet wird als der Flaggschiff-Aufpreis.
| Einstieg | Sprachschicht | Backend | Urteil |
|---|---|---|---|
| FAQ / Termin / Status | Live-1 | Luna | so defaulten |
| Mehrschritt-Tools, Funktionen müssen sitzen | Live-1 | Terra | offizielle Startstufe |
| Code über Dateien, lange Recherche, Computer Use | Sprache darf aus | Astra | nur diesen Sprung aufs Flaggschiff |
| Übernacht-Scan, Batch-Zusammenfassungen | kein Live-1 | Terra Batch | halber Preis, kein Echtzeit-Platz |
| Tail-Latenz drücken | Live-1 | Terra Fast | doppelter Preis, nur den letzten Sprung |
// Nach Aufgabe hochstufen, nicht nach Marke
if (task.voice) session.model = "gpt-live-1";
if (task.kind === "faq") backend = "gpt-5.6-luna";
else if (task.kind === "tool_agent") backend = "gpt-5.6-terra";
else if (task.kind === "hard_reason") backend = "gpt-6-astra";
If Sie ein Sprachprodukt bauen, Then Live-1 + Terra, Astra als Upgrade-Taste. If Sie einen IDE-Agenten bauen und jede Runde mehrere Dateien berühren, Then setzen Sie für Astra ein Tageslimit, Routine läuft über Luna. If der Kontext oft nahe 272K liegt, Then zuerst zusammenfassen, nicht auf die Ganzauftrag-Preiserhöhung wetten.
gpt-6-astra setzen, wenn Nacharbeit teurer ist als der Flaggschiff-Aufpreis.Häufige Fragen FAQ
Was kostet die GPT-Live-1 API?
Die Sprachschicht kostet laut Listenpreis $0.05/Minute, sekundengenau, ohne Aufrunden. 10 Minuten etwa $0.50. Backend-Modell, Tools und Telefonleitung extra.
Was kostet eine Million GPT-6-Astra-Token?
Standard, kurzer Kontext: Input $10, Output $50, Cache-Treffer $1, Cache-Schreiben $12.50. Halb/halb etwa $30; 80/20 etwa $18. Pro steht nicht in dieser Alltagstabelle.
Ist GPT-Live-1 oder Astra teurer?
Die Einheiten sind verschieden, ein Direktvergleich geht nicht. Bei kurzen Gesprächen ist die Sprachschicht oft billiger als das Backend. Am teuersten in diesem Vergleich: „Live-1 + Astra in jeder Runde + sehr langer Kontext“.
Welche OpenAI-API-Stufe ist am günstigsten?
In den hier verglichenen Stufen hat GPT-5.6 Luna den niedrigsten öffentlichen Token-Preis. Geeignet für Klassifikation und FAQ, nicht als einzige Engine für Refactoring über Dateigrenzen.
Was kostet ein AI-Agent an API im Monat?
Nach der Tabelle oben, leicht/mittel/schwer: reiner Text nur über Astra etwa $100 / $600 / $2,000. Zuerst eigene Minuten und Token exportieren, dann mit dem Listenpreis multiplizieren.
Fazit
Geeignet, wenn Sie Live-1-Minuten und Astra-Token zuerst verstehen und mit derselben Addition die Agent-Monatskosten schätzen wollen.
Nicht geeignet, wenn Sie weiter nach „einem günstigsten Alleskönner“ suchen. Die Antwort ist meist das ungeroutete Flaggschiff-Default — die teuerste Zeile in der Tabelle.
If der Einstieg Sprache ist, Then Live-1 + Terra/Luna. If der Einstieg hartes Denken ist, Then Astra, und 272K halten. Der Drei-Anbieter-Vergleich steht in Astra vs Fable vs Flash, die Abo-Schicht in ChatGPT-Work-Preise. Von dieser API-Tabelle muss niemand in eine Mietseite springen.