Wer „GPT-6 API Preis“ oder „Kosten pro Million Token“ sucht, will zuerst eine Tabelle fürs Controlling – kein 15-Kapitel-Ranking. Vergleichsseiten trennen Input, Output, Cache und Batch, sodass Einsteiger nicht sehen, welches SKU sie kaufen.
Im September 2026 ist der öffentliche Abstand groß: Ein Flaggschiff kann rund das 50-Fache einer Volumenstufe kosten. Zahlen zuerst, dann Routing.
Alle Beträge sind Schätzungen aus öffentlichen Listenpreisen zum 2026-09-10. Karten vor dem Kauf aktualisieren. Kein Leaderboard, keine unveröffentlichten internen Rechnungen.
1. API-Preistabelle 2026
Alles in USD / Million Token. Astra ist das öffentliche GPT-6-Flaggschiff, nicht Pro. Fable 5.1 ist die Coding-/Agent-Revision. Flash ist Googles Volumen-SKU.
| Position (Stand 2026-09-10) | GPT-6 Astra | Claude Fable 5.1 | Gemini 3.8 Flash |
|---|---|---|---|
| Input | $5.00 | $6.00 | $0.10 |
| Output | $20.00 | $30.00 | $0.40 |
| Cache-Hit Input | $0.50 | $0.60 | $0.01 |
| Batch (offline) | ~50 % | ~50 % | ~50 % |
2. So wird abgerechnet
SKU prüfen, bevor ein Screenshot zählt. „GPT-6“ ist fast immer Astra; Pro ist eine andere, teurere Karte. Fable 5 verschwand aus manchen IDEs – 5.1 in die Config, nicht in eine Konstante. Hintergrund: Fable 5 und Agent-Infrastruktur.
| Sichtbarer Name | Budget gegen | Nicht verwechseln |
|---|---|---|
| GPT-6 / Astra | Astra: $5 / $20 | GPT-6 Pro, günstige Destillate |
| Claude Fable 5.1 | Fable 5.1: $6 / $30 | Altes Fable 5, Haiku-Klasse |
| Gemini 3.8 Flash | Flash: $0.10 / $0.40 | Gemini-Flaggschiff / Deep-Think |
Input ist das Gesendete, Output das Zurückkommende und meist 4–5× teurer. Cache-Hits liegen bei etwa 1/10 des Inputs. Batch ist für Jobs, die über Nacht warten können. Sitzlizenzen sind eine andere Rechnung: KI-Coding-Kosten 2026.
3. Was 1 Mio., 10 Mio. und 100 Mio. Token kosten
Lineare Schätzung von der öffentlichen Karte (ohne Steuer, ohne Gateway). „100 Mio.“ heißt hier 100 Mio. Input + 20 Mio. Output – ungefähr ein Teammonat mittlerer Intensität.
| Nutzung (Schätzung) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 1 Mio. In + 1 Mio. Out | $25 | $36 | $0.50 |
| 10 Mio. In + 2 Mio. Out | $90 | $120 | $1.80 |
| 100 Mio. In + 20 Mio. Out | $900 | $1,200 | $18 |
| 30 Mio. In + 6 Mio. Out / Monat | ~$270 | ~$360 | ~$5.40 |
Treffen 70 % des Inputs den Cache, fällt dieselbe Monatszeile auf etwa $176 / $247 / $3.50. Fehltreffer zahlen vollen Input.
4. Was ein Coding-Durchlauf kostet
Ein Review ≈ 80k Input + 8k Output. Das ist Listenpreis-Mathematik, keine Laborrechnung.
| Ein Review (Schätzung) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 80k In + 8k Out | ~$0.56 | ~$0.72 | ~$0.011 |
Derselbe Job aus einem IDE-Agenten spielt Regeln und Baum oft erneut ein – Token können 2–3× werden. Zehn Läufe im eigenen Repo, Mittelwert, dann multiplizieren.
5. Coding, API und CI
Ein niedriger Stückpreis heißt nicht, dass der Compile durchläuft. Default nach Einstieg des Requests wählen.
| Aufgabe | Besserer Default | Reserve | Nicht als Default |
|---|---|---|---|
| IDE / Agent, mehrere Dateien | Fable 5.1 | Astra | Nur Flash fürs große Refactor |
| Produktchat, multimodal | Astra | Fable 5.1 | Flash als einziges Gehirn |
| CI-Logs, Klassifizieren, Übersetzen | Flash | Astra Batch | Fable über jedes Repo nachts |
| Monat im zweistelligen Dollar | Flash + gezieltes Upgrade | Astra + Cache | Drei Flaggschiffe gleichzeitig |
Tool-Calling Gemini: Gemini 2026 Agent. GPT-6-Band: GPT-6 API-Preisprognose.
6. Kosten senken
- ☐ Default Flash oder „auto“; nur bei Mehrdatei/fehlgeschlagenem Build hochstufen
- ☐ Systemprompt und Repo-Summary cachen
- ☐ Tageslimits für Astra/Fable; nicht still auf Pro
- ☐ Nachtjobs in Batch, nicht im Flaggschiff-IDE-Loop
- ☐ Modell-IDs in der Config, Fallback Flash
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";
Ein Router spart SDKs. Geld spart er nicht, wenn der Default weiter das teure SKU trifft.
7. So wählen
| Lage | Start |
|---|---|
| Student / Indie, schon bei Google | Zuerst Flash; Astra nur für schwere Inferenz |
| Täglich Agent, viele Dateien | Fable-5.1-Kontingent; Flash für Kleinkram |
| Monat dem Controlling erklären | §3 mit eigenen Token-Zahlen |
Ein Satz: Flash ist billig und schnell, Fable 5.1 bringt die Änderung durch, Astra erklärt den Plan. Alle drei Jobs auf einem Default sprengen die Rechnung.
FAQ
Was kostet 1 Million GPT-6-Token?
Astra-Karte 2026-09-10: 1 Mio. Input $5, 1 Mio. Output $20. Halb/halb etwa $12.50. Pro steht nicht auf dieser Alltagstabelle.
Ist Input oder Output teurer?
Output, bei allen dreien: etwa 4× bei Astra/Flash, 5× bei Fable.
Wie werden Cache-Token berechnet?
Getroffener Input etwa 1/10 ($0.50 / $0.60 / $0.01 pro Million). Fehltreffer voller Preis.
Welche dieser APIs ist am günstigsten?
Gemini 3.8 Flash auf der öffentlichen Karte. Für Klassifizieren, Summaries, CI – nicht als einzige große Refactor-Engine.
Was kostet AI-Coding im Monat?
Zeile 30 Mio. + 6 Mio.: ~$270 nur Astra, ~$360 nur Fable, ~$5.40 nur Flash. Teams mischen. Token messen, dann multiplizieren.
Fazit
Für dich, wenn du die Listenpreise 2026-09 und eine öffentliche Monatsschätzung brauchst.
Nicht für dich, wenn du einen „besten“ Champion willst. Das ist meist das ungeroutete Flaggschiff – die teuerste Zeile.
Sitzpreise: KI-Coding-Kosten oder ChatGPT-Tarife. Geht es um Xcode oder lokale Agents, lies jenes Cluster – diese Preistabelle muss nicht in eine Mac-Bestellung springen.