API-Preiskarten für GPT-6 Astra, Claude Fable 5.1 und Gemini 3.8 Flash

Wer „GPT-6 API Preis“ oder „Kosten pro Million Token“ sucht, will zuerst eine Tabelle fürs Controlling – kein 15-Kapitel-Ranking. Vergleichsseiten trennen Input, Output, Cache und Batch, sodass Einsteiger nicht sehen, welches SKU sie kaufen.

Im September 2026 ist der öffentliche Abstand groß: Ein Flaggschiff kann rund das 50-Fache einer Volumenstufe kosten. Zahlen zuerst, dann Routing.

Alle Beträge sind Schätzungen aus öffentlichen Listenpreisen zum 2026-09-10. Karten vor dem Kauf aktualisieren. Kein Leaderboard, keine unveröffentlichten internen Rechnungen.

1. API-Preistabelle 2026

Alles in USD / Million Token. Astra ist das öffentliche GPT-6-Flaggschiff, nicht Pro. Fable 5.1 ist die Coding-/Agent-Revision. Flash ist Googles Volumen-SKU.

Position (Stand 2026-09-10)GPT-6 AstraClaude Fable 5.1Gemini 3.8 Flash
Input$5.00$6.00$0.10
Output$20.00$30.00$0.40
Cache-Hit Input$0.50$0.60$0.01
Batch (offline)~50 %~50 %~50 %
Fünf-Sekunden-Antwort: Reicht Volumenqualität, ist Flash meist am günstigsten. Ein ungeroutetes Flaggschiff-Default ist die teure Gewohnheit.

2. So wird abgerechnet

SKU prüfen, bevor ein Screenshot zählt. „GPT-6“ ist fast immer Astra; Pro ist eine andere, teurere Karte. Fable 5 verschwand aus manchen IDEs – 5.1 in die Config, nicht in eine Konstante. Hintergrund: Fable 5 und Agent-Infrastruktur.

Sichtbarer NameBudget gegenNicht verwechseln
GPT-6 / AstraAstra: $5 / $20GPT-6 Pro, günstige Destillate
Claude Fable 5.1Fable 5.1: $6 / $30Altes Fable 5, Haiku-Klasse
Gemini 3.8 FlashFlash: $0.10 / $0.40Gemini-Flaggschiff / Deep-Think

Input ist das Gesendete, Output das Zurückkommende und meist 4–5× teurer. Cache-Hits liegen bei etwa 1/10 des Inputs. Batch ist für Jobs, die über Nacht warten können. Sitzlizenzen sind eine andere Rechnung: KI-Coding-Kosten 2026.

3. Was 1 Mio., 10 Mio. und 100 Mio. Token kosten

Lineare Schätzung von der öffentlichen Karte (ohne Steuer, ohne Gateway). „100 Mio.“ heißt hier 100 Mio. Input + 20 Mio. Output – ungefähr ein Teammonat mittlerer Intensität.

Nutzung (Schätzung)AstraFable 5.1Flash
1 Mio. In + 1 Mio. Out$25$36$0.50
10 Mio. In + 2 Mio. Out$90$120$1.80
100 Mio. In + 20 Mio. Out$900$1,200$18
30 Mio. In + 6 Mio. Out / Monat~$270~$360~$5.40

Treffen 70 % des Inputs den Cache, fällt dieselbe Monatszeile auf etwa $176 / $247 / $3.50. Fehltreffer zahlen vollen Input.

4. Was ein Coding-Durchlauf kostet

Ein Review ≈ 80k Input + 8k Output. Das ist Listenpreis-Mathematik, keine Laborrechnung.

Ein Review (Schätzung)AstraFable 5.1Flash
80k In + 8k Out~$0.56~$0.72~$0.011

Derselbe Job aus einem IDE-Agenten spielt Regeln und Baum oft erneut ein – Token können 2–3× werden. Zehn Läufe im eigenen Repo, Mittelwert, dann multiplizieren.

Formel: Kosten ≈ (Input-Millionen × Preis) + (Output-Millionen × Preis).

5. Coding, API und CI

Ein niedriger Stückpreis heißt nicht, dass der Compile durchläuft. Default nach Einstieg des Requests wählen.

AufgabeBesserer DefaultReserveNicht als Default
IDE / Agent, mehrere DateienFable 5.1AstraNur Flash fürs große Refactor
Produktchat, multimodalAstraFable 5.1Flash als einziges Gehirn
CI-Logs, Klassifizieren, ÜbersetzenFlashAstra BatchFable über jedes Repo nachts
Monat im zweistelligen DollarFlash + gezieltes UpgradeAstra + CacheDrei Flaggschiffe gleichzeitig

Tool-Calling Gemini: Gemini 2026 Agent. GPT-6-Band: GPT-6 API-Preisprognose.

6. Kosten senken

  • ☐ Default Flash oder „auto“; nur bei Mehrdatei/fehlgeschlagenem Build hochstufen
  • ☐ Systemprompt und Repo-Summary cachen
  • ☐ Tageslimits für Astra/Fable; nicht still auf Pro
  • ☐ Nachtjobs in Batch, nicht im Flaggschiff-IDE-Loop
  • ☐ Modell-IDs in der Config, Fallback Flash
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";

Ein Router spart SDKs. Geld spart er nicht, wenn der Default weiter das teure SKU trifft.

7. So wählen

LageStart
Student / Indie, schon bei GoogleZuerst Flash; Astra nur für schwere Inferenz
Täglich Agent, viele DateienFable-5.1-Kontingent; Flash für Kleinkram
Monat dem Controlling erklären§3 mit eigenen Token-Zahlen

Ein Satz: Flash ist billig und schnell, Fable 5.1 bringt die Änderung durch, Astra erklärt den Plan. Alle drei Jobs auf einem Default sprengen die Rechnung.

FAQ

Was kostet 1 Million GPT-6-Token?

Astra-Karte 2026-09-10: 1 Mio. Input $5, 1 Mio. Output $20. Halb/halb etwa $12.50. Pro steht nicht auf dieser Alltagstabelle.

Ist Input oder Output teurer?

Output, bei allen dreien: etwa 4× bei Astra/Flash, 5× bei Fable.

Wie werden Cache-Token berechnet?

Getroffener Input etwa 1/10 ($0.50 / $0.60 / $0.01 pro Million). Fehltreffer voller Preis.

Welche dieser APIs ist am günstigsten?

Gemini 3.8 Flash auf der öffentlichen Karte. Für Klassifizieren, Summaries, CI – nicht als einzige große Refactor-Engine.

Was kostet AI-Coding im Monat?

Zeile 30 Mio. + 6 Mio.: ~$270 nur Astra, ~$360 nur Fable, ~$5.40 nur Flash. Teams mischen. Token messen, dann multiplizieren.

Fazit

Für dich, wenn du die Listenpreise 2026-09 und eine öffentliche Monatsschätzung brauchst.

Nicht für dich, wenn du einen „besten“ Champion willst. Das ist meist das ungeroutete Flaggschiff – die teuerste Zeile.

Sitzpreise: KI-Coding-Kosten oder ChatGPT-Tarife. Geht es um Xcode oder lokale Agents, lies jenes Cluster – diese Preistabelle muss nicht in eine Mac-Bestellung springen.