對照 GPT-6 Astra、Claude Fable 5.1 與 Gemini 3.8 Flash 的 API 價目卡

搜「GPT-6 API 價格」或「Claude / Gemini 每百萬 Token 多少錢」時,你多半只想先看到一張能對財務講的表。搜尋頁卻常把三款模型擺成擂臺,Input、Output、快取、Batch 拆成四套單位,L1 很難判斷自己這種用法該買哪一檔。

2026 年 9 月,三家公開價差已經拉得很大:旗艦大約是量產檔的 50 倍。先看數字,再決定要不要上路由。

本文按截至 2026-09-10 的官網公開標價估算用量與一次開發成本。下單前請重新整理價目卡。這不是排行榜,也不使用未公開的內部帳單。

1. 2026 三款模型 API 價格表

單位均為 USD / 百萬 Token。Astra 是對外主推的 GPT-6 旗艦檔,不是 Pro;Fable 5.1 是編程 / Agent 修訂版;Flash 是 Google 量產檔。

計費項(截至 2026-09-10) GPT-6 Astra Claude Fable 5.1 Gemini 3.8 Flash
Input $5.00 $6.00 $0.10
Output $20.00 $30.00 $0.40
快取命中 Input $0.50 $0.60 $0.01
Batch(非即時) 約 5 折 約 5 折 約 5 折
5 秒結論:只要任務能接受量產檔品質,Flash 通常最省。預設走旗艦、又沒有路由,才是最貴的用法。

2. 三款分別怎麼收費

先認準 SKU,再看單位。價表上的「GPT-6」十有八九是 Astra;Pro 更貴,不在這張日常預算表裡。Fable 5 舊 ID 從部分 IDE 消失過,選 5.1 時把模型名寫進設定,不要寫死在腳本裡。背景見 Fable 5 與 Agent 基礎設施

你看到的名字 日常預算按誰算 別和它搞混
GPT-6 / Astra Astra:$5 / $20 GPT-6 Pro、更便宜的蒸餾檔
Claude Fable 5.1 Fable 5.1:$6 / $30 已下架的 Fable 5、Haiku 類小模型
Gemini 3.8 Flash Flash:$0.10 / $0.40 Gemini 旗艦 / 深思模式

Input 是你送進去的提示和程式碼;Output 是模型吐出來的字,通常更貴。快取命中大約是 Input 的 1/10,適合重複的系統提示和倉庫摘要。Batch 適合能等的夜間任務,即時 IDE 對話一般用不上。訂閱制 IDE 月費是另一筆帳,見 2026 AI 編程成本排行

3. 100 萬、1000 萬、1 億 Token 分別多少錢

下面按官網標價線性估算(未含稅、未含閘道加價)。「1 億 Token」按 1 億 Input + 2 千萬 Output 計,接近中等強度團隊一個月的量級。

用量(估算) Astra Fable 5.1 Flash
100 萬 Input + 100 萬 Output $25 $36 $0.50
1000 萬 Input + 200 萬 Output $90 $120 $1.80
1 億 Input + 2000 萬 Output $900 $1,200 $18
一個月 3000 萬 Input + 600 萬 Output 約 $270 約 $360 約 $5.40

若 Input 有 70% 打中快取,同一月用量大約降到 Astra $176、Fable $247、Flash $3.50。公式是公開的:未命中走全價,命中走約 1/10。

4. 一次程式開發大概要花多少錢

按「一次程式碼審查約 8 萬 Input + 8 千 Output」估算——相當於讀幾個檔案、改一處、寫一段說明。這不是實測帳單,是用上一節單價乘出來的:

一次審查(估算) Astra Fable 5.1 Flash
8 萬 In + 8 千 Out 約 $0.56 約 $0.72 約 $0.011

同一任務若從 IDE Agent 發出,往往會多輪重貼規則和目錄,Token 可能到單次審查的 2~3 倍。從網頁 Chat 手工貼上通常輪次更少,但人要自己切檔案。便宜的是 Token 還是人,取決於你有沒有時間自己貼程式碼。

怎麼算:費用 ≈(Input 百萬數 × Input 單價)+(Output 百萬數 × Output 單價)。先用自己倉庫試 10 次,記下平均 Token,再乘單價。

5. 哪個更適合 AI Coding / API / CI

單價低不等於改得動程式碼。按你從哪條入口發請求選預設模型,比選「最強品牌」更省錢。

你在做什麼 更合適的預設 備選 別當預設
IDE / Agent 改多檔、補測試 Fable 5.1 Astra 只用 Flash 扛重構
產品對話、方案、看圖問數 Astra Fable 5.1 Flash 當唯一大腦
CI 日誌、分類、摘要、翻譯 Flash Astra Batch Fable 按次掃全倉
要把月 Token 壓進幾十美元 Flash 為主 + 貴模型點射 Astra + 快取 三家旗艦同時開著

Gemini 側怎麼接工具呼叫,見 Gemini 2026 Agent 與 Structured Output。GPT-6 價帶怎麼演進,見 GPT-6 API 價格預測

6. 怎麼降低 AI API 成本

  • ☐ 預設模型改成 Flash 或「自動」,只有跨多檔 / 編譯失敗再升級
  • ☐ 打開快取:系統提示和倉庫摘要做成固定前綴
  • ☐ 給 Astra、Fable 設日上限,超限降級,不要靜默升到 Pro
  • ☐ 能隔夜跑的用 Batch,不要在 IDE 裡用旗艦掃 nightly
  • ☐ 模型 ID 放設定檔,相容舊名,失敗走 Flash
// 按任務升級,而不是按品牌升級
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";

接一層路由器能少維護幾個 SDK,但預設仍可能打到貴模型。規則、上限、快取命中,比「已經接了 OpenRouter」更決定帳單。

7. 最終怎麼選

你的情況 建議
學生 / 個人,已經在用 Google 先開 Flash;缺推理時再點一次 Astra
每天用 Agent 改多檔 保證 Fable 5.1 額度,Flash 打雜
要跟財務講清楚月費 用第 3 節表按自己的 Token 估算,不要等「一個全能冠軍」

一句話:Flash 負責便宜和快,Fable 5.1 負責改對,Astra 負責說清。 三個職責疊在同一個預設模型上,帳單會先爆。

常見問題 FAQ

GPT-6 API 一百萬 Token 多少錢?

按 2026-09-10 公開卡,Astra 一百萬 Input 是 $5,一百萬 Output 是 $20。若你說的「一百萬」是一半進一半出,大約 $12.50。Pro 不在這張日常表裡。

GPT-6 Input 和 Output 哪個更貴?

三家都是 Output 更貴:Astra 4 倍,Fable 5 倍,Flash 4 倍。長篇生成、讓模型「再寫一遍」會明顯拉高帳單。

快取 Token 怎麼收費?

命中快取的 Input 大約是正常 Input 的 1/10(Astra $0.50 / Fable $0.60 / Flash $0.01,每百萬)。沒命中仍走全價。先讓系統提示穩定,再談省錢。

哪個 AI API 最便宜?

這三款裡,Gemini 3.8 Flash 的公開單價最低。它適合分類、摘要、CI,不適合當唯一的跨檔重構引擎。

AI Coding 一個月 API 要多少錢?

按第 3 節「3000 萬 Input + 600 萬 Output」估算:全走 Astra 約 $270,全走 Fable 約 $360,全走 Flash 約 $5.40。真實團隊幾乎都是混合,先量自己的 Token 再乘。

總結

適合把這篇當價表的人:你要在 2026 年 9 月先看懂每百萬 Token 多少錢,再用公開標價估算自己的月費。

不適合繼續找「一個全能最強」的人。那個答案通常等於無路由的旗艦預設,也就是表上最貴的一檔。

下一篇看訂閱層怎麼計費,讀 AI 編程成本排行ChatGPT 工作檔價格。若你的問題其實是本機跑 Xcode / Agent,再讀相關的雲端 Mac 文章,不必從這張 API 價表跳進下單頁。