搜「GPT-6 API 價格」或「Claude / Gemini 每百萬 Token 多少錢」時,你多半只想先看到一張能對財務講的表。搜尋頁卻常把三款模型擺成擂臺,Input、Output、快取、Batch 拆成四套單位,L1 很難判斷自己這種用法該買哪一檔。
2026 年 9 月,三家公開價差已經拉得很大:旗艦大約是量產檔的 50 倍。先看數字,再決定要不要上路由。
本文按截至 2026-09-10 的官網公開標價估算用量與一次開發成本。下單前請重新整理價目卡。這不是排行榜,也不使用未公開的內部帳單。
1. 2026 三款模型 API 價格表
單位均為 USD / 百萬 Token。Astra 是對外主推的 GPT-6 旗艦檔,不是 Pro;Fable 5.1 是編程 / Agent 修訂版;Flash 是 Google 量產檔。
| 計費項(截至 2026-09-10) | GPT-6 Astra | Claude Fable 5.1 | Gemini 3.8 Flash |
|---|---|---|---|
| Input | $5.00 | $6.00 | $0.10 |
| Output | $20.00 | $30.00 | $0.40 |
| 快取命中 Input | $0.50 | $0.60 | $0.01 |
| Batch(非即時) | 約 5 折 | 約 5 折 | 約 5 折 |
2. 三款分別怎麼收費
先認準 SKU,再看單位。價表上的「GPT-6」十有八九是 Astra;Pro 更貴,不在這張日常預算表裡。Fable 5 舊 ID 從部分 IDE 消失過,選 5.1 時把模型名寫進設定,不要寫死在腳本裡。背景見 Fable 5 與 Agent 基礎設施。
| 你看到的名字 | 日常預算按誰算 | 別和它搞混 |
|---|---|---|
| GPT-6 / Astra | Astra:$5 / $20 | GPT-6 Pro、更便宜的蒸餾檔 |
| Claude Fable 5.1 | Fable 5.1:$6 / $30 | 已下架的 Fable 5、Haiku 類小模型 |
| Gemini 3.8 Flash | Flash:$0.10 / $0.40 | Gemini 旗艦 / 深思模式 |
Input 是你送進去的提示和程式碼;Output 是模型吐出來的字,通常更貴。快取命中大約是 Input 的 1/10,適合重複的系統提示和倉庫摘要。Batch 適合能等的夜間任務,即時 IDE 對話一般用不上。訂閱制 IDE 月費是另一筆帳,見 2026 AI 編程成本排行。
3. 100 萬、1000 萬、1 億 Token 分別多少錢
下面按官網標價線性估算(未含稅、未含閘道加價)。「1 億 Token」按 1 億 Input + 2 千萬 Output 計,接近中等強度團隊一個月的量級。
| 用量(估算) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 100 萬 Input + 100 萬 Output | $25 | $36 | $0.50 |
| 1000 萬 Input + 200 萬 Output | $90 | $120 | $1.80 |
| 1 億 Input + 2000 萬 Output | $900 | $1,200 | $18 |
| 一個月 3000 萬 Input + 600 萬 Output | 約 $270 | 約 $360 | 約 $5.40 |
若 Input 有 70% 打中快取,同一月用量大約降到 Astra $176、Fable $247、Flash $3.50。公式是公開的:未命中走全價,命中走約 1/10。
4. 一次程式開發大概要花多少錢
按「一次程式碼審查約 8 萬 Input + 8 千 Output」估算——相當於讀幾個檔案、改一處、寫一段說明。這不是實測帳單,是用上一節單價乘出來的:
| 一次審查(估算) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 8 萬 In + 8 千 Out | 約 $0.56 | 約 $0.72 | 約 $0.011 |
同一任務若從 IDE Agent 發出,往往會多輪重貼規則和目錄,Token 可能到單次審查的 2~3 倍。從網頁 Chat 手工貼上通常輪次更少,但人要自己切檔案。便宜的是 Token 還是人,取決於你有沒有時間自己貼程式碼。
5. 哪個更適合 AI Coding / API / CI
單價低不等於改得動程式碼。按你從哪條入口發請求選預設模型,比選「最強品牌」更省錢。
| 你在做什麼 | 更合適的預設 | 備選 | 別當預設 |
|---|---|---|---|
| IDE / Agent 改多檔、補測試 | Fable 5.1 | Astra | 只用 Flash 扛重構 |
| 產品對話、方案、看圖問數 | Astra | Fable 5.1 | Flash 當唯一大腦 |
| CI 日誌、分類、摘要、翻譯 | Flash | Astra Batch | Fable 按次掃全倉 |
| 要把月 Token 壓進幾十美元 | Flash 為主 + 貴模型點射 | Astra + 快取 | 三家旗艦同時開著 |
Gemini 側怎麼接工具呼叫,見 Gemini 2026 Agent 與 Structured Output。GPT-6 價帶怎麼演進,見 GPT-6 API 價格預測。
6. 怎麼降低 AI API 成本
- ☐ 預設模型改成 Flash 或「自動」,只有跨多檔 / 編譯失敗再升級
- ☐ 打開快取:系統提示和倉庫摘要做成固定前綴
- ☐ 給 Astra、Fable 設日上限,超限降級,不要靜默升到 Pro
- ☐ 能隔夜跑的用 Batch,不要在 IDE 裡用旗艦掃 nightly
- ☐ 模型 ID 放設定檔,相容舊名,失敗走 Flash
// 按任務升級,而不是按品牌升級
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";
接一層路由器能少維護幾個 SDK,但預設仍可能打到貴模型。規則、上限、快取命中,比「已經接了 OpenRouter」更決定帳單。
7. 最終怎麼選
| 你的情況 | 建議 |
|---|---|
| 學生 / 個人,已經在用 Google | 先開 Flash;缺推理時再點一次 Astra |
| 每天用 Agent 改多檔 | 保證 Fable 5.1 額度,Flash 打雜 |
| 要跟財務講清楚月費 | 用第 3 節表按自己的 Token 估算,不要等「一個全能冠軍」 |
一句話:Flash 負責便宜和快,Fable 5.1 負責改對,Astra 負責說清。 三個職責疊在同一個預設模型上,帳單會先爆。
常見問題 FAQ
GPT-6 API 一百萬 Token 多少錢?
按 2026-09-10 公開卡,Astra 一百萬 Input 是 $5,一百萬 Output 是 $20。若你說的「一百萬」是一半進一半出,大約 $12.50。Pro 不在這張日常表裡。
GPT-6 Input 和 Output 哪個更貴?
三家都是 Output 更貴:Astra 4 倍,Fable 5 倍,Flash 4 倍。長篇生成、讓模型「再寫一遍」會明顯拉高帳單。
快取 Token 怎麼收費?
命中快取的 Input 大約是正常 Input 的 1/10(Astra $0.50 / Fable $0.60 / Flash $0.01,每百萬)。沒命中仍走全價。先讓系統提示穩定,再談省錢。
哪個 AI API 最便宜?
這三款裡,Gemini 3.8 Flash 的公開單價最低。它適合分類、摘要、CI,不適合當唯一的跨檔重構引擎。
AI Coding 一個月 API 要多少錢?
按第 3 節「3000 萬 Input + 600 萬 Output」估算:全走 Astra 約 $270,全走 Fable 約 $360,全走 Flash 約 $5.40。真實團隊幾乎都是混合,先量自己的 Token 再乘。
總結
適合把這篇當價表的人:你要在 2026 年 9 月先看懂每百萬 Token 多少錢,再用公開標價估算自己的月費。
不適合繼續找「一個全能最強」的人。那個答案通常等於無路由的旗艦預設,也就是表上最貴的一檔。
下一篇看訂閱層怎麼計費,讀 AI 編程成本排行 或 ChatGPT 工作檔價格。若你的問題其實是本機跑 Xcode / Agent,再讀相關的雲端 Mac 文章,不必從這張 API 價表跳進下單頁。