搜「GPT-6 API 价格」或「Claude / Gemini 每百万 Token 多少钱」时,你多半只想先看到一张能对财务讲的表。搜索页却常把三款模型摆成擂台,Input、Output、缓存、Batch 拆成四套单位,L1 很难判断自己这种用法该买哪一档。
2026 年 9 月,三家公开价差已经拉得很大:旗舰大约是量产档的 50 倍。先看数字,再决定要不要上路由。
本文按截至 2026-09-10 的官网公开标价估算用量与一次开发成本。下单前请刷新价目卡。这不是排行榜,也不使用未公开的内部账单。
1. 2026 三款模型 API 价格表
单位均为 USD / 百万 Token。Astra 是对外主推的 GPT-6 旗舰档,不是 Pro;Fable 5.1 是编程 / Agent 修订版;Flash 是 Google 量产档。
| 计费项(截至 2026-09-10) | GPT-6 Astra | Claude Fable 5.1 | Gemini 3.8 Flash |
|---|---|---|---|
| Input | $5.00 | $6.00 | $0.10 |
| Output | $20.00 | $30.00 | $0.40 |
| 缓存命中 Input | $0.50 | $0.60 | $0.01 |
| Batch(非实时) | 约 5 折 | 约 5 折 | 约 5 折 |
2. 三款分别怎么收费
先认准 SKU,再看单位。价表上的「GPT-6」十有八九是 Astra;Pro 更贵,不在这张日常预算表里。Fable 5 旧 ID 从部分 IDE 消失过,选 5.1 时把模型名写进配置,不要写死在脚本里。背景见 Fable 5 与 Agent 基础设施。
| 你看到的名字 | 日常预算按谁算 | 别和它搞混 |
|---|---|---|
| GPT-6 / Astra | Astra:$5 / $20 | GPT-6 Pro、更便宜的蒸馏档 |
| Claude Fable 5.1 | Fable 5.1:$6 / $30 | 已下架的 Fable 5、Haiku 类小模型 |
| Gemini 3.8 Flash | Flash:$0.10 / $0.40 | Gemini 旗舰 / 深思模式 |
Input 是你送进去的提示和代码;Output 是模型吐出来的字,通常更贵。缓存命中大约是 Input 的 1/10,适合重复的系统提示和仓库摘要。Batch 适合能等的夜间任务,实时 IDE 对话一般用不上。订阅制 IDE 月费是另一笔账,见 2026 AI 编程成本排行。
3. 100 万、1000 万、1 亿 Token 分别多少钱
下面按官网标价线性估算(未含税、未含网关加价)。「1 亿 Token」按 1 亿 Input + 2 千万 Output 计,接近中等强度团队一个月的量级。
| 用量(估算) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 100 万 Input + 100 万 Output | $25 | $36 | $0.50 |
| 1000 万 Input + 200 万 Output | $90 | $120 | $1.80 |
| 1 亿 Input + 2000 万 Output | $900 | $1,200 | $18 |
| 一个月 3000 万 Input + 600 万 Output | 约 $270 | 约 $360 | 约 $5.40 |
若 Input 有 70% 打中缓存,同一月用量大约降到 Astra $176、Fable $247、Flash $3.50。公式是公开的:未命中走全价,命中走约 1/10。
4. 一次代码开发大概要花多少钱
按「一次代码审查约 8 万 Input + 8 千 Output」估算——相当于读几个文件、改一处、写一段说明。这不是实测账单,是用上一节单价乘出来的:
| 一次审查(估算) | Astra | Fable 5.1 | Flash |
|---|---|---|---|
| 8 万 In + 8 千 Out | 约 $0.56 | 约 $0.72 | 约 $0.011 |
同一任务若从 IDE Agent 发出,往往会多轮重贴规则和目录,Token 可能到单次审查的 2~3 倍。从网页 Chat 手工粘贴通常轮次更少,但人要自己切文件。便宜的是 Token 还是人,取决于你有没有时间自己贴代码。
5. 哪个更适合 AI Coding / API / CI
单价低不等于改得动代码。按你从哪条入口发请求选默认模型,比选「最强品牌」更省钱。
| 你在做什么 | 更合适的默认 | 备选 | 别当默认 |
|---|---|---|---|
| IDE / Agent 改多文件、补测试 | Fable 5.1 | Astra | 只用 Flash 扛重构 |
| 产品对话、方案、看图问数 | Astra | Fable 5.1 | Flash 当唯一大脑 |
| CI 日志、分类、摘要、翻译 | Flash | Astra Batch | Fable 按次扫全仓 |
| 要把月 Token 压进几十美元 | Flash 为主 + 贵模型点射 | Astra + 缓存 | 三家旗舰同时开着 |
Gemini 侧怎么接工具调用,见 Gemini 2026 Agent 与 Structured Output。GPT-6 价带怎么演进,见 GPT-6 API 价格预测。
6. 怎么降低 AI API 成本
- ☐ 默认模型改成 Flash 或「自动」,只有跨多文件 / 编译失败再升级
- ☐ 打开缓存:系统提示和仓库摘要做成固定前缀
- ☐ 给 Astra、Fable 设日封顶,超限降级,不要静默升到 Pro
- ☐ 能隔夜跑的用 Batch,不要在 IDE 里用旗舰扫 nightly
- ☐ 模型 ID 放配置文件,兼容旧名,失败走 Flash
// 按任务升级,而不是按品牌升级
if (task.kind === "classify" || task.kind === "summary") model = "gemini-3.8-flash";
else if (task.kind === "refactor" || task.touches > 3) model = "claude-fable-5.1";
else model = "gpt-6-astra";
接一层路由器能少维护几个 SDK,但默认仍可能打到贵模型。规则、封顶、缓存命中,比「已经接了 OpenRouter」更决定账单。
7. 最终怎么选
| 你的情况 | 建议 |
|---|---|
| 学生 / 个人,已经在用 Google | 先开 Flash;缺推理时再点一次 Astra |
| 每天用 Agent 改多文件 | 保证 Fable 5.1 额度,Flash 打杂 |
| 要跟财务讲清楚月费 | 用第 3 节表按自己的 Token 估算,不要等「一个全能冠军」 |
一句话:Flash 负责便宜和快,Fable 5.1 负责改对,Astra 负责说清。 三个职责叠在同一个默认模型上,账单会先爆。
常见问题 FAQ
GPT-6 API 一百万 Token 多少钱?
按 2026-09-10 公开卡,Astra 一百万 Input 是 $5,一百万 Output 是 $20。若你说的「一百万」是一半进一半出,大约 $12.50。Pro 不在这张日常表里。
GPT-6 Input 和 Output 哪个更贵?
三家都是 Output 更贵:Astra 4 倍,Fable 5 倍,Flash 4 倍。长篇生成、让模型「再写一遍」会明显拉高账单。
缓存 Token 怎么收费?
命中缓存的 Input 大约是正常 Input 的 1/10(Astra $0.50 / Fable $0.60 / Flash $0.01,每百万)。没命中仍走全价。先让系统提示稳定,再谈省钱。
哪个 AI API 最便宜?
这三款里,Gemini 3.8 Flash 的公开单价最低。它适合分类、摘要、CI,不适合当唯一的跨文件重构引擎。
AI Coding 一个月 API 要多少钱?
按第 3 节「3000 万 Input + 600 万 Output」估算:全走 Astra 约 $270,全走 Fable 约 $360,全走 Flash 约 $5.40。真实团队几乎都是混合,先量自己的 Token 再乘。
总结
适合把这篇当价表的人:你要在 2026 年 9 月先看懂每百万 Token 多少钱,再用公开标价估算自己的月费。
不适合继续找「一个全能最强」的人。那个答案通常等于无路由的旗舰默认,也就是表上最贵的一档。
下一篇看订阅层怎么计费,读 AI 编程成本排行 或 ChatGPT 工作档价格。若你的问题其实是本机跑 Xcode / Agent,再读相关的云 Mac 文章,不必从这张 API 价表跳进下单页。