Рабочий стол с оценкой стоимости: поминутная плата GPT-Live-1 и тариф токенов GPT-6 Astra

Сначала разведите два счёта: GPT-Live-1 берёт $0.05 за минуту голоса, GPT-6 Astra — $10 / $50 за токены (за миллион, стандартный короткий контекст). Если голосовой фронт и флагманский бэкенд висят на одной цепочке по умолчанию, счёт агента обычно взрывается именно так.

Критериев три: говорите ли вы вслух, можно ли задачу понизить и переваливает ли один Input за 272K. Цифры — оценка по публичной карточке OpenAI. Перед заказом обновите сайт.

Сколько стоят GPT-Live-1 и GPT-6 Astra по отдельности?

Позиция GPT-Live-1 GPT-6 Astra Как выбрать
Основная единица $0.05 / мин голоса $10 Input / $50 Output Голос — минуты, рассуждение — токены
Попадание в кэш (Input) не применяется $1.00 / млн Экономия только при фиксированном системном промпте
Запись в кэш не применяется $12.50 / млн Запись = 1.25× Input
Batch / Flex живая сессия ≈ половина стандарта Полуцена — для ночных задач, не смешивайте со стандартом в одной карточке
Fast / Priority смотрите очередь ≈ 2× стандарта Ускоряйте только последний прыжок
Бэкенд / инструменты отдельно по выбранной модели Web Search и др. отдельно Голосовой слой — не «всё включено»
Коротко: Live-1 — голосовой слой по $0.05/мин; Astra — флагманские токены $10/$50. Связка «Live-1 + Astra на каждый ход» в этом наборе самая дорогая.

Batch / Flex у Astra — это $5 / $25. Если полуцену скопировать в повседневный бюджет, месяц недосчитаете вдвое. Длинный контекст (Input > 272K) пересчитывает весь заказ на $20 / $75 — не только «лишний» хвост.

Почему поминутную плату за голос нельзя сравнивать с платой за токены?

Live-1 идёт через POST /v1/live/sessions: слушает и говорит одновременно, посекундно, без округления вверх до целой минуты. При создании WebRTC-сессии начисляют 15 с инициализации; когда сессия реально стартует, они зачитываются — в оценке эти 15 с не прибавляйте ещё раз.

Astra идёт через Responses / Chat Completions, по токенам. Официальная рекомендация: рассуждение отдать бэкенду. Голосовой слой оставьте Live-1, думание и инструменты — GPT-5.6 Terra или Luna. Сумма двух строк и есть одна сессия.

Имя, которое слышите Повседневный бюджет считайте по Не путайте с
GPT-Live / Live-1 $0.05 / мин голосового слоя аудио-токенами gpt-realtime-2.1
GPT-6 / Astra $10 / $50, стандартный короткий контекст Batch $5/$25, Fast $20/$100
GPT-5.6 Terra / Luna $2/$12 или $0.20/$1.20 «GPT-5.6» как будто это Astra
Граница: аудио Realtime 2.1 — $32 / $64 за миллион; Live-1 перешёл на минуты. Сначала сверьте SKU, потом цифры.

Эндпоинты с резидентностью данных добавляют ≈ 10% для моделей, вышедших 5 марта 2026 и позже и подходящих по правилам. При EU-резидентности Fast у Astra недоступен. Поперечные цены трёх вендоров — в Astra vs Fable 5.1 vs Flash.

Сколько стоят 1 млн, 10 млн, 100 млн токенов и час голоса?

Ниже — оценка при стандартном коротком контексте, без кэша, не Batch, не Fast. Типичное соотношение агента: 80% Input / 20% Output.

Объём Astra (80/20) Terra (80/20) Luna (80/20) Как читать
1 млн токенов $18 $4.00 $0.40 Пробный прогон, оценка
10 млн токенов $180 $40 $4.00 Неделя тяжёлого личного использования
100 млн токенов $1,800 $400 $40 Если всем по умолчанию Astra, упрётесь сюда
Длительность голоса Голосовой слой Live-1 Пересчёт
90 с $0.075 Короткий звонок
10 мин $0.50 Полная сессия поддержки
1 час $3.00 Посекундно: 61 мин = $3.05
40 ч / месяц $120 Бэкенд-токены ещё не включены
Как читать таблицу: 100 млн токенов целиком на Astra ≈ $1,800; та же структура на Luna ≈ $40. Разница в маршрутизации, а не в том, что «OpenAI вдруг подорожал».

Какие формулы ломают счёт агента?

Самая частая ошибка — взять одну «флагманскую цену» и умножить на размытые «несколько миллионов токенов в месяц». Разрыв делают модель по умолчанию, переход через 272K и постоянно висящий голосовой слой.

Формула Что недосчитаете Как исправить
$5/$25 как повседневная цена Astra Это Batch/Flex; живой IDE идёт по $10/$50 Бюджет по стандарту, полуцену — отдельной строкой
Astra на каждый ход + постоянно включённый Live-1 Минуты и флагманские токены перемножаются Голос — Live-1, бэкенд по умолчанию — Terra
Каждый раз пихать весь репозиторий в контекст После 272K весь заказ: 2× Input, 1.5× Output Саммари в кэш; сверх лимита — Luna
Умножать только Input, забыть Output Output Astra в 5 раз дороже Input Берите своё соотношение вход/выход, не фантазию 50/50

Web Search отдельно ≈ $10 / 1 000 вызовов; найденный текст ещё идёт по токенам модели. Hosted Shell / Code Interpreter — по сессии контейнера (1 ГБ ≈ $0.03 / 20 мин). Инструменты не попадают в строку «за миллион токенов», но попадают в счёт.

Типичная ошибка: «Live-1 всего пять центов» забывает бэкенд; «Astra всего десять долларов за миллион» забывает Output, длинный контекст и Fast.

Как оценить одну сессию агента по публичным тарифам?

Это протокол расчёта, не замер. Откройте счёт или выгрузку Usage и сложите свои цифры той же суммой.

  • ☐ Запишите длительность сессии в секундах, разделите на 60, умножьте на $0.05; без голоса пишите 0
  • ☐ Выделите ID бэкенда: Astra / Terra / Luna, не «GPT-6»
  • ☐ Отдельно: Input, попадание в кэш, запись в кэш, Output
  • ☐ Input > 272K? Тогда весь заказ — по тарифу длинного контекста
  • ☐ Fast или Batch? Тогда ×2 или ×0.5
  • ☐ Плюс число вызовов инструментов × публичная цена инструмента
итого ≈ (секунды_голоса ÷ 60 × 0.05)
     + Input_M × цена_Input_модели
     + CacheHit_M × цена_кэша
     + CacheWrite_M × цена_записи
     + Output_M × цена_Output_модели
     + инструменты
Пример (оценка) Live-1 Бэкенд Итого
8 мин поддержки + Terra 8K/1.5K $0.40 ≈ $0.03 ≈ $0.43
То же, бэкенд заменён на Astra $0.40 ≈ $0.16 ≈ $0.56
8 мин + Astra с 200K контекста $0.40 ≈ $2.20 ≈ $2.60

Третья строка 10 раз в день, 22 дня в месяц — только этот паттерн ≈ $572. Дорого не Live-1, а «каждый ход кормить Astra репозиторием».

Протокол в одну фразу: минуты и токены умножайте отдельно, потом складывайте. Не берите из головы константу «один звонок = доллар».

Сколько примерно стоит месяц при лёгкой, средней и тяжёлой нагрузке?

Ступени нужны, чтобы финансы могли разговаривать по таблице, а не как внутренний счёт. Чистый текст — соотношение 5:1 вход/выход; голосовая поддержка плюс минуты.

Ступень Допущение Всё на Astra Всё на Terra Как читать
Лёгкая · текст 5M in + 1M out $100 $22 Личный прогон, маленький инструмент
Средняя · текст 30M in + 6M out $600 $132 Малой команде по умолчанию можно Terra
Тяжёлая · текст 100M in + 20M out $2,000 $440 Перед «всем Astra» сначала маршрутизация
Лёгкая · голос 20 ч + Terra 5M/1M ≈ $82 $60 минуты + $22 токены
Средняя · голос 80 ч + Terra 20M/4M ≈ $328 $240 минуты + $88 токены
Тяжёлая · голос 300 ч + Astra 30M/6M ≈ $1,500 $900 минуты + $600 токены

Тот же средний текст на Luna ≈ $13. Слой подписки (ChatGPT Work / Pro) и API — разные счета; сверка в ценах ChatGPT Work.

Как читать итог: лёгкую ступень можно пробовать целиком на Astra; со средней модели по умолчанию решает месяц сильнее, чем «ещё чуть урезать промпт».

Голосовому агенту бэкенд вешать на Astra или на Terra?

Официальный старт — GPT-5.6 Terra; если цена жмёт — Luna. Astra оставьте для межфайлового рефакторинга, длинных документов и computer use: там одна ошибка стоит дороже разницы тарифов.

Вход Голосовой слой Бэкенд Решение
FAQ / запись / статус Live-1 Luna так по умолчанию
Многошаговые инструменты, нужно стабильно выбрать функцию Live-1 Terra официальный старт
Межфайловый код, длинное исследование, computer use голос можно выключить Astra Флагман только на этот прыжок
Ночное сканирование, пакетные саммари без Live-1 Terra Batch Полуцена, не занимайте живой слот
Нужно сжать хвостовую задержку Live-1 Terra Fast 2× цена, только последний прыжок
// повышайте по задаче, не по бренду
if (task.voice) session.model = "gpt-live-1";
if (task.kind === "faq") backend = "gpt-5.6-luna";
else if (task.kind === "tool_agent") backend = "gpt-5.6-terra";
else if (task.kind === "hard_reason") backend = "gpt-6-astra";

If вход — голос, Then Live-1 + Terra, Astra как кнопка апгрейда. If IDE-агент и каждый ход трогает несколько файлов, Then поставьте Astra дневной потолок, рутину отправьте на Luna. If контекст часто близко к 272K, Then сначала саммари, потом запрос — не играйте в лотерею подорожания всего заказа.

If→Then: можете понизить — понижайте. Бэкенд пишите gpt-6-astra только когда цена переделки выше разницы с флагманом.

Частые вопросы FAQ

Сколько стоит GPT-Live-1 API?

Голосовой слой по публичному тарифу $0.05/мин, посекундно, без округления вверх. 10 минут ≈ $0.50. Бэкенд, инструменты и телефонная линия — отдельно.

Сколько стоит миллион токенов GPT-6 Astra?

Стандартный короткий контекст: Input $10, Output $50, попадание в кэш $1, запись в кэш $12.50. Пополам вход/выход ≈ $30; 80/20 ≈ $18. Pro в этой повседневной таблице нет.

Что дороже — GPT-Live-1 или Astra?

Единицы разные, напрямую не сравнить. На коротком звонке голосовой слой часто дешевле бэкенда. В этом наборе самое дорогое — «Live-1 + Astra на каждый ход + сверхдлинный контекст».

Какой тариф API OpenAI самый дешёвый?

Среди тарифов этой статьи публичная цена токена ниже всего у GPT-5.6 Luna. Она подходит для классификации и FAQ, не как единственный движок межфайлового рефакторинга.

Сколько API стоит AI-агенту за месяц?

По таблице лёгкий / средний / тяжёлый: чистый текст целиком на Astra ≈ $100 / $600 / $2,000. Сначала выгрузите свои минуты и токены, потом умножьте на публичные тарифы.

Итог

Подходит тем, кому нужна именно прайс-таблица: сначала понять поминутную плату Live-1 и токены Astra, потом той же суммой оценить месяц агента.

Не подходит тем, кто всё ещё ищет «один самый дешёвый универсал». Обычно это флагман без маршрутизации — самая дорогая строка таблицы.

If вход — голос, Then Live-1 + Terra/Luna. If вход — жёсткое рассуждение, Then Astra и держите 272K. Дальше сверка трёх флагманов: Astra vs Fable vs Flash, или слой подписки цены ChatGPT Work. С этой таблицы API в аренду машины прыгать не нужно.