Перейти к основному содержанию

GPT-6 Astra API: актуальные цены, доступ и расчёт длинного контекста

7 мин чтенияOpenAI API

Цена GPT-6 Astra начинается с $10 за 1 млн входных токенов и $50 за 1 млн выходных токенов в Standard, но запрос свыше 272 000 входных токенов целиком переходит на более дорогие ставки.

Цена GPT-6 Astra API и проверка доступа к модели для пилота

На 4 сентября 2026 года у GPT-6 Astra уже есть официальный прайс для прямого API OpenAI. В режиме Standard запрос с 272 000 входных токенов или меньше стоит $10 за 1 млн обычных входных токенов, $1 за 1 млн кэшированных, $12,50 за 1 млн токенов, записанных в кэш, и $50 за 1 млн выходных. Эти ставки опубликованы в актуальном прайсе OpenAI.

Однако опубликованная цена ещё не означает, что модель доступна каждому ключу. OpenAI описывает поэтапное развёртывание для ограниченного круга организаций, а фактический доступ зависит от проекта. Проверять нужно не страницу анонса, а реальный вызов с model: "gpt-6-astra" в своём проекте. Страница модели также отмечает Free как неподдерживаемый вариант и указывает зависящие от уровня аккаунта лимиты.

Самая дорогая ошибка в предварительной смете — считать, что повышенная цена применяется только к токенам сверх 272 000. Если вход длиннее этого порога хотя бы на один токен, весь запрос рассчитывается по ставкам длинного контекста: $20 за вход, $2 за кэшированный ввод, $25 за запись в кэш и $75 за выход на 1 млн токенов.

Две шкалы цены GPT-6 Astra

Все значения ниже указаны в долларах США за 1 млн токенов прямого API OpenAI. Налоги, индивидуальный договор, кредиты и цены сторонних площадок в таблицу не входят.

Число входных токенов в запросеОбычный вводКэшированный вводЗапись в кэшВывод
Не более 272 000$10$1$12,50$50
Более 272 000$20$2$25$75

Порог определяется именно входными токенами. Максимальное окно контекста и ценовая граница — разные вещи. По официальным характеристикам GPT-6 Astra, окно составляет 1 050 000 токенов: до 922 000 на входе и до 128 000 на выходе. Модель принимает текст и изображения, а возвращает текст. Большое окно позволяет передать очень длинный материал, но запрос уже после 272 000 входных токенов целиком оплачивается по тарифу длинного контекста.

Запись в кэш стоит в 1,25 раза дороже обычного ввода: $12,50 вместо $10 в коротком диапазоне и $25 вместо $20 в длинном. Экономия появляется при повторном использовании, когда те же токены оплачиваются уже как кэшированный ввод по $1 или $2. Поэтому смета должна разделять как минимум четыре величины, а не объединять весь промпт в одну строку.

Базовая формула для одного запроса выглядит так:

text
стоимость токенов = обычный ввод / 1 000 000 × ставка обычного ввода + кэшированный ввод / 1 000 000 × ставка кэшированного ввода + запись в кэш / 1 000 000 × ставка записи + вывод / 1 000 000 × ставка вывода

После выбора нужной строки прайса к результату применяют множитель режима обработки, а затем, если это действительно относится к вашему региональному варианту, региональную надбавку. Платные инструменты считаются отдельно.

Три расчёта, которые показывают реальную разницу

Повторный короткий запрос: $0,53

Пусть в Standard запрос содержит 20 000 некэшированных входных токенов, 80 000 кэшированных и 5 000 выходных. Новых записей в кэш нет:

text
20 000 / 1 000 000 × $10 = $0,20 80 000 / 1 000 000 × $1 = $0,08 5 000 / 1 000 000 × $50 = $0,25 Итого: $0,53

Если первый запрос вместо чтения 80 000 токенов записывает их в кэш, та же смесь обойдется в $1,45: $0,20 за обычный ввод, $1 за запись и $0,25 за вывод. Сравнивать $1,45 и $0,53 как гарантированную экономию нельзя без ожидаемого числа повторов, но эти две суммы сразу показывают, почему запись и чтение кэша должны быть разными строками бюджета.

Длинный запрос: $7,50

Для 300 000 некэшированных входных и 20 000 выходных токенов применяются длинноконтекстные ставки ко всему запросу:

text
300 000 / 1 000 000 × $20 = $6,00 20 000 / 1 000 000 × $75 = $1,50 Итого: $7,50

Здесь нет кэша, инструментов, налога или региональной надбавки. Это иллюстративная арифметика, а не прогноз счета для любого приложения.

Один токен за границей меняет всю смету

Рассмотрим Standard-запрос с 10 000 выходных токенов, без кэша и инструментов:

ВходРасчетСтоимость
272 000 токенов272 000 × $10/млн + 10 000 × $50/млн$3,22
272 001 токен272 001 × $20/млн + 10 000 × $75/млноколо $6,19

Это не плавная доплата за один лишний токен. Переоцениваются все входные и выходные токены запроса. Практический вывод: не планируйте рабочую нагрузку вплотную к порогу. Системная инструкция, история диалога, содержимое файлов и результат поиска тоже могут увеличить вход.

Расчёт стоимости GPT-6 Astra по входным, кэшированным и выходным токенам

Standard, Batch, Flex и Fast

OpenAI указывает, что Batch и Flex стоят 50% от Standard, а Fast — вдвое дороже применимой ставки. Поэтому цену можно вычислить без отдельной догадки для каждой корзины токенов. В строках таблицы порядок такой: обычный ввод / кэшированный ввод / запись в кэш / вывод.

Режим обработкиДо 272 000 входных токеновБолее 272 000 входных токенов
Standard$10 / $1 / $12,50 / $50$20 / $2 / $25 / $75
Batch$5 / $0,50 / $6,25 / $25$10 / $1 / $12,50 / $37,50
Flex$5 / $0,50 / $6,25 / $25$10 / $1 / $12,50 / $37,50
Fast$20 / $2 / $25 / $100$40 / $4 / $50 / $150

Для примера на 300 000 входных и 20 000 выходных токенов базовые $7,50 превращаются в $3,75 для Batch или Flex и в $15 для Fast. Это сравнение касается цены, а не эквивалентной задержки или доступности. В руководстве по актуальным моделям для Fast не заявлена гарантия задержки, а его доступность также может различаться.

Не подставляйте слово из маркетингового названия режима в service_tier наугад. Batch использует отдельный пакетный процесс, а доступные значения service_tier для синхронного запроса следует брать из текущей документации и проверять в ответе API для своего проекта. Для первого теста разумнее оставить Standard, чтобы одновременно не выяснять доступ к модели и к дополнительному режиму.

Региональная обработка и инструменты добавляются сверху

Для подходящих моделей и региональных конечных точек OpenAI указывает надбавку 10% за региональную обработку или хранение данных. Она относится не ко всем регионам и не ко всем аккаунтам: сначала нужно подтвердить соответствие модели, конечной точки и договора. Например, базовые $7,50 из длинного запроса стали бы $8,25 при применимой надбавке 10%. Astra Fast сейчас недоступен при EU data residency — это отдельное ограничение, а не ещё один ценовой множитель. Эти условия приведены в прайсе и руководстве по GPT-6 Astra.

Встроенные инструменты не следует прятать в цене токенов:

  • web search стоит $10 за 1000 вызовов, то есть $0,01 за один вызов, плюс токены найденного содержимого по ставке выбранной модели;
  • вызовы и хранение file search оплачиваются отдельно;
  • размещенные контейнеры также имеют собственную плату;
  • само обращение к API не создаёт отдельную строку цены сверх фактического использования.

Не каждый запрос вызывает инструмент. Добавляйте соответствующую строку только в тот сценарий, где инструмент действительно используется. Для оценки поиска особенно важно учитывать и цену вызова, и дополнительные токены контента: одна лишь сумма $0,01 неполна.

Как проверить доступ именно для своего проекта

Анонс OpenAI говорит о поэтапном доступе для ограниченного круга организаций и более широком развертывании в ChatGPT и API в последующие дни. Другая официальная страница одновременно называет gpt-6-astra доступной API-моделью. Это не противоречие, если различать существование API-маршрута и разрешение для конкретного проекта.

Проверка должна быть минимальной и дешевой. Выполните простой запрос через Responses API тем же проектом и ключом, которые планируете использовать в пилоте:

bash
curl https://api.openai.com/v1/responses \ -H "Authorization: Bearer $OPENAI_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-6-astra", "input": "Верни только слово READY" }'

Успешный ответ подтверждает доступ этого проекта в момент проверки. Отказ не доказывает, что модели «нет в API»: сначала проверьте выбранный проект, его уровень доступа и состояние поэтапного развёртывания. Не стройте обработку вокруг предполагаемого текста ошибки — универсальный код или сообщение для отсутствия доступа текущие источники не обещают.

Доступ в приложении ChatGPT, подписка ChatGPT и баланс прямого API — не одно и то же. Аналогично, если Astra используется через Amazon Bedrock, счёт и условия определяет AWS; переносить туда ставки OpenAI из этой статьи нельзя. Для любого другого шлюза действует то же правило: сначала найдите прайс стороны, которая выставляет счёт.

Проверка доступа к GPT-6 Astra и этапы бюджетного пилота

Перед пилотом проверьте совместимость вызова

Для нового запроса укажите model: "gpt-6-astra". Модель поддерживает Responses API и Chat Completions, но для вызова инструментов официальное руководство рекомендует Responses API. Уровни рассуждения поддерживаются от low до max; значение none не поддерживается. Параметры temperature, top_p и семейство logprobs, которые модель не принимает, нужно удалить, а не пытаться подобрать для них старые значения.

При переносе кэша с GPT-5.5 или более ранней модели документация указывает prompt_cache_options.ttl: "30m". Эта настройка важна для сметы: без фактического повторного использования более дорогая запись в кэш сама по себе не снижает расходы.

Не начинайте с максимального контекста. Сначала сохраните исходный набор задач, оцените четыре корзины токенов и проверьте короткий Standard-вызов. Затем отдельно прогоните сценарий около 272 000 токенов и сценарий выше порога. Так ценовой скачок не растворится в среднем значении.

Когда премия Astra может окупиться

Для ценового ориентира GPT-5.6 Sol сейчас стоит $4 / $0,40 / $5 / $20 в коротком Standard-контексте и $8 / $0,80 / $10 / $30 в длинном. При одинаковой смеси токенов, диапазоне контекста и режиме ставки Astra ровно в 2,5 раза выше. Это означает простой порог: чтобы сравняться по счёту, Astra должна сократить оплачиваемую нагрузку примерно до 40% — например, за счёт существенно меньшего числа повторов или более короткого принятого результата. Текущий прайс Sol является рекламным как минимум до 21 ноября 2026 года, поэтому сравнение нужно пересмотреть после этой даты. Все ставки взяты из официального прайса OpenAI.

Множитель 2,5 не доказывает, что Astra лучше или хуже на ваших задачах. Необходим небольшой контрольный пилот с одинаковыми входами и критериями принятия результата. Сравнивайте не только цену одного вызова, а стоимость принятого результата: токены первоначального ответа, исправления, повторные попытки, использование инструментов и долю результатов, которые действительно прошли проверку.

До запуска задайте лимит расходов и заранее определите решение:

  1. доступ подтвержден тем же проектом, который пойдет в работу;
  2. короткие и длинные запросы считаются раздельно;
  3. запись в кэш и кэшированный ввод не смешаны;
  4. режим обработки и применимость региональной надбавки зафиксированы;
  5. инструменты учтены отдельными строками;
  6. качество оценивается по заранее выбранным рабочим примерам, а не по одному демонстрационному ответу;
  7. переход выполняется только если стоимость принятого результата оправдывает премию.

Итог для первичного решения прост: официальный прайс GPT-6 Astra уже существует, но доступ нужно подтвердить вызовом своего проекта. Для большинства пилотов опаснее всего не базовые $10 и $50, а полная переоценка запроса после 272 000 входных токенов. Сначала проверьте доступ и короткий Standard-сценарий, затем измерьте кэш, длинный контекст и нужный режим на реальной выборке — и только после этого переносите нагрузку.

#GPT-6 Astra#OpenAI API#API pricing#длинный контекст#кэширование промптов
Поделиться: