Короткий ответ: выбирать между GPT-6 Astra и Claude Fable 5.1 по одному рейтингу нельзя. Для длинного некэшированного входа и часто читаемого кэша Fable 5.1 может оказаться заметно дешевле. Если важны договорный режим Zero Data Retention или инструменты, уже построенные вокруг Responses API, первым кандидатом может быть Astra. Для программирования, исследований и длительной автоматизации окончательный выбор всё равно требует одинакового задания, заранее заданного критерия приёмки и учёта всех повторов.
Состояние спецификаций в этой статье — на 4 сентября 2026 года. OpenAI представила GPT-6 Astra 3 сентября и описала поэтапное открытие доступа, а Anthropic указывает для Claude Fable 5.1 дату выпуска 1 сентября. Публичный анонс не доказывает, что модель уже доступна в конкретном аккаунте, регионе или облачном канале.
Сначала проверьте доступ, а не сравнивайте обещания
Точные идентификаторы API — gpt-6-astra и claude-fable-5-1. Похожее название в интерфейсе, у посредника или в таблице тарифов ещё не подтверждает, что запрос обслужила нужная модель. До переноса рабочей нагрузки сделайте минимальную проверку в том же канале, где собираетесь работать:
- найдите точный model ID в списке моделей своего проекта;
- отправьте короткий безопасный запрос без конфиденциальных данных;
- сохраните идентификатор из ответа и запись usage;
- проверьте валюту, квоту, лимит скорости и фактический источник списания;
- уточните регион обработки, срок хранения и право на требуемый режим данных.
Анонс Astra перечисляет поэтапный доступ для отдельных организаций, платных планов ChatGPT, API и AWS. Это не означает одновременное включение всех способов доступа. Anthropic перечисляет для Fable 5.1 Claude API и несколько облачных платформ, но наличие модели, регион и договорные условия также зависят от конкретного аккаунта.

Для пользователя из России особенно важно не подменять эту проверку русскоязычной страницей или ценой посредника. Официальные материалы не подтверждают универсальную возможность регистрации, оплаты и вызова обеих моделей из РФ. Если сервис скрывает upstream, реальный model ID или политику хранения, его результат характеризует именно маршрут посредника, а не официальный API-контракт.
Похожие размеры контекста скрывают разные расходы
У моделей почти одинаковые максимальные окна, но одинаковое число токенов не гарантирует одинаковую стоимость. Карточка GPT-6 Astra указывает контекст 1 050 000 токенов, максимальный вывод 128 000 и отдельное правило для входа свыше 272 000 токенов. Карточка Claude Fable 5.1 указывает окно 1 млн, вывод до 128 тыс. токенов и постоянно включённое адаптивное рассуждение.
Базовые ставки ниже приведены для прямого API и миллиона токенов. Цены Astra взяты из официальной карточки модели OpenAI, а цены Fable — из тарифов Claude API.
| Параметр | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| Вход Standard | $10 | $10 |
| Кэшированный вход / чтение кэша | $1 | $0,25 |
| Запись кэша | $12,50 | $12,50 на 5 минут; $20 на 1 час |
| Выход Standard | $50 | $50 |
| Контекстное окно | 1 050 000 | 1 000 000 |
| Максимальный вывод | 128 000 | 128 000 |
Критическое различие возникает после 272 тыс. входных токенов. У Astra превышение порога повышает цену всего запроса: вход и кэш тарифицируются с множителем 2, а выход — с множителем 1,5. Документация Claude о контекстном окне говорит, что запросы в пределах 1 млн токенов сохраняют стандартную ставку Fable 5.1.
Это не делает Fable автоматически лучше для длинных документов. Провайдеры могут по-разному токенизировать один и тот же материал, а большой контекст не гарантирует, что модель удержит нужные ограничения. Но порог Astra обязательно нужно включить в бюджет до загрузки репозитория, архива документов или длинной истории агента.
Два расчёта, которые меняют порядок пилота
Рассмотрим только токены и одинаковые измеренные объёмы, не выдавая расчёт за реальный счёт.
При 250 тыс. токенов, прочитанных из кэша, 10 тыс. новых входных и 5 тыс. выходных токенов:
- Astra:
0,25 + 0,10 + 0,25 = $0,60; - Fable 5.1:
0,0625 + 0,10 + 0,25 = $0,4125.
При 300 тыс. некэшированных входных и 10 тыс. выходных токенов:
- Astra:
300K × $20/MTok + 10K × $75/MTok = $6,75; - Fable 5.1:
300K × $10/MTok + 10K × $50/MTok = $3,50.
В примерах не учтены первоначальная запись кэша, инструменты, повторы, налоги, наценка облака или посредника и различия токенизации. Поэтому использовать их стоит как сигнал: для длинного входа и повторного чтения большого контекста Fable нужно проверять раньше, а не как доказательство меньшей цены любой завершённой задачи.
Полезная рабочая метрика выглядит иначе:
стоимость принятого результата = все вызовы + кэш + инструменты + повторы + время проверки человека
Если дешёвый запуск дважды нарушает требования и требует ручной переделки, цена его токенов мало помогает. Неудачные попытки нельзя выбрасывать из расчёта.
Инструменты и политика данных могут решить выбор до теста качества
Astra поддерживает уровни рассуждений low, medium, high, xhigh и max, но не none. Руководство по GPT-6 Astra рекомендует работать с инструментами через Responses API и отдельно описывает асинхронные вызовы и управление во время хода модели. Если агент уже использует этот контракт, пилот Astra можно встроить без попытки искусственно повторить поведение Claude API.
Fable 5.1 использует постоянно включённое адаптивное рассуждение; для API значением effort по умолчанию служит high. Важное миграционное ограничение: по release notes Anthropic значения tool_choice: any и tool_choice: tool возвращают HTTP 400, тогда как auto и none остаются допустимыми. Агент, который принудительно требует вызов функции, сначала нуждается в изменении оркестрации, а уже затем — в сравнении качества.
С политикой данных различие столь же практично. Для подходящих API-клиентов OpenAI описывает поддержку Zero Data Retention, но право на этот режим нужно подтвердить для конкретного проекта. Условия Anthropic для Fable 5.1 предусматривают хранение в течение 30 дней по умолчанию; исключение возможно лишь для явно подходящих enterprise-клиентов. Там же описаны защитные механизмы и возможность обработки запроса другой моделью Claude. Если для аудита важна модель-исполнитель, сохраняйте её фактический идентификатор, а не только запрошенное имя.
Облачная площадка может иметь собственные регионы, журналы, наценки и договор. Не переносите условия прямого Claude API или OpenAI API на Bedrock, Foundry либо посредника без проверки.
Как выбирать по рабочей нагрузке
Большие документы и повторно используемый контекст
Начните с Fable 5.1, если типичный некэшированный вход регулярно превышает 272 тыс. токенов или один и тот же большой корпус часто читается из кэша. Его опубликованные ставки в этих двух сценариях выгоднее. Затем проверьте качество извлечения важных ограничений: контекст, который поместился, но не повлиял на ответ, не создаёт ценности.
Если вход можно надёжно разбить, извлечь релевантные части или сократить до порога, Astra снова становится полноценным кандидатом. Сравнивайте не максимальный размер окна, а весь способ подготовки данных и долю принятых результатов.
Агентная автоматизация и работа с компьютером
Astra логично поставить первой, когда существующий процесс использует Responses API, асинхронные инструменты или управление во время выполнения. Но заявленная пригодность к работе с компьютером не доказывает устойчивость в вашей среде. Критерий должен проверять завершение всей операции: правильное состояние системы, отсутствие нежелательных действий и восстановление после ошибки инструмента.
Fable 5.1 стоит включить в тот же пилот, если оркестратор совместим с её правилами tool_choice. Учитывайте не только правильный финальный текст, но и число вызовов, зависания, повторные запросы, вмешательство человека и случаи защитной маршрутизации.
Программирование
Для исправления кода дайте обеим моделям один и тот же коммит, зависимости, доступные команды и тесты. Приёмка должна требовать не красивого объяснения, а проходящих тестов и изменения, которое не приходится переписывать на ревью. Отдельно считайте попытки после неверной правки, потерю контекста между инструментами и минуты ручной проверки.
Если одна модель сильнее в коротких исправлениях, а другая — в длительной межфайловой переработке, это основание для двойной маршрутизации, а не для объявления общего победителя.
Исследование и аналитика
Зафиксируйте набор разрешённых источников, дату среза и список утверждений, которые обязаны иметь прямую ссылку. Принятым считается вывод, выдержавший выборочную проверку фактов и ограничений. Большое число уверенных абзацев или высокий результат общего теста интеллекта не заменяют такую приёмку.
Бенчмарки задают гипотезу, а не победителя
OpenAI публикует прямые строки сравнения Astra и Fable, но примечания к таблицам указывают максимальные результаты при разных уровнях effort, настройках испытания, fallback и защитных механизмах. Anthropic также публикует собственные результаты и оценки экономии. Обе страницы принадлежат заинтересованным поставщикам.
Из этого можно выбрать тестовый класс, но нельзя сложить разнородные проценты в универсальный рейтинг. Результат терминального агента предлагает проверить исправление реального репозитория; показатель работы с компьютером — сценарий с наблюдаемым конечным состоянием; экономия токенов — расчёт на вашей истории запросов. Effort, оболочка, права инструментов, время и допустимые повторы должны быть записаны рядом с результатом.
Проведите ограниченный сопоставимый пилот
Возьмите 6–10 недавних задач, которые представляют настоящую очередь, а не демонстрационные запросы. До запуска сохраните для каждой задачи:
- неизменный входной снимок и среду;
- одинаковый результат, который считается принятым;
- права на файлы, сеть и инструменты;
- уровень рассуждений или ближайшую доступную настройку;
- лимит времени, бюджета и помощи человека;
- максимум повторов и стоп-условие.

Полной симметрии между API нет: adaptive thinking не равен любому уровню Astra, а наборы инструментов различаются. Не скрывайте это. Цель, вход и критерий приёмки должны быть функционально одинаковыми, а различия исполнения — явно записанными.
Чередуйте порядок моделей, чтобы второй кандидат не всегда получал более тёплый кэш или исправленную среду. Используйте отдельные рабочие копии: ни одна модель не должна видеть подсказки, ошибки и изменения другой. Для каждого запуска фиксируйте запрошенный и фактический model ID, входные/кэшированные/выходные токены, задержку, вызовы инструментов, повторы, итог приёмки и время проверки.
Остановите кандидат раньше лимита, если он нарушил политику данных, выполнил нежелательное внешнее действие, несколько раз повторил одну ошибку или фактическая модель не подтверждается. Такие исходы нельзя компенсировать средней ценой.
Решение может быть двойным — или никаким
После пилота возможны четыре здравых исхода:
- Astra как основной маршрут, если она доступна, соблюдает требования к данным и устойчиво даёт более дешёвый принятый результат на главной нагрузке.
- Fable 5.1 как основной маршрут, если длинный вход, кэш и качество результата перевешивают стоимость миграции оркестратора.
- Двойная маршрутизация, если кандидаты выигрывают в разных классах задач; правило выбора должно опираться на размер входа, инструменты и требования к данным, а не на свободную классификацию модели.
- Отложенная миграция, если доступ нестабилен, разница меньше обычного разброса, не подтверждается фактическая модель или новый маршрут не окупает стоимость перехода.
Заранее задайте порог переключения и рабочий откат. Не меняйте основную модель после одного удачного примера. Если вы переходите с предыдущей версии Claude, отдельно проверьте изменения цены, кэша, effort и инструментов в Fable 5.1.
Практичный старт таков: исключите кандидата, который не проходит доступ, данные или интеграционный контракт; оставшиеся модели прогоните на одной короткой и одной длинной группе задач; посчитайте все попытки на принятый результат. Только после этого выбирайте основной маршрут, специализацию или отказ от миграции. Спецификация помогает решить, кого проверять первым, но победителя определяет ваша рабочая приёмка.



