Перейти к основному содержанию

GPT-5.6 Sol против Claude Fable 5: что выбрать для кода и агентов?

19 мин чтенияСравнение AI-моделей

Начните с Sol для терминала и повторяемых API-задач, с Fable — для длинного контекста. Основной маршрут меняйте только по принятой работе.

Задача выбирает первый тест между GPT-5.6 Sol и Claude Fable 5, а принятая правка определяет рабочий маршрут

Короткий ответ на 21 июля 2026 года: сначала тестируйте GPT-5.6 Sol в Codex для восстановления через терминал, многошаговой работы с инструментами и повторяемых API-задач с жёстким бюджетом. Claude Fable 5 в Claude Code логично первой проверить для длительной межфайловой работы и задач, где полезен контекст 1 млн токенов. Это не общий рейтинг. Основной маршрут выбирает не красивый ответ и не строка бенчмарка, а принятая правка в вашем репозитории с учётом повторов, проверки и отката.

Первая рабочая задачаЧто проверять первымПочему это ещё не окончательный победитель
Ремонт через терминал, восстановление после ошибок команд, много шагов с инструментамиGPT-5.6 Sol в CodexOpenAI направляет Sol на агентные задачи в терминале; заявленная цена API ниже.
Долгое чтение репозитория, межфайловая диагностика, продолжительная переработка кодаClaude Fable 5 в Claude CodeAnthropic заявляет контекст 1 млн токенов и позиционирует Fable для длительной самостоятельной работы.
Уже надёжный рабочий процессСохранить текущий основной маршрут, новый вариант подключить для отдельных задачРезультаты релизных тестов не учитывают повторы, время проверки, регрессии и риск отката.

Проверяйте фактически использованную модель. Если приложение Claude перенаправило отмеченный запрос по кибербезопасности или биологии с Fable на Claude Opus 4.8, результат и расходы нельзя приписывать Fable. Запрос к Fable через API сам по себе не переходит на Opus: для этого разработчик должен явно настроить Anthropic Fallback API. Любой повтор Codex на другой модели тоже записывайте отдельным маршрутом, а не бесплатной второй попыткой Sol.

Правило остановки: не меняйте основной маршрут команды, пока новый вариант не выиграл контролируемую проверку в том же репозитории, не подтвердил фактически использованную модель и не прошёл практическую проверку отката.

Для российского рынка сначала проверьте посредника

Русская выдача заметно зависит от видео, обзоров и сторонних шлюзов. Поэтому до сравнения качества установите владельца маршрута: кто выдал ключ, какой upstream реально ответил, как называется модель в журнале, где хранятся запросы, чем ограничена квота, в какой единице списывается баланс, что произойдёт после пробного периода и можно ли выгрузить usage. Надпись «без VPN», рублёвая цена или совпадающее имя модели не превращают посредника в официальный контракт OpenAI либо Anthropic.

Эта проверка определяет порядок всей страницы: сначала доступ и фактический upstream, затем подходящая форма задачи, и только после этого — одинаковая приёмка в репозитории. Если upstream или фактическую модель доказать нельзя, результат остаётся демонстрацией wrapper, а не голосом за Sol или Fable.

Можно ли бесплатно использовать GPT-5.6 Sol или Claude Fable 5 онлайн?

У семейства GPT-5.6 есть официальный маршрут без оплаты, но сейчас это Terra, а не Sol. На странице запуска OpenAI указано, что Free и Go получают Terra в ChatGPT Work и Codex, а Plus и более высокие планы могут выбирать Sol, Terra и Luna. API Sol стоит $5 за миллион входных и $30 за миллион выходных токенов. Это платный API-контракт, а не официальный бесплатный уровень Sol.

Страница Anthropic перечисляет для Fable планы Pro, Max, Team и Enterprise, но не Free. Официальный API claude-fable-5 стоит $10 за миллион входных и $50 за миллион выходных токенов. Обещание «Fable 5 бесплатно» на стороннем сайте может означать пробный кредит, спонсируемую квоту, общий playground или маршрут шлюза. Оно не становится контрактом Anthropic только из-за названия модели.

Официальная карта бесплатных и платных планов, API и проверки стороннего маршрута

МаршрутЧто говорит официальный владелецЧто делать
OpenAI Free / GoGPT-5.6 Terra в ChatGPT Work и CodexНе называйте результат запуском Sol
OpenAI Plus и вышеДоступны Sol, Terra и LunaЗафиксируйте фактическую модель и лимит плана
OpenAI APISol: $5/M вход, $30/M выходИспользуйте свой проект и учитывайте токены и повторы
Claude FreeFable не указанНе считайте название в оболочке бесплатным селектором
Claude Pro / Max / Team / EnterpriseFable доступенЗаписывайте расход usage credits
Claude APIFable: $10/M вход, $50/M выходДо отправки кода проверьте обязательное хранение 30 дней

Перед сторонним «бесплатным» запуском проверьте восемь полей: провайдер и владелец ключа; официальный или wrapper-ID; квота и срок её действия; логи и хранение; запрошенная модель; доказательство фактической модели; наценка или единица списания; оплата после пробного периода. Остановитесь, если условия скрыты, сервис просит чувствительный код до показа политики или не показывает, какой upstream действительно ответил. Бесплатный запуск в playground не означает постоянный бесплатный API, а рублёвая цена посредника не является официальной ценой OpenAI или Anthropic.

Карточка фактического upstream и оплаты

Фраза «Codex 5.6 против Claude Code Fable 5» смешивает сущности разных уровней. GPT-5.6 Sol и Claude Fable 5 — модели. Codex и Claude Code — рабочие оболочки для программирования: они собирают контекст, предоставляют инструменты, применяют права доступа, запускают команды и возвращают модели их результаты. Схема оплаты определяет, расходуются ли лимиты подписки, кредиты или оплачиваемые токены API. Фактическая модель — та, которая действительно создала результат.

УровеньМаршрут OpenAIМаршрут AnthropicЧто записывать
МодельGPT-5.6 SolClaude Fable 5Точный идентификатор модели или значение выбора в интерфейсе
Рабочая оболочкаCodexClaude CodeВерсию клиента, инструменты, права, память и параметры выполнения
ОплатаТариф ChatGPT, кредиты или APIТариф Claude, кредиты использования или APIРеальный способ оплаты; цена API не заменяет счёт за подписку
Фактическая модельМодель в активном ответе Codex или APIFable либо Opus 4.8 после защитного переключения в приложенииЖурнал запуска, а не только запрошенный идентификатор

Для каждого запуска скопируйте карточку атрибуции и заполните её до того, как увидите результат:

text
Задача / commit / чистая рабочая копия: Запрошенная модель: Рабочая оболочка, версия и effort: Права, инструменты и лимит помощи человека: Маршрут оплаты и владелец ключа: Фактически использованная модель: Токены, повторы, время и расходы: Приёмочные тесты и решение проверяющего: Откат проверен: да / нет

Первые четыре строки фиксируют одинаковый вход и маршрут; последние пять связывают результат с фактической моделью и принятой работой. Карточка не устраняет различия Codex и Claude Code, зато не даёт оболочке, запасной модели или посреднику незаметно присвоить себе результат.

Это разделение меняет смысл результата. Если Codex восстановился после упавшей команды благодаря своему циклу выполнения, это преимущество сочетания Sol и Codex, а не доказательство качества «чистой» Sol. Если Claude Code удержал ограничения на протяжении долгой сессии разработки, это преимущество сочетания Fable и Claude Code. Прямой запрос к API и полноценная рабочая оболочка для программирования не являются одним экспериментом, даже если идентификатор модели совпадает.

Особенно опасно пропускать фактическую модель. Anthropic сообщает, что в приложениях Claude запросы, отмеченные защитными системами как связанные с кибербезопасностью или биологией, могут перейти с Fable на Opus 4.8. API устроен иначе: выбор claude-fable-5 не включает Opus автоматически. Резервная модель вызывается только тогда, когда разработчик явно настроил Fallback API. Без журнала запуска команда способна ошибочно приписать Fable успех, который на самом деле принадлежит Opus.

Для OpenAI нужна та же дисциплина. Компания предупреждает, что консервативные защитные механизмы Sol могут задеть безобидную работу, а ChatGPT и Codex способны предложить повтор на менее мощной модели. Для такого повтора создайте отдельную строку с фактической моделью, токенами, задержкой, изменением кода и решением проверяющего. Иначе Sol одновременно получит чужой успех и заниженную стоимость.

Если нужно сравнить продукты целиком — тарифы, лимиты, права, скорость, передачу контекста и командный процесс, — используйте отдельное сравнение Claude Code и Codex. Здесь единица решения уже: GPT-5.6 Sol в Codex, Claude Fable 5 в Claude Code и любой реально сработавший резервный маршрут как отдельный результат.

От локального сигнала к проверяемому пилоту

Первый пробный запуск — опровержимая гипотеза, а не коллекция удачных демонстраций. Он не должен заранее подыгрывать одному инструменту. Свяжите каждый внешний сигнал с конкретным классом задач, а затем потребуйте доказательство из собственного репозитория.

Тип задачиПервый пробный маршрутДоказательство до внедрения
Исправление ошибки через терминалSol в CodexСуществующие тесты проходят с меньшим числом повторов, а проверяющему не приходится переписывать основное исправление
Многошаговое восстановление работы инструментовSol в CodexМаршрут восстанавливается после реальных сбоев без опасных команд и дополнительных подсказок человека
Длительный анализ репозиторияFable в Claude CodeОграничения сохраняются до принятой реализации, а работа не заканчивается убедительным планом без кода
Переработка с большим контекстомFable в Claude CodeМежфайловые инварианты соблюдены; большой контекст не подменяет точность
Повторяющиеся задания программирования через APIСначала API SolБолее низкая заявленная цена сохраняет преимущество после повторов, задержки, CI и ручной проверки
Реализация интерфейсаПроверить обаОдинаковые критерии внешнего вида, доступности, статической проверки, тестов и поведения в браузере; привлекательный снимок экрана не считается оценкой
Работа рядом с кибербезопасностью или биологиейВынести отдельноПовтор Codex на другой модели и переключение приложения Claude на Opus записываются как отдельные маршруты
Надёжный существующий процессСохранить его резервнымНовый вариант даёт больше принятой работы и допускает безопасный обратный переход

Почему для терминала первым идёт Sol? В таблице OpenAI от 9 июля Sol лидирует в Terminal-Bench 2.1, DeepSWE v1.1 и Artificial Analysis Coding Agent Index v1.1. Почему в проверку задач репозитория нужно включить Fable? В той же таблице Fable заметно лидирует в SWE-Bench Pro, а Anthropic заявляет контекст 1 млн токенов. Здесь нет противоречия: сигналы относятся к разным первым задачам.

Большое контекстное окно — это ёмкость, а не принятая работа. Модель может прочитать тысячи файлов и потерять ключевой инвариант из сценария миграции. Другая модель может увидеть меньше файлов, но быстрее найти источник ошибки по результатам инструментов. Поэтому проверка длинного контекста должна заканчиваться изменением кода, тестами и проверкой, а не оценкой объёма анализа.

Сильный результат в терминальном тесте тоже не обещает победу в вашей среде. Внутренний интерфейс командной строки, порядок подтверждений, сеть, командная оболочка, кэш монорепозитория и правила репозитория меняют поведение рабочей оболочки. Не упрощайте задачу перед сравнением. Если реальная работа включает упавшую команду или неполный вывод инструмента, сохраните это условие, иначе вы не измерите способность восстановиться.

Низкая цена API позволяет Sol первой попасть в пакет задач с жёстким бюджетом, но рабочая стоимость зависит от принятия результата. Дешёвый запуск, который дважды повторяют, а потом исправляют вручную, способен обойтись дороже более дорогого запуска, принятого с первой попытки.

Официальные условия на 21 июля 2026 года

На дату проверки OpenAI указывает Sol, Terra и Luna для Plus, Pro, Business и Enterprise, а в API доступны все три модели. Free и Go получают Terra, а не бесплатный Sol. Anthropic перечисляет Fable для Pro, Max, Team и Enterprise и документирует API claude-fable-5. Доступ всё равно может зависеть от тарифа, региона, рабочего пространства и настроек администратора, поэтому фиксируйте не только название в интерфейсе, но и фактический маршрут.

УсловиеGPT-5.6 SolClaude Fable 5
ДоступSol выбирается на Plus, Pro, Business и Enterprise; Free и Go получают Terra; API доступен отдельноFable перечислена для Pro, Max, Team и Enterprise и доступна через Claude Platform
Идентификатор APIgpt-5.6-solclaude-fable-5
Цена входных данных API$5 за 1 млн токенов$10 за 1 млн токенов
Цена выходных данных API$30 за 1 млн токенов$50 за 1 млн токенов
Дополнительные официальные цены$0.50 за 1 млн кэшированных входных токенов; $6.25 за запись в кэш; Batch/Flex — $2.50/$15, Priority — $10/$60 за вход/выходДля расчёта этой статьи используется стандартный контракт $10/$50; особенности кэша проверяйте отдельно перед миграцией
Контекст и выводПеред внедрением проверяйте конкретный маршрут OpenAI; лимит рабочей среды не является условием APIКонтекст 1 млн токенов, вывод до 128 тыс. токенов
Граница данныхУсловия фактически используемой учётной записи и маршрута OpenAIОбязательное хранение 30 дней; режим без хранения данных недоступен
Защитный маршрутПовтор на другой модели учитывается отдельной попыткойПриложения Claude могут перейти на Opus 4.8; резерв через API требует явной настройки

Источники: релиз GPT-5.6, модели Codex и официальные цены API у OpenAI; страница Fable, контракт модели и правила подсчёта токенов у Anthropic.

Лимит подписки и долларовая цена миллиона токенов API — разные единицы. Записывайте тариф, фактически списанные кредиты, ограничения скорости и расходы API в разных столбцах; не подставляйте цену API в расчёт сессии Codex или Claude Code внутри подписки.

Есть отдельный риск миграции на Fable: она использует токенизатор, появившийся в Claude Opus 4.7. Anthropic предупреждает, что одинаковый текст может давать примерно на 30% больше токенов, чем у моделей до Opus 4.7; точное изменение зависит от содержимого. Это не гарантированная надбавка к каждому запросу. Перед прогнозом стоимости и вместимости прогоните реальные payload через подсчёт токенов именно для claude-fable-5, иначе старый бюджет может систематически занижать расход.

При 200 000 входных и 40 000 выходных токенов расчёт API для моделей выглядит так:

  • Sol: 0.2 × $5 + 0.04 × $30 = $2.20.
  • Fable: 0.2 × $10 + 0.04 × $50 = $4.00.

Расчёт не включает кэширование, повторы, запуск инструментов, CI, региональные условия и ручную проверку. Он также не показывает стоимость сеанса Codex или Claude Code внутри подписки. У Sol ниже заявленная цена API, но это не даёт автоматического рабочего преимущества. Два неудачных запуска и 45 минут ручного исправления могут сделать маршрут за $2.20 дороже маршрута за $4 с одним проходом и короткой проверкой.

Условие хранения данных должно участвовать в решении о допустимости ещё до запуска. Если данные репозитория или запрос нельзя хранить 30 дней, Fable не подходит для этой задачи независимо от оценки возможностей. Политику данных проверяют до того, как модель увидела содержимое.

Четыре строки тестов дают разные ответы

OpenAI публикует не единый рейтинг, а четыре отдельных сравнения. Их следует использовать как ориентиры от поставщика, а не как независимое контролируемое состязание между Codex и Claude Code.

Тест на странице OpenAIGPT-5.6 SolClaude Fable 5Кто впередиОграничение методики
Artificial Analysis Coding Agent Index v1.180.077.2SolДля Sol указан режим рассуждений max; Fable приведена строкой конкурента в таблице релиза
SWE-Bench Pro64.6%80.0%FableЭто не испытание Codex и Claude Code в одной рабочей оболочке
DeepSWE v1.172.7%69.7%SolДля двух маршрутов не раскрыта полностью одинаковая конфигурация клиентов
Terminal-Bench 2.188.8%83.1%SolРабочую оболочку, права, вычислительное усилие и правила повторов нужно фиксировать локально

Режим max важен: объём рассуждений влияет на качество, задержку и стоимость. Для остальных строк открытых сведений тоже недостаточно, чтобы утверждать, что инструменты, права, сбор контекста, число разрешённых повторов и версии клиентов совпадали. Поэтому таблица помогает выбрать первую проверку, но не объявляет основной рабочий маршрут.

OpenAI отдельно указывает, что показанные оценки задержки и цены API смоделированы по рабочему поведению, а реальные результаты могут отличаться. Такая модель расчёта полезна для гипотезы, но не заменяет ваши журналы токенов, время по часам, длительность работы инструментов и минуты проверяющего.

Не усредняйте четыре результата. У задач разные шкалы и методики, поэтому среднее число лишено инженерного смысла. Победа Fable в SWE-Bench Pro остаётся важным сигналом для исправления задач, даже если Sol ведёт в трёх других строках. Преимущество Sol в Terminal-Bench указывает на хорошую первую проверку терминальных задач, но не доказывает соблюдение незадокументированных бизнес-правил вашего проекта.

Превращайте каждую строку в проверяемую гипотезу. Terminal-Bench предлагает задачи восстановления после ошибок команд. SWE-Bench Pro — реальные исправления дефектов. DeepSWE — самостоятельную реализацию. Большой контекст Fable — межфайловую диагностику. Если результат в вашем репозитории противоречит таблице релиза, решение о рабочем маршруте должно следовать локальному результату.

Как провести одинаковую проверку в одном репозитории

Контроль начинается до первого запуска. Codex и Claude Code нельзя сделать полностью одинаковыми: циклы выполнения, инструменты и управление контекстом входят в ценность каждого маршрута. Но можно зафиксировать состояние репозитория, цели, тесты, порядок задач, лимит помощи человека и набор доказательств.

Возьмите десять задач из недавней очереди:

  1. Два исправления ошибок с существующими или скрытыми приёмочными тестами.
  2. Две межфайловые переработки с заранее записанными инвариантами.
  3. Две задачи диагностики с длинным контекстом, затрагивающие удалённые части репозитория.
  4. Две задачи восстановления команд или инструментов после реалистичных сбоев.
  5. Одно изменение интерфейса с критериями внешнего вида, доступности, статической проверки, тестов и браузера.
  6. Одно изменение API или документации, которое требуется сверить с реализацией.

Одинаковые исходные данные репозитория и метрики принятой работы

Перед каждой парой запусков сохраните адрес репозитория, SHA коммита, состояние ветки, файл блокировки зависимостей и образ среды выполнения. Зафиксируйте полный запрос, приложенные файлы, начальный контекст и правила репозитория. Запишите запрошенную и фактическую модели, версию рабочей оболочки, режим рассуждений, инструменты, права на файловую систему, сеть и команды, а также порядок подтверждений.

Приёмочные тесты должны существовать до обоих запусков. Назначьте одинаковый срок и одинаковый лимит вмешательства человека. Например, разрешите один самостоятельный проход и один проход исправления с тем же самым выводом тестов. Сохраняйте изменение кода, журнал команд, результаты тестов, токены, задержку, расходы и решение проверяющего. Не передавайте второму варианту подсказку, найденную первым.

Каждый запуск начинайте в новой рабочей копии или в равнозначном чистом состоянии. Второй вариант не должен видеть изменение первого, замечания проверяющего и уже найденные сбои. Чередуйте порядок маршрутов между задачами: прогретый кэш, нагрузка поставщика или усталость оценщика иначе могут постоянно помогать одной стороне.

Одинаковый запрос не означает, что у рабочих оболочек должна быть одна командная строка. Совпадать должны основная цель, ограничения репозитория, приёмочные тесты и лимит вмешательства. Разные команды запуска и права можно функционально адаптировать, но различия требуется записать. По возможности давайте проверяющему обезличенные изменения и тесты, не называя маршрут заранее.

Задачи, способные вызвать защитное переключение, проверяйте отдельной группой. Если Claude Code перешёл на Opus 4.8, сохраните запуск как доказательство поведения системы, но не начисляйте результат Fable. Если Codex использовал повтор на менее мощной модели, сохраните обе попытки отдельно. Только так возможности модели не смешиваются с поведением маршрутизации.

Десять задач могут опровергнуть слабую гипотезу или обнаружить узкую специализацию. Для замены зрелого основного маршрута обычно нужен второй цикл на ключевых классах задач. Если результаты близки, расширяйте набор реальной рабочей очередью, а не подбирайте задания под желаемого победителя.

Считайте принятую работу, а не объём ответа

Принятым считается изменение, которое проходит заранее заданные тесты, соблюдает ограничения репозитория, не создаёт существенной регрессии безопасности или данных и выдерживает проверку без переписывания основного решения человеком. Только такие изменения входят в знаменатель.

ПоказательЧто он показывает
Принятые измененияСколько работы команда действительно может объединить с основной веткой
Принятие с первого проходаВыдерживает ли самостоятельная работа первый цикл тестов и проверки
Число повторовСкрытые токены, задержку, расходы CI и оператора
Вмешательства человекаСколько дополнительных подсказок и ручного восстановления понадобилось
Входные и выходные токеныОплачиваемое потребление API
Общее время и время инструментовМедленные циклы, превышения времени и издержки восстановления
Минуты проверкиСтоимость, которую редко включает релизное сравнение
Откат или дефект после объединенияНе создало ли быстрое принятие отложенную цену
Совпадение фактической моделиПринадлежит ли результат запрошенной модели
Сбой рабочей оболочкиОшибка в инструментах, правах, памяти или нижележащей модели

Формула:

стоимость принятого результата = (все оплачиваемые расходы первых попыток и повторов + внешние расходы на инструменты и CI + труд проверяющего) ÷ число принятых изменений

Токены повторов уже находятся в сумме оплачиваемых расходов и учитываются один раз. Во внешнюю строку добавляйте только отдельные расходы на CI, браузер, изолированную среду или инструменты; повторно записывать стоимость модели нельзя. Если маршрут создал ноль принятых изменений, остановите пакет и пометьте его неудачным. Не делите на ноль и не прячьте такой результат в среднем.

Для маршрута через подписку отдельно храните расход тарифа или кредитов и ограничения скорости, если честную стоимость одной задачи в долларах получить нельзя. «Входит в подписку» не означает нулевой стоимости: время проверки, доступная мощность команды и цена упущенной возможности остаются.

Предположим, вариант A потратил $22, дал восемь принятых изменений и потребовал 90 минут проверки. Вариант B потратил $40, дал девять изменений и потребовал 40 минут. Если полная внутренняя стоимость проверки равна $120 в час:

  • A: ($22 + $180) ÷ 8 = $25.25 за принятое изменение.
  • B: ($40 + $80) ÷ 9 = $13.33 за принятое изменение.

У B выше счёт за модель, но ниже стоимость принятого результата. Поэтому цена токенов выбирает первый вариант для проверки бюджета, а не окончательного рабочего победителя. Время проверки, повторы и регрессии часто влияют сильнее, чем разница заявленных цен моделей.

Критические запреты не усредняйте. Проблема безопасности, нарушение правил данных, неизвестная фактическая модель или отсутствие проверенного отката запрещают внедрение, даже если маршрут дёшев. Снижение стоимости не отменяет требований допустимости.

Как внедрять, оставлять специализированным и откатывать

Порог решения нужно записать до проверки. Иначе после результатов команда начнёт двигать показатели в пользу предпочитаемой модели. Обратимость — часть доказательства: новый основной маршрут без работоспособного старого маршрута не прошёл внедрение.

Правила внедрения, специализации, резервного маршрута и отката

РешениеНеобходимое доказательство
Сделать основным маршрутомДоля принятия не хуже в двух циклах; заранее заданное улучшение стоимости или времени принятого результата; нет критической регрессии; фактическая модель подтверждена; откат проверен
Оставить специализированнымПовторяемая победа в одном классе, например восстановлении терминала или переработке с длинным контекстом, без общей победы
Оставить резервнымТекущий проверенный маршрут сохраняет запросы, права, учётные данные и инструкции восстановления
ОткатитьКритический сбой безопасности или данных, повторное падение принятия, превышение бюджета стоимости или проверки, необъяснимое изменение фактической модели либо нестабильный доступ

Команда может заранее потребовать, например, снижения медианной стоимости или времени принятого результата на 15% для ключевых задач. Это внутренний рабочий порог, а не факт поставщика. Запас должен быть больше обычного разброса между запусками. Разница 2% на десяти задачах редко оправдывает переход.

Если Sol стабильно выигрывает ремонт через терминал, но не работу с длинным контекстом, направляйте терминальные задачи к Sol, а остальные оставьте Fable или текущему основному маршруту. Если Fable выигрывает межфайловые переработки, но чувствительные задачи часто выполняет Opus, используйте Fable для этой специализации с обязательной проверкой фактической модели. Узкая специализация — полезный итог, а не компромиссная неудача.

Резерв должен работать на практике. Сохраните идентификатор модели, проверенные запросы, учётные данные, права, зависимости и инструкцию восстановления. Периодически запускайте небольшую задачу, чтобы маршрут не устарел после изменения тарифа или версии. Определите, кто переключает поток задач, как продолжить незавершённую работу и как не дать двум агентам писать в одну ветку.

Условия отката тоже должны быть конкретными. Критическое событие безопасности или данных вызывает немедленный возврат. Устойчивое падение доли принятия, превышение бюджета проверки, необъяснимое отличие фактической модели или изменение кредитов и доступа приостанавливают внедрение. Не перемещайте пороги ради истории об «успешном запуске».

Практическое правило простое: форму первой проверки выбирает задача; основной маршрут выбирает принятая работа в одном репозитории; резерв и возможность отката должны оставаться живыми всегда.

Часто задаваемые вопросы

«Codex 5.6» — официальное имя модели?

Нет. Модель называется GPT-5.6 Sol, а Codex — рабочая оболочка для программирования. Когда результат зависит от обоих уровней, точная формулировка — «GPT-5.6 Sol в Codex».

«Claude Code Fable 5» — единое официальное название?

Нет. Модель называется Claude Fable 5, её идентификатор API — claude-fable-5; Claude Code — рабочая оболочка. Точная формулировка — «Claude Fable 5 в Claude Code».

Обе модели доступны сейчас?

По официальным страницам, проверенным 21 июля 2026 года, Sol доступна в API и для выбора на планах ChatGPT Plus и выше, а Anthropic перечисляет Fable для Pro, Max, Team и Enterprise и через Claude Platform. Это не обещание доступа для любого аккаунта: тариф, регион, рабочее пространство и настройки администратора могут изменить фактический маршрут.

Какой API дешевле?

По стандартной заявленной цене дешевле Sol: $5 за миллион входных и $30 за миллион выходных токенов против $10 и $50 у Fable. Это сравнение оплачиваемого использования API, а не автоматический расчёт сеанса Codex или Claude Code в подписке. При миграции на Fable сначала пересчитайте реальные payload её текущим токенизатором: старое число токенов может занизить прогноз.

Делает ли контекст 1 млн токенов Fable лучшим выбором для большого репозитория?

Он делает Fable сильным первым вариантом для задач с большим контекстом. Но внедрение требует принятого изменения, соблюдения межфайловых инвариантов, меньших затрат на проверку и совместимости с обязательным хранением данных в течение 30 дней.

Зачем в сравнении Claude Opus 4.8?

Приложения Claude могут переключить запрос Fable, затронутый защитными правилами, на Opus 4.8. Поэтому Opus появляется как фактически использованная резервная модель, а не как третий совместный победитель. Изменение и расход нужно приписывать Opus.

Claude API автоматически переключит Fable на Opus?

Нет. Защитная маршрутизация приложений и резервный маршрут API — разные механизмы. API вызывает запасную модель только при явной настройке Anthropic Fallback API.

Как учитывать повтор Codex на менее мощной модели?

Сохраните исходный запуск Sol и повтор как разные маршруты. Запишите фактическую модель, токены, время, изменение кода и тесты. Расход повтора входит в общие оплачиваемые расходы один раз; его успех нельзя называть успехом Sol с первой попытки.

Кто выигрывает четыре официальных теста программирования?

Единого победителя нет. Fable лидирует в SWE-Bench Pro; Sol — в Artificial Analysis Coding Agent Index, DeepSWE и Terminal-Bench. Различие задач и неполное совпадение методики означают, что строки выбирают первые проверки, а не основной рабочий маршрут.

Когда менять основной маршрут команды?

Когда новый вариант повторяемо выполняет заранее заданный порог принятия и стоимости в одном репозитории, не создаёт критических регрессий, подтверждает фактическую модель и имеет проверенный откат. Если значимого выигрыша нет, решение не переключаться остаётся правильным.

#GPT-5.6 Sol#Claude Fable 5#Codex#Claude Code#агенты программирования
Поделиться: