Перейти к основному содержанию

Какую модель Claude API выбрать: Fable 5, Opus 5, Sonnet 5 или Haiku 4.5

8 мин чтенияAPI Guides

Sonnet 5 — разумная отправная точка, Haiku 4.5 подходит для быстрого массового потока, а Opus 5 и Fable 5 стоит подключать только после проверки выгоды на сложных задачах. До переключения нужно сверить цену, параметры и условия хранения.

Четыре маршрута выбора Claude API: массовый поток, баланс, сложные агенты и предельная сложность

Какие модели Claude API доступны 10 августа 2026 года

В актуальном публичном сравнении Anthropic указаны четыре модели: claude-fable-5, claude-opus-5, claude-sonnet-5 и claude-haiku-4-5-20251001; у последней также есть короткий ID claude-haiku-4-5. Список и строки для запросов можно сверить в официальном обзоре моделей Anthropic. Это датированный срез: доступность, цены и жизненный цикл следует проверять заново перед запуском.

Короткий ответ для новой интеграции: начните с Sonnet 5. Выбирайте Haiku 4.5, если приоритетны минимальная цена и задержка в большом потоке. Переходите на Opus 5, если Sonnet стабильно не завершает ваши сложные агентные или программные задачи. Fable 5 имеет смысл только тогда, когда рост доли принятых результатов окупает двойную относительно Opus стандартную цену, а проект принимает особые условия этой модели.

Это редакционное правило выбора, а не результат независимого сравнительного теста. Anthropic позиционирует Fable как наиболее способную широко доступную модель, Opus — как модель для сложного агентного программирования и корпоративной работы, Sonnet — как баланс скорости и интеллекта, а Haiku — как самый быстрый вариант с близкими к передовому уровню возможностями. На ваших задачах порядок может оказаться другим.

Скопируйте выбранную строку в конфигурацию тестового окружения, а не прямо в production:

text
claude-fable-5 claude-opus-5 claude-sonnet-5 claude-haiku-4-5-20251001

Название модели и Model ID — разные вещи. Согласно правилам ID и версионирования Claude, ID обозначает закреплённую версию (snapshot). Бездатированные ID поколения 4.6 и новее не являются указателем, который автоматически переключится на будущую модель. Поэтому изменение версии должно оставаться явным и проверяемым событием.

Что нужно понимать до сравнительной таблицы

Здесь под Claude API понимается API, которым управляет Anthropic. Подписки Claude Pro и Max, а также доступ к Claude Code не определяют цену токенов API. Amazon Bedrock, Google Cloud, Microsoft Foundry и сторонние шлюзы используют собственные идентификаторы, доступность, сроки вывода и тарифы; приведённые ниже ID и цены нельзя переносить на них без отдельной проверки.

Цена запроса складывается из двух частей:

text
стоимость = входные токены / 1 000 000 × ставка ввода + выходные токены / 1 000 000 × ставка вывода

MTok в таблице означает миллион токенов. Входные токены включают переданный модели материал, а выходные — сгенерированный ответ. Контекстное окно — общий рабочий объём запроса, истории и служебных данных; максимальный синхронный вывод — отдельный предел ответа. Контекст на 1 млн токенов не означает, что модель вернёт ответ такой же длины.

Режим thinking тоже влияет на выбор и фактическое потребление. Fable 5, Opus 5 и Sonnet 5 используют адаптивное рассуждение (adaptive thinking), тогда как Haiku 4.5 поддерживает ручной extended thinking. Для Opus 5 и Sonnet 5 значение effort в Claude API по умолчанию — high. Thinking-токены не следует воспринимать как бесплатное скрытое рассуждение.

Кеширование запросов и Batch API — отдельные механизмы. Попадание в кеш (cache hit) стоит 10% стандартной ставки ввода, запись кеша тарифицируется с повышающим множителем, а Batch API снижает ставки ввода и вывода на 50%. Это не автоматическая скидка: кеш полезен при повторяющемся префиксе, а Batch — для допустимой отложенной обработки; сгенерированные токены, инструменты и неудачная организация нагрузки всё равно влияют на итоговый счёт. Условия и актуальные коэффициенты опубликованы на странице цен Claude API.

Сравнение моделей: цена, лимиты и главный стоп-фактор

По официальной странице цен Claude API, стандартные ставки ниже указаны в долларах США за 1 млн входных и выходных токенов. До 31 августа 2026 года включительно для Sonnet 5 действует вводная цена $2/$10; с 1 сентября 2026 года применяется стандартная $3/$15. В бюджет после августа следует закладывать стандартную ставку.

МодельПозиционирование AnthropicModel IDВвод / вывод за MTokКонтекст / макс. синхронный выводОтносительная задержкаThinkingГлавный стоп-фактор
Fable 5Максимум возможностей среди общедоступных моделейclaude-fable-5$10 / $501 млн / 128 тыс.МедленнееАдаптивноеЦена, обработка отказов и требования к хранению
Opus 5Сложные агенты, программирование, корпоративные задачиclaude-opus-5$5 / $251 млн / 128 тыс.УмереннаяАдаптивное, effort: high по умолчаниюНет измеримой выгоды относительно Sonnet
Sonnet 5Баланс скорости и возможностейclaude-sonnet-5$3 / $151 млн / 128 тыс.БыстраяАдаптивное, effort: high по умолчаниюВременная цена заканчивается 31 августа
Haiku 4.5Быстрый массовый потокclaude-haiku-4-5-20251001 или claude-haiku-4-5$1 / $5200 тыс. / 64 тыс.Самая быстраяРучной extended thinkingНедостаточное качество на многошаговой задаче

Слова «медленнее», «быстрая» и «самая быстрая» — относительные метки из официального сравнения, а не SLA и не измеренные миллисекунды. Роли моделей тоже отражают позиционирование Anthropic, а не наш рейтинг качества.

Выбор модели Claude API по стоимости запроса, сложности задачи и относительной задержке; способности показаны по официальному позиционированию, а не по независимому бенчмарку.

Таблица помогает отсеять явно неподходящие варианты, но не назначает победителя. Самая важная величина — не цена одного вызова, а стоимость принятого результата. Дорогая модель может оказаться выгоднее, если завершает задачу с первого раза вместо нескольких повторов. Дешёвая выигрывает, если сохраняет нужную точность, формат и долю завершения на том же наборе примеров.

Три сценария, в которых выбор начинается с разных моделей

Классификация и короткие ответы в большом потоке

Начните с Haiku 4.5. Это логичный кандидат, когда ответы короткие, формат жёстко задан, а задержка и стоимость каждого элемента суммируются в большом объёме. Подготовьте собственный набор с типичными, пограничными и некорректными входами. Сравнивайте не впечатление от нескольких ответов, а долю результатов, которые проходят ваши правила без ручного исправления.

Переходите на Sonnet 5 только при измеримом недоборе: например, Haiku чаще нарушает схему, неверно маршрутизирует редкий класс или требует повторного вызова. Если Sonnet не улучшает принятый результат настолько, чтобы покрыть разницу в цене и задержке, повышение класса не обосновано.

Рабочий агент для кода и инструментов

Начните с Sonnet 5. Его официальная роль — баланс скорости и интеллекта, поэтому он даёт практичную базовую точку для многошаговой работы. На репрезентативных задачах фиксируйте завершение, корректность вызовов инструментов, количество повторов, p95 задержки, входные и выходные токены.

Opus 5 подключайте к тем же задачам, где Sonnet систематически застревает, преждевременно завершает цепочку или требует дорогого повторного запуска. Переход оправдан, если более высокая ставка уменьшает число незавершённых задач и общую стоимость принятого результата. Формулировка Anthropic о сильной стороне Opus в сложной агентной работе — основание включить модель в тест, но не доказательство выигрыша в вашей системе.

Длинная аналитическая или предельно сложная агентная задача

Сначала сравните Sonnet 5 и Opus 5 на одинаковых входах и с одинаковым набором инструментов. Добавляйте Fable 5 только в набор задач, где даже Opus не даёт устойчивого принятого результата или цена ошибки особенно высока. Не смешивайте модели с разными подсказками, лимитами и инструментами: иначе нельзя понять, что именно изменило результат.

Fable 5 общедоступна, а Mythos 5 доступна только одобренным клиентам Project Glasswing и не является обычной строкой выбора. Anthropic также требует, чтобы интеграции Fable корректно обрабатывали отказы safety classifier; эти условия описаны в официальном представлении Fable 5 и Mythos 5. Если проект не готов к такой обработке или к требованиям хранения, Fable нельзя выбирать только ради максимальных заявленных возможностей.

Условный расчёт: запрос на 100 тысяч входных токенов

Возьмём один условный запрос: 100 000 входных и 5 000 выходных токенов, без кеша, Batch API и инструментов. Это расчёт по тарифу, а не прогноз типичного ответа.

МодельРасчётСтоимость запроса
Fable 50,1 × $10 + 0,005 × $50$1.25
Opus 50,1 × $5 + 0,005 × $25$0.625
Sonnet 5, стандартная цена0,1 × $3 + 0,005 × $15$0.375
Sonnet 5, вводная цена до 31 августа0,1 × $2 + 0,005 × $10$0.25
Haiku 4.50,1 × $1 + 0,005 × $5$0.125

По стандартному тарифу Fable в десять раз дороже Haiku для этого профиля токенов, но такое соотношение ещё ничего не говорит о стоимости результата. Если дешёвая модель требует повторов, генерирует длиннее или не завершает задачу, её фактический расход растёт. Если дорогая не улучшает приёмку, доплата бесполезна.

Есть и миграционный эффект: согласно описанию изменений Sonnet 5, модели Claude 4.7 и новее используют новый tokenizer, который может давать примерно на 30% больше токенов на том же тексте. Изменение зависит от материала и не является фиксированной 30-процентной надбавкой. Поэтому старое количество символов или токенов нельзя просто умножить на новую ставку: соберите фактические input_tokens и output_tokens после переключения.

Когда повышать или понижать класс модели

До теста задайте порог, который изменит решение. Минимальный набор метрик выглядит так:

  • доля задач, завершённых и принятых без ручной доработки;
  • число повторных вызовов на один принятый результат;
  • p95 задержки, а не только среднее значение;
  • фактические входные и выходные токены;
  • итоговая стоимость принятого результата.

Повышайте класс с Haiku до Sonnet или с Sonnet до Opus, если улучшение по завершению и повторам покрывает дополнительный расход и остаётся приемлемым по задержке. Fable добавляйте только после такого же сравнения с Opus и проверки специальных условий. Понижайте класс, если более дешёвая модель сохраняет обязательную точность, формат и устойчивость на том же наборе.

Например, две модели нельзя честно сравнить только по цене десяти вызовов. Если у одной принято восемь результатов, а у другой — пять, знаменатель должен быть числом принятых результатов. Для каждой модели считайте:

text
стоимость принятого результата = общая стоимость всех вызовов и повторов / число принятых результатов

Не подставляйте выдуманный процент успеха из чужого обзора. Ваш порог должен исходить из допустимой ошибки продукта: для черновой классификации и для агента, меняющего код, он будет разным.

Миграция без неожиданного HTTP 400 и скачка счёта

По официальному описанию миграции на Sonnet 5, при переходе с Sonnet 4.6 можно заменить ID, но это не означает полную совместимость прежнего запроса. Sonnet 5 отклоняет ручной extended thinking, а также нестандартные temperature, top_p и top_k; адаптивное рассуждение включено по умолчанию, и новый tokenizer меняет количество токенов. Для более старых исходных моделей одной замены ID может быть недостаточно.

Безопасная последовательность миграции:

  1. Закрепите новый Model ID в staging-конфигурации и не меняйте production одновременно.
  2. Для Sonnet 5 удалите несовместимый ручной thinking и нестандартные параметры sampling; затем сравните поведение с адаптивным режимом.
  3. Пересчитайте фактические токены, максимальный ответ и запас контекстного окна на реальных запросах.
  4. Обработайте HTTP 400, отказ safety classifier и незавершённый ответ как отдельные исходы, а не как обычный успешный результат.
  5. Для Fable 5 подтвердите 30-дневное хранение данных и совместимость настроек ZDR: несовместимая конфигурация может вернуть HTTP 400.
  6. Выполните canary на небольшой доле типовых запросов и сравните принятые результаты, p95, токены, повторы и стоимость.
  7. Меняйте production только после прохождения заранее заданного порога и с возможностью вернуть прежний ID.

Проверка миграции Claude API: зафиксировать ID, проверить thinking и sampling, пересчитать токены, обработать ошибки, провести canary и только затем менять production.

У миграции есть и календарный риск. По официальной таблице жизненного цикла Claude, на дату этого материала Fable 5, Opus 5, Sonnet 5, Opus 4.8/4.7/4.6, Sonnet 4.6 и Haiku 4.5 активны на API-поверхностях Anthropic. Opus 4.1 выведена 5 августа 2026 года, а Opus 4 и Sonnet 4 — 15 июня 2026 года. Эти даты нельзя автоматически применять к Bedrock или Google Cloud.

Практический выбор на сегодня

Для большинства новых интеграций отправная точка — claude-sonnet-5: она позволяет получить базовые показатели качества, задержки и стоимости без немедленного перехода к самому дорогому варианту. Для простого массового потока параллельно проверьте claude-haiku-4-5-20251001. Opus и Fable должны входить в решение не как символ «лучшей модели», а как управляемое повышение класса для задач, где оно снижает повторы и увеличивает долю принятого результата.

Следующий шаг прост: откройте официальный обзор моделей, скопируйте выбранный ID в staging и прогоните небольшой набор собственных типовых запросов. Запишите результат, p95 задержки, input_tokens, output_tokens, число повторов и полную стоимость. Затем проверьте актуальные ограничения выбранной модели в документации Anthropic и только после успешного canary меняйте production.

#Claude API#Claude Sonnet 5#Claude Opus 5#Claude Fable 5#Claude Haiku 4.5
Поделиться: