Какие модели Claude API доступны 10 августа 2026 года
В актуальном публичном сравнении Anthropic указаны четыре модели: claude-fable-5, claude-opus-5, claude-sonnet-5 и claude-haiku-4-5-20251001; у последней также есть короткий ID claude-haiku-4-5. Список и строки для запросов можно сверить в официальном обзоре моделей Anthropic. Это датированный срез: доступность, цены и жизненный цикл следует проверять заново перед запуском.
Короткий ответ для новой интеграции: начните с Sonnet 5. Выбирайте Haiku 4.5, если приоритетны минимальная цена и задержка в большом потоке. Переходите на Opus 5, если Sonnet стабильно не завершает ваши сложные агентные или программные задачи. Fable 5 имеет смысл только тогда, когда рост доли принятых результатов окупает двойную относительно Opus стандартную цену, а проект принимает особые условия этой модели.
Это редакционное правило выбора, а не результат независимого сравнительного теста. Anthropic позиционирует Fable как наиболее способную широко доступную модель, Opus — как модель для сложного агентного программирования и корпоративной работы, Sonnet — как баланс скорости и интеллекта, а Haiku — как самый быстрый вариант с близкими к передовому уровню возможностями. На ваших задачах порядок может оказаться другим.
Скопируйте выбранную строку в конфигурацию тестового окружения, а не прямо в production:
textclaude-fable-5 claude-opus-5 claude-sonnet-5 claude-haiku-4-5-20251001
Название модели и Model ID — разные вещи. Согласно правилам ID и версионирования Claude, ID обозначает закреплённую версию (snapshot). Бездатированные ID поколения 4.6 и новее не являются указателем, который автоматически переключится на будущую модель. Поэтому изменение версии должно оставаться явным и проверяемым событием.
Что нужно понимать до сравнительной таблицы
Здесь под Claude API понимается API, которым управляет Anthropic. Подписки Claude Pro и Max, а также доступ к Claude Code не определяют цену токенов API. Amazon Bedrock, Google Cloud, Microsoft Foundry и сторонние шлюзы используют собственные идентификаторы, доступность, сроки вывода и тарифы; приведённые ниже ID и цены нельзя переносить на них без отдельной проверки.
Цена запроса складывается из двух частей:
textстоимость = входные токены / 1 000 000 × ставка ввода + выходные токены / 1 000 000 × ставка вывода
MTok в таблице означает миллион токенов. Входные токены включают переданный модели материал, а выходные — сгенерированный ответ. Контекстное окно — общий рабочий объём запроса, истории и служебных данных; максимальный синхронный вывод — отдельный предел ответа. Контекст на 1 млн токенов не означает, что модель вернёт ответ такой же длины.
Режим thinking тоже влияет на выбор и фактическое потребление. Fable 5, Opus 5 и Sonnet 5 используют адаптивное рассуждение (adaptive thinking), тогда как Haiku 4.5 поддерживает ручной extended thinking. Для Opus 5 и Sonnet 5 значение effort в Claude API по умолчанию — high. Thinking-токены не следует воспринимать как бесплатное скрытое рассуждение.
Кеширование запросов и Batch API — отдельные механизмы. Попадание в кеш (cache hit) стоит 10% стандартной ставки ввода, запись кеша тарифицируется с повышающим множителем, а Batch API снижает ставки ввода и вывода на 50%. Это не автоматическая скидка: кеш полезен при повторяющемся префиксе, а Batch — для допустимой отложенной обработки; сгенерированные токены, инструменты и неудачная организация нагрузки всё равно влияют на итоговый счёт. Условия и актуальные коэффициенты опубликованы на странице цен Claude API.
Сравнение моделей: цена, лимиты и главный стоп-фактор
По официальной странице цен Claude API, стандартные ставки ниже указаны в долларах США за 1 млн входных и выходных токенов. До 31 августа 2026 года включительно для Sonnet 5 действует вводная цена $2/$10; с 1 сентября 2026 года применяется стандартная $3/$15. В бюджет после августа следует закладывать стандартную ставку.
| Модель | Позиционирование Anthropic | Model ID | Ввод / вывод за MTok | Контекст / макс. синхронный вывод | Относительная задержка | Thinking | Главный стоп-фактор |
|---|---|---|---|---|---|---|---|
| Fable 5 | Максимум возможностей среди общедоступных моделей | claude-fable-5 | $10 / $50 | 1 млн / 128 тыс. | Медленнее | Адаптивное | Цена, обработка отказов и требования к хранению |
| Opus 5 | Сложные агенты, программирование, корпоративные задачи | claude-opus-5 | $5 / $25 | 1 млн / 128 тыс. | Умеренная | Адаптивное, effort: high по умолчанию | Нет измеримой выгоды относительно Sonnet |
| Sonnet 5 | Баланс скорости и возможностей | claude-sonnet-5 | $3 / $15 | 1 млн / 128 тыс. | Быстрая | Адаптивное, effort: high по умолчанию | Временная цена заканчивается 31 августа |
| Haiku 4.5 | Быстрый массовый поток | claude-haiku-4-5-20251001 или claude-haiku-4-5 | $1 / $5 | 200 тыс. / 64 тыс. | Самая быстрая | Ручной extended thinking | Недостаточное качество на многошаговой задаче |
Слова «медленнее», «быстрая» и «самая быстрая» — относительные метки из официального сравнения, а не SLA и не измеренные миллисекунды. Роли моделей тоже отражают позиционирование Anthropic, а не наш рейтинг качества.

Таблица помогает отсеять явно неподходящие варианты, но не назначает победителя. Самая важная величина — не цена одного вызова, а стоимость принятого результата. Дорогая модель может оказаться выгоднее, если завершает задачу с первого раза вместо нескольких повторов. Дешёвая выигрывает, если сохраняет нужную точность, формат и долю завершения на том же наборе примеров.
Три сценария, в которых выбор начинается с разных моделей
Классификация и короткие ответы в большом потоке
Начните с Haiku 4.5. Это логичный кандидат, когда ответы короткие, формат жёстко задан, а задержка и стоимость каждого элемента суммируются в большом объёме. Подготовьте собственный набор с типичными, пограничными и некорректными входами. Сравнивайте не впечатление от нескольких ответов, а долю результатов, которые проходят ваши правила без ручного исправления.
Переходите на Sonnet 5 только при измеримом недоборе: например, Haiku чаще нарушает схему, неверно маршрутизирует редкий класс или требует повторного вызова. Если Sonnet не улучшает принятый результат настолько, чтобы покрыть разницу в цене и задержке, повышение класса не обосновано.
Рабочий агент для кода и инструментов
Начните с Sonnet 5. Его официальная роль — баланс скорости и интеллекта, поэтому он даёт практичную базовую точку для многошаговой работы. На репрезентативных задачах фиксируйте завершение, корректность вызовов инструментов, количество повторов, p95 задержки, входные и выходные токены.
Opus 5 подключайте к тем же задачам, где Sonnet систематически застревает, преждевременно завершает цепочку или требует дорогого повторного запуска. Переход оправдан, если более высокая ставка уменьшает число незавершённых задач и общую стоимость принятого результата. Формулировка Anthropic о сильной стороне Opus в сложной агентной работе — основание включить модель в тест, но не доказательство выигрыша в вашей системе.
Длинная аналитическая или предельно сложная агентная задача
Сначала сравните Sonnet 5 и Opus 5 на одинаковых входах и с одинаковым набором инструментов. Добавляйте Fable 5 только в набор задач, где даже Opus не даёт устойчивого принятого результата или цена ошибки особенно высока. Не смешивайте модели с разными подсказками, лимитами и инструментами: иначе нельзя понять, что именно изменило результат.
Fable 5 общедоступна, а Mythos 5 доступна только одобренным клиентам Project Glasswing и не является обычной строкой выбора. Anthropic также требует, чтобы интеграции Fable корректно обрабатывали отказы safety classifier; эти условия описаны в официальном представлении Fable 5 и Mythos 5. Если проект не готов к такой обработке или к требованиям хранения, Fable нельзя выбирать только ради максимальных заявленных возможностей.
Условный расчёт: запрос на 100 тысяч входных токенов
Возьмём один условный запрос: 100 000 входных и 5 000 выходных токенов, без кеша, Batch API и инструментов. Это расчёт по тарифу, а не прогноз типичного ответа.
| Модель | Расчёт | Стоимость запроса |
|---|---|---|
| Fable 5 | 0,1 × $10 + 0,005 × $50 | $1.25 |
| Opus 5 | 0,1 × $5 + 0,005 × $25 | $0.625 |
| Sonnet 5, стандартная цена | 0,1 × $3 + 0,005 × $15 | $0.375 |
| Sonnet 5, вводная цена до 31 августа | 0,1 × $2 + 0,005 × $10 | $0.25 |
| Haiku 4.5 | 0,1 × $1 + 0,005 × $5 | $0.125 |
По стандартному тарифу Fable в десять раз дороже Haiku для этого профиля токенов, но такое соотношение ещё ничего не говорит о стоимости результата. Если дешёвая модель требует повторов, генерирует длиннее или не завершает задачу, её фактический расход растёт. Если дорогая не улучшает приёмку, доплата бесполезна.
Есть и миграционный эффект: согласно описанию изменений Sonnet 5, модели Claude 4.7 и новее используют новый tokenizer, который может давать примерно на 30% больше токенов на том же тексте. Изменение зависит от материала и не является фиксированной 30-процентной надбавкой. Поэтому старое количество символов или токенов нельзя просто умножить на новую ставку: соберите фактические input_tokens и output_tokens после переключения.
Когда повышать или понижать класс модели
До теста задайте порог, который изменит решение. Минимальный набор метрик выглядит так:
- доля задач, завершённых и принятых без ручной доработки;
- число повторных вызовов на один принятый результат;
- p95 задержки, а не только среднее значение;
- фактические входные и выходные токены;
- итоговая стоимость принятого результата.
Повышайте класс с Haiku до Sonnet или с Sonnet до Opus, если улучшение по завершению и повторам покрывает дополнительный расход и остаётся приемлемым по задержке. Fable добавляйте только после такого же сравнения с Opus и проверки специальных условий. Понижайте класс, если более дешёвая модель сохраняет обязательную точность, формат и устойчивость на том же наборе.
Например, две модели нельзя честно сравнить только по цене десяти вызовов. Если у одной принято восемь результатов, а у другой — пять, знаменатель должен быть числом принятых результатов. Для каждой модели считайте:
textстоимость принятого результата = общая стоимость всех вызовов и повторов / число принятых результатов
Не подставляйте выдуманный процент успеха из чужого обзора. Ваш порог должен исходить из допустимой ошибки продукта: для черновой классификации и для агента, меняющего код, он будет разным.
Миграция без неожиданного HTTP 400 и скачка счёта
По официальному описанию миграции на Sonnet 5, при переходе с Sonnet 4.6 можно заменить ID, но это не означает полную совместимость прежнего запроса. Sonnet 5 отклоняет ручной extended thinking, а также нестандартные temperature, top_p и top_k; адаптивное рассуждение включено по умолчанию, и новый tokenizer меняет количество токенов. Для более старых исходных моделей одной замены ID может быть недостаточно.
Безопасная последовательность миграции:
- Закрепите новый
Model IDв staging-конфигурации и не меняйте production одновременно. - Для Sonnet 5 удалите несовместимый ручной thinking и нестандартные параметры sampling; затем сравните поведение с адаптивным режимом.
- Пересчитайте фактические токены, максимальный ответ и запас контекстного окна на реальных запросах.
- Обработайте HTTP 400, отказ safety classifier и незавершённый ответ как отдельные исходы, а не как обычный успешный результат.
- Для Fable 5 подтвердите 30-дневное хранение данных и совместимость настроек ZDR: несовместимая конфигурация может вернуть HTTP 400.
- Выполните canary на небольшой доле типовых запросов и сравните принятые результаты, p95, токены, повторы и стоимость.
- Меняйте production только после прохождения заранее заданного порога и с возможностью вернуть прежний ID.

У миграции есть и календарный риск. По официальной таблице жизненного цикла Claude, на дату этого материала Fable 5, Opus 5, Sonnet 5, Opus 4.8/4.7/4.6, Sonnet 4.6 и Haiku 4.5 активны на API-поверхностях Anthropic. Opus 4.1 выведена 5 августа 2026 года, а Opus 4 и Sonnet 4 — 15 июня 2026 года. Эти даты нельзя автоматически применять к Bedrock или Google Cloud.
Практический выбор на сегодня
Для большинства новых интеграций отправная точка — claude-sonnet-5: она позволяет получить базовые показатели качества, задержки и стоимости без немедленного перехода к самому дорогому варианту. Для простого массового потока параллельно проверьте claude-haiku-4-5-20251001. Opus и Fable должны входить в решение не как символ «лучшей модели», а как управляемое повышение класса для задач, где оно снижает повторы и увеличивает долю принятого результата.
Следующий шаг прост: откройте официальный обзор моделей, скопируйте выбранный ID в staging и прогоните небольшой набор собственных типовых запросов. Запишите результат, p95 задержки, input_tokens, output_tokens, число повторов и полную стоимость. Затем проверьте актуальные ограничения выбранной модели в документации Anthropic и только после успешного canary меняйте production.



