Перейти к основному содержанию

Claude Haiku 5.5 или Sonnet 5.5: что выбрать по цене задачи

Claude Haiku 5.5 дешевле Sonnet 5.5 в 20 раз за токен, но при равном балле в замерах Artificial Analysis — лишь в 4 раза, и задача решается дольше.

LaoZhang AI TeamОпубликовано14 мин чтения
Содержание
Claude Haiku 5.5 или Sonnet 5.5: цены $0,10 / $0,50 против $2 / $10 за 1 млн токенов, при равном балле 41 Haiku в 4 раза дешевле и в 2,3 раза дольше

Массовые узкие задачи — классификацию, извлечение полей, маршрутизацию, сжатие контекста, работу субагентов — переводите на Claude Haiku 5.5. Сложное агентное программирование, бизнес-автоматизацию и ответы, где ошибка в фактах дорого стоит, оставляйте на Sonnet 5.5. Если результат Haiku проверяется автоматически — тестами, JSON-схемой, валидатором, — выгоднее третий вариант: сначала Haiku, а то, что он не решил, отправлять на Sonnet.

Разрыв в цене меньше, чем кажется по прайсу. За токен Haiku 5.5 дешевле в 20 раз, пока промпт не длиннее 100 000 токенов, и в 4 раза — на более длинных промптах. В сторонних замерах Artificial Analysis задача на одинаковом уровне effort medium обходится на Haiku примерно в 10 раз дешевле (effort задаёт, сколько модель рассуждает перед ответом), а при одинаковом итоговом балле — только в 4 раза, причём решается в 2,3 раза дольше. Все цифры ниже приведены по состоянию на 8 октября 2026 года.

Haiku 5.5 (claude-haiku-5-5) вышел 7 октября 2026 года, Sonnet 5.5 (claude-sonnet-5-5) — 28 сентября. Если и Sonnet 5.5 не справляется, следующий шаг — Opus 5.5 или Fable 5.1, об этом ниже в вопросах.

Чем Haiku 5.5 отличается от Sonnet 5.5: то же окно, другая цена

Технически модели почти одинаковы: контекст 1 млн токенов, до 128 тыс. токенов ответа, на вход текст и изображения, знания до июня 2026 года, адаптивное рассуждение (adaptive thinking) и пять уровней effort. Различаются цена, качество на сложных задачах, настройки по умолчанию и то, насколько хорошо модель доводит до конца длинную работу. Цены — по странице цен Claude API, за 1 млн токенов:

Haiku 5.5Sonnet 5.5
Входные токены, промпт до 100 000$0,10$2
Выходные токены, промпт до 100 000$0,50$10
Чтение из кэша, промпт до 100 000$0,01$0,10
Промпт больше 100 000: вход / выход / кэш$0,50 / $2,50 / $0,05без надбавки: $2 / $10 / $0,10
Пакетная обработка (Batch), вход / выход$0,05 / $0,25 (до 100 000)$1 / $5
Effort по умолчанию в APImediumhigh
Effort по умолчанию в Claude Codemediummedium
Как выключить рассуждение перед ответомthinking: {"type": "disabled"}, до highthinking: {"type": "between_tools"}, от low до high
Назначение по описанию Anthropicбольшие объёмы и низкая задержка: классификация, извлечение, маршрутизациялучшее сочетание скорости и интеллекта

Две детали важны для расчётов. Во-первых, 7 октября Anthropic вдвое снизила для Sonnet 5.5 цену чтения из кэша — с $0,20 до $0,10. По этой ставке оплачиваются токены, которые повторно используются через кэширование промптов (prompt caching), поэтому таблицы, составленные раньше, завышают стоимость агентной работы на Sonnet. Во-вторых, Haiku 5.5 использует тот же токенизатор, что и модели Claude 4.7 и новее, к которым относится и Sonnet 5.5. Поэтому один и тот же промпт должен давать на обеих моделях одинаковое число токенов, и цены за токен сравниваются напрямую. А вот по сравнению с Haiku 4.5 тот же текст на Haiku 5.5 занимает примерно на 30 % больше токенов.

Цифры «на 90 % дешевле» и «на 75 % дешевле» из анонса Claude Haiku 5.5 относятся к сравнению с Haiku 4.5, а не с Sonnet.

Что выбрать: задачи для Haiku 5.5 и задачи для Sonnet 5.5

Граница проходит не по сложности темы, а по тому, длинная ли цепочка действий и видна ли ошибка сразу. Результаты отдельных тестов Artificial Analysis в таблице приведены для уровня medium — он стоит по умолчанию в Claude Code и у Haiku в API; в парах чисел первым идёт Haiku 5.5, вторым Sonnet 5.5.

ЗадачаЧто братьНа чём основано
Классификация, извлечение полей, маршрутизация запросовHaiku 5.5, effort low или mediumПрямое назначение модели по описанию Anthropic; миллион коротких запросов стоит $350 вместо $7 000 (расчёт ниже)
Сжатие контекста (compaction), суммаризация, субагент для поиска по коду или документамHaiku 5.5В анонсе Anthropic называет эти задачи основными для Haiku 5.5 и советует ставить его субагентом к Sonnet 5.5 или Opus 5.5
Ответы по длинному документуОбе подходят, выбор по ценеAA-LCR: 77,3 % против 76,3 %; но после 100 000 токенов промпта разрыв в цене сокращается до 4×
Научный и вычислительный кодHaiku 5.5, если проходят ваши тестыSciCode: 49,0 % против 52,9 %
Агентное программирование в терминале, многошаговые правкиSonnet 5.5Terminal-Bench 4.0: 15,2 % против 29,8 % у Artificial Analysis, 39,2 % против 70,6 % в таблице Anthropic
Бизнес-автоматизация через инструментыSonnet 5.5AutomationBench-AA: 28,6 % против 54,9 %
Ответы по фактам без поиска, где выдумка недопустимаSonnet 5.5AA-Omniscience, где штрафуют за галлюцинации: 4 против 20
Чат, где важно быстро начать отвечатьSonnet 5.5 на low или Haiku 5.5 без рассужденияПервый токен на low: 12,0 с у Haiku против 1,05 с у Sonnet; режим disabled в этих замерах не участвовал
Оборонительные задачи по кибербезопасностиHaiku 5.5, кроме пентестаОграничения Haiku 5.5 пропускают больше оборонительных задач, чем у Sonnet 5.5, но тестирование на проникновение блокируют

Практическое правило: короткая проверяемая задача, повторяемая тысячи раз, — Haiku. Задача, где ошибку заметит только человек или где модель должна сама провести десятки вызовов инструментов, — Sonnet. Всё, что между, проще решить каскадом и измерить долю успеха Haiku на своих данных. Такой порядок предлагает и руководство Anthropic по выбору модели: начать с Haiku 5.5 и переходить на старшую модель там, где тесты показывают нехватку качества. Там же сказано, что настройка effort часто полезнее смены модели.

Что лучше по бенчмаркам: при равном балле Haiku дешевле в 4 раза

В собственной таблице Anthropic Sonnet 5.5 впереди во всех строках. Уровень effort для каждой колонки в анонсе не указан, кроме FrontierCode, где Sonnet запускался на xhigh.

Тест (данные Anthropic)Haiku 5.5Sonnet 5.5
Terminal-Bench 4.0, агентное программирование39,2 %70,6 %
OSWorld 2.1 (офлайн-подмножество), работа с компьютером72,4 %83,9 %
FrontierCode 1.1 (Main)46,4 %52,1 %
Humanity's Last Exam без инструментов / с инструментами45,9 % / 57,4 %56,9 % / 64,5 %
GDPval-AA v2.1, профессиональные задачи16201840
Chartography без инструментов46,4 %61,6 %

Для сравнения: Haiku 4.5 в Terminal-Bench 4.0 набирал 0,0 %. Скачок большой, но до Sonnet в агентном коде Haiku 5.5 всё ещё далеко.

Полезнее другой разрез. Artificial Analysis прогнала обе модели на всех пяти уровнях effort и для каждого записала итоговый индекс (Intelligence Index v4.3.2, среднее по десяти тестам), стоимость одной задачи индекса и время на неё:

EffortSonnet 5.5: индекс / $ за задачу / с на задачуHaiku 5.5: индекс / $ за задачу / с на задачу
max56 / $5,46 / 92143 / $0,21 / 423
xhigh52 / $2,01 / 43141 / $0,12 / 291
high47 / $0,88 / 21738 / $0,08 / 194
medium41 / $0,48 / 12634 / $0,05 / 134
low36 / $0,35 / 9029 / $0,02 / 62

Из этой таблицы следуют три вывода:

  • При одинаковом effort задача на Sonnet дороже в 9,6 раза на medium ($0,48 / $0,05) и в 17,5 раза на low ($0,35 / $0,02).
  • При одинаковом балле разрыв меньше. Haiku на xhigh набирает те же 41, что Sonnet на medium, и стоит $0,12 против $0,48 — в 4 раза дешевле, но тратит 291 с против 126 с, то есть в 2,3 раза дольше. Haiku на high (38 баллов, $0,08, 194 с) обходит Sonnet на low (36 баллов, $0,35, 90 с): дешевле в 4,4 раза, медленнее в 2,2 раза.
  • У Haiku есть потолок. Даже на max он набирает 43 — меньше, чем Sonnet на high (47). Если вашей задаче нужен уровень Sonnet high и выше, Haiku его не достигает ни при какой настройке.

Индекс Artificial Analysis, цена и время задачи у Haiku 5.5 и Sonnet 5.5 на пяти уровнях effort: равный балл 41 у Haiku на xhigh и Sonnet на medium, потолок Haiku 43 против 47 у Sonnet на high

«Самая быстрая модель» — это про скорость выдачи токенов: 137–243 токена в секунду у Haiku против 101–136 у Sonnet. Но перед ответом Haiku долго рассуждает: первый токен на low появился через 12,0 с, на medium — через 12,6 с, тогда как Sonnet на low начал отвечать через 1,05 с. На max обе модели многословны: на тестах индекса Haiku сгенерировал 440 млн токенов, Sonnet — 420 млн.

Ограничения этих замеров: Haiku в них тарифицирован только по ставке для промптов до 100 000 токенов, поэтому на длинном контексте его стоимость занижена. Прогоны Sonnet подписаны «with fallback», и смысл этой пометки на странице не раскрыт. Индекс — среднее значение, и он скрывает провалы в отдельных тестах из таблицы выбора выше.

Что дешевле за задачу: от 20× на коротком промпте до 4× после 100K

Стоимость запроса считается так: входные токены × цена входа ÷ 1 000 000 плюс выходные токены × цена выхода ÷ 1 000 000. Токены рассуждения входят в выходные. Цены — по прайсу на 8 октября 2026 года, без кэша, если не указано иное:

СценарийHaiku 5.5Sonnet 5.5Во сколько раз
10 000 токенов на вход + 1 000 на выход$0,0015$0,03020
99 000 на вход + 2 000 на выход$0,0109$0,21820
150 000 на вход + 2 000 на выход$0,080$0,324
1 млн запросов классификации по 2 000 на вход + 300 на выход$350$7 00020
Ход агента: 90 000 из кэша + 5 000 новых + 2 000 на выход$0,0024$0,039≈16
Тот же ход, но 120 000 из кэша (если кэш учитывается в границе 100 000)$0,0135$0,042≈3

Как получен ход агента на Haiku: 90 000 × $0,01 + 5 000 × $0,10 + 2 000 × $0,50, всё делённое на 1 000 000, — $0,0009 + $0,0005 + $0,0010 = $0,0024. На Sonnet: $0,009 + $0,010 + $0,020 = $0,039. По старой цене кэша $0,20 тот же ход стоил $0,048, то есть снижение цены сделало его на 18,75 % дешевле. Anthropic оценивает экономию на большинстве агентных задач примерно в 20 %. Запись в кэш на первом ходе в расчёт не входит.

Граница в 100 000 токенов — главный подвох Haiku. На странице цен у тарифа для длинных промптов есть свои колонки для входа, выхода и кэша, то есть по старшей ставке оплачивается весь такой запрос, включая ответ. Учитываются ли в границе кэшированные токены и описания инструментов, в документации не уточняется. Поэтому бюджет надёжнее считать по полному входу: кэш плюс запись в кэш плюс новые токены. Агент с длинной историей, которую он каждый ход читает из кэша, легко переходит через 100 000, и тогда преимущество Haiku сжимается с 16 раз примерно до 3.

Цена за токен — ещё не цена задачи. Сколько токенов уйдёт на рассуждение, зависит от effort: на medium у Artificial Analysis задача на Haiku стоит $0,05, на max — $0,21, в четыре раза больше. Подняв Haiku до xhigh, чтобы догнать Sonnet на medium, вы сокращаете выигрыш с 10 до 4 раз и ждёте результат в 2,3 раза дольше.

Каскад «сначала Haiku, потом Sonnet» окупается при успехе от 10 %

Схема простая: каждую задачу сначала решает Haiku, результат проверяется автоматически, всё, что не прошло проверку, повторно отправляется на Sonnet. Ожидаемая стоимость задачи:

C = c(Haiku) + (1 − p) × c(Sonnet), где p — доля задач, которые Haiku решил правильно.

Если взять стоимость задачи из замеров Artificial Analysis на medium (Haiku $0,05, Sonnet $0,48), каскад дешевле одного Sonnet, как только p больше 0,05 / 0,48 ≈ 10,4 %. Время считается так же: T = 134 + (1 − p) × 126 секунд — Haiku тратит свои 134 с на каждую задачу, а Sonnet добавляет 126 с к тем, что ушли дальше.

Доля успеха HaikuСтоимость 1 000 задачСреднее время на задачу
Только Sonnet 5.5$480126 с
50 %$290197 с
70 %$194172 с
90 %$98147 с

Схема каскада «сначала Haiku, потом Sonnet»: Haiku 5.5 на medium, автоматическая проверка, повтор на Sonnet 5.5; стоимость 1 000 задач от $480 до $98 и среднее время от 126 до 147 с

Расчёт верен только при трёх условиях. Ошибку Haiku должна ловить автоматическая и почти бесплатная проверка: прогон тестов, валидация по JSON-схеме, сверка с базой, stop_reason: "refusal". Sonnet должен решать задачу со второй попытки. И неверные ответы, которые проверка пропустила, обходятся вам дороже любой экономии — в таблицу они не входят. При этих цифрах каскад медленнее одного Sonnet при любой доле успеха, потому что Haiku на medium решает задачу не быстрее Sonnet. Для интерактивного чата он поэтому подходит хуже, чем для фоновой обработки.

Подставьте свои цифры: прогоните выборку реальных задач через Haiku на medium, посчитайте долю прошедших проверку и среднюю стоимость по счёту API — и посмотрите, сколько выходит на 1 000 задач.

Переход с Sonnet 5.5 на Haiku 5.5 в API: что сломается при замене ID

Простая замена claude-sonnet-5-5 на claude-haiku-5-5 запустит код, но поменяет поведение. Что проверить:

  1. Effort. Если вы не задавали output_config.effort, Sonnet 5.5 работал на high, а Haiku 5.5 будет работать на medium. Задайте уровень явно. По документации Anthropic по параметру effort: medium — для большинства задач, включая агентное программирование; low — для чата, коротких задач с инструментами и простых массовых запросов; high — для работы со знаниями, длинных агентных задач и строгого следования инструкциям; xhigh и max — только если тесты показывают выигрыш, и тогда стоит сравнить с Sonnet 5.5 по качеству, цене и скорости.
  2. Режим без рассуждения. На Sonnet 5.5 минимальная настройка — thinking: {"type": "between_tools"}. На Haiku 5.5 её аналог — thinking: {"type": "disabled"}, допустимый до high. На xhigh и max обе настройки возвращают ошибку 400: там оставьте адаптивный режим, просто не передавая поле thinking.
  3. Смена effort посреди диалога. Обе модели на Claude API и Google Cloud принимают output_config в отдельном сообщении с beta-заголовком mid-conversation-output-config-2026-07-01, и кэш промпта при этом сохраняется. С disabled на Haiku так же, как с between_tools на Sonnet, это не работает — будет 400.
  4. Лимит max_tokens. Рассуждение входит в max_tokens. Слишком маленький лимит может закончиться на блоке thinking, до текста ответа.
  5. Ответ начинается с блока рассуждения. Выбирайте блоки по полю type, а не по позиции. Текст рассуждения по умолчанию не возвращается; чтобы получить краткое изложение, укажите thinking.display: "summarized".

Если код раньше работал с Haiku 4.5, добавляются несовместимые изменения из списка изменений Haiku 5.5 по сравнению с Haiku 4.5: budget_tokens вызывает ошибку, нестандартные temperature, top_p и top_k возвращают 400, предзаполнение ответа ассистента (prefill) не поддерживается, для работы с компьютером нужен computer_toolset_20260801 вместо computer_20250124, а классификаторы безопасности могут вернуть stop_reason: "refusal" без серверного переключения на другую модель.

Минимальный запрос к Haiku 5.5 с явными настройками выглядит так:

json
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "output_config": { "effort": "medium" },
  "messages": [
    { "role": "user", "content": "Определи категорию обращения: ..." }
  ]
}

Есть и поведенческие отличия, которые Anthropic описывает в руководстве по промптам для Haiku 5.5:

  • Останавливается раньше времени на low с длинным системным промптом агента и возвращает задачу пользователю. Переход с low на medium примерно вдвое сократил такие остановки в тестах Anthropic, но более чем вдвое увеличил число выходных токенов. В руководстве есть готовый фрагмент системного промпта против этого.
  • Сообщает, что правка кода готова, не запустив проверку, на low и medium. Добавьте в системный промпт требование проверять работу или запускайте тесты в своём коде после ответа модели.
  • Пропускает нужный вызов инструмента, если рассуждение выключено и запрошен структурированный JSON-вывод. Помогает адаптивный режим или принудительный вызов через tool_choice.
  • Не ищет свежие данные, если не знает сегодняшнюю дату. Вместе с инструментом поиска передавайте текущую дату в системном промпте.

Haiku 5.5 и Sonnet 5.5 в Claude Code: /model, субагенты, effort

В Claude Code Haiku 5.5 работает с версии v2.1.293 (Sonnet 5.5 — с v2.1.284); обновление — claude update. Переключиться можно командой /model claude-haiku-5-5 в сессии или при запуске: claude --model claude-haiku-5-5. Подробности — в настройках моделей в документации Claude Code.

Что учесть при выборе:

  • Алиасы зависят от провайдера. haiku указывает на Haiku 5.5 и sonnet на Sonnet 5.5 только при работе через Anthropic API. На Amazon Bedrock и Google Cloud haiku ведёт к Haiku 4.5, а sonnet к Sonnet 4.5, на Claude Platform on AWS — к Haiku 4.5 и Sonnet 4.6. Там указывайте полный ID модели.
  • Sonnet ведёт, Haiku помогает. Переменная CLAUDE_CODE_SUBAGENT_MODEL=haiku задаёт модель для субагентов, у которых модель не указана иначе; поле model в определении субагента имеет приоритет. Основная сессия при этом остаётся на Sonnet 5.5. Переменная ANTHROPIC_DEFAULT_HAIKU_MODEL управляет тем, куда ведёт алиас haiku, и заодно фоновыми функциями Claude Code.
  • Effort по умолчанию одинаковый. В Claude Code и Haiku 5.5, и Sonnet 5.5 по умолчанию работают на medium — в отличие от API, где у Sonnet по умолчанию high.
  • Рассуждение не выключается. Для обеих моделей Claude Code показывает «Thinking can't be turned off»; глубину регулирует только effort.
  • Длинные сессии дороже на Haiku. Обе модели работают в Claude Code с окном 1 млн токенов на любом плане. Если сессия оплачивается через API, запросы Haiku с промптом больше 100 000 токенов идут по старшему тарифу, а в долгой сессии с большим репозиторием это быстро становится нормой. Тогда разница с Sonnet ближе к 4×, чем к 20×.

Чем платить за Claude Code — подпиской или токенами API — разобрано в статье «Claude API и Claude Code: в чём разница и что выбрать».

Haiku 5.5 в приложении Claude: доступен на всех планах, включая Free

По странице Claude Haiku на сайте Anthropic, Haiku 5.5 можно выбрать в Claude.ai на планах Free, Pro, Max, Team и Enterprise — в веб-версии и в приложениях для iOS и Android. Sonnet 5.5 доступен в Claude.ai всем пользователям.

Расходует ли Haiku меньше лимита подписки, Anthropic напрямую не говорит. В справке Claude о лимитах использования сказано, что расход зависит от длины и сложности разговора, используемых функций, выбранной модели и уровня effort, но соотношение между моделями не опубликовано. Как устроены пятичасовые и недельные лимиты на разных планах, собрано в статье «Лимиты Claude Pro и Max в неделю и за 5 часов: сводная таблица».

С 7 октября Anthropic постепенно включает подписчикам Max и Team ежемесячный кредит на Claude API: $100 на Max 5x, $200 на Max 20x и до $500 общего пула на Team. Его можно потратить на любую модель в Claude Platform, в том числе на Haiku 5.5.

Россия, по состоянию на 8 октября 2026 года, не входит в список стран, где Anthropic официально предоставляет Claude. На само сравнение моделей это не влияет.

Вопросы о Claude Haiku 5.5 и Sonnet 5.5

Хватает ли Claude Haiku 5.5 для программирования?

Для узких задач — да: поиск по коду, сводка изменений, небольшие правки, которые проверяются тестами. Для многошаговой агентной работы в терминале — нет: в Terminal-Bench 4.0 у Haiku 5.5 39,2 % против 70,6 % у Sonnet 5.5 по данным Anthropic, и сама Anthropic называет Sonnet 5.5 и Opus 5.5 лучшим выбором для сложного агентного программирования. Рабочая связка в Claude Code — Sonnet в основной сессии и Haiku в субагентах.

Когда нужен не Sonnet 5.5, а Opus 5.5 или Fable 5.1?

Когда Sonnet 5.5 не решает задачу даже на xhigh или max. Цены Opus 5.5 и работа его лимитов в подписке описаны в статье «Claude Opus 5.5: цена API и как сбросить лимит подписки», а выбор между двумя старшими моделями — в статье «Claude Fable 5.1 или Opus 5.5: что выбрать и когда стоит доплатить».

Источники11

Внешние страницы, на которые ссылается это руководство, в порядке упоминания. Последнее обновление: 8 окт. 2026 г..

  1. 1.Artificial Analysisartificialanalysis.ai/models/releases/comparisons/claude-haiku-5-5-vs-claude-sonnet-5-5
  2. 2.странице цен Claude APIplatform.claude.com/docs/en/about-claude/pricing
  3. 3.анонса Claude Haiku 5.5anthropic.com/claude-haiku-5-5
  4. 4.руководство Anthropic по выбору моделиplatform.claude.com/docs/en/about-claude/models/choosing-a-model
  5. 5.документации Anthropic по параметру effortplatform.claude.com/docs/en/build-with-claude/effort
  6. 6.списка изменений Haiku 5.5 по сравнению с Haiku 4.5platform.claude.com/docs/en/models/haiku-5-5/whats-new-haiku-5-5
  7. 7.руководстве по промптам для Haiku 5.5platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-haiku-5-5
  8. 8.настройках моделей в документации Claude Codecode.claude.com/docs/en/model-config
  9. 9.странице Claude Haiku на сайте Anthropicanthropic.com/claude/haiku
  10. 10.справке Claude о лимитах использованияsupport.claude.com/en/articles/11647753-understanding-usage-and-length-limits
  11. 11.список стран, где Anthropic официально предоставляет Claudeanthropic.com/supported-countries
Ещё по теме Claude Code
Два пути к проверенному результату: Opus 5.5 для начала работы и Fable 5.1 для нерешённых задач
Claude Code

Claude Fable 5.1 или Opus 5.5: что выбрать и когда стоит доплатить

Opus 5.5 — разумный первый выбор для большинства рабочих задач. Fable 5.1 стоит проверять там, где Opus не справляется даже с повышенным уровнем рассуждений. Сравниваем возможности, стоимость задачи и условия перехода.

7 мин
Варианты подключения Claude Code: подписка, API-ключ и шлюз или облачный провайдер
Claude Code

Настройка Claude Code API: ключи, settings.json, модели и шлюзы

Прямой API подключается через ANTHROPIC_API_KEY с подтверждением в интерактивном сеансе. Для шлюза нужны совместимый API, адрес и его ключ или bearer-токен. Затем проверьте, какие настройки применились и откуда пришёл ответ модели.

11 мин