Anthropic выпустила Claude Haiku 5.5 7 октября для коротких частых задач, на которые может приходиться значительная доля вызовов в агентной системе. Публичные тарифы Claude API начинаются с $0,10 за миллион входных токенов и $0,50 за миллион выходных — это десятая часть тарифов Haiku 4.5. Однако, по словам Anthropic, для того же текста новая модель расходует примерно на 30% больше токенов, а prompt длиной свыше 100 000 токенов попадает в более дорогой тарифный уровень. Командам, использующим Haiku 4.5, нужно заново подсчитать собственные запросы, прежде чем оценивать счёт или переводить производственный трафик.
Релиз также меняет работу с Messages API. Ручные бюджеты thinking в Haiku 5.5 не работают, адаптивный thinking включён по умолчанию, а первым блоком ответа может быть thinking , а не текст. Это конкретные проверки совместимости для сервисов, которые многократно вызывают небольшую модель для классификации, извлечения, маршрутизации или суммирования данных.
Главное изменение
- Что изменилось: Anthropic добавила новое контекстное окно на миллион токенов и адаптивный thinking в самый доступный уровень Claude. Haiku 5.5 снижает тариф для коротких prompt, одновременно меняя подсчёт текста и возможное начало ответа.
- Почему это важно: Теперь команда может рассмотреть Claude для большего числа частых, узкоспециализированных этапов работы агента по более низкому опубликованному тарифу. Выгода зависит от сочетания длины prompt, выходных токенов и токенов thinking, использования кеша, а также от того, достигает ли новая модель требуемого качества на конкретном этапе.
- На что обратить внимание: Интеграции с Haiku 4.5 нужно мигрировать с проверкой результатов. После пересчёта запросы около порога в 100 000 токенов могут перейти на более дорогой уровень, а код, считающий первый блок содержимого текстом, может неправильно обработать в остальном успешный ответ.
Цена зависит от длины prompt
В Claude API Haiku 5.5 стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для prompt длиной до 100 000 токенов. Выше этого порога тарифы составляют соответственно $0,50 и $2,50. Для Haiku 4.5 указаны цены $1 и $5 на всём контекстном окне в 200 000 токенов. У Haiku 5.5 контекстное окно составляет миллион токенов, а максимальный объём вывода — 128 000 токенов; у Haiku 4.5 — 200 000 и 64 000 соответственно. Anthropic указывает доступность через Claude API, Amazon Bedrock, Claude Platform в AWS, Google Cloud и Microsoft Foundry. ID модели для Amazon Bedrock — anthropic.claude-haiku-5-5; в Claude API используется claude-haiku-5-5. На страницах моделей Anthropic указаны актуальные ID платформ, ограничения и тарифы.
По данным Anthropic, средняя стоимость запуска Haiku 5.5 примерно на 75% ниже, чем у Haiku 4.5 в среднем. В сноске объединены тариф на 90% ниже для prompt длиной до 100 000 токенов, тариф на 50% ниже выше этого порога, наблюдение, что 90% запросов Haiku 4.5 относились к короткой категории, и более высокий подсчёт токенов новым токенизатором для той же работы. Этот расчёт описывает структуру запросов Anthropic, а не единообразную скидку на каждый запрос. Увеличение числа токенов примерно на 30% — тоже оценка поставщика для того же входного текста; точное изменение зависит от его содержания. В анонсе запуска Anthropic приведены и заявление, и метод расчёта.
Для запроса Claude API без кеширования возьмите число входных и выходных токенов Haiku 5.5, умножьте каждое на тариф ценового уровня по длине prompt запроса и разделите на миллион. Пример расчёта: 80 000 входных и 10 000 выходных токенов по тарифам для коротких prompt стоят $0,013. Для 120 000 входных и 10 000 выходных токенов тарифы для длинных prompt дают $0,085. Это расчёты стоимости, а не наблюдавшиеся задачи или прогнозы. Для чтения и записи кеша действуют отдельные тарифы, а для пакетной обработки указана скидка 50% на вход и выход. Поэтому полезная оценка сначала группирует реальные вызовы по длине prompt и использованию кеша, а затем суммирует их стоимость. Эти категории перечислены на странице модели Haiku 5.5 .
Пересчитайте сохранённые репрезентативные prompt с помощью эндпоинта подсчёта токенов Message, указав claude-haiku-5-5. Общее число токенов старой модели не позволяет определить, в какой тарифный уровень 5.5 попадёт prompt. Для реального примера фиксируйте ответ usage, длину вывода, поля кеша, effort и фактическую стоимость вместе с результатами задачи. Включите короткие запросы, самые длинные повторяющиеся диалоги и случаи около 100 000 токенов. BIG CHANGE изучила документацию, но не запускала Haiku 5.5 и не измеряла производственную нагрузку.
Настройки, которые нужно проверить при миграции
В руководстве Anthropic по миграции на Haiku 5.5 приведён необычно подробный список проверок для клиентов, переходящих с Haiku 4.5:
- Измените ID модели для платформы и пересчитайте prompt.
claude-haiku-5-5— фиксированный ID Claude API без суффикса даты и отдельного псевдонима. Проверьтеmax_tokens, поскольку thinking расходует этот лимит, а для того же текста может потребоваться больше токенов. - Замените
thinking: {"type":"enabled","budget_tokens":N}адаптивным thinking или оставьтеthinkingнезаданным. Установитеoutput_config.effortдля настройки глубины; документированное значение по умолчанию —medium. Низкое значениеmax_tokensможет завершить ответ после блока thinking, не выдав текст. - Читайте блоки содержимого по
type, а не по позиции. Передавайте блоки thinking обратно без изменений вместе с результатами инструментов. Проверьте хранилища диалогов, которые воспроизводят блок через другую учётную запись либо меняют прежние сообщения, системные инструкции или инструменты. - Удалите пользовательские настройки
temperature,top_pиtop_k. Замените финальный префикс assistant на ход user, а для форматов с ограничениями используйте описанный Anthropic подход со структурированным выводом или инструментами. Обрабатывайте в клиенте значениеstop_reasonуrefusal. - Если интеграция использует computer use в Claude API или Google Cloud, замените старый инструмент
computer_20250124наcomputer_toolset_20260801и обновите цикл работы с инструментами по руководству. Организациям с ёмкостью Priority Tier для Haiku 4.5 также нужен отдельный план: согласно руководству, Priority Tier недоступен в Haiku 5.5.
Эти изменения не предписывают одно значение effort для всех задач. Сравнение должно сохранять неизменными задачу приложения и критерии приёмки, а затем фиксировать качество ответов, отказы, обрывы, задержку и тарифицируемые токены при выбранных настройках. Anthropic сообщает о более высоких результатах Haiku 5.5 по сравнению с 4.5 в нескольких тестах, включая 39,2% против 0,0% в таблице Terminal-Bench 4.0. Это результаты Anthropic в условиях её оценки, а не измерение агентной системы читателя. Anthropic также считает Sonnet 5.5 и Opus 5.5 более подходящими для сложного агентного программирования в этом тесте. Ближайший вопрос для пользователей Haiku 4.5 — соответствует ли меньшая модель требованиям каждого узкого этапа с учётом изменений API и нового подсчёта токенов.
Источники и дополнительная литература
- Анонс Anthropic о Haiku 5.5Указывает дату запуска, предполагаемые задачи и доступность, а также объясняет расчёт средней стоимости задачи. В таблице тестов приведены результаты оценки Anthropic.
- Страница модели Haiku 5.5 на Claude PlatformСодержит ID, ограничения контекста и вывода, тарифные уровни по длине prompt, цены кеша и поддерживаемые платформы. Страница Haiku 4.5содержит тарифы и ограничения предыдущей модели.
- Руководство по миграции Haiku 5.5Описывает изменения Messages API и ошибки, которые следует проверить перед переносом существующей интеграции. Справочник API подсчёта токеновописывает подсчёт запроса с выбранной моделью.
- Материал Reuters о запуске 7 октябрянезависимо подтверждает дату релиза. Технические настройки и тарифы выше взяты из актуальной документации Anthropic.



