AI-translated from English; not yet reviewed by a fluent editor.

# Claude Haiku 5.5 снижает цену токенов, но меняет расчёты миграции

> Новая модель Haiku от Anthropic предлагает более низкие тарифы на токены, использует другой токенизатор и вносит изменения в миграцию Messages API. Перед переходом пользователям Haiku 4.5 стоит заново подсчитать запросы и проверить обработку ответов.

By BIG CHANGE Editorial

Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

![Conceptual charcoal illustration of a mechanical adding machine with a long blank paper tape and one orange band.](https://bigchange.ai/api/media/file/claude-haiku-55-recount-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.

Anthropic выпустила Claude Haiku 5.5 7 октября для коротких частых задач, на которые может приходиться значительная доля вызовов в агентной системе. Публичные тарифы Claude API начинаются с $0,10 за миллион входных токенов и $0,50 за миллион выходных — это десятая часть тарифов Haiku 4.5. Однако, по словам Anthropic, для того же текста новая модель расходует примерно на 30% больше токенов, а prompt длиной свыше 100 000 токенов попадает в более дорогой тарифный уровень. Командам, использующим Haiku 4.5, нужно заново подсчитать собственные запросы, прежде чем оценивать счёт или переводить производственный трафик.

Релиз также меняет работу с Messages API. Ручные бюджеты thinking в Haiku 5.5 не работают, адаптивный thinking включён по умолчанию, а первым блоком ответа может быть `thinking` , а не текст. Это конкретные проверки совместимости для сервисов, которые многократно вызывают небольшую модель для классификации, извлечения, маршрутизации или суммирования данных.

## Главное изменение

- **Что изменилось:** Anthropic добавила новое контекстное окно на миллион токенов и адаптивный thinking в самый доступный уровень Claude. Haiku 5.5 снижает тариф для коротких prompt, одновременно меняя подсчёт текста и возможное начало ответа.
- **Почему это важно:** Теперь команда может рассмотреть Claude для большего числа частых, узкоспециализированных этапов работы агента по более низкому опубликованному тарифу. Выгода зависит от сочетания длины prompt, выходных токенов и токенов thinking, использования кеша, а также от того, достигает ли новая модель требуемого качества на конкретном этапе.
- **На что обратить внимание:** Интеграции с Haiku 4.5 нужно мигрировать с проверкой результатов. После пересчёта запросы около порога в 100 000 токенов могут перейти на более дорогой уровень, а код, считающий первый блок содержимого текстом, может неправильно обработать в остальном успешный ответ.

## Цена зависит от длины prompt

В Claude API Haiku 5.5 стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для prompt длиной до 100 000 токенов. Выше этого порога тарифы составляют соответственно $0,50 и $2,50. Для Haiku 4.5 указаны цены $1 и $5 на всём контекстном окне в 200 000 токенов. У Haiku 5.5 контекстное окно составляет миллион токенов, а максимальный объём вывода — 128 000 токенов; у Haiku 4.5 — 200 000 и 64 000 соответственно. Anthropic указывает доступность через Claude API, Amazon Bedrock, Claude Platform в AWS, Google Cloud и Microsoft Foundry. ID модели для Amazon Bedrock — `anthropic.claude-haiku-5-5`; в Claude API используется `claude-haiku-5-5`. [На страницах моделей Anthropic](https://platform.claude.com/docs/en/models/haiku-5-5/overview) указаны актуальные ID платформ, ограничения и тарифы.

По данным Anthropic, средняя стоимость запуска Haiku 5.5 примерно на 75% ниже, чем у Haiku 4.5 *в среднем*. В сноске объединены тариф на 90% ниже для prompt длиной до 100 000 токенов, тариф на 50% ниже выше этого порога, наблюдение, что 90% запросов Haiku 4.5 относились к короткой категории, и более высокий подсчёт токенов новым токенизатором для той же работы. Этот расчёт описывает структуру запросов Anthropic, а не единообразную скидку на каждый запрос. Увеличение числа токенов примерно на 30% — тоже оценка поставщика для того же входного текста; точное изменение зависит от его содержания. [В анонсе запуска Anthropic](https://www.anthropic.com/claude-haiku-5-5) приведены и заявление, и метод расчёта.

Для запроса Claude API без кеширования возьмите число входных и выходных токенов Haiku 5.5, умножьте каждое на тариф *ценового уровня по длине prompt запроса* и разделите на миллион. Пример расчёта: 80 000 входных и 10 000 выходных токенов по тарифам для коротких prompt стоят $0,013. Для 120 000 входных и 10 000 выходных токенов тарифы для длинных prompt дают $0,085. Это расчёты стоимости, а не наблюдавшиеся задачи или прогнозы. Для чтения и записи кеша действуют отдельные тарифы, а для пакетной обработки указана скидка 50% на вход и выход. Поэтому полезная оценка сначала группирует реальные вызовы по длине prompt и использованию кеша, а затем суммирует их стоимость. [Эти категории перечислены на странице модели Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) .

Пересчитайте сохранённые репрезентативные prompt с помощью [эндпоинта подсчёта токенов Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens), указав `claude-haiku-5-5`. Общее число токенов старой модели не позволяет определить, в какой тарифный уровень 5.5 попадёт prompt. Для реального примера фиксируйте ответ `usage`, длину вывода, поля кеша, effort и фактическую стоимость вместе с результатами задачи. Включите короткие запросы, самые длинные повторяющиеся диалоги и случаи около 100 000 токенов. BIG CHANGE изучила документацию, но не запускала Haiku 5.5 и не измеряла производственную нагрузку.

## Настройки, которые нужно проверить при миграции

В [руководстве Anthropic по миграции на Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) приведён необычно подробный список проверок для клиентов, переходящих с Haiku 4.5:

1. Измените ID модели для платформы и пересчитайте prompt. `claude-haiku-5-5`— фиксированный ID Claude API без суффикса даты и отдельного псевдонима. Проверьте `max_tokens`, поскольку thinking расходует этот лимит, а для того же текста может потребоваться больше токенов.
2. Замените `thinking: {"type":"enabled","budget_tokens":N}` адаптивным thinking или оставьте `thinking` незаданным. Установите `output_config.effort` для настройки глубины; документированное значение по умолчанию — `medium`. Низкое значение `max_tokens` может завершить ответ после блока thinking, не выдав текст.
3. Читайте блоки содержимого по `type`, а не по позиции. Передавайте блоки thinking обратно без изменений вместе с результатами инструментов. Проверьте хранилища диалогов, которые воспроизводят блок через другую учётную запись либо меняют прежние сообщения, системные инструкции или инструменты.
4. Удалите пользовательские настройки `temperature`, `top_p` и `top_k`. Замените финальный префикс assistant на ход user, а для форматов с ограничениями используйте описанный Anthropic подход со структурированным выводом или инструментами. Обрабатывайте в клиенте значение `stop_reason` у `refusal`.
5. Если интеграция использует computer use в Claude API или Google Cloud, замените старый инструмент `computer_20250124` на `computer_toolset_20260801` и обновите цикл работы с инструментами по руководству. Организациям с ёмкостью Priority Tier для Haiku 4.5 также нужен отдельный план: согласно руководству, Priority Tier недоступен в Haiku 5.5.

Эти изменения не предписывают одно значение effort для всех задач. Сравнение должно сохранять неизменными задачу приложения и критерии приёмки, а затем фиксировать качество ответов, отказы, обрывы, задержку и тарифицируемые токены при выбранных настройках. Anthropic сообщает о более высоких результатах Haiku 5.5 по сравнению с 4.5 в нескольких тестах, включая 39,2% против 0,0% в таблице Terminal-Bench 4.0. Это результаты Anthropic в условиях её оценки, а не измерение агентной системы читателя. Anthropic также считает Sonnet 5.5 и Opus 5.5 более подходящими для сложного агентного программирования в этом тесте. Ближайший вопрос для пользователей Haiku 4.5 — соответствует ли меньшая модель требованиям каждого узкого этапа с учётом изменений API и нового подсчёта токенов.

## Источники и дополнительная литература

- [Анонс Anthropic о Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5)Указывает дату запуска, предполагаемые задачи и доступность, а также объясняет расчёт средней стоимости задачи. В таблице тестов приведены результаты оценки Anthropic.
- [Страница модели Haiku 5.5 на Claude Platform](https://platform.claude.com/docs/en/models/haiku-5-5/overview)Содержит ID, ограничения контекста и вывода, тарифные уровни по длине prompt, цены кеша и поддерживаемые платформы. [Страница Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview)содержит тарифы и ограничения предыдущей модели.
- [Руководство по миграции Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)Описывает изменения Messages API и ошибки, которые следует проверить перед переносом существующей интеграции. [Справочник API подсчёта токенов](https://platform.claude.com/docs/en/api/go/messages/count_tokens)описывает подсчёт запроса с выбранной моделью.
- [Материал Reuters о запуске 7 октября](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)независимо подтверждает дату релиза. Технические настройки и тарифы выше взяты из актуальной документации Anthropic.

## Sources

- [Anthropic: запуск Claude Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5) — Дата релиза, предполагаемые задачи, бенчмарк поставщика и заявления о средней стоимости, сноска с расчётом и доступность в облаке.
- [Обзор модели Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — Текущий ID модели, цены API в зависимости от длины prompt, тарифы кеша и пакетной обработки, контекст, вывод и доступность.
- [Обзор модели Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — Текущий статус предыдущей модели, опубликованные тарифы и ограничения.
- [Руководство по миграции Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Основной список изменений Messages API и рекомендации по токенизатору.
- [Подсчёт токенов в Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — Эндпоинт подсчёта токенов и подсчёт запроса для конкретной модели.
- [Reuters: Anthropic выпустила третью модель Claude 5.5](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — Только независимое подтверждение выпуска.
