МИР НЕ СТОИТ НА МЕСТЕ.RSS
BIG CHANGE.

Версия Markdown

AI-translated from English; not yet reviewed by a fluent editor.

# Claude Opus 5.5 снижает цены API и требует изменений при переходе

> Anthropic снизила цены на токены Opus 5.5 и позиционирует модель ниже Fable 5.1 для контролируемой работы в организациях. При этом клиенты API сталкиваются с несовместимыми изменениями в настройках рассуждений и инструментов, а резервная модель подключается только при определённых условиях.

By BIG CHANGE Editorial

Published: 2026-09-22T17:10:37.939Z
Updated: 2026-09-23T03:16:01.519Z
Canonical: https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access

![A large abstract work capsule travels on a broad supported track while a separate side track ends at an unlabelled gate.](https://bigchange.ai/api/media/file/claude-opus-5-5-access-boundary-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE. More affordable capable AI can put longer jobs within reach, while routing and safeguards still determine what work a service handles. This is a conceptual mechanism, not an Anthropic product, benchmark or measured customer result.

Anthropic [представила Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) 22 сентября. Компания заявляет, что по большинству задач модель показывает результаты, близкие к Fable 5.1, при этом стоит дешевле Opus 5.

Для команд, уже использующих Opus 5, это обновление означает больше, чем просто более дешёвый идентификатор модели. Opus 5.5 всегда использует адаптивные рассуждения со средним уровнем по умолчанию и отклоняет некоторые форматы запросов, которые принимала Opus 5. Anthropic также рекомендует её как основную повседневную модель ниже Fable 5.1 для работы под надзором; Fable предназначена для наиболее сложных и продолжительных автономных задач.

## Главное изменение

- **Что изменилось:** Opus 5.5 снижает тарифы на входные и выходные токены на 20%, а на чтение из кэша — на 60%. Постоянно включённые адаптивные рассуждения также меняют то, как существующим клиентам API нужно формировать запросы и рассчитывать бюджет.
- **Почему это важно:** Длительные задачи агента многократно считывают предыдущие инструкции и результаты работы инструментов. Наибольшее снижение цены приходится на этот повторно используемый контекст, поэтому использование кэша становится ключом к пониманию полной стоимости задачи.
- **За чем следить:** Anthropic анонсировала Sonnet 5.5 и Haiku 5.5 на ближайшие недели; пока доступна только Opus. Выбирая модель по умолчанию, следует сравнивать стоимость завершённых задач и объём проверки, необходимый для каждого уровня.

## Opus 5.5 предназначена для производственной работы под надзором — ниже уровня Fable

Партнёрам Anthropic рекомендует Opus 5.5 как модель по умолчанию для корпоративной разработки, финансовых и юридических задач в рабочей среде, а также для агентов. В [открытом руководстве по выбору модели](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) сказано, что большинство рабочих нагрузок можно начинать с Opus 5.5; она подходит для сложной агентной разработки и корпоративных задач. Отдельное [руководство по стоимости](https://claude.com/blog/what-a-task-costs-on-opus-5-5) называет её «повседневной рабочей лошадкой» для разработки функций, отладки и проверки кода под надзором. В обоих руководствах Fable 5.1 стоит выше, когда важнее максимальные возможности или длительный сложный запуск, а не цена токенов.

В [руководстве по созданию промптов](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) Anthropic приводит результаты собственных тестов для анализа первопричин, проверки кода, параллельных подагентов, исследований, электронных таблиц, отчётов и презентаций. В нём также описаны более ясные сообщения о ходе работы и итоговые сводки, а также улучшения распознавания изображений и управления компьютером. Это оценки Anthropic, а не испытания BIG CHANGE.

Различие между Opus и Fable важно, поскольку цена Fable 5.1 составляет $10 за миллион входных токенов и $50 за миллион выходных, а Opus 5.5 — $4 и $20 соответственно. Тарифы за чтение из кэша гораздо ближе: $0.25 и $0.20. Поэтому в длительных сессиях с активным кэшированием разница в цене может быть меньше, чем предполагают основные тарифы на входные и выходные токены.

## В тарифах Claude Opus 5.5 изменены четыре ставки API

Ниже приведены стандартные цены API за миллион токенов. В [справочнике моделей](https://platform.claude.com/docs/en/models/opus-5-5/overview) Anthropic указаны контекстное окно на 1 млн токенов и максимальный объём выходных данных в 128 000 токенов для Opus 5.5. В [документации по ценам](https://platform.claude.com/docs/en/about-claude/pricing) сказано, что для всего контекстного окна действуют стандартные тарифы.

| Списание API | Opus 5.5 | Opus 5 | Изменение |
| --- | --- | --- | --- |
| Входные токены | $4 | $5 | На 20% ниже |
| Выходные токены | $20 | $25 | На 20% ниже |
| Запись в кэш на 5 минут | $5 | $6.25 | На 20% ниже |
| Чтение из кэша | $0.20 | $0.50 | На 60% ниже |

Anthropic сообщает, что при настройках по умолчанию типичная рабочая нагрузка обходится на 40% дешевле с учётом тарифов и эффективности расхода токенов. В [объяснении стоимости задач](https://claude.com/blog/what-a-task-costs-on-opus-5-5) показано, почему важна структура расходов: в длительных агентных сессиях неоднократно перечитывается увеличивающийся контекст, выходные данные включают токены рассуждений, а задача может состоять из множества шагов. Снижение цены на чтение из кэша на 60% может дать большую экономию в сессии с активным кэшированием; короткий запрос без кэширования с длинным ответом будет ближе к снижению тарифа на выходные токены на 20%.

По данным руководства по промптам, скорость генерации выходных данных выросла более чем на 30%. Это не измеряет время ожидания инструментов, тестов, внешних сервисов или проверяющего. Anthropic также предлагает более быстрый режим API по цене $8 за миллион входных и $40 за миллион выходных токенов; он доступен в режиме исследовательского предварительного просмотра в Claude API, но не на облачных платформах партнёров.

Anthropic также увеличила лимиты использования в течение пяти часов для планов Pro, Max, Team и Enterprise с оплатой за место, а также добавила возможность сохранять неиспользованный лимит до сброса. Лимит подписки отличается от оплаты API.

## Корпоративные бенчмарки показывают сильные стороны и границы

Anthropic сообщает о результатах Terminal-Bench 4.0: Opus 5.5 в режиме Xhigh — 66.4%, Opus 5 — 52.3%, Fable 5.1 — 55.8%. Большинство остальных основных результатов получено при уровне Max.

В опубликованных строках AutomationBench и Terminal-Bench-Science лидирует GPT-6 Astra. Для защищённых киберзадач использовалась Opus 4.8; для биологических задач и разработки передовых моделей — Opus 5. В AutomationBench резервная модель не использовалась.

Anthropic сообщает о меньшем количестве необратимых действий и действий за пределами разрешённых задач в своём поведенческом аудите. В [руководстве по созданию промптов](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) также заявлено, что Opus лучше предыдущих моделей этой линейки противостоит косвенным атакам через промпт-инъекции. Это результаты собственных тестов компании, а не общая сертификация безопасности.

## Клиентам API необходимо явно выполнить переход

Клиентам API нужно указывать `claude-opus-5-5`; запросы для Opus 5 не переключатся на новую модель сами собой. В [справочнике по переходу](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) перечислены изменения запросов, которые иначе могут вызывать ошибки или менять поток вывода приложения.

| Точка перехода | Поведение Opus 5.5 |
| --- | --- |
| Выбор модели | Явно задайте `claude-opus-5-5`. |
| Рассуждения | Адаптивные рассуждения всегда включены. Запросы с отключёнными рассуждениями или ручным бюджетом токенов возвращают HTTP 400. |
| Уровень усилий | Используйте `low`, `medium`, `high`, `xhigh` или `max`; по умолчанию используется `medium`. |
| Принудительный выбор инструментов | `tool_choice` Значения `any` и `tool` возвращают HTTP 400; `auto` и `none` по-прежнему поддерживаются. |
| Управление компьютером | Устаревший инструмент `computer_20251124` отклоняется в Claude API и Google Cloud; Amazon Bedrock продолжает его поддерживать. |
| Текст о ходе работы | Текст между вызовами инструментов приходит в блоках рассуждений, поэтому клиент, который по умолчанию не показывает такие блоки, может выглядеть бездействующим между вызовами. |

Сохранённые блоки рассуждений создают дополнительное ограничение для клиентов с длительными задачами. Такие блоки привязаны к модели и префиксу диалога. В аккаунтах API и облачных платформ, созданных 31 августа 2026 года или позже, изменение более ранних инструкций, инструментов или сообщений перед повторной передачей блока по умолчанию приводит к ошибке 400. [Документация Anthropic о сохранённых рассуждениях](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) объясняет добавление сообщений только в конец диалога и контролируемый способ удалить несовместимый блок.

## Защитная маршрутизация может изменить модель, которая ответит

В [руководстве по созданию промптов](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) описаны меры защиты биологических задач на уровне Fable 5.1, а также классификаторы для кибербезопасности и извлечения рассуждений. Поиск уязвимостей в исходном коде по-прежнему разрешён; организации могут подать заявку на проверку для задач в области наук о жизни. Расширенная проверка киберзадач анонсирована на ближайшие недели.

Вместо ответа может прийти отказ с HTTP 200 и кодом `stop_reason: "refusal"`. В [документации о резервных моделях](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) описаны переключение на стороне сервера, промежуточное ПО SDK и повторные попытки со стороны клиента. Переход на резервную модель происходит только при настройке одного из этих поддерживаемых способов; он не гарантируется автоматически для каждого запроса к Opus 5.5. Для категорий без рекомендуемой резервной модели возможен отказ.

Таким образом, модель, фактически обслужившая запрос, становится частью результата. При переходе на Opus 5.5 приложению нужно отдельно учитывать отказы и ответы, обслуженные резервной моделью, особенно если работа затрагивает защищённые области. Более низкие тарифы и широкие заявления о возможностях относятся к Opus 5.5; запрос, направленный другой модели, подчиняется поведению и ограничениям модели, которая фактически ответила.

## Sources

- [Anthropic: представляем Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) — Основное объявление о запуске модели, заявления Anthropic о стоимости и скорости на типичных задачах, бенчмарки, изменения лимитов подписчиков и подход к безопасности. Опубликованные тесты и примеры ранних пользователей представлены компанией, а не являются независимыми результатами для всех задач.
- [Claude Platform: что нового в Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — Актуальная справка о модели и переходе: идентификатор API, доступность у провайдеров, цены, настройки усилий по умолчанию, неподдерживаемые параметры рассуждений и инструментов, охват быстрого режима и переход с инструмента управления компьютером. Перед развёртыванием проверьте поддержку у выбранного провайдера.
- [Claude Platform: сохранённые рассуждения](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) — Объясняет привязку к модели и правило добавления сообщений только в конец префикса диалога для возвращённых блоков рассуждений. Проверка префикса по умолчанию действует для аккаунтов, созданных 31 августа 2026 года или позже; для интерфейсов под управлением Anthropic прямые изменения клиента не нужны.
- [Claude Platform: отказы и резервная модель](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) — Описывает отказы классификатора как ответы HTTP 200 со значением stop_reason refusal и сведениями о категории, а также способы переключения на резервную модель. Успешный HTTP-статус не доказывает, что задачу выполнила запрошенная модель.
- [Справочник модели Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/overview) — Официальная спецификация контекстного окна в 1 млн токенов, максимального вывода в 128 000 токенов, стандартных тарифов и стоимости кэширования, среднего уровня усилий по умолчанию, идентификаторов модели и поддерживаемых платформ. В статье производительность не выводится из этих спецификаций.
- [Сколько стоит задача на Opus 5.5](https://claude.com/blog/what-a-task-costs-on-opus-5-5) — Руководство Anthropic объясняет, как количество шагов, чтение кэша, выходные данные и уровень усилий влияют на стоимость задачи, а также позиционирует Opus 5.5 ниже Fable 5.1 как повседневную модель для работы под надзором. Примеры служат иллюстративными рекомендациями компании, а не результатами тестов BIG CHANGE.
- [Подготовка промптов для Claude Opus 5.5](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) — Официальное руководство описывает проверенные компанией возможности в программировании, аналитической работе, коммуникациях, зрительном восприятии, управлении компьютером и работе нескольких агентов, а также заявление о скорости генерации и поведении сообщений о ходе работы. Это оценки Anthropic, а не продуктовые тесты BIG CHANGE.
- [Выбор подходящей модели Claude](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) — Официальная таблица выбора указывает, что начинать большинство задач следует с Opus 5.5, рекомендует её для сложной агентной разработки и корпоративных задач, а Fable 5.1 оставляет для наиболее высокой доступной способности. Это подтверждает позиционирование уровней без опоры только на материалы партнёров.
- [Claude Platform: цены](https://platform.claude.com/docs/en/about-claude/pricing) — Официальный справочник по ценам подтверждает, что в Claude 4.6 и более поздних моделях контекстное окно на 1 млн токенов доступно по стандартным тарифам за токен. Также подтверждены тарифы на кэш промптов и быстрый режим, использованные в сравнении.