Anthropic представила Claude Opus 5.5 22 сентября. Компания заявляет, что по большинству задач модель показывает результаты, близкие к Fable 5.1, при этом стоит дешевле Opus 5.

Для команд, уже использующих Opus 5, это обновление означает больше, чем просто более дешёвый идентификатор модели. Opus 5.5 всегда использует адаптивные рассуждения со средним уровнем по умолчанию и отклоняет некоторые форматы запросов, которые принимала Opus 5. Anthropic также рекомендует её как основную повседневную модель ниже Fable 5.1 для работы под надзором; Fable предназначена для наиболее сложных и продолжительных автономных задач.

Главное изменение

  • Что изменилось: Opus 5.5 снижает тарифы на входные и выходные токены на 20%, а на чтение из кэша — на 60%. Постоянно включённые адаптивные рассуждения также меняют то, как существующим клиентам API нужно формировать запросы и рассчитывать бюджет.
  • Почему это важно: Длительные задачи агента многократно считывают предыдущие инструкции и результаты работы инструментов. Наибольшее снижение цены приходится на этот повторно используемый контекст, поэтому использование кэша становится ключом к пониманию полной стоимости задачи.
  • За чем следить: Anthropic анонсировала Sonnet 5.5 и Haiku 5.5 на ближайшие недели; пока доступна только Opus. Выбирая модель по умолчанию, следует сравнивать стоимость завершённых задач и объём проверки, необходимый для каждого уровня.

Opus 5.5 предназначена для производственной работы под надзором — ниже уровня Fable

Партнёрам Anthropic рекомендует Opus 5.5 как модель по умолчанию для корпоративной разработки, финансовых и юридических задач в рабочей среде, а также для агентов. В открытом руководстве по выбору модели сказано, что большинство рабочих нагрузок можно начинать с Opus 5.5; она подходит для сложной агентной разработки и корпоративных задач. Отдельное руководство по стоимости называет её «повседневной рабочей лошадкой» для разработки функций, отладки и проверки кода под надзором. В обоих руководствах Fable 5.1 стоит выше, когда важнее максимальные возможности или длительный сложный запуск, а не цена токенов.

В руководстве по созданию промптов Anthropic приводит результаты собственных тестов для анализа первопричин, проверки кода, параллельных подагентов, исследований, электронных таблиц, отчётов и презентаций. В нём также описаны более ясные сообщения о ходе работы и итоговые сводки, а также улучшения распознавания изображений и управления компьютером. Это оценки Anthropic, а не испытания BIG CHANGE.

Различие между Opus и Fable важно, поскольку цена Fable 5.1 составляет $10 за миллион входных токенов и $50 за миллион выходных, а Opus 5.5 — $4 и $20 соответственно. Тарифы за чтение из кэша гораздо ближе: $0.25 и $0.20. Поэтому в длительных сессиях с активным кэшированием разница в цене может быть меньше, чем предполагают основные тарифы на входные и выходные токены.

В тарифах Claude Opus 5.5 изменены четыре ставки API

Ниже приведены стандартные цены API за миллион токенов. В справочнике моделей Anthropic указаны контекстное окно на 1 млн токенов и максимальный объём выходных данных в 128 000 токенов для Opus 5.5. В документации по ценам сказано, что для всего контекстного окна действуют стандартные тарифы.

Списание API

Opus 5.5

Opus 5

Изменение

Входные токены

$4

$5

На 20% ниже

Выходные токены

$20

$25

На 20% ниже

Запись в кэш на 5 минут

$5

$6.25

На 20% ниже

Чтение из кэша

$0.20

$0.50

На 60% ниже

Anthropic сообщает, что при настройках по умолчанию типичная рабочая нагрузка обходится на 40% дешевле с учётом тарифов и эффективности расхода токенов. В объяснении стоимости задач показано, почему важна структура расходов: в длительных агентных сессиях неоднократно перечитывается увеличивающийся контекст, выходные данные включают токены рассуждений, а задача может состоять из множества шагов. Снижение цены на чтение из кэша на 60% может дать большую экономию в сессии с активным кэшированием; короткий запрос без кэширования с длинным ответом будет ближе к снижению тарифа на выходные токены на 20%.

По данным руководства по промптам, скорость генерации выходных данных выросла более чем на 30%. Это не измеряет время ожидания инструментов, тестов, внешних сервисов или проверяющего. Anthropic также предлагает более быстрый режим API по цене $8 за миллион входных и $40 за миллион выходных токенов; он доступен в режиме исследовательского предварительного просмотра в Claude API, но не на облачных платформах партнёров.

Anthropic также увеличила лимиты использования в течение пяти часов для планов Pro, Max, Team и Enterprise с оплатой за место, а также добавила возможность сохранять неиспользованный лимит до сброса. Лимит подписки отличается от оплаты API.

Корпоративные бенчмарки показывают сильные стороны и границы

Anthropic сообщает о результатах Terminal-Bench 4.0: Opus 5.5 в режиме Xhigh — 66.4%, Opus 5 — 52.3%, Fable 5.1 — 55.8%. Большинство остальных основных результатов получено при уровне Max.

В опубликованных строках AutomationBench и Terminal-Bench-Science лидирует GPT-6 Astra. Для защищённых киберзадач использовалась Opus 4.8; для биологических задач и разработки передовых моделей — Opus 5. В AutomationBench резервная модель не использовалась.

Anthropic сообщает о меньшем количестве необратимых действий и действий за пределами разрешённых задач в своём поведенческом аудите. В руководстве по созданию промптов также заявлено, что Opus лучше предыдущих моделей этой линейки противостоит косвенным атакам через промпт-инъекции. Это результаты собственных тестов компании, а не общая сертификация безопасности.

Клиентам API необходимо явно выполнить переход

Клиентам API нужно указывать claude-opus-5-5; запросы для Opus 5 не переключатся на новую модель сами собой. В справочнике по переходу перечислены изменения запросов, которые иначе могут вызывать ошибки или менять поток вывода приложения.

Точка перехода

Поведение Opus 5.5

Выбор модели

Явно задайте claude-opus-5-5.

Рассуждения

Адаптивные рассуждения всегда включены. Запросы с отключёнными рассуждениями или ручным бюджетом токенов возвращают HTTP 400.

Уровень усилий

Используйте low, medium, high, xhigh или max; по умолчанию используется medium.

Принудительный выбор инструментов

tool_choice Значения any и tool возвращают HTTP 400; auto и none по-прежнему поддерживаются.

Управление компьютером

Устаревший инструмент computer_20251124 отклоняется в Claude API и Google Cloud; Amazon Bedrock продолжает его поддерживать.

Текст о ходе работы

Текст между вызовами инструментов приходит в блоках рассуждений, поэтому клиент, который по умолчанию не показывает такие блоки, может выглядеть бездействующим между вызовами.

Сохранённые блоки рассуждений создают дополнительное ограничение для клиентов с длительными задачами. Такие блоки привязаны к модели и префиксу диалога. В аккаунтах API и облачных платформ, созданных 31 августа 2026 года или позже, изменение более ранних инструкций, инструментов или сообщений перед повторной передачей блока по умолчанию приводит к ошибке 400. Документация Anthropic о сохранённых рассуждениях объясняет добавление сообщений только в конец диалога и контролируемый способ удалить несовместимый блок.

Защитная маршрутизация может изменить модель, которая ответит

В руководстве по созданию промптов описаны меры защиты биологических задач на уровне Fable 5.1, а также классификаторы для кибербезопасности и извлечения рассуждений. Поиск уязвимостей в исходном коде по-прежнему разрешён; организации могут подать заявку на проверку для задач в области наук о жизни. Расширенная проверка киберзадач анонсирована на ближайшие недели.

Вместо ответа может прийти отказ с HTTP 200 и кодом stop_reason: "refusal". В документации о резервных моделях описаны переключение на стороне сервера, промежуточное ПО SDK и повторные попытки со стороны клиента. Переход на резервную модель происходит только при настройке одного из этих поддерживаемых способов; он не гарантируется автоматически для каждого запроса к Opus 5.5. Для категорий без рекомендуемой резервной модели возможен отказ.

Таким образом, модель, фактически обслужившая запрос, становится частью результата. При переходе на Opus 5.5 приложению нужно отдельно учитывать отказы и ответы, обслуженные резервной моделью, особенно если работа затрагивает защищённые области. Более низкие тарифы и широкие заявления о возможностях относятся к Opus 5.5; запрос, направленный другой модели, подчиняется поведению и ограничениям модели, которая фактически ответила.