세상은 멈춰 있지 않습니다.RSS
BIG CHANGE.

Markdown 버전

AI-translated from English; not yet reviewed by a fluent editor.

# Claude Sonnet 5.5 출시: Sonnet 5와 같은 가격, 달라진 마이그레이션

> Anthropic은 Sonnet 5.5가 토큰 요금을 그대로 유지하면서 더 빠른 출력을 제공하고 작업당 비용을 낮춘다고 주장한다. 평가 조건과 개발자가 확인해야 할 API 변경 사항을 살펴본다.

By BIG CHANGE Editorial

Published: 2026-09-29T00:34:31.965Z
Updated: 2026-09-29T00:34:31.965Z
Canonical: https://bigchange.ai/blog/claude-sonnet-55-prices-benchmarks-migration

![Conceptual charcoal illustration of a standing developer in profile examining a laptop on a sturdy counter.](https://bigchange.ai/api/media/file/claude-sonnet-55-migration-hero-v2.png)
AI-generated conceptual illustration by BIG CHANGE.

Anthropic은 9월 28일 Sonnet 5와 같은 API 토큰 가격으로 Claude Sonnet 5.5를 출시했다. 회사는 이 모델이 출력을 30% 넘게 더 빠르게 생성하고 토큰을 더 적게 사용해 작업당 비용을 최대 30% 낮출 수 있다고 밝혔다. 이는 서로 다른 주장이다. 공개된 가격 자체가 인하된 것은 아니며, 실제 작업 비용은 여전히 프롬프트, 출력, 도구, 노력 설정에 따라 달라진다.

개발자에게 이번 출시는 유용할 수 있는 효율성 향상과 Sonnet 5 통합을 깨뜨릴 수 있는 변경 사항을 함께 가져온다. Anthropic 문서에는 이 모델이 `claude-sonnet-5-5`로 Claude API, Google Cloud, Microsoft Foundry에서 제공되며, `anthropic.claude-sonnet-5-5`는 Amazon Bedrock에서 제공된다고 나와 있다. 모델 페이지에는 컨텍스트 창이 100만 토큰이고 최대 출력이 128,000토큰이라고 명시되어 있다. AWS의 Claude Platform을 통한 이용도 안내되어 있다. 클라우드 제공업체의 청구 방식과 리전 설정은 Claude API에 공개된 요금과 다를 수 있다.

## 평가 결과가 보여주는 것

Anthropic의 Terminal-Bench 4.0 실행에서 Sonnet 5.5는 터미널 작업 66개 중 70.6%를 완료했다. 출시 표에서 Sonnet 5의 완료율은 10.3%였다. 시스템 카드는 컨테이너화된 명령줄 환경에서 과학 및 공학 분야의 까다로운 작업을 수행했다고 설명한다. Anthropic은 Claude Code를 bare 모드와 최대 사고 노력 설정으로 실행하고 인터넷 접근을 차단했으며 작업에 필요한 리소스를 캐시했다. 안전장치가 Sonnet 5.5 요청의 1.2%를 대체 모델로 보내면서 시험의 1.5%에 영향을 주었다. Anthropic은 Sonnet 5.5 결과의 표준 오차가 2.5%포인트라고 보고했다. 이 점수는 해당 설정에서의 결과를 측정한 것이며, 개발자 자신의 저장소에서도 같은 향상이 나타난다는 근거는 아니다.

Anthropic 시스템 카드에 따르면 Cognition은 Claude Code에서 저장소 작업 150개를 대상으로 FrontierCode를 실행했고, xhigh 노력 설정의 Main 세트에서 Sonnet 5.5가 52.1%를 기록했다고 보고했다. max 설정에서는 46.2%로 낮아졌다. Cognition이 살펴본 사례에서는 에이전트의 추가 검토와 수정 작업이 벤치마크의 범위나 시간 제한을 넘어선 것이 부분적인 원인이었다. Cursor는 Cursor 세션에서 가져온 작업을 자사 프로덕션 에이전트 하네스에서 CursorBench 4.0으로 실행했다. max 설정에서 Sonnet 5.5가 기록한 55.5%는 Anthropic에 전달된 결과 표에 실려 있으며, Anthropic은 Cursor의 토큰 사용량을 바탕으로 해당 모델의 작업당 비용을 추정했다. 이 외부 평가는 서로 다른 작업과 하네스를 사용했으며, 여기 제시한 Sonnet 5.5 수치는 Anthropic 시스템 카드를 통해 공개된 것이다.

Artificial Analysis도 출시 전 모델로 GDPval-AA를 실행했다. 이 평가는 44개 직종의 220개 작업 결과물을 비교한다. 연결된 지식 업무 프로젝트 모음인 AA-Briefcase도 평가했다. 카드에는 max 노력 설정에서 각각 1844와 1811의 Elo 점수가 보고되어 있으며, 해당 시험에서 Opus 5.5에 근접했다. Anthropic은 출시 전 배포에 결과에 영향을 미쳤을 수 있는 구조화 출력 버그가 있었으며 이후 수정했다고 밝혔다. 이 비교는 그 조건에서 벤치마크 출력물을 평가한 것이다. 독자의 개방형 작업에서 Sonnet 5.5가 Opus와 같은 성능을 낸다는 뜻은 아니다. Anthropic도 지속적인 판단이 필요한 복잡한 작업에서는 Opus가 여전히 더 강력하다고 밝혔다.

Anthropic의 출시 발표에 인용된 초기 고객들은 자체 시험에서 더 빠른 작업 흐름과 적은 토큰 사용량을 언급했다. 이 고객들은 각자 다른 작업과 방법을 사용했으므로, 그들의 경험만으로 공통된 생산성 지표를 세울 수는 없다. BIG CHANGE는 Sonnet 5.5를 실행하거나 실제 작업 흐름에서 벤더의 속도 및 작업 비용 수치를 검증하지 않았다.

## 가격과 마이그레이션

Claude API의 공개 요금은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10으로 Sonnet 5와 동일하다. 5분 캐시 쓰기는 토큰 100만 개당 $2.50이고 캐시 읽기는 $0.20이다. Anthropic의 작업당 비용 그래프는 공개 요금에 지정된 노력 수준에서 소비한 토큰 수를 결합한다. 이 그래프만으로 모든 경우에 30% 절감된다고 볼 수는 없다. 모델을 비교하는 팀은 필요한 품질 기준에 맞춰 대표적인 자체 작업을 실행하고, 성공 여부뿐 아니라 토큰 사용량과 경과 시간도 기록해야 한다.

기존 Messages API 코드에서는 모델 ID만 바꾸는 것으로 충분하지 않을 수 있다. Sonnet 5에서 사용하던 `thinking: {"type": "disabled"}` 설정은 5.5에서 오류를 반환한다. 초기 사고를 피하려면 문서에 나온 대체 설정인 `thinking: {"type": "between_tools"}`을 사용할 수 있으며, low, medium, high 노력 수준에서 허용된다. 해당 필드를 생략하면 적응형 사고가 활성화되고, Claude API의 기본 노력 수준은 high다. 강제로 지정한 `tool_choice` 값 `any`와 `tool` 값도 오류를 반환한다. Anthropic은 개발자에게 `auto`를 사용하고, 지원되는 경우 엄격한 도구 스키마를 적용하라고 안내한다. Amazon Bedrock의 Sonnet 5.5에서는 엄격한 도구 사용이 불가능하므로 `auto`를 `strict` 없이 사용하고 애플리케이션 코드에서 도구 입력을 검증해야 한다. 도구 호출 사이의 텍스트를 표시하는 코드는 사고 블록으로 반환되는 진행 상황 업데이트도 처리해야 할 수 있다. Claude API와 Google Cloud의 컴퓨터 사용 통합에는 새 `computer_toolset_20260801` 도구 세트가 필요하며, Bedrock은 이전 `computer_20251124` 버전을 계속 사용한다. 마이그레이션 가이드에는 그 밖의 호환성 변경 사항도 설명되어 있다.

## 가장 큰 변화

Sonnet 5.5는 비용에 민감한 팀에 Sonnet 5와 같은 토큰 요금의 새 모델을 제공하며, 지정된 여러 평가에서 더 높은 결과와 Anthropic의 출력 속도 향상 주장을 내세운다. 실제 가치는 작업 구성과 노력 설정에 달려 있다. 기존 통합도 설정을 검토해야 한다. 다음으로 가장 명확한 비교 방법은 조직 자체의 작업량을 사용해 결과의 정확성, 토큰 사용량, 경과 시간을 측정하는 것이다.

## 출처 및 추가 읽을거리

- [Anthropic의 Sonnet 5.5 발표](https://www.anthropic.com/claude-sonnet-5-5)에는 출시일, 회사의 속도 및 작업 비용 주장, 벤치마크 요약, 초기 고객 사례가 담겨 있다. 성능 주장은 실제 작업 환경에 맞춰 확인해야 한다.
- [Anthropic의 Claude Sonnet 5.5 시스템 카드](https://www.anthropic.com/claude-sonnet-5-5-system-card)에는 벤치마크 작업, 하네스, 노력 설정, 대체 모델 동작, 외부 평가의 출처가 기록되어 있다. 외부에서 실행되어 Anthropic에 제공된 결과를 포함해 모델 벤더가 공개한 1차 자료다.
- [Claude Platform 모델 페이지](https://platform.claude.com/docs/en/models/sonnet-5-5/overview)에는 API ID, 이용 가능 여부, 한도, 토큰 가격이 나와 있다. [전체 가격 페이지](https://platform.claude.com/docs/en/about-claude/pricing)에서는 Sonnet 5와 5.5의 기본 요금이 동일함을 확인할 수 있고, 클라우드 가격 차이도 설명한다.
- [Sonnet 5.5 마이그레이션 가이드](https://platform.claude.com/docs/en/models/sonnet-5-5/migration-guide)에는 변경되거나 오류를 반환하는 요청 설정이 기록되어 있다. 기존 통합을 점검할 때 전체 확인 목록으로 활용할 수 있다.

## Sources

- [Anthropic, Claude Sonnet 5.5 소개](https://www.anthropic.com/claude-sonnet-5-5) — 모델 출시를 알리는 1차 자료다. 벤치마크와 성능 주장은 Anthropic의 것이므로 인용된 평가와 정의를 확인해야 한다.
- [Claude Sonnet 5.5 시스템 카드](https://www.anthropic.com/claude-sonnet-5-5-system-card) — 148쪽 분량의 1차 PDF다. 8.4, 8.5, 8.8, 8.14절에서 작업 조건, 대체 모델 사용, 외부 실행 평가, 출시 전 구조화 출력 버그를 자세히 다룬다.
- [Claude Sonnet 5.5 모델 페이지](https://platform.claude.com/docs/en/models/sonnet-5-5/overview) — 출시일, 정확한 ID, 제공 범위, 한도, Claude API 공개 요금을 기록한 1차 제품 자료다.
- [Claude Platform 가격](https://platform.claude.com/docs/en/about-claude/pricing) — Sonnet 5와 5.5의 기본 요금이 같음을 확인하고 파트너 클라우드 및 리전별 가격 차이를 설명한다.
- [Claude Sonnet 5.5로 마이그레이션하기](https://platform.claude.com/docs/en/models/sonnet-5-5/migration-guide) — 사고 기능, 강제 도구 호출, 응답 블록, 컴퓨터 사용 버전에 관한 Messages API 1차 호환성 가이드다. Amazon Bedrock의 Sonnet 5.5는 엄격한 도구 사용을 지원하지 않으므로 strict 없이 auto를 사용하고 애플리케이션 코드에서 도구 입력을 검증해야 한다.