Anthropic은 에이전트 시스템의 호출량에서 큰 비중을 차지할 수 있는 짧고 빈번한 작업을 위해 10월 7일 Claude Haiku 5.5를 출시했다. Claude API의 공개 요금은 입력 토큰 100만 개당 0.10달러, 출력 토큰 100만 개당 0.50달러부터 시작하며 Haiku 4.5 요금의 10분의 1이다. 그러나 Anthropic에 따르면 새 모델에서는 같은 텍스트에 토큰이 약 30% 더 들고, 100,000토큰을 초과하는 프롬프트에는 더 높은 가격 구간이 적용된다. Haiku 4.5를 사용하는 팀은 청구액을 추정하거나 프로덕션 트래픽을 옮기기 전에 자체 요청을 다시 세어야 한다.
이번 출시로 Messages API 경로도 달라졌다. Haiku 5.5에서는 수동 thinking 예산이 작동하지 않고 적응형 thinking이 기본으로 켜지며 첫 응답 블록이 텍스트 대신 thinking 텍스트 대신일 수 있다. 소형 모델을 반복 호출해 작업을 분류·추출·라우팅·요약하는 서비스라면 구체적인 호환성 점검이 필요하다.
주요 변화
- 달라진 점: Anthropic은 100만 토큰 컨텍스트 창과 적응형 thinking을 가장 저렴한 Claude 등급에 적용했다. Haiku 5.5는 짧은 프롬프트의 요금을 낮추는 동시에 텍스트 계산 방식과 응답이 시작되는 형태를 바꾼다.
- 중요한 이유: 팀은 더 낮은 공개 요금으로 자주 실행되는 범위가 좁은 에이전트 단계에 Claude를 더 많이 사용하는 방안을 검토할 수 있다. 실제 이점은 프롬프트 길이, 출력 및 thinking 토큰, 캐시 사용량의 구성과 새 모델이 해당 단계의 품질 목표를 충족하는지에 달려 있다.
- 확인할 점: Haiku 4.5 통합은 신중하게 측정하며 마이그레이션해야 한다. 100,000토큰 경계에 가까운 요청은 다시 계산하면 더 높은 구간으로 넘어갈 수 있고, 첫 콘텐츠 블록이 텍스트라고 가정하는 코드는 정상적으로 성공한 응답도 잘못 처리할 수 있다.
가격은 프롬프트 길이에 따라 달라진다
Claude API에서 Haiku 5.5는 최대 100,000토큰 프롬프트에 입력 토큰 100만 개당 0.10달러, 출력 토큰 100만 개당 0.50달러를 청구한다. 이 임계값을 넘으면 각각 0.50달러와 2.50달러가 적용된다. Haiku 4.5는 200,000토큰 컨텍스트 창 전체에서 1달러와 5달러로 표시되어 있다. Haiku 5.5의 컨텍스트 창은 100만 토큰이고 최대 출력은 128,000토큰이다. Haiku 4.5는 각각 200,000토큰과 64,000토큰이다. Anthropic은 Claude API, Amazon Bedrock, AWS의 Claude Platform, Google Cloud, Microsoft Foundry를 통한 이용 가능성을 안내한다. Amazon Bedrock 모델 ID는 anthropic.claude-haiku-5-5이고 Claude API에서는 claude-haiku-5-5를 사용한다. Anthropic의 모델 페이지에서 각 플랫폼의 현재 ID, 한도와 요금을 확인할 수 있다.
Anthropic은 Haiku 5.5의 실행 비용이 Haiku 4.5보다 평균 약 75% 낮다고 설명한다. 평균적으로. 각주에는 100,000토큰 이하 프롬프트의 공개 요금이 90% 낮다는 점, 그보다 긴 프롬프트의 요금이 50% 낮다는 점, Haiku 4.5 요청의 90%가 짧은 구간이었다는 관찰, 같은 작업에 새 토크나이저가 더 많은 토큰을 계산한다는 점이 함께 반영됐다. 이 계산은 Anthropic의 요청 구성에 해당하며 모든 요청에 동일한 할인이 적용된다는 뜻은 아니다. 토큰이 약 30% 늘어난다는 수치도 같은 입력 텍스트에 대한 공급업체의 추정치이며 정확한 차이는 내용에 따라 달라진다. Anthropic의 출시 발표에 주장과 계산 방법이 함께 설명되어 있다.
캐시를 사용하지 않는 Claude API 요청은 Haiku 5.5의 입력·출력 토큰 수에 각각 해당 요청의 프롬프트 길이 가격 구간의 요금을 곱한 뒤 100만으로 나누면 된다. 예를 들어 짧은 프롬프트 요금으로 입력 80,000토큰과 출력 10,000토큰을 계산하면 0.013달러다. 입력 120,000토큰과 출력 10,000토큰이라면 긴 프롬프트 요금으로 0.085달러가 된다. 이는 가격 계산 예시이지 실제 작업 기록이나 전망이 아니다. 캐시 읽기와 쓰기에는 별도 요금이 있고 배치 처리에는 입력과 출력 모두 50% 할인이 표시되어 있다. 따라서 유용한 비용 추정은 실제 호출을 프롬프트 길이와 캐시 동작에 따라 묶은 다음 합산해야 한다. Haiku 5.5 모델 페이지에서 이 구간을 확인할 수 있다.
저장된 대표 프롬프트를 Message 토큰 계산 엔드포인트에서 다시 세고 claude-haiku-5-5를 지정한다. 이전 모델의 토큰 합계로는 해당 프롬프트가 5.5의 어느 구간에 속하는지 알 수 없다. 실제 표본에서는 작업 결과와 함께 응답의 usage, 출력 길이, 캐시 필드, effort, 실제 청구액을 기록한다. 짧은 요청, 가장 긴 반복 대화, 100,000토큰에 가까운 사례를 포함해야 한다. BIG CHANGE는 문서를 검토했지만 Haiku 5.5를 실행하거나 프로덕션 작업량을 측정하지 않았다.
마이그레이션 과정에서 점검할 설정
Anthropic의 Haiku 5.5 마이그레이션 가이드에는 Haiku 4.5에서 전환하는 클라이언트를 위한 구체적인 점검 목록이 담겨 있다.
- 플랫폼의 모델 ID를 바꾸고 프롬프트 토큰을 다시 계산한다.
claude-haiku-5-5는 날짜 접미사나 별도 별칭이 없는 고정 Claude API ID다. thinking이 해당 한도를 사용하고 같은 텍스트에 토큰이 더 들 수 있으므로max_tokens를 검토한다. - 다음을 대체하세요:
thinking: {"type":"enabled","budget_tokens":N}를 적응형 thinking으로 바꾸거나thinking를 설정하지 않은 상태로 둔다. 깊이를 조정하려면output_config.effort를 설정한다. 문서의 기본값은medium다. 낮은max_tokens설정은 텍스트가 나오기 전에 thinking 블록 뒤에서 응답을 끝낼 수 있다. - 콘텐츠 블록은 위치가 아니라
type를 기준으로 읽는다. thinking 블록은 도구 결과와 함께 변경하지 않고 돌려보낸다. 다른 계정에서 블록을 재생하거나 이전 메시지, 시스템 지침 또는 도구를 바꾸는 대화 저장소는 반드시 테스트한다. - 사용자 지정
temperature,top_p및top_k설정을 제거한다. 마지막 assistant 사전 입력은 user 턴으로 바꾸고, 제약 형식에는 Anthropic이 문서화한 구조화 출력 또는 도구 방식을 사용한다. 클라이언트에서stop_reason가refusal인 경우를 처리한다. - 통합에서 Claude API 또는 Google Cloud의 computer use를 쓴다면 기존
computer_20250124도구를computer_toolset_20260801로 교체하고 가이드에 맞춰 도구 루프를 업데이트한다. Haiku 4.5의 Priority Tier 용량을 쓰는 조직은 별도 계획도 필요하다. 가이드에 따르면 Haiku 5.5에서는 Priority Tier를 사용할 수 없다.
이 변경 사항이 모든 작업에 하나의 effort 설정을 지정하는 것은 아니다. 비교할 때는 애플리케이션 작업과 수락 기준을 동일하게 유지하고, 고려하는 설정별로 답변 품질, 거부, 잘림, 지연 시간, 청구 토큰을 기록해야 한다. Anthropic은 Terminal-Bench 4.0 표에서 39.2% 대 0.0%를 포함해 여러 벤치마크에서 Haiku 5.5가 4.5보다 좋은 결과를 냈다고 보고했다. 이는 Anthropic의 평가 조건에 따른 결과이지 독자가 사용하는 에이전트의 측정값은 아니다. Anthropic은 해당 벤치마크에서 Sonnet 5.5와 Opus 5.5가 복잡한 에이전트형 코딩에 더 적합하다고도 설명한다. Haiku 4.5 사용자가 당장 판단할 것은 API 변경과 새 토큰 수를 반영한 뒤에도 소형 모델이 각각의 좁은 단계에서 요구 사항을 충족하는지다.
출처 및 더 읽을거리
- Anthropic의 Haiku 5.5 출시 발표출시일과 대상 작업 및 이용 가능성을 안내하고 회사의 평균 작업 비용 계산을 설명한다. 벤치마크 표에는 Anthropic의 평가 결과가 담겨 있다.
- Claude Platform의 Haiku 5.5 모델 페이지ID, 컨텍스트 및 출력 한도, 프롬프트 길이 구간, 캐시 요금, 플랫폼 지원을 안내한다. Haiku 4.5 페이지에는 이전 모델의 요금과 한도가 나와 있다.
- Haiku 5.5 마이그레이션 가이드기존 통합을 전환하기 전에 확인할 Messages API 변경 사항과 오류를 명시한다. 토큰 계산 API 참고 문서선택한 모델로 요청의 토큰을 계산하는 방법을 설명한다.
- Reuters의 10월 7일 출시 보도출시 날짜를 독립적으로 확인해 준다. 위의 기술 설정과 요금은 Anthropic의 최신 문서에 근거한다.



