दुनिया ठहरी नहीं है।RSS
BIG CHANGE.

Markdown संस्करण

AI-translated from English; not yet reviewed by a fluent editor.

# Claude Haiku 5.5 टोकन की कीमतें घटाता है, लेकिन माइग्रेशन का हिसाब बदलता है

> Anthropic के नए Haiku मॉडल की टोकन दरें कम हैं, इसका tokenizer अलग है और Messages API माइग्रेशन में भी बदलाव हैं। Haiku 4.5 के मौजूदा उपयोगकर्ताओं को स्विच करने से पहले अनुरोधों की गिनती दोबारा करनी चाहिए और response handling की जाँच करनी चाहिए।

By BIG CHANGE Editorial

Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

![Conceptual charcoal illustration of a mechanical adding machine with a long blank paper tape and one orange band.](https://bigchange.ai/api/media/file/claude-haiku-55-recount-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.

Anthropic ने 7 अक्टूबर को Claude Haiku 5.5 जारी किया। यह छोटे और बार-बार होने वाले कामों के लिए है, जो किसी agent system के call volume का बड़ा हिस्सा बन सकते हैं। Claude API की सूची दरें प्रति दस लाख input token $0.10 और प्रति दस लाख output token $0.50 से शुरू होती हैं—Haiku 4.5 की दरों का दसवाँ हिस्सा। फिर भी Anthropic का कहना है कि नए मॉडल में उसी पाठ के लिए लगभग 30% अधिक token लगते हैं और 100,000 token से लंबे prompts ऊँचे मूल्य-स्तर में चले जाते हैं। Haiku 4.5 चलाने वाली टीम को बिल का अनुमान लगाने या production traffic बदलने से पहले अपने अनुरोध फिर से गिनने चाहिए।

इस रिलीज़ से Messages API का तरीका भी बदलता है। Haiku 5.5 में manual thinking budget काम नहीं करते, adaptive thinking डिफ़ॉल्ट रूप से चालू है और पहला response block पाठ के बजाय `thinking` हो सकता है। छोटे मॉडल को बार-बार बुलाकर वर्गीकृत करने, जानकारी निकालने, route करने या सारांश बनाने वाली सेवाओं के लिए ये ठोस compatibility checks हैं।

## मुख्य बदलाव

- **क्या बदला:** Anthropic ने एक मिलियन token की नई context window और adaptive thinking को सबसे कम कीमत वाले Claude tier में शामिल किया है। Haiku 5.5 छोटे prompts की दर घटाता है, साथ ही पाठ की गिनती और response की संभावित शुरुआत का तरीका भी बदलता है।
- **यह क्यों मायने रखता है:** टीम अब कम प्रकाशित दर पर agent के अधिक बार चलने वाले, सीमित दायरे के चरणों के लिए Claude पर विचार कर सकती है। लाभ prompt की लंबाइयों के मिश्रण, output और thinking token, cache के उपयोग तथा नए मॉडल के उस चरण के गुणवत्ता लक्ष्य तक पहुँचने पर निर्भर करता है।
- **किस पर नज़र रखें:** Haiku 4.5 integrations को मापकर माइग्रेट करना चाहिए। 100,000-token सीमा के पास के अनुरोध दोबारा गिने जाने पर ऊँचे tier में जा सकते हैं; पहला content block पाठ ही होगा, ऐसा मानने वाला code सफल reply को भी गलत ढंग से संभाल सकता है।

## कीमत prompt की लंबाई पर निर्भर करती है

Claude API में 100,000 token तक के prompts के लिए Haiku 5.5 की कीमत प्रति दस लाख input token $0.10 और प्रति दस लाख output token $0.50 है। इस सीमा के ऊपर दरें क्रमशः $0.50 और $2.50 हैं। Haiku 4.5 की 200,000-token context window के लिए $1 और $5 सूचीबद्ध हैं। Haiku 5.5 में एक मिलियन token की context window और अधिकतम 128,000-token output है; Haiku 4.5 में ये 200,000 और 64,000 हैं। Anthropic Claude API, Amazon Bedrock, AWS पर Claude Platform, Google Cloud और Microsoft Foundry के माध्यम से उपलब्धता बताता है। Amazon Bedrock का model ID है `anthropic.claude-haiku-5-5`; Claude API `claude-haiku-5-5` का उपयोग करता है। [Anthropic के model pages](https://platform.claude.com/docs/en/models/haiku-5-5/overview) मौजूदा platform ID, सीमाएँ और दरें बताते हैं।

Anthropic का कहना है कि Haiku 5.5 चलाने की लागत लगभग 75% कम है *औसतन* Haiku 4.5 की तुलना में इसे चलाने पर। फुटनोट में 100,000 token तक के prompts के लिए 90% कम सूची दर, उससे ऊपर 50% कम दर, Haiku 4.5 के 90% अनुरोध छोटी श्रेणी में होने का उसका अवलोकन, और उसी काम के लिए नए tokenizer की अधिक token गिनती शामिल हैं। यह गणना Anthropic के अनुरोध-मिश्रण का वर्णन करती है, हर अनुरोध पर समान छूट का नहीं। उसी input text के लिए लगभग 30% token वृद्धि भी vendor का अनुमान है; वास्तविक अंतर सामग्री पर निर्भर करता है। [Anthropic की लॉन्च घोषणा](https://www.anthropic.com/claude-haiku-5-5) दावे और उसकी गणना की विधि दोनों बताती है।

बिना cache वाले Claude API अनुरोध के लिए Haiku 5.5 के input और output token लें, दोनों को *उस अनुरोध की prompt-लंबाई वाली मूल्य-श्रेणी* की दर से गुणा करें और दस लाख से भाग दें। उदाहरण के तौर पर, छोटे-prompt दरों पर 80,000 input और 10,000 output token की लागत $0.013 है। 120,000 input और 10,000 output token पर लंबे-prompt दर $0.085 देती है। ये कीमत की गणनाएँ हैं, देखे गए काम या पूर्वानुमान नहीं। Cache पढ़ने और लिखने की अपनी दरें हैं, और batch processing में input तथा output दोनों पर 50% छूट सूचीबद्ध है। इसलिए उपयोगी अनुमान के लिए वास्तविक calls को prompt की लंबाई और cache के व्यवहार के अनुसार समूहित करके जोड़ा जाना चाहिए। [Haiku 5.5 model page](https://platform.claude.com/docs/en/models/haiku-5-5/overview) इन श्रेणियों को सूचीबद्ध करता है।

सहेजे गए प्रतिनिधि prompts को [Message token-count endpoint](https://platform.claude.com/docs/en/api/go/messages/count_tokens) से फिर गिनें और `claude-haiku-5-5` निर्दिष्ट करें। पुराने मॉडल की कुल token संख्या यह नहीं बताती कि prompt 5.5 की किस श्रेणी में आएगा। वास्तविक नमूने के लिए काम के नतीजों के साथ response का `usage`, output की लंबाई, cache fields, effort और वास्तविक शुल्क दर्ज करें। छोटे अनुरोध, सबसे लंबी दोहराई गई बातचीत और 100,000 token के करीब के मामले शामिल करें। BIG CHANGE ने दस्तावेज़ों की समीक्षा की है; उसने Haiku 5.5 चलाया या production workload मापा नहीं है।

## वे सेटिंग्स जिन्हें माइग्रेशन में जाँचना चाहिए

Anthropic की [Haiku 5.5 migration guide](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) Haiku 4.5 से जाने वाले clients के लिए असामान्य रूप से स्पष्ट checklist देती है:

1. Platform के लिए model ID बदलें और prompts फिर से गिनें। `claude-haiku-5-5`बिना date suffix या अलग alias वाला स्थिर Claude API ID है। `max_tokens` की समीक्षा करें, क्योंकि thinking इस सीमा का उपयोग करता है और समान पाठ में अधिक token लग सकते हैं।
2. बदलें `thinking: {"type":"enabled","budget_tokens":N}` को adaptive thinking से, या `thinking` को unset छोड़ें। गहराई तय करने के लिए `output_config.effort` सेट करें; दस्तावेज़ में default `medium` है। कम `max_tokens` होने पर response thinking block के बाद और किसी भी पाठ से पहले समाप्त हो सकता है।
3. Content blocks को उनकी `type` के अनुसार पढ़ें, स्थान के अनुसार नहीं। Thinking blocks को tool results के साथ बिना बदलाव वापस भेजें। ऐसे किसी conversation store की जाँच करें जो किसी block को दूसरे account से replay करता हो या पुराने message, system instruction या tool को बदलता हो।
4. Custom `temperature`, `top_p` और `top_k` settings हटाएँ। अंतिम assistant prefill को user turn से बदलें और सीमित formats के लिए Anthropic द्वारा बताए structured-output या tool तरीके का उपयोग करें। Client में `stop_reason` को `refusal` पर संभालें।
5. यदि integration Claude API या Google Cloud पर computer use करता है, तो पुराने `computer_20250124` tool को `computer_toolset_20260801` से बदलें और guide के अनुसार tool loop अपडेट करें। Haiku 4.5 के Priority Tier capacity का उपयोग करने वाले संगठनों को अलग योजना भी चाहिए: guide कहती है कि Haiku 5.5 में Priority Tier उपलब्ध नहीं है।

ये बदलाव हर काम के लिए एक effort setting तय नहीं करते। तुलना में application task और acceptance criteria समान रखें, फिर विचाराधीन settings पर उत्तर की गुणवत्ता, refusals, truncation, latency और billed token दर्ज करें। Anthropic कई benchmarks पर Haiku 5.5 के Haiku 4.5 से बेहतर परिणाम बताता है, जिसमें उसकी Terminal-Bench 4.0 तालिका में 39.2% बनाम 0.0% भी शामिल है। ये Anthropic की अपनी मूल्यांकन परिस्थितियों के परिणाम हैं, पाठक के agent का माप नहीं। Anthropic उस benchmark में जटिल agentic coding के लिए Sonnet 5.5 और Opus 5.5 को अधिक उपयुक्त भी बताता है। Haiku 4.5 उपयोगकर्ता का निकट-अवधि का निर्णय यह है कि API बदलाव और नई token गिनती शामिल करने के बाद भी छोटा मॉडल हर सीमित चरण की आवश्यकताएँ पूरी करता है या नहीं।

## स्रोत और आगे पढ़ें

- [Haiku 5.5 पर Anthropic की घोषणा](https://www.anthropic.com/claude-haiku-5-5)लॉन्च की तारीख, लक्षित काम और उपलब्धता बताती है तथा कंपनी की औसत task cost गणना समझाती है। इसकी benchmark तालिका Anthropic के मूल्यांकन परिणाम देती है।
- [Claude Platform का Haiku 5.5 model page](https://platform.claude.com/docs/en/models/haiku-5-5/overview)ID, context और output सीमाएँ, prompt-लंबाई मूल्य-स्तर, cache कीमतें और platform support सूचीबद्ध करता है। [Haiku 4.5 page](https://platform.claude.com/docs/en/models/haiku-4-5/overview)पिछले model की दरें और सीमाएँ देता है।
- [Haiku 5.5 migration guide](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)मौजूदा integration बदलने से पहले जाँचने योग्य Messages API बदलाव और त्रुटियाँ बताती है। [Token-count API reference](https://platform.claude.com/docs/en/api/go/messages/count_tokens)चुने हुए model से अनुरोध गिनने की विधि बताता है।
- [7 अक्टूबर की लॉन्च पर Reuters रिपोर्ट](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)जारी होने की तारीख की स्वतंत्र पुष्टि करती है। ऊपर की तकनीकी सेटिंग्स और दरें Anthropic के मौजूदा दस्तावेज़ों से हैं।

## Sources

- [Anthropic: Claude Haiku 5.5 का लॉन्च](https://www.anthropic.com/claude-haiku-5-5) — लॉन्च की तारीख, लक्षित काम, vendor benchmark और औसत लागत के दावे, गणना फुटनोट तथा cloud उपलब्धता।
- [Claude Haiku 5.5 model overview](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — मौजूदा model ID, prompt लंबाई के अनुसार API कीमतें, cache और batch दरें, context, output और उपलब्धता।
- [Claude Haiku 4.5 model overview](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — पिछले model की मौजूदा legacy स्थिति, सूची दरें और सीमाएँ।
- [Claude Haiku 5.5 migration guide](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — मुख्य Messages API बदलाव checklist और tokenizer मार्गदर्शन।
- [Message में token गिनना](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — Token-count endpoint और model-विशिष्ट अनुरोध गणना।
- [Reuters: Anthropic ने तीसरा Claude 5.5 model लॉन्च किया](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — केवल स्वतंत्र रिलीज़ पुष्टि के लिए।
BIG CHANGE न्यूज़लेटर

बड़ी तस्वीर। आपकी गति से।

AI और रोबोटिक्स पर ताज़ा लेख, ध्यान देने योग्य बदलाव और उपयोगी विचार। दैनिक ब्रीफ़िंग, साप्ताहिक सारांश या मासिक परिप्रेक्ष्य चुनें।