Anthropic ने 7 अक्टूबर को Claude Haiku 5.5 जारी किया। यह छोटे और बार-बार होने वाले कामों के लिए है, जो किसी agent system के call volume का बड़ा हिस्सा बन सकते हैं। Claude API की सूची दरें प्रति दस लाख input token $0.10 और प्रति दस लाख output token $0.50 से शुरू होती हैं—Haiku 4.5 की दरों का दसवाँ हिस्सा। फिर भी Anthropic का कहना है कि नए मॉडल में उसी पाठ के लिए लगभग 30% अधिक token लगते हैं और 100,000 token से लंबे prompts ऊँचे मूल्य-स्तर में चले जाते हैं। Haiku 4.5 चलाने वाली टीम को बिल का अनुमान लगाने या production traffic बदलने से पहले अपने अनुरोध फिर से गिनने चाहिए।
इस रिलीज़ से Messages API का तरीका भी बदलता है। Haiku 5.5 में manual thinking budget काम नहीं करते, adaptive thinking डिफ़ॉल्ट रूप से चालू है और पहला response block पाठ के बजाय thinking हो सकता है। छोटे मॉडल को बार-बार बुलाकर वर्गीकृत करने, जानकारी निकालने, route करने या सारांश बनाने वाली सेवाओं के लिए ये ठोस compatibility checks हैं।
मुख्य बदलाव
- क्या बदला: Anthropic ने एक मिलियन token की नई context window और adaptive thinking को सबसे कम कीमत वाले Claude tier में शामिल किया है। Haiku 5.5 छोटे prompts की दर घटाता है, साथ ही पाठ की गिनती और response की संभावित शुरुआत का तरीका भी बदलता है।
- यह क्यों मायने रखता है: टीम अब कम प्रकाशित दर पर agent के अधिक बार चलने वाले, सीमित दायरे के चरणों के लिए Claude पर विचार कर सकती है। लाभ prompt की लंबाइयों के मिश्रण, output और thinking token, cache के उपयोग तथा नए मॉडल के उस चरण के गुणवत्ता लक्ष्य तक पहुँचने पर निर्भर करता है।
- किस पर नज़र रखें: Haiku 4.5 integrations को मापकर माइग्रेट करना चाहिए। 100,000-token सीमा के पास के अनुरोध दोबारा गिने जाने पर ऊँचे tier में जा सकते हैं; पहला content block पाठ ही होगा, ऐसा मानने वाला code सफल reply को भी गलत ढंग से संभाल सकता है।
कीमत prompt की लंबाई पर निर्भर करती है
Claude API में 100,000 token तक के prompts के लिए Haiku 5.5 की कीमत प्रति दस लाख input token $0.10 और प्रति दस लाख output token $0.50 है। इस सीमा के ऊपर दरें क्रमशः $0.50 और $2.50 हैं। Haiku 4.5 की 200,000-token context window के लिए $1 और $5 सूचीबद्ध हैं। Haiku 5.5 में एक मिलियन token की context window और अधिकतम 128,000-token output है; Haiku 4.5 में ये 200,000 और 64,000 हैं। Anthropic Claude API, Amazon Bedrock, AWS पर Claude Platform, Google Cloud और Microsoft Foundry के माध्यम से उपलब्धता बताता है। Amazon Bedrock का model ID है anthropic.claude-haiku-5-5; Claude API claude-haiku-5-5 का उपयोग करता है। Anthropic के model pages मौजूदा platform ID, सीमाएँ और दरें बताते हैं।
Anthropic का कहना है कि Haiku 5.5 चलाने की लागत लगभग 75% कम है औसतन Haiku 4.5 की तुलना में इसे चलाने पर। फुटनोट में 100,000 token तक के prompts के लिए 90% कम सूची दर, उससे ऊपर 50% कम दर, Haiku 4.5 के 90% अनुरोध छोटी श्रेणी में होने का उसका अवलोकन, और उसी काम के लिए नए tokenizer की अधिक token गिनती शामिल हैं। यह गणना Anthropic के अनुरोध-मिश्रण का वर्णन करती है, हर अनुरोध पर समान छूट का नहीं। उसी input text के लिए लगभग 30% token वृद्धि भी vendor का अनुमान है; वास्तविक अंतर सामग्री पर निर्भर करता है। Anthropic की लॉन्च घोषणा दावे और उसकी गणना की विधि दोनों बताती है।
बिना cache वाले Claude API अनुरोध के लिए Haiku 5.5 के input और output token लें, दोनों को उस अनुरोध की prompt-लंबाई वाली मूल्य-श्रेणी की दर से गुणा करें और दस लाख से भाग दें। उदाहरण के तौर पर, छोटे-prompt दरों पर 80,000 input और 10,000 output token की लागत $0.013 है। 120,000 input और 10,000 output token पर लंबे-prompt दर $0.085 देती है। ये कीमत की गणनाएँ हैं, देखे गए काम या पूर्वानुमान नहीं। Cache पढ़ने और लिखने की अपनी दरें हैं, और batch processing में input तथा output दोनों पर 50% छूट सूचीबद्ध है। इसलिए उपयोगी अनुमान के लिए वास्तविक calls को prompt की लंबाई और cache के व्यवहार के अनुसार समूहित करके जोड़ा जाना चाहिए। Haiku 5.5 model page इन श्रेणियों को सूचीबद्ध करता है।
सहेजे गए प्रतिनिधि prompts को Message token-count endpoint से फिर गिनें और claude-haiku-5-5 निर्दिष्ट करें। पुराने मॉडल की कुल token संख्या यह नहीं बताती कि prompt 5.5 की किस श्रेणी में आएगा। वास्तविक नमूने के लिए काम के नतीजों के साथ response का usage, output की लंबाई, cache fields, effort और वास्तविक शुल्क दर्ज करें। छोटे अनुरोध, सबसे लंबी दोहराई गई बातचीत और 100,000 token के करीब के मामले शामिल करें। BIG CHANGE ने दस्तावेज़ों की समीक्षा की है; उसने Haiku 5.5 चलाया या production workload मापा नहीं है।
वे सेटिंग्स जिन्हें माइग्रेशन में जाँचना चाहिए
Anthropic की Haiku 5.5 migration guide Haiku 4.5 से जाने वाले clients के लिए असामान्य रूप से स्पष्ट checklist देती है:
- Platform के लिए model ID बदलें और prompts फिर से गिनें।
claude-haiku-5-5बिना date suffix या अलग alias वाला स्थिर Claude API ID है।max_tokensकी समीक्षा करें, क्योंकि thinking इस सीमा का उपयोग करता है और समान पाठ में अधिक token लग सकते हैं। - बदलें
thinking: {"type":"enabled","budget_tokens":N}को adaptive thinking से, याthinkingको unset छोड़ें। गहराई तय करने के लिएoutput_config.effortसेट करें; दस्तावेज़ में defaultmediumहै। कमmax_tokensहोने पर response thinking block के बाद और किसी भी पाठ से पहले समाप्त हो सकता है। - Content blocks को उनकी
typeके अनुसार पढ़ें, स्थान के अनुसार नहीं। Thinking blocks को tool results के साथ बिना बदलाव वापस भेजें। ऐसे किसी conversation store की जाँच करें जो किसी block को दूसरे account से replay करता हो या पुराने message, system instruction या tool को बदलता हो। - Custom
temperature,top_pऔरtop_ksettings हटाएँ। अंतिम assistant prefill को user turn से बदलें और सीमित formats के लिए Anthropic द्वारा बताए structured-output या tool तरीके का उपयोग करें। Client मेंstop_reasonकोrefusalपर संभालें। - यदि integration Claude API या Google Cloud पर computer use करता है, तो पुराने
computer_20250124tool कोcomputer_toolset_20260801से बदलें और guide के अनुसार tool loop अपडेट करें। Haiku 4.5 के Priority Tier capacity का उपयोग करने वाले संगठनों को अलग योजना भी चाहिए: guide कहती है कि Haiku 5.5 में Priority Tier उपलब्ध नहीं है।
ये बदलाव हर काम के लिए एक effort setting तय नहीं करते। तुलना में application task और acceptance criteria समान रखें, फिर विचाराधीन settings पर उत्तर की गुणवत्ता, refusals, truncation, latency और billed token दर्ज करें। Anthropic कई benchmarks पर Haiku 5.5 के Haiku 4.5 से बेहतर परिणाम बताता है, जिसमें उसकी Terminal-Bench 4.0 तालिका में 39.2% बनाम 0.0% भी शामिल है। ये Anthropic की अपनी मूल्यांकन परिस्थितियों के परिणाम हैं, पाठक के agent का माप नहीं। Anthropic उस benchmark में जटिल agentic coding के लिए Sonnet 5.5 और Opus 5.5 को अधिक उपयुक्त भी बताता है। Haiku 4.5 उपयोगकर्ता का निकट-अवधि का निर्णय यह है कि API बदलाव और नई token गिनती शामिल करने के बाद भी छोटा मॉडल हर सीमित चरण की आवश्यकताएँ पूरी करता है या नहीं।
स्रोत और आगे पढ़ें
- Haiku 5.5 पर Anthropic की घोषणालॉन्च की तारीख, लक्षित काम और उपलब्धता बताती है तथा कंपनी की औसत task cost गणना समझाती है। इसकी benchmark तालिका Anthropic के मूल्यांकन परिणाम देती है।
- Claude Platform का Haiku 5.5 model pageID, context और output सीमाएँ, prompt-लंबाई मूल्य-स्तर, cache कीमतें और platform support सूचीबद्ध करता है। Haiku 4.5 pageपिछले model की दरें और सीमाएँ देता है।
- Haiku 5.5 migration guideमौजूदा integration बदलने से पहले जाँचने योग्य Messages API बदलाव और त्रुटियाँ बताती है। Token-count API referenceचुने हुए model से अनुरोध गिनने की विधि बताता है।
- 7 अक्टूबर की लॉन्च पर Reuters रिपोर्टजारी होने की तारीख की स्वतंत्र पुष्टि करती है। ऊपर की तकनीकी सेटिंग्स और दरें Anthropic के मौजूदा दस्तावेज़ों से हैं।



