AI-translated from English; not yet reviewed by a fluent editor.
# Claude Haiku 5.5 मुळे टोकनचे दर कमी होतात, पण स्थलांतराचे गणित बदलते
> Anthropic च्या नव्या Haiku मॉडेलचे टोकनदर कमी आहेत, tokenizer वेगळा आहे आणि Messages API स्थलांतरातही बदल आहेत. Haiku 4.5 वापरणाऱ्यांनी बदल करण्यापूर्वी आपल्या विनंत्यांतील टोकन पुन्हा मोजावेत आणि प्रतिसाद हाताळणीची चाचणी घ्यावी.
By BIG CHANGE Editorial
Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.
एजंट प्रणालीतील कॉल्सच्या प्रमाणात मोठा वाटा घेऊ शकणाऱ्या लहान आणि वारंवार होणाऱ्या कामांसाठी Anthropic ने 7 ऑक्टोबर रोजी Claude Haiku 5.5 आणले. Claude API चे सूचीबद्ध दर प्रति दहा लाख इनपुट टोकनसाठी $0.10 आणि प्रति दहा लाख आउटपुट टोकनसाठी $0.50 पासून सुरू होतात; हे Haiku 4.5 च्या दरांच्या दहावा भाग आहेत. मात्र, त्याच मजकुरासाठी नव्या मॉडेलवर सुमारे 30% अधिक टोकन लागतात आणि 100,000 टोकनपेक्षा मोठे prompts उच्च दरस्तरात जातात, असे Anthropic सांगते. Haiku 4.5 वापरणाऱ्या टीमने बिलाचा अंदाज घेण्यापूर्वी किंवा उत्पादनातील ट्रॅफिक हलवण्याआधी स्वतःच्या विनंत्या पुन्हा मोजाव्यात.
या प्रकाशनामुळे Messages API चा मार्गही बदलतो. Haiku 5.5 वर हाताने ठरवलेले thinking बजेट चालत नाहीत, adaptive thinking पूर्वनियोजितपणे सुरू असते आणि प्रतिसादाचा पहिला भाग मजकुराऐवजी `thinking` असू शकतो. वर्गीकरण, माहिती काढणे, मार्गनियोजन किंवा सारांशासाठी लहान मॉडेलला वारंवार कॉल करणाऱ्या सेवांसाठी या ठोस सुसंगतता तपासण्या आहेत.
## मुख्य बदल
- **काय बदलले:** Anthropic ने दहा लाख टोकनची नवी संदर्भ-खिडकी आणि adaptive thinking सर्वांत कमी किमतीच्या Claude स्तरावर आणले. Haiku 5.5 लहान prompts चे दर कमी करते; त्याच वेळी मजकूर कसा मोजला जातो आणि प्रतिसादाची सुरुवात कशी होऊ शकते हे बदलते.
- **हे महत्त्वाचे का:** कमी प्रकाशित दराने अधिक वारंवार आणि मर्यादित व्याप्तीच्या एजंट पायऱ्यांसाठी Claude वापरण्याचा विचार टीम करू शकते. फायदा prompt ची लांबी, आउटपुट व thinking टोकन्सचे प्रमाण, cache चा वापर आणि त्या पायरीसाठी नवे मॉडेल गुणवत्ता निकष पूर्ण करते का यावर अवलंबून असतो.
- **कशावर लक्ष ठेवावे:** Haiku 4.5 एकत्रीकरणाचे स्थलांतर मोजून करावे. 100,000 टोकनच्या सीमेजवळील विनंत्या पुन्हा मोजल्यावर उच्च दरस्तरात जाऊ शकतात; पहिला content भाग मजकूरच असेल असे मानणारा कोड यशस्वी प्रतिसादही चुकीने हाताळू शकतो.
## किंमत prompt च्या लांबीवर अवलंबून असते
Claude API वर 100,000 टोकनपर्यंतच्या prompts साठी Haiku 5.5 चे दर प्रति दहा लाख इनपुट टोकन $0.10 आणि प्रति दहा लाख आउटपुट टोकन $0.50 आहेत. ही मर्यादा ओलांडल्यास संबंधित दर $0.50 आणि $2.50 होतात. Haiku 4.5 च्या 200,000 टोकन संदर्भ-खिडकीसाठी $1 आणि $5 असे दर दिले आहेत. Haiku 5.5 ची संदर्भ-खिडकी दहा लाख टोकनची असून कमाल आउटपुट 128,000 टोकन आहे; Haiku 4.5 मध्ये ते अनुक्रमे 200,000 आणि 64,000 आहेत. Claude API, Amazon Bedrock, AWS वरील Claude Platform, Google Cloud आणि Microsoft Foundry द्वारे उपलब्धता Anthropic नमूद करते. Amazon Bedrock मॉडेल ID `anthropic.claude-haiku-5-5` आहे; Claude API मध्ये `claude-haiku-5-5` वापरले जाते. [Anthropic ची मॉडेल पाने](https://platform.claude.com/docs/en/models/haiku-5-5/overview) सध्याचे प्लॅटफॉर्म ID, मर्यादा आणि दर देतात.
Haiku 5.5 चालवण्याचा सरासरी खर्च Haiku 4.5 पेक्षा सुमारे 75% कमी असल्याचे Anthropic सांगते. *सरासरीने*. तळटीपेत 100,000 टोकनपर्यंतच्या prompts साठी 90% कमी सूचीदर, त्यापुढील prompts साठी 50% कमी दर, Haiku 4.5 च्या 90% विनंत्या लहान श्रेणीत होत्या हे निरीक्षण आणि त्याच कामासाठी नव्या tokenizer कडून मोजले जाणारे अधिक टोकन यांचा एकत्रित विचार आहे. हा हिशेब Anthropic च्या विनंती-मिश्रणाचे वर्णन करतो; प्रत्येक विनंतीला समान सवलत मिळते असे नाही. त्याच इनपुट मजकुरासाठी सुमारे 30% टोकनवाढ हा पुरवठादाराचा अंदाज आहे; नेमका बदल मजकुरावर अवलंबून असतो. [Anthropic ची लॉन्च घोषणा](https://www.anthropic.com/claude-haiku-5-5) हा दावा आणि त्याची पद्धत दोन्ही स्पष्ट करते.
Cache न केलेल्या Claude API विनंतीसाठी Haiku 5.5 चे इनपुट आणि आउटपुट टोकन मोजा, प्रत्येकाला त्या *विनंतीच्या prompt-लांबीच्या दरस्तरा*चा दर लावा आणि दहा लाखांनी भागा. उदाहरणार्थ, लहान prompt दराने 80,000 इनपुट आणि 10,000 आउटपुट टोकन्सची किंमत $0.013 होते. 120,000 इनपुट आणि 10,000 आउटपुट टोकन्ससाठी मोठ्या prompt चे दर $0.085 देतात. ही किंमत-गणिते आहेत; प्रत्यक्ष पाहिलेल्या कामांचे निष्कर्ष किंवा अंदाज नाहीत. Cache वाचन आणि लेखनासाठी स्वतंत्र दर आहेत, तसेच batch प्रक्रियेला इनपुट आणि आउटपुटवर 50% सवलत सूचीबद्ध आहे. म्हणून उपयुक्त अंदाजासाठी प्रत्यक्ष कॉल्स prompt-लांबी आणि cache-वर्तनानुसार गटबद्ध करून मग त्यांची बेरीज करावी. [Haiku 5.5 मॉडेल पान](https://platform.claude.com/docs/en/models/haiku-5-5/overview) या श्रेणी सूचीबद्ध करते.
जतन केलेले प्रतिनिधिक prompts [Message टोकन-मोजणी endpoint](https://platform.claude.com/docs/en/api/go/messages/count_tokens) वापरून पुन्हा मोजा आणि `claude-haiku-5-5` निर्दिष्ट करा. जुन्या मॉडेलची एकूण टोकन संख्या 5.5 वर prompt कोणत्या दरस्तरात येईल हे सांगू शकत नाही. प्रत्यक्ष नमुन्यासाठी कामाच्या निकालांसह प्रतिसादातील `usage`, आउटपुटची लांबी, cache फील्ड, effort आणि प्रत्यक्ष आकारलेला खर्च नोंदवा. लहान विनंत्या, सर्वांत लांब पुनरावृत्ती होणारी संभाषणे आणि 100,000 टोकनच्या जवळची प्रकरणे समाविष्ट करा. BIG CHANGE ने दस्तऐवज पाहिले आहेत; Haiku 5.5 चालवलेले नाही किंवा उत्पादनातील कामाचे मोजमाप केलेले नाही.
## स्थलांतरात पुन्हा तपासण्याची सेटिंग्ज
Anthropic चे [Haiku 5.5 स्थलांतर मार्गदर्शक](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) Haiku 4.5 वरून बदलणाऱ्या क्लायंटसाठी असामान्यपणे विशिष्ट तपासणी-सूची देते:
1. प्लॅटफॉर्मसाठी मॉडेल ID बदला आणि prompts पुन्हा मोजा. `claude-haiku-5-5`हे तारीख-सuffix किंवा वेगळे alias नसलेले स्थिर Claude API ID आहे. `max_tokens` तपासा; thinking या मर्यादेत मोजले जाते आणि त्याच मजकुराला अधिक टोकन लागू शकतात.
2. बदला `thinking: {"type":"enabled","budget_tokens":N}` adaptive thinking ने, किंवा `thinking` सेट न करता ठेवा. खोली नियंत्रित करण्यासाठी `output_config.effort` सेट करा; दस्तऐवजात दिलेले पूर्वनियोजित मूल्य `medium` आहे. कमी `max_tokens` मुळे मजकूर येण्यापूर्वी thinking भागानंतर प्रतिसाद संपुष्टात येऊ शकतो.
3. Content भाग स्थानावरून नव्हे तर `type`नुसार वाचा. thinking भाग साधनांच्या निकालांसह जसाच्या तसा परत पाठवा. दुसऱ्या खात्याद्वारे भाग पुन्हा चालवणारे किंवा जुने संदेश, system सूचना अथवा साधने बदलणारे कोणतेही संभाषण-संग्रह तपासा.
4. सानुकूल `temperature`, `top_p` आणि `top_k` सेटिंग्ज काढून टाका. शेवटचा assistant prefill user turn ने बदला; मर्यादित स्वरूपांसाठी Anthropic ने दस्तऐवजीकरण केलेला structured-output किंवा tool मार्ग वापरा. क्लायंटमध्ये `stop_reason` चे `refusal` हे कारण हाताळा.
5. Claude API किंवा Google Cloud वर एकत्रीकरण computer use करत असल्यास जुने `computer_20250124` साधन `computer_toolset_20260801` ने बदला आणि मार्गदर्शकाप्रमाणे tool loop अद्ययावत करा. Haiku 4.5 साठी Priority Tier क्षमता वापरणाऱ्या संस्थांनी स्वतंत्र योजना करावी; Haiku 5.5 वर Priority Tier उपलब्ध नाही, असे मार्गदर्शक सांगते.
या बदलांमुळे प्रत्येक कामासाठी एकच effort सेटिंग ठरवली जात नाही. तुलना करताना अॅप्लिकेशनचे काम आणि स्वीकृती निकष स्थिर ठेवून विचाराधीन सेटिंग्जनुसार उत्तराची गुणवत्ता, नकार, मजकूर खंडित होणे, विलंब आणि बिलातील टोकन्स नोंदवावेत. Anthropic च्या Terminal-Bench 4.0 तक्त्यात 39.2% विरुद्ध 0.0% यासह अनेक बेंचमार्कवर Haiku 5.5 चे निकाल 4.5 पेक्षा चांगले असल्याचे Anthropic सांगते. हे Anthropic च्या मूल्यांकन परिस्थितीतले निकाल आहेत; वाचकाच्या एजंटचे मोजमाप नाहीत. त्या बेंचमार्कवर क्लिष्ट agents-आधारित coding साठी Sonnet 5.5 आणि Opus 5.5 अधिक योग्य असल्याचेही Anthropic म्हणते. Haiku 4.5 वापरणाऱ्यांसाठी जवळचा निर्णय असा आहे: API बदल आणि नवी टोकन संख्या धरल्यानंतर लहान मॉडेल प्रत्येक मर्यादित पायरीच्या गरजा पूर्ण करते का?
## स्रोत आणि पुढील वाचन
- [Anthropic ची Haiku 5.5 घोषणा](https://www.anthropic.com/claude-haiku-5-5)लॉन्चची तारीख, अपेक्षित कामे आणि उपलब्धता देते, तसेच कंपनीचा सरासरी काम-खर्चाचा हिशेब स्पष्ट करते. तिच्या बेंचमार्क तक्त्यात Anthropic चे मूल्यांकन निकाल आहेत.
- [Claude Platform चे Haiku 5.5 मॉडेल पान](https://platform.claude.com/docs/en/models/haiku-5-5/overview)ID, संदर्भ व आउटपुट मर्यादा, prompt-लांबीचे दरस्तर, cache किमती आणि प्लॅटफॉर्म समर्थन सूचीबद्ध करते. [Haiku 4.5 पान](https://platform.claude.com/docs/en/models/haiku-4-5/overview)मागील मॉडेलचे दर आणि मर्यादा देते.
- [Haiku 5.5 स्थलांतर मार्गदर्शक](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)विद्यमान एकत्रीकरण बदलण्यापूर्वी तपासायचे Messages API बदल आणि त्रुटी सांगते. [टोकन-मोजणी API संदर्भ](https://platform.claude.com/docs/en/api/go/messages/count_tokens)निवडलेल्या मॉडेलने विनंतीचे टोकन कसे मोजायचे ते दस्तऐवजीकरण करतो.
- [Reuters चा 7 ऑक्टोबरचा लॉन्च अहवाल](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)लॉन्चची तारीख स्वतंत्रपणे पुष्टी करतो. वरील तांत्रिक सेटिंग्ज आणि दर Anthropic च्या सध्याच्या दस्तऐवजांमधून घेतले आहेत.
## Sources
- [Anthropic, Claude Haiku 5.5 चे लॉन्च](https://www.anthropic.com/claude-haiku-5-5) — लॉन्चची तारीख, अपेक्षित कामे, पुरवठादाराचा बेंचमार्क आणि सरासरी खर्चाचे दावे, गणनेची तळटीप आणि क्लाउड उपलब्धता.
- [Claude Haiku 5.5 मॉडेलचा आढावा](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — सध्याचे मॉडेल ID, prompt लांबीनुसार API दर, cache व batch दर, संदर्भ, आउटपुट आणि उपलब्धता.
- [Claude Haiku 4.5 मॉडेलचा आढावा](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — मागील मॉडेलची सध्याची legacy स्थिती, सूचीदर आणि मर्यादा.
- [Claude Haiku 5.5 स्थलांतर मार्गदर्शक](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Messages API मधील मुख्य बदलांची तपासणी-सूची आणि tokenizer मार्गदर्शन.
- [Message मधील टोकन मोजणे](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — टोकन-मोजणी endpoint आणि मॉडेलनुसार विनंतीतील टोकन संख्या.
- [Reuters, Anthropic ने तिसरे Claude 5.5 मॉडेल आणले](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — फक्त स्वतंत्र लॉन्च-पुष्टी.
BIG CHANGE वृत्तपत्र
मोठे चित्र. तुमच्या गतीने.
AI आणि रोबोटिक्सवरील ताज्या बातम्या, पाहण्यासारखे बदल आणि वापरता येतील अशा व्यावहारिक कल्पना. दैनिक माहिती, साप्ताहिक सारांश किंवा मासिक दृष्टिकोन निवडा.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
तुमची गोपनीयता, तुमची निवड.
आवश्यक स्टोरेज साइट सुरक्षित ठेवण्यास आणि तुमच्या निवडी लक्षात ठेवण्यास मदत करते. तुमची परवानगी मिळेपर्यंत पर्यायी Google Analytics बंद राहते. फक्त आवश्यक स्टोरेज वापरून प्रत्येक लेख वाचता येतो. गोपनीयतेचा तपशील