AI-translated from English; not yet reviewed by a fluent editor.
# Claude Haiku 5.5 టోకెన్ ధరలను తగ్గించింది, కానీ మైగ్రేషన్ లెక్కను మార్చింది
> Anthropic కొత్త Haiku మోడల్లో టోకెన్ రేట్లు తక్కువగా ఉన్నాయి, tokenizer వేరుగా ఉంది, Messages API మైగ్రేషన్లోనూ మార్పులున్నాయి. ఇప్పటికే Haiku 4.5 వాడుతున్నవారు మారడానికి ముందు తమ అభ్యర్థనల టోకెన్లను మళ్లీ లెక్కించి, ప్రతిస్పందనల నిర్వహణను పరీక్షించాలి.
By BIG CHANGE Editorial
Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.
ఏజెంట్ వ్యవస్థలో కాల్స్ పరిమాణంలో ఎక్కువ వాటా ఉండగల చిన్న, తరచూ జరిగే పనుల కోసం Anthropic అక్టోబర్ 7న Claude Haiku 5.5ను విడుదల చేసింది. Claude API జాబితా రేట్లు ప్రతి మిలియన్ ఇన్పుట్ టోకెన్లకు $0.10, ప్రతి మిలియన్ అవుట్పుట్ టోకెన్లకు $0.50 నుంచి మొదలవుతాయి; ఇవి Haiku 4.5 రేట్లలో పదో వంతు. అయితే కొత్త మోడల్లో అదే పాఠ్యానికి సుమారు 30% ఎక్కువ టోకెన్లు అవసరమవుతాయని, 100,000 టోకెన్లకు మించిన prompts అధిక ధరల శ్రేణిలోకి వెళ్తాయని Anthropic చెబుతోంది. బిల్లు అంచనా వేయడానికి లేదా production ట్రాఫిక్ను మార్చడానికి ముందు Haiku 4.5 వాడే బృందాలు తమ అభ్యర్థనలను మళ్లీ లెక్కించాలి.
ఈ విడుదల Messages API మార్గాన్నీ మార్చింది. Haiku 5.5లో చేతితో నిర్ణయించిన thinking బడ్జెట్లు పనిచేయవు, adaptive thinking డిఫాల్ట్గా ఆన్లో ఉంటుంది, మొదటి ప్రతిస్పందన బ్లాక్ పాఠ్యం కాకుండా `thinking` కావచ్చు. వర్గీకరణ, సంగ్రహణ, రూటింగ్ లేదా సారాంశం కోసం చిన్న మోడల్కు పదే పదే కాల్ చేసే సేవలకు ఇవి నిర్దిష్ట అనుకూలత తనిఖీలు.
## ముఖ్యమైన మార్పు
- **ఏం మారింది:** Anthropic కొత్త ఒక మిలియన్ టోకెన్ల context window, adaptive thinkingను అత్యల్ప ధర Claude స్థాయికి తీసుకొచ్చింది. Haiku 5.5 చిన్న prompts రేటును తగ్గిస్తూ, పాఠ్యాన్ని లెక్కించే విధానాన్ని, ప్రతిస్పందన మొదలయ్యే తీరును మార్చింది.
- **ఇది ఎందుకు ముఖ్యం:** తక్కువ ప్రచురిత రేటుతో, తరచుగా జరిగే పరిమిత పరిధి ఏజెంట్ దశల్లో Claudeను ఉపయోగించవచ్చా అని బృందం పరిశీలించవచ్చు. ప్రయోజనం prompt పొడవుల మిశ్రమం, output మరియు thinking టోకెన్లు, cache వాడకం, ఆ దశకు కొత్త మోడల్ నాణ్యత లక్ష్యాన్ని చేరుతుందా అనే అంశాలపై ఆధారపడుతుంది.
- **ఏం గమనించాలి:** Haiku 4.5 అనుసంధానాలను కొలతలతో జాగ్రత్తగా మైగ్రేట్ చేయాలి. 100,000 టోకెన్ల పరిమితికి దగ్గరగా ఉన్న అభ్యర్థనలు మళ్లీ లెక్కించినప్పుడు అధిక ధరల శ్రేణికి వెళ్లవచ్చు; మొదటి content బ్లాక్ తప్పనిసరిగా పాఠ్యమేనని భావించే కోడ్ విజయవంతమైన ప్రతిస్పందనను తప్పుగా నిర్వహించవచ్చు.
## ధర prompt పొడవుపై ఆధారపడి ఉంటుంది
Claude APIలో 100,000 టోకెన్ల వరకు promptsకు Haiku 5.5 ధర ప్రతి మిలియన్ ఇన్పుట్ టోకెన్లకు $0.10, ప్రతి మిలియన్ అవుట్పుట్ టోకెన్లకు $0.50. ఆ పరిమితి దాటితే వరుసగా $0.50, $2.50. Haiku 4.5కు దాని 200,000-టోకెన్ల context window అంతటా $1, $5 ధరలు జాబితా అయ్యాయి. Haiku 5.5లో ఒక మిలియన్ టోకెన్ల context window, గరిష్ఠంగా 128,000 టోకెన్ల output ఉన్నాయి; Haiku 4.5లో ఇవి 200,000, 64,000. Claude API, Amazon Bedrock, AWSలోని Claude Platform, Google Cloud, Microsoft Foundry ద్వారా అందుబాటులో ఉంటుందని Anthropic జాబితా చేసింది. Amazon Bedrock మోడల్ ID `anthropic.claude-haiku-5-5`; Claude APIలో `claude-haiku-5-5` వాడుతుంది. [Anthropic మోడల్ పేజీలు](https://platform.claude.com/docs/en/models/haiku-5-5/overview) ప్రస్తుత ప్లాట్ఫారమ్ IDలు, పరిమితులు, రేట్లను చూపుతాయి.
Haiku 5.5 నడపడానికి అయ్యే సగటు ఖర్చు Haiku 4.5 కంటే సుమారు 75% తక్కువని Anthropic చెబుతోంది. *సగటున*. ఫుట్నోట్లో 100,000 టోకెన్ల వరకు promptsకు జాబితా రేటు 90% తక్కువ, ఆ పరిమితి పైన 50% తక్కువ, Haiku 4.5 అభ్యర్థనల్లో 90% చిన్న వర్గంలో ఉన్నాయనే పరిశీలన, అదే పనికి కొత్త tokenizer ఎక్కువ టోకెన్లు లెక్కించడం — ఇవన్నీ కలిపి ఉన్నాయి. ఆ లెక్క Anthropic అభ్యర్థనల మిశ్రమాన్ని వివరిస్తుంది; ప్రతి అభ్యర్థనకు ఒకే రాయితీ అని కాదు. అదే input textకు సుమారు 30% టోకెన్ పెరుగుదల కూడా vendor అంచనా మాత్రమే; ఖచ్చితమైన మార్పు విషయంపై ఆధారపడుతుంది. [Anthropic విడుదల ప్రకటన](https://www.anthropic.com/claude-haiku-5-5) దావాను, దాని లెక్కింపు పద్ధతిని రెండింటినీ వివరిస్తుంది.
Cache లేని Claude API అభ్యర్థన కోసం Haiku 5.5 ఇన్పుట్, అవుట్పుట్ టోకెన్ సంఖ్యలను తీసుకుని, ఒక్కొక్కదాన్ని ఆ *అభ్యర్థన prompt పొడవు ధరల శ్రేణి*రేటుతో గుణించి, ఒక మిలియన్తో భాగించాలి. లెక్క ప్రకారం చిన్న-prompt రేట్ల వద్ద 80,000 ఇన్పుట్, 10,000 అవుట్పుట్ టోకెన్లకు $0.013 ఖర్చవుతుంది. 120,000 ఇన్పుట్, 10,000 అవుట్పుట్ టోకెన్లకు దీర్ఘ-prompt రేట్లతో $0.085. ఇవి ధరల గణనలు; గమనించిన పనులు లేదా అంచనాలు కావు. Cache reads, writesకు వేర్వేరు రేట్లు ఉన్నాయి; batch processingలో ఇన్పుట్, అవుట్పుట్ రెండింటిపై 50% తగ్గింపు జాబితా అయ్యింది. కాబట్టి ఉపయోగకరమైన అంచనా కోసం నిజమైన కాల్స్ను prompt పొడవు, cache ప్రవర్తన ఆధారంగా గుంపులుగా చేసి కలపాలి. [Haiku 5.5 మోడల్ పేజీ](https://platform.claude.com/docs/en/models/haiku-5-5/overview) ఈ వర్గాలను జాబితా చేస్తుంది.
నిల్వ చేసిన ప్రతినిధి promptsను [Message token-count endpoint](https://platform.claude.com/docs/en/api/go/messages/count_tokens)తో మళ్లీ లెక్కించి, `claude-haiku-5-5`ను పేర్కొనండి. పాత మోడల్ టోకెన్ మొత్తాలు prompt 5.5లో ఏ ధరల శ్రేణికి చెందుతుందో చెప్పలేవు. ప్రత్యక్ష నమూనా కోసం పనుల ఫలితాలతో పాటు స్పందన `usage`, output పొడవు, cache ఫీల్డులు, effort, నిజంగా వసూలైన మొత్తాన్ని నమోదు చేయండి. చిన్న అభ్యర్థనలు, అత్యంత పొడవైన పునరావృత సంభాషణలు, 100,000 టోకెన్లకు దగ్గరి సందర్భాలు చేర్చండి. BIG CHANGE పత్రాలను సమీక్షించింది; Haiku 5.5ను నడపలేదు లేదా production పనిభారాన్ని కొలవలేదు.
## మైగ్రేషన్ సమయంలో మళ్లీ పరిశీలించాల్సిన సెట్టింగులు
Anthropic [Haiku 5.5 మైగ్రేషన్ గైడ్](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) Haiku 4.5 నుంచి మారే క్లయింట్ల కోసం అసాధారణంగా నిర్దిష్టమైన తనిఖీ జాబితాను ఇస్తుంది:
1. ప్లాట్ఫారమ్కు మోడల్ ID మార్చి, promptsను మళ్లీ లెక్కించండి. `claude-haiku-5-5`తేదీ suffix లేదా వేరే alias లేని స్థిర Claude API ID. thinking ఆ పరిమితిని వినియోగిస్తుంది; అదే పాఠ్యానికి ఎక్కువ టోకెన్లు పట్టవచ్చు కాబట్టి `max_tokens`ను సమీక్షించండి.
2. భర్తీ చేయండి: `thinking: {"type":"enabled","budget_tokens":N}`ను adaptive thinkingతో భర్తీ చేయండి లేదా `thinking`ను సెట్ చేయకుండా వదిలేయండి. లోతును సర్దుబాటు చేయడానికి `output_config.effort`ను సెట్ చేయండి; పత్రాల్లో డిఫాల్ట్ `medium`. తక్కువ `max_tokens` ఉంటే పాఠ్యం రాకముందే thinking బ్లాక్ తర్వాత స్పందన ముగిసిపోవచ్చు.
3. Content blocksను స్థానాన్ని బట్టి కాకుండా `type`బట్టి చదవండి. thinking blocksను tool resultsతో మార్పులేకుండా తిరిగి పంపండి. వేరే ఖాతా ద్వారా బ్లాక్ను మళ్లీ అమలు చేసే లేదా పాత సందేశాలు, system సూచనలు, toolsను మార్చే conversation storeను పరీక్షించండి.
4. కస్టమ్ `temperature`, `top_p`, `top_k` సెట్టింగులను తీసేయండి. చివరి assistant prefillను user turnతో భర్తీ చేయండి; పరిమిత ఫార్మాట్లకు Anthropic చెప్పిన structured-output లేదా tool పద్ధతిని వాడండి. క్లయింట్లో `stop_reason`కు `refusal` వచ్చినప్పుడు నిర్వహించండి.
5. Claude API లేదా Google Cloudలో computer use వాడితే పాత `computer_20250124` toolను `computer_toolset_20260801`తో మార్చి, గైడ్ ప్రకారం tool loopను నవీకరించండి. Haiku 4.5 కోసం Priority Tier సామర్థ్యాన్ని వాడే సంస్థలకు ప్రత్యేక ప్రణాళిక అవసరం: Haiku 5.5లో Priority Tier అందుబాటులో లేదని గైడ్ చెబుతుంది.
ఈ మార్పులు ప్రతి పనికి ఒకే effort సెట్టింగ్ను నిర్దేశించవు. పోలికలో అప్లికేషన్ పని, అంగీకార ప్రమాణాలు ఒకేలా ఉంచి, పరిశీలిస్తున్న సెట్టింగులకు సమాధాన నాణ్యత, నిరాకరణలు, కత్తిరింపులు, ఆలస్యం, బిల్ చేసిన టోకెన్లను నమోదు చేయాలి. Anthropic తన Terminal-Bench 4.0 పట్టికలో 39.2% వర్సెస్ 0.0% సహా పలు బెంచ్మార్క్లలో Haiku 5.5 ఫలితాలు 4.5 కంటే మెరుగ్గా ఉన్నాయని తెలిపింది. అవి Anthropic మూల్యాంకన పరిస్థితుల్లో వచ్చిన ఫలితాలు; పాఠకుడి ఏజెంట్ కొలతలు కావు. ఆ బెంచ్మార్క్లో క్లిష్టమైన ఏజెంట్ కోడింగ్కు Sonnet 5.5, Opus 5.5 మరింత అనుకూలమని కూడా Anthropic చెబుతోంది. Haiku 4.5 వాడేవారి తక్షణ నిర్ణయం: API మార్పులు, కొత్త టోకెన్ లెక్కను కలిపిన తర్వాత చిన్న మోడల్ ప్రతి పరిమిత దశ అవసరాలను చేరుతుందా?
## మూలాలు, మరింత చదవండి
- [Anthropic Haiku 5.5 ప్రకటన](https://www.anthropic.com/claude-haiku-5-5)విడుదల తేదీ, ఉద్దేశించిన పనులు, లభ్యతను తెలియజేస్తూ, కంపెనీ సగటు పనిఖర్చు లెక్కను వివరిస్తుంది. దాని benchmark పట్టిక Anthropic మూల్యాంకన ఫలితాలను చూపుతుంది.
- [Claude Platform Haiku 5.5 మోడల్ పేజీ](https://platform.claude.com/docs/en/models/haiku-5-5/overview)IDలు, context మరియు output పరిమితులు, prompt పొడవు ధరల శ్రేణులు, cache ధరలు, ప్లాట్ఫారమ్ మద్దతును జాబితా చేస్తుంది. [Haiku 4.5 పేజీ](https://platform.claude.com/docs/en/models/haiku-4-5/overview)మునుపటి మోడల్ రేట్లు, పరిమితులను అందిస్తుంది.
- [Haiku 5.5 మైగ్రేషన్ గైడ్](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)ఇప్పటికే ఉన్న అనుసంధానాన్ని మార్చే ముందు తనిఖీ చేయాల్సిన Messages API మార్పులు, లోపాలను వివరిస్తుంది. [టోకెన్ లెక్కింపు API సూచిక](https://platform.claude.com/docs/en/api/go/messages/count_tokens)ఎంచుకున్న మోడల్తో అభ్యర్థనను లెక్కించే విధానాన్ని వివరిస్తుంది.
- [Reuters అక్టోబర్ 7 విడుదల కథనం](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)విడుదల తేదీని స్వతంత్రంగా ధృవీకరిస్తుంది. పై సాంకేతిక సెట్టింగులు, ధరలు Anthropic ప్రస్తుత పత్రాల నుంచివి.
## Sources
- [Anthropic, Claude Haiku 5.5 విడుదల](https://www.anthropic.com/claude-haiku-5-5) — విడుదల తేదీ, ఉద్దేశిత పనులు, విక్రేత benchmark మరియు సగటు ఖర్చు వాదనలు, లెక్క ఫుట్నోట్, cloud లభ్యత.
- [Claude Haiku 5.5 మోడల్ అవలోకనం](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — ప్రస్తుత మోడల్ ID, prompt పొడవు ఆధారిత API ధరలు, cache మరియు batch రేట్లు, context, output, లభ్యత.
- [Claude Haiku 4.5 మోడల్ అవలోకనం](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — మునుపటి మోడల్ ప్రస్తుత legacy స్థితి, జాబితా ధరలు, పరిమితులు.
- [Claude Haiku 5.5 మైగ్రేషన్ గైడ్](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — ప్రధాన Messages API మార్పుల తనిఖీ జాబితా, tokenizer సూచనలు.
- [Messageలో టోకెన్లు లెక్కించడం](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — టోకెన్ లెక్కింపు endpoint, మోడల్-నిర్దిష్ట అభ్యర్థన లెక్కింపు.
- [Reuters: Anthropic మూడో Claude 5.5 మోడల్ను విడుదల చేసింది](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — స్వతంత్ర విడుదల ధృవీకరణ మాత్రమే.
BIG CHANGE వార్తాపత్రిక
పెద్ద దృశ్యం. మీ వేగంతో.
AI, రోబోటిక్స్ తాజా కథనాలు, గమనించదగిన మార్పులు, ఆచరణలో పెట్టగల ఆలోచనలు. రోజువారీ బ్రీఫింగ్, వారపు సంకలనం లేదా నెలవారీ దృక్కోణం ఎంచుకోండి.
Belgrade సమయం 09:00కు పంపబడుతుంది: రోజూ, సోమవారాల్లో లేదా నెల మొదటి తేదీన. మీరు నిర్ధారించిన తర్వాతి షెడ్యూల్ పంపిణీలో మొదటి సంచిక వస్తుంది.
మీ గోప్యత, మీ ఎంపిక.
అవసరమైన నిల్వ సైట్ భద్రతకు తోడ్పడి, మీ ఎంపికలను గుర్తుంచుకుంటుంది. మీరు అనుమతించే వరకు ఐచ్ఛిక Google Analytics ఆఫ్లోనే ఉంటుంది. అవసరమైన స్టోరేజ్తోనే ప్రతి కథనాన్ని చదవవచ్చు. గోప్యత వివరాలు