ఏజెంట్ వ్యవస్థలో కాల్స్ పరిమాణంలో ఎక్కువ వాటా ఉండగల చిన్న, తరచూ జరిగే పనుల కోసం Anthropic అక్టోబర్ 7న Claude Haiku 5.5ను విడుదల చేసింది. Claude API జాబితా రేట్లు ప్రతి మిలియన్ ఇన్‌పుట్ టోకెన్లకు $0.10, ప్రతి మిలియన్ అవుట్‌పుట్ టోకెన్లకు $0.50 నుంచి మొదలవుతాయి; ఇవి Haiku 4.5 రేట్లలో పదో వంతు. అయితే కొత్త మోడల్‌లో అదే పాఠ్యానికి సుమారు 30% ఎక్కువ టోకెన్లు అవసరమవుతాయని, 100,000 టోకెన్లకు మించిన prompts అధిక ధరల శ్రేణిలోకి వెళ్తాయని Anthropic చెబుతోంది. బిల్లు అంచనా వేయడానికి లేదా production ట్రాఫిక్‌ను మార్చడానికి ముందు Haiku 4.5 వాడే బృందాలు తమ అభ్యర్థనలను మళ్లీ లెక్కించాలి.

ఈ విడుదల Messages API మార్గాన్నీ మార్చింది. Haiku 5.5లో చేతితో నిర్ణయించిన thinking బడ్జెట్లు పనిచేయవు, adaptive thinking డిఫాల్ట్‌గా ఆన్‌లో ఉంటుంది, మొదటి ప్రతిస్పందన బ్లాక్ పాఠ్యం కాకుండా thinking కావచ్చు. వర్గీకరణ, సంగ్రహణ, రూటింగ్ లేదా సారాంశం కోసం చిన్న మోడల్‌కు పదే పదే కాల్ చేసే సేవలకు ఇవి నిర్దిష్ట అనుకూలత తనిఖీలు.

ముఖ్యమైన మార్పు

  • ఏం మారింది: Anthropic కొత్త ఒక మిలియన్ టోకెన్ల context window, adaptive thinkingను అత్యల్ప ధర Claude స్థాయికి తీసుకొచ్చింది. Haiku 5.5 చిన్న prompts రేటును తగ్గిస్తూ, పాఠ్యాన్ని లెక్కించే విధానాన్ని, ప్రతిస్పందన మొదలయ్యే తీరును మార్చింది.
  • ఇది ఎందుకు ముఖ్యం: తక్కువ ప్రచురిత రేటుతో, తరచుగా జరిగే పరిమిత పరిధి ఏజెంట్ దశల్లో Claudeను ఉపయోగించవచ్చా అని బృందం పరిశీలించవచ్చు. ప్రయోజనం prompt పొడవుల మిశ్రమం, output మరియు thinking టోకెన్లు, cache వాడకం, ఆ దశకు కొత్త మోడల్ నాణ్యత లక్ష్యాన్ని చేరుతుందా అనే అంశాలపై ఆధారపడుతుంది.
  • ఏం గమనించాలి: Haiku 4.5 అనుసంధానాలను కొలతలతో జాగ్రత్తగా మైగ్రేట్ చేయాలి. 100,000 టోకెన్ల పరిమితికి దగ్గరగా ఉన్న అభ్యర్థనలు మళ్లీ లెక్కించినప్పుడు అధిక ధరల శ్రేణికి వెళ్లవచ్చు; మొదటి content బ్లాక్ తప్పనిసరిగా పాఠ్యమేనని భావించే కోడ్ విజయవంతమైన ప్రతిస్పందనను తప్పుగా నిర్వహించవచ్చు.

ధర prompt పొడవుపై ఆధారపడి ఉంటుంది

Claude APIలో 100,000 టోకెన్ల వరకు promptsకు Haiku 5.5 ధర ప్రతి మిలియన్ ఇన్‌పుట్ టోకెన్లకు $0.10, ప్రతి మిలియన్ అవుట్‌పుట్ టోకెన్లకు $0.50. ఆ పరిమితి దాటితే వరుసగా $0.50, $2.50. Haiku 4.5కు దాని 200,000-టోకెన్ల context window అంతటా $1, $5 ధరలు జాబితా అయ్యాయి. Haiku 5.5లో ఒక మిలియన్ టోకెన్ల context window, గరిష్ఠంగా 128,000 టోకెన్ల output ఉన్నాయి; Haiku 4.5లో ఇవి 200,000, 64,000. Claude API, Amazon Bedrock, AWSలోని Claude Platform, Google Cloud, Microsoft Foundry ద్వారా అందుబాటులో ఉంటుందని Anthropic జాబితా చేసింది. Amazon Bedrock మోడల్ ID anthropic.claude-haiku-5-5; Claude APIలో claude-haiku-5-5 వాడుతుంది. Anthropic మోడల్ పేజీలు ప్రస్తుత ప్లాట్‌ఫారమ్ IDలు, పరిమితులు, రేట్లను చూపుతాయి.

Haiku 5.5 నడపడానికి అయ్యే సగటు ఖర్చు Haiku 4.5 కంటే సుమారు 75% తక్కువని Anthropic చెబుతోంది. సగటున. ఫుట్‌నోట్‌లో 100,000 టోకెన్ల వరకు promptsకు జాబితా రేటు 90% తక్కువ, ఆ పరిమితి పైన 50% తక్కువ, Haiku 4.5 అభ్యర్థనల్లో 90% చిన్న వర్గంలో ఉన్నాయనే పరిశీలన, అదే పనికి కొత్త tokenizer ఎక్కువ టోకెన్లు లెక్కించడం — ఇవన్నీ కలిపి ఉన్నాయి. ఆ లెక్క Anthropic అభ్యర్థనల మిశ్రమాన్ని వివరిస్తుంది; ప్రతి అభ్యర్థనకు ఒకే రాయితీ అని కాదు. అదే input textకు సుమారు 30% టోకెన్ పెరుగుదల కూడా vendor అంచనా మాత్రమే; ఖచ్చితమైన మార్పు విషయంపై ఆధారపడుతుంది. Anthropic విడుదల ప్రకటన దావాను, దాని లెక్కింపు పద్ధతిని రెండింటినీ వివరిస్తుంది.

Cache లేని Claude API అభ్యర్థన కోసం Haiku 5.5 ఇన్‌పుట్, అవుట్‌పుట్ టోకెన్ సంఖ్యలను తీసుకుని, ఒక్కొక్కదాన్ని ఆ అభ్యర్థన prompt పొడవు ధరల శ్రేణిరేటుతో గుణించి, ఒక మిలియన్‌తో భాగించాలి. లెక్క ప్రకారం చిన్న-prompt రేట్ల వద్ద 80,000 ఇన్‌పుట్, 10,000 అవుట్‌పుట్ టోకెన్లకు $0.013 ఖర్చవుతుంది. 120,000 ఇన్‌పుట్, 10,000 అవుట్‌పుట్ టోకెన్లకు దీర్ఘ-prompt రేట్లతో $0.085. ఇవి ధరల గణనలు; గమనించిన పనులు లేదా అంచనాలు కావు. Cache reads, writesకు వేర్వేరు రేట్లు ఉన్నాయి; batch processingలో ఇన్‌పుట్, అవుట్‌పుట్ రెండింటిపై 50% తగ్గింపు జాబితా అయ్యింది. కాబట్టి ఉపయోగకరమైన అంచనా కోసం నిజమైన కాల్స్‌ను prompt పొడవు, cache ప్రవర్తన ఆధారంగా గుంపులుగా చేసి కలపాలి. Haiku 5.5 మోడల్ పేజీ ఈ వర్గాలను జాబితా చేస్తుంది.

నిల్వ చేసిన ప్రతినిధి promptsను Message token-count endpointతో మళ్లీ లెక్కించి, claude-haiku-5-5ను పేర్కొనండి. పాత మోడల్ టోకెన్ మొత్తాలు prompt 5.5లో ఏ ధరల శ్రేణికి చెందుతుందో చెప్పలేవు. ప్రత్యక్ష నమూనా కోసం పనుల ఫలితాలతో పాటు స్పందన usage, output పొడవు, cache ఫీల్డులు, effort, నిజంగా వసూలైన మొత్తాన్ని నమోదు చేయండి. చిన్న అభ్యర్థనలు, అత్యంత పొడవైన పునరావృత సంభాషణలు, 100,000 టోకెన్లకు దగ్గరి సందర్భాలు చేర్చండి. BIG CHANGE పత్రాలను సమీక్షించింది; Haiku 5.5ను నడపలేదు లేదా production పనిభారాన్ని కొలవలేదు.

మైగ్రేషన్ సమయంలో మళ్లీ పరిశీలించాల్సిన సెట్టింగులు

Anthropic Haiku 5.5 మైగ్రేషన్ గైడ్ Haiku 4.5 నుంచి మారే క్లయింట్ల కోసం అసాధారణంగా నిర్దిష్టమైన తనిఖీ జాబితాను ఇస్తుంది:

  1. ప్లాట్‌ఫారమ్‌కు మోడల్ ID మార్చి, promptsను మళ్లీ లెక్కించండి. claude-haiku-5-5తేదీ suffix లేదా వేరే alias లేని స్థిర Claude API ID. thinking ఆ పరిమితిని వినియోగిస్తుంది; అదే పాఠ్యానికి ఎక్కువ టోకెన్లు పట్టవచ్చు కాబట్టి max_tokensను సమీక్షించండి.
  2. భర్తీ చేయండి: thinking: {"type":"enabled","budget_tokens":N}ను adaptive thinkingతో భర్తీ చేయండి లేదా thinkingను సెట్ చేయకుండా వదిలేయండి. లోతును సర్దుబాటు చేయడానికి output_config.effortను సెట్ చేయండి; పత్రాల్లో డిఫాల్ట్ medium. తక్కువ max_tokens ఉంటే పాఠ్యం రాకముందే thinking బ్లాక్ తర్వాత స్పందన ముగిసిపోవచ్చు.
  3. Content blocksను స్థానాన్ని బట్టి కాకుండా typeబట్టి చదవండి. thinking blocksను tool resultsతో మార్పులేకుండా తిరిగి పంపండి. వేరే ఖాతా ద్వారా బ్లాక్‌ను మళ్లీ అమలు చేసే లేదా పాత సందేశాలు, system సూచనలు, toolsను మార్చే conversation storeను పరీక్షించండి.
  4. కస్టమ్ temperature, top_p, top_k సెట్టింగులను తీసేయండి. చివరి assistant prefillను user turnతో భర్తీ చేయండి; పరిమిత ఫార్మాట్లకు Anthropic చెప్పిన structured-output లేదా tool పద్ధతిని వాడండి. క్లయింట్‌లో stop_reasonకు refusal వచ్చినప్పుడు నిర్వహించండి.
  5. Claude API లేదా Google Cloudలో computer use వాడితే పాత computer_20250124 toolను computer_toolset_20260801తో మార్చి, గైడ్ ప్రకారం tool loopను నవీకరించండి. Haiku 4.5 కోసం Priority Tier సామర్థ్యాన్ని వాడే సంస్థలకు ప్రత్యేక ప్రణాళిక అవసరం: Haiku 5.5లో Priority Tier అందుబాటులో లేదని గైడ్ చెబుతుంది.

ఈ మార్పులు ప్రతి పనికి ఒకే effort సెట్టింగ్‌ను నిర్దేశించవు. పోలికలో అప్లికేషన్ పని, అంగీకార ప్రమాణాలు ఒకేలా ఉంచి, పరిశీలిస్తున్న సెట్టింగులకు సమాధాన నాణ్యత, నిరాకరణలు, కత్తిరింపులు, ఆలస్యం, బిల్ చేసిన టోకెన్లను నమోదు చేయాలి. Anthropic తన Terminal-Bench 4.0 పట్టికలో 39.2% వర్సెస్ 0.0% సహా పలు బెంచ్‌మార్క్‌లలో Haiku 5.5 ఫలితాలు 4.5 కంటే మెరుగ్గా ఉన్నాయని తెలిపింది. అవి Anthropic మూల్యాంకన పరిస్థితుల్లో వచ్చిన ఫలితాలు; పాఠకుడి ఏజెంట్ కొలతలు కావు. ఆ బెంచ్‌మార్క్‌లో క్లిష్టమైన ఏజెంట్ కోడింగ్‌కు Sonnet 5.5, Opus 5.5 మరింత అనుకూలమని కూడా Anthropic చెబుతోంది. Haiku 4.5 వాడేవారి తక్షణ నిర్ణయం: API మార్పులు, కొత్త టోకెన్ లెక్కను కలిపిన తర్వాత చిన్న మోడల్ ప్రతి పరిమిత దశ అవసరాలను చేరుతుందా?

మూలాలు, మరింత చదవండి

  • Anthropic Haiku 5.5 ప్రకటనవిడుదల తేదీ, ఉద్దేశించిన పనులు, లభ్యతను తెలియజేస్తూ, కంపెనీ సగటు పనిఖర్చు లెక్కను వివరిస్తుంది. దాని benchmark పట్టిక Anthropic మూల్యాంకన ఫలితాలను చూపుతుంది.
  • Claude Platform Haiku 5.5 మోడల్ పేజీIDలు, context మరియు output పరిమితులు, prompt పొడవు ధరల శ్రేణులు, cache ధరలు, ప్లాట్‌ఫారమ్ మద్దతును జాబితా చేస్తుంది. Haiku 4.5 పేజీమునుపటి మోడల్ రేట్లు, పరిమితులను అందిస్తుంది.
  • Haiku 5.5 మైగ్రేషన్ గైడ్ఇప్పటికే ఉన్న అనుసంధానాన్ని మార్చే ముందు తనిఖీ చేయాల్సిన Messages API మార్పులు, లోపాలను వివరిస్తుంది. టోకెన్ లెక్కింపు API సూచికఎంచుకున్న మోడల్‌తో అభ్యర్థనను లెక్కించే విధానాన్ని వివరిస్తుంది.
  • Reuters అక్టోబర్ 7 విడుదల కథనంవిడుదల తేదీని స్వతంత్రంగా ధృవీకరిస్తుంది. పై సాంకేతిక సెట్టింగులు, ధరలు Anthropic ప్రస్తుత పత్రాల నుంచివి.