Anthropic نے 7 اکتوبر کو Claude Haiku 5.5 جاری کیا، جو مختصر اور بار بار ہونے والے کاموں کے لیے ہے جو کسی agent system کی کالز کا بڑا حصہ بن سکتے ہیں۔ Claude API کے عوامی نرخ فی ملین input tokens $0.10 اور فی ملین output tokens $0.50 سے شروع ہوتے ہیں، یعنی Haiku 4.5 کے نرخوں کا دسواں حصہ۔ تاہم، Anthropic کے مطابق نئے ماڈل میں اسی متن کے لیے تقریباً 30% زیادہ tokens درکار ہوتے ہیں، اور 100,000 tokens سے طویل prompts زیادہ قیمت والے درجے میں چلے جاتے ہیں۔ Haiku 4.5 استعمال کرنے والی ٹیموں کو بل کا اندازہ لگانے یا production traffic منتقل کرنے سے پہلے اپنی درخواستیں دوبارہ گننی چاہئیں۔

اس ریلیز سے Messages API کا طریقۂ کار بھی بدلتا ہے۔ Haiku 5.5 میں دستی طور پر مقرر کردہ thinking budgets کام نہیں کرتے، adaptive thinking پہلے سے فعال ہے، اور جواب کا پہلا block متن کے بجائے thinking ہو سکتا ہے۔ یہ ان سروسز کے لیے واضح compatibility checks ہیں جو درجہ بندی، استخراج، routing یا خلاصے کے لیے چھوٹے ماڈل کو بار بار بلاتی ہیں۔

اہم تبدیلی

  • کیا بدلا: Anthropic نے نئی دس لاکھ-token context window اور adaptive thinking کو Claude کے سب سے کم قیمت والے درجے میں شامل کیا ہے۔ Haiku 5.5 مختصر prompts کے نرخ کم کرتا ہے، مگر متن گننے اور جواب شروع ہونے کے طریقے بھی بدلتا ہے۔
  • یہ کیوں اہم ہے: ٹیمیں اب کم شائع شدہ نرخ پر زیادہ بار چلنے والے، محدود دائرے کے agent مراحل کے لیے Claude پر غور کر سکتی ہیں۔ فائدہ prompt کی لمبائیوں کے امتزاج، output اور thinking tokens، cache کے استعمال، اور نئے ماڈل کے اس مرحلے کا معیار پورا کرنے پر منحصر ہے۔
  • کس بات پر نظر رکھیں: Haiku 4.5 integrations کو ناپ تول کے ساتھ منتقل کرنا چاہیے۔ دوبارہ گنتی کے بعد 100,000-token حد کے قریب درخواستیں زیادہ قیمت والے درجے میں جا سکتی ہیں؛ جو code پہلے content block کو متن سمجھتا ہے وہ بظاہر کامیاب جواب کو بھی غلط سنبھال سکتا ہے۔

قیمت prompt کی لمبائی پر منحصر ہے

Claude API میں 100,000 tokens تک کے prompts کے لیے Haiku 5.5 کی قیمت فی ملین input tokens $0.10 اور فی ملین output tokens $0.50 ہے۔ اس حد سے اوپر متعلقہ نرخ $0.50 اور $2.50 ہیں۔ Haiku 4.5 کی 200,000-token context window میں $1 اور $5 کے نرخ درج ہیں۔ Haiku 5.5 کی context window دس لاکھ tokens اور زیادہ سے زیادہ output 128,000 tokens ہے، جبکہ Haiku 4.5 میں یہ حدیں 200,000 اور 64,000 ہیں۔ Anthropic Claude API، Amazon Bedrock، AWS پر Claude Platform، Google Cloud اور Microsoft Foundry کے ذریعے دستیابی بتاتا ہے۔ Amazon Bedrock کا model ID anthropic.claude-haiku-5-5 ہے؛ Claude API claude-haiku-5-5 استعمال کرتا ہے۔ Anthropic کے model pages موجودہ platform IDs، حدود اور نرخ درج کرتے ہیں۔

Anthropic کے مطابق Haiku 5.5 چلانے کی لاگت Haiku 4.5 سے تقریباً 75% کم ہے اوسطاً اوسطاً چلانے پر۔ حاشیے میں 100,000 tokens تک کے prompts کے لیے 90% کم فہرستی نرخ، اس سے اوپر 50% کم نرخ، یہ مشاہدہ کہ Haiku 4.5 کی 90% درخواستیں مختصر زمرے میں تھیں، اور ایک ہی کام کے لیے نئے tokenizer کی زیادہ token گنتی شامل ہے۔ یہ حساب Anthropic کی درخواستوں کے امتزاج کی وضاحت کرتا ہے، ہر درخواست پر یکساں رعایت کی نہیں۔ اسی input text کے لیے تقریباً 30% اضافی tokens بھی فراہم کنندہ کا تخمینہ ہے؛ اصل فرق مواد پر منحصر ہے۔ Anthropic کا لانچ اعلان دعویٰ اور اس کا طریقۂ حساب دونوں بیان کرتا ہے۔

بغیر cache والی Claude API درخواست کے لیے Haiku 5.5 کے input اور output tokens کی تعداد لیں، ہر ایک کو اس درخواست کی prompt-length قیمت کی سطح کے نرخ سے ضرب دیں اور دس لاکھ پر تقسیم کریں۔ حساب کی مثال: مختصر prompt نرخ پر 80,000 input اور 10,000 output tokens کی قیمت $0.013 بنتی ہے۔ 120,000 input اور 10,000 output tokens پر طویل prompt نرخ $0.085 دیتے ہیں۔ یہ قیمت کے حساب ہیں، مشاہدہ شدہ کام یا پیش گوئیاں نہیں۔ Cache پڑھنے اور لکھنے کے اپنے نرخ ہیں، اور batch processing میں input اور output دونوں پر 50% رعایت درج ہے۔ اس لیے مفید تخمینے کے لیے حقیقی calls کو prompt کی لمبائی اور cache کے رویے کے مطابق گروپ کر کے پھر جمع کرنا چاہیے۔ Haiku 5.5 model page ان زمروں کی فہرست دیتا ہے۔

محفوظ کیے گئے نمائندہ prompts کو Message token-count endpoint سے دوبارہ گنیں اور claude-haiku-5-5 بتائیں۔ پرانے ماڈل کے کل tokens سے معلوم نہیں ہوتا کہ 5.5 میں prompt کس قیمت کے درجے میں آئے گا۔ حقیقی نمونے کے لیے کام کے نتائج کے ساتھ response کا usage، output کی لمبائی، cache fields، effort اور اصل چارج ریکارڈ کریں۔ مختصر درخواستیں، طویل ترین بار بار ہونے والی گفتگوئیں اور 100,000 tokens کے قریب مثالیں شامل کریں۔ BIG CHANGE نے دستاویزات کا جائزہ لیا ہے؛ اس نے Haiku 5.5 چلایا یا production workload ناپا نہیں۔

مائیگریشن میں جن ترتیبات کا جائزہ لینا ہے

Anthropic کی Haiku 5.5 مائیگریشن گائیڈ Haiku 4.5 سے منتقل ہونے والے clients کے لیے غیر معمولی طور پر واضح checklist دیتی ہے:

  1. platform کے لیے model ID تبدیل کریں اور prompts دوبارہ گنیں۔ claude-haiku-5-5تاریخ کے suffix یا الگ alias کے بغیر مقررہ Claude API ID ہے۔ max_tokensکا جائزہ لیں، کیونکہ thinking اس حد میں شمار ہوتا ہے اور اسی متن کے لیے مزید tokens لگ سکتے ہیں۔
  2. بدلیں thinking: {"type":"enabled","budget_tokens":N} کو adaptive thinking سے، یا thinking کو غیر مقرر رہنے دیں۔ گہرائی درست کرنے کے لیے output_config.effort مقرر کریں؛ دستاویزی default medium ہے۔ کم max_tokens ہونے پر response کسی متن سے پہلے thinking block کے بعد ختم ہو سکتا ہے۔
  3. content blocks کو ان کے type کے مطابق پڑھیں، مقام کے مطابق نہیں۔ thinking blocks کو tool results کے ساتھ بغیر تبدیلی واپس بھیجیں۔ ایسے conversation store کو آزمائیں جو کسی block کو دوسرے account سے دوبارہ چلاتا ہو یا پچھلے پیغامات، system ہدایات یا tools کو بدلتا ہو۔
  4. custom temperature، top_p اور top_k ترتیبات ہٹائیں۔ آخری assistant prefill کی جگہ user turn لائیں؛ محدود formats کے لیے Anthropic کا دستاویزی structured-output یا tool طریقہ اپنائیں۔ client میں stop_reason کی قدر refusal سنبھالیں۔
  5. اگر integration Claude API یا Google Cloud پر computer use استعمال کرتی ہے تو پرانے computer_20250124 tool کو computer_toolset_20260801 سے بدلیں اور guide کے مطابق tool loop اپ ڈیٹ کریں۔ Haiku 4.5 کے Priority Tier capacity والے اداروں کو الگ منصوبہ بھی چاہیے: guide کے مطابق Haiku 5.5 میں Priority Tier دستیاب نہیں۔

یہ تبدیلیاں ہر کام کے لیے ایک effort setting مقرر نہیں کرتیں۔ تقابل میں application task اور قبولیت کے معیار یکساں رکھیں، پھر زیرِ غور ترتیبات پر جواب کا معیار، انکار، truncation، تاخیر اور بل کیے گئے tokens درج کریں۔ Anthropic کئی benchmarks میں Haiku 5.5 کے Haiku 4.5 سے بہتر نتائج بتاتا ہے، جن میں اس کی Terminal-Bench 4.0 جدول میں 39.2% بمقابلہ 0.0% شامل ہے۔ یہ Anthropic کی اپنی جانچ کے حالات میں رپورٹ کیے گئے نتائج ہیں، قاری کے agent کی پیمائش نہیں۔ Anthropic اس benchmark میں پیچیدہ agentic coding کے لیے Sonnet 5.5 اور Opus 5.5 کو زیادہ موزوں بھی کہتا ہے۔ Haiku 4.5 استعمال کرنے والے کے لیے فوری سوال یہ ہے کہ API تبدیلیوں اور نئے token count کو شامل کرنے کے بعد چھوٹا ماڈل ہر محدود مرحلے کی ضروریات پوری کرتا ہے یا نہیں۔

ذرائع اور مزید مطالعہ

  • Haiku 5.5 سے متعلق Anthropic کا اعلانلانچ کی تاریخ، مطلوبہ کاموں اور دستیابی کی تفصیل دیتا ہے اور کمپنی کی اوسط task cost کے حساب کی وضاحت کرتا ہے۔ اس کی benchmark جدول میں Anthropic کے جائزے کے نتائج ہیں۔
  • Claude Platform کا Haiku 5.5 model pageIDs، context اور output حدود، prompt کی لمبائی کے نرخ، cache قیمتیں اور platform support درج کرتا ہے۔ Haiku 4.5 pageپچھلے ماڈل کے نرخ اور حدود فراہم کرتا ہے۔
  • Haiku 5.5 مائیگریشن گائیڈموجودہ integration منتقل کرنے سے پہلے Messages API تبدیلیاں اور جانچنے والی غلطیاں بتاتی ہے۔ token-count API referenceمنتخب ماڈل سے درخواست گننے کا طریقہ درج کرتا ہے۔
  • 7 اکتوبر کے لانچ پر Reuters کی رپورٹریلیز کی تاریخ کی آزادانہ توثیق کرتی ہے۔ اوپر کی تکنیکی ترتیبات اور نرخ Anthropic کی موجودہ دستاویزات سے لیے گئے ہیں۔