Anthropic نے Claude Opus 5.5 جاری کیا 22 ستمبر کو۔ کمپنی کا دعویٰ ہے کہ زیادہ تر کاموں میں کارکردگی Fable 5.1 کے قریب ہے، اور قیمتیں Opus 5 سے کم ہیں۔

جو ٹیمیں پہلے ہی Opus 5 استعمال کررہی ہیں، ان کے لیے یہ اپ ڈیٹ صرف سستی model ID نہیں۔ Opus 5.5 ہمیشہ adaptive thinking استعمال کرتا ہے، default effort medium ہے، اور درخواست کی کئی ایسی صورتوں کو رد کرتا ہے جنہیں Opus 5 قبول کرتا تھا۔ Anthropic اسے زیرنگرانی کام کے لیے روزمرہ تجویز کردہ ماڈل قرار دیتا ہے، Fable 5.1 کو انتہائی مشکل اور طویل خودمختار کاموں کے لیے رکھتا ہے۔

بڑی تبدیلی

  • کیا بدلا: Opus 5.5 نے input اور output نرخ 20%، اور cache-read نرخ 60% کم کیے۔ ہمیشہ فعال adaptive thinking یہ بھی بدلتا ہے کہ موجودہ API clients کام کی درخواست اور بجٹ کیسے بنائیں۔
  • یہ کیوں اہم ہے: طویل ایجنٹ کاموں میں پرانی ہدایات اور ٹول کے نتائج بار بار پڑھے جاتے ہیں۔ سب سے بڑی قیمت میں کمی اسی دوبارہ استعمال ہونے والے context پر ہے، اس لیے پورے کام کا بل سمجھنے کے لیے cache کا استعمال مرکزی اہمیت رکھتا ہے۔
  • کس بات پر نظر رکھیں: Sonnet 5.5 اور Haiku 5.5 آئندہ چند ہفتوں میں آنے کا اعلان ہوچکا ہے؛ فی الحال Opus دستیاب ہے۔ Default چنتے وقت مکمل کیے گئے کام کی لاگت اور ہر tier کے لیے درکار جائزے کا موازنہ کریں۔

Opus 5.5 کو Fable tier سے نیچے عملی کاموں کے لیے رکھا گیا ہے

Anthropic کی شراکت داروں کے لیے پوزیشننگ میں Opus 5.5 کو عملی coding، مالی اور قانونی شعبوں کے علم، اور agents کے لیے default کاروباری انتخاب تجویز کیا گیا ہے۔ اس کی عوامی ماڈل انتخاب گائیڈ کہتی ہے کہ زیادہ تر کام Opus 5.5 سے شروع کیے جائیں، اور اسے پیچیدہ agentic coding اور کاروباری کاموں سے جوڑتی ہے۔ الگ لاگت گائیڈ اسے زیرنگرانی feature work، debugging اور code review کا “روزمرہ کا ماڈل” کہتی ہے۔ دونوں گائیڈز Fable 5.1 کو اس سے اوپر رکھتی ہیں، جب بلند ترین صلاحیت یا طویل مشکل کام ٹوکن کی قیمت سے زیادہ اہم ہو۔

Anthropic کی prompting گائیڈ، root-cause analysis، code checking، متوازی subagents، تحقیق، spreadsheets، reports اور presentations پر کمپنی کے ٹیسٹ بیان کرکے اس وسیع استعمال کی تائید کرتی ہے۔ اس میں واضح progress messages اور آخری خلاصوں کے ساتھ vision اور computer-use میں بہتری بھی درج ہے۔ یہ Anthropic کی اپنی جانچ ہے، BIG CHANGE کے کیے ہوئے ٹیسٹ نہیں۔

Opus اور Fable میں فرق اہم ہے، کیونکہ Fable 5.1 کی قیمت فی دس لاکھ input tokens $10 اور output tokens $50 ہے، جبکہ Opus 5.5 کے لیے بالترتیب $4 اور $20 ہیں۔ Cache reads میں فرق بہت کم ہے: $0.25 اور $0.20۔ لہٰذا طویل cached sessions میں قیمت کا فرق نمایاں input اور output نرخوں سے کم ہوسکتا ہے۔

Claude Opus 5.5 نے چار API نرخ بدلے

معیاری API قیمتیں فی دس لاکھ tokens ہیں۔ Anthropic کا ماڈل حوالہ Opus 5.5 کے لیے 1 ملین token context window اور زیادہ سے زیادہ 128,000-token output درج کرتا ہے۔ اس کی قیمتوں کی دستاویزات کہتی ہیں کہ مکمل context window پر معیاری نرخ لاگو ہوتے ہیں۔

API چارج

Opus 5.5

Opus 5

تبدیلی

اِن پٹ

$4

$5

20% کم

آؤٹ پٹ

$20

$25

20% کم

5 منٹ کی cache write

$5

$6.25

20% کم

Cache read

$0.20

$0.50

60% کم

Anthropic عام workload پر default settings کے ساتھ نرخ اور token efficiency ملا کر 40% کم لاگت کا دعویٰ کرتا ہے۔ اس کی کام کی لاگت کی وضاحت بتاتی ہے کہ یہ امتزاج کیوں اہم ہے: طویل ایجنٹ سیشن بڑھتے ہوئے context کو بار بار پڑھتے ہیں، output میں thinking tokens شامل ہوتے ہیں اور ایک کام میں کئی turns لگ سکتے ہیں۔ Cache-read کی 60% کمی cache پر زیادہ منحصر سیشن میں فیصلہ کن ہوسکتی ہے؛ جبکہ مختصر، غیر cached درخواست اور طویل جواب پر output نرخ کی 20% کمی زیادہ اثرانداز ہوتی ہے۔

prompting گائیڈ کے مطابق output تیار کرنے کی رفتار 30% سے زیادہ بہتر ہوئی ہے۔ یہ tools، ٹیسٹ، بیرونی سروس یا reviewer کا انتظار کرنے کا وقت نہیں ناپتی۔ Anthropic Claude API پر research preview میں تیز API mode بھی دیتا ہے، جس کے نرخ فی دس لاکھ tokens input کے لیے $8 اور output کے لیے $40 ہیں؛ یہ partner cloud platforms پر دستیاب نہیں۔

Anthropic نے Pro، Max، Team اور نشست پر مبنی Enterprise منصوبوں کی پانچ گھنٹے کی حدود بھی بڑھائیں اور دوبارہ بحال ہونے والی گنجائش دی۔ سبسکرپشن کی گنجائش API بلنگ سے الگ ہے۔

کمپنی کے بینچ مارکس صلاحیت اور حدود دکھاتے ہیں

Anthropic کے مطابق Terminal-Bench 4.0 میں Opus 5.5 کا xhigh اسکور 66.4%، Opus 5 کا 52.3% اور Fable 5.1 کا 55.8% ہے۔ زیادہ تر دوسرے نمایاں نتائج max effort کے ہیں۔

دکھائی گئی AutomationBench اور Terminal-Bench-Science قطاروں میں GPT-6 Astra آگے ہے۔ محفوظ کردہ cyber کاموں میں Opus 4.8 اور biology اور جدید ماڈل کی تیاری والے کاموں میں Opus 5 استعمال ہوا۔ AutomationBench میں fallback نہیں تھا۔

Anthropic اپنے رویّے کے audit میں ناقابلِواپسی یا حدود سے باہر اقدامات کی کمی کی اطلاع دیتا ہے۔ اس کی prompting گائیڈ میں پچھلے Opus ماڈلز کی نسبت بالواسطہ prompt injection کے خلاف بہتر مزاحمت کا دعویٰ بھی ہے۔ دونوں کمپنی کے اپنے ٹیسٹ ہیں، عمومی حفاظتی سرٹیفکیشن نہیں۔

موجودہ API clients کو واضح migration درکار ہے

API صارفین کو claude-opus-5-5 مانگنا ہوگا؛ Opus 5 کی موجودہ کالز خاموشی سے دوسرے ماڈل پر نہیں جاتیں۔ منتقلی کا حوالہ درخواست میں کئی ایسی تبدیلیاں درج کرتا ہے جو نہ کی جائیں تو error آسکتا ہے یا application کا output stream بدل سکتا ہے۔

منتقلی کا پہلو

Opus 5.5 کا رویہ

ماڈل کا انتخاب

واضح طور پر claude-opus-5-5 استعمال کریں۔

Thinking

Adaptive thinking ہمیشہ فعال ہے۔ Disabled thinking اور دستی token budgets پر HTTP 400 آتا ہے۔

Effort

استعمال کریں: low، medium، high، xhigh یا max؛ default medium ہے۔

زبردستی tools

tool_choice اقدار any اور tool پر HTTP 400 آتا ہے؛ auto اور none معاون رہتے ہیں۔

کمپیوٹر کا استعمال

پرانا computer_20251124 tool، Claude API اور Google Cloud پر رد ہوتا ہے؛ Amazon Bedrock پر اب بھی معاون ہے۔

پیش رفت کا متن

tool calls کے درمیان آنے والا متن thinking blocks میں آتا ہے، اس لیے default کے تحت اسے نہ دکھانے والا client calls کے بیچ خاموش دکھائی دے سکتا ہے۔

طویل چلنے والے clients کے لیے محفوظ thinking ایک اضافی حد پیدا کرتی ہے۔ Thinking blocks ماڈل اور گفتگو کے prefix سے منسلک ہوتے ہیں۔ 31 اگست 2026 یا اس کے بعد بنائے گئے API اور cloud-platform اکاؤنٹس پر block دوبارہ چلانے سے پہلے ہدایات، tools یا پیغامات میں تبدیلی کرنے پر default طور پر 400 error آتا ہے۔ Anthropic کی محفوظ thinking کی دستاویز صرف آخر میں مواد جوڑنے والا طریقہ اور غیر مطابقت رکھنے والے block کو ہٹانے کا محدود اختیار سمجھاتی ہے۔

Safety routing جواب دینے والا ماڈل بدل سکتی ہے

یہ prompting گائیڈ biology کے لیے Fable 5.1 سطح کے حفاظتی اقدامات اور cybersecurity و reasoning extraction کے لیے classifiers بیان کرتی ہے۔ source code میں vulnerability تلاش کرنا اب بھی جائز ہے، اور ادارے life-sciences کی توثیق کے لیے درخواست دے سکتے ہیں۔ cyber کی توسیع شدہ توثیق آئندہ چند ہفتوں کے لیے اعلان ہوئی ہے۔

انکار پھر بھی HTTP 200 اور stop_reason: "refusal" کے ساتھ آسکتا ہے۔ fallback کی دستاویز server-side fallback، SDK middleware اور client کے زیرانتظام دوبارہ کوششوں کی وضاحت کرتی ہے۔ Fallback صرف اس وقت ہوتا ہے جب ان معاون راستوں میں سے کوئی ترتیب دیا گیا ہو؛ ہر Opus 5.5 درخواست کے ساتھ خودکار ضمانت نہیں۔ جن زمروں کے لیے تجویز کردہ fallback نہیں، انہیں پھر بھی مسترد کیا جاسکتا ہے۔

اس کا مطلب ہے کہ جواب دینے والا ماڈل بھی نتیجے کا حصہ ہے۔ Opus 5.5 پر منتقل ہونے والی application کو انکار اور fallback سے آنے والے جوابات الگ درج کرنے چاہییں، خاص طور پر جب کام محفوظ شعبوں سے متعلق ہو۔ کم نرخ اور وسیع تر صلاحیت کے دعوے Opus 5.5 پر لاگو ہیں؛ route کی گئی درخواست اصل جواب دینے والے ماڈل کے رویے اور حدود کے تابع ہے۔