OpenAI اور Anthropic نے 22 ستمبر کو نئے ماڈل جاری کیے، لیکن ان کے ماڈل سلسلے مختلف رفتار سے آگے بڑھ رہے ہیں۔ GPT-6 Sol اور Luna، Astra کے ساتھ شامل ہیں، جبکہ Terra اب بھی GPT-5.6 پر ہے۔ Claude Opus اب 5.5 تک پہنچا ہے، ساتھ Fable 5.1، Sonnet 5 اور تقریباً ایک سال پرانا Haiku 4.5 موجود ہیں۔

اہم موازنے Astra بمقابلہ Fable، Sol بمقابلہ Opus، Terra بمقابلہ Sonnet، اور Luna بمقابلہ Haiku ہیں۔ چاروں کو ایک ساتھ دیکھنے سے کسی ایک لانچ سے زیادہ دلچسپ مقابلہ سامنے آتا ہے: Opus فلیگ شپ tier کو چیلنج کررہا ہے، Luna Anthropic کی کم قیمت پیش کش پر دباؤ ڈال رہا ہے، اور دونوں سلسلوں کے درمیانی حصے ابھی تازہ نہیں ہوئے۔

بڑی تبدیلی

  • کیا بدلا: خریدار اب ایک ہی فراہم کنندہ کے سلسلے میں نمایاں طور پر مختلف قیمتوں پر نئے ماڈل حاصل کرسکتے ہیں۔ OpenAI نے اپنا کم قیمت tier تازہ کیا ہے جبکہ Anthropic نے اس اجرا میں توجہ Opus پر رکھی، اور Haiku اجرا کے تقویم میں تقریباً ایک سال پیچھے ہے۔
  • یہ کیوں اہم ہے: مصنوعات کی ٹیمیں معمول کے AI استعمال کی لاگت کم کرنے کے لیے زیادہ انتخاب رکھتی ہیں، اور جہاں غلطی مہنگی ہو وہاں بہتر نتائج کے لیے خرچ کرسکتی ہیں۔ مشکل کام ثابت شدہ کارکردگی کے مطابق انتخاب ہے: مصنوعات کے سلسلے میں ماڈل کا مقام اس کے بینچ مارک نتائج کی قابلِاعتماد درجہ بندی نہیں بتاتا۔
  • کس بات پر نظر رکھیں: Anthropic کہتا ہے کہ Sonnet 5.5 اور Haiku 5.5 آئندہ چند ہفتوں میں آئیں گے۔ ان کی قیمتیں اور نتائج طے کریں گے کہ آج OpenAI کے لیے پیدا ہونے والی گنجائش کتنی برقرار رہتی ہے، خاص طور پر ان مصنوعات میں جو بہت بڑی تعداد میں کم لاگت کی درخواستیں بھیجتی ہیں۔

ہر tier کی قیمتیں

نیچے کے تمام اعداد 22 ستمبر کو جانچے گئے براہ راست API کے معیاری امریکی ڈالر فی دس لاکھ ٹوکن نرخ ہیں۔ Cached input سے مراد cache hit ہے۔ OpenAI کے درج کردہ نرخ 272,000 input tokens تک لاگو ہیں؛ اس سے اوپر پوری درخواست کے input نرخ دوگنے اور output نرخ 50% بڑھ جاتے ہیں۔ Cache writes، batch پراسیسنگ اور tools کی بلنگ الگ شرائط کے تابع ہے۔ ماخذ: OpenAI اور Anthropic.

ماڈل

اِن پٹ

کیش شدہ اِن پٹ

آؤٹ پٹ

GPT-6 Astra

$10

$1

$50

Claude Fable 5.1

$10

$0.25

$50

GPT-6 Sol

$2

$0.20

$10

Claude Opus 5.5

$4

$0.20

$20

GPT-5.6 Terra

$2

$0.20

$12

Claude Sonnet 5

$2

$0.20

$10

GPT-6 Luna

$0.10

$0.01

$0.50

Claude Haiku 4.5

$1

$0.10

$5

انٹیلیجنس اور ناپے گئے ٹیسٹ کا خرچ

Artificial Analysis Intelligence Index v4.3.2، 22 ستمبر کو جانچا گیا۔ لاگت ہر index task پر آپریٹر کا وزنی اوسط خرچ ہے۔

ماڈل

آزمودہ ترتیب

انٹیلیجنس انڈیکس

فی انڈیکس کام لاگت

GPT-6 Astra

Max

52.7

$3.26

Claude Fable 5.1

Max، fallback کے ساتھ

53.4

$7.63

GPT-6 Sol

Max

47.5

درج نہیں

Claude Opus 5.5

Max، fallback کے ساتھ

57.6

$5.98

GPT-5.6 Terra

Max

42.1

$1.40

Claude Sonnet 5

Max

38.2

$5.09

GPT-6 Luna

Max

37.3

درج نہیں

Claude Haiku 4.5

reasoning فعال

16.9

$0.21

ماخذ: Artificial Analysis؛ انفرادی ماڈل کے نتائج نیچے موازنے میں منسلک ہیں۔

Astra بمقابلہ Fable: فلیگ شپ جوڑی

ان کے معیاری input اور output نرخ برابر ہیں۔ Fable کی cache-hit شرح Astra کی ایک چوتھائی ہے؛ جب ایپلیکیشنز اہل prompt مواد بار بار استعمال کرتی ہیں تو یہ فرق اہم ہوتا ہے۔

Artificial Analysis کے موجودہ Intelligence Index میں max پر Astra کا اسکور 52.7 اور max with fallback پر Fable 5.1 کا اسکور 53.4 ہے۔ یہ قریب قریب نتیجہ ہے۔ Artificial Analysis کے مطابق index کے ہر کام پر Astra کا وزنی خرچ Astra کے لیے $3.26 فی انڈیکس کام ہے، جبکہ Fable کے لیے $7.63 ہے۔ input/output نرخ برابر ہونے کے باوجود Astra تقریباً 57% کم ناپے گئے خرچ پر قریب تر اسکور دیتا ہے۔ Astra کے نتائج، Fable کے نتائج.

Sol بمقابلہ Opus: کم قیمت کے ساتھ زیادہ اسکور

Sol کے عام input اور output نرخ Opus کے نصف ہیں؛ ان کے cache-hit نرخ برابر ہیں۔ OpenAI نے GPT-5.6 Sol کے اجرا کے نرخوں کے مقابلے میں Sol کے input اور output نرخ بھی نصف کردیے۔ Anthropic نے Opus 5 کے مقابلے میں Opus کے متعلقہ نرخ 20% کم کیے۔ OpenAI کا اجرا، Opus کا اجرا.

Artificial Analysis کے مطابق max پر Sol کا اسکور 47.5، جبکہ 57.6 ہے؛ max with fallback پر Opus 5.5 اس سے 10.1 پوائنٹ آگے ہے، جبکہ عام input اور output کے لیے دوگنا نرخ لیتا ہے۔ یہ کم نرخوں کے باوجود Astra اور Fable سے بھی زیادہ اسکور کرتا ہے، جہاں input/output کی قیمت 60% کم ہے۔ عملی ٹیسٹ کا خرچ یہ تصویر بدلتا ہے: Opus کا اوسط $5.98 فی انڈیکس کام ہے، جو Astra سے تقریباً 84% زیادہ ہے۔ جانچ کے وقت Artificial Analysis کے شائع شدہ لاگت چارٹ میں Sol کا عدد موجود نہیں تھا۔ Sol کے نتائج، Opus کے نتائج.

Terra بمقابلہ Sonnet: غائب GPT-6 ماڈل

OpenAI کے موجودہ لانچ یا ماڈل کیٹلاگ میں GPT-6 Terra موجود نہیں۔ دستیاب موازنہ GPT-5.6 Terra ہے، جس کی موجودہ API دستاویزات اوپر کے نرخوں کی تصدیق کرتی ہیں۔ OpenAI کی Work اور Codex رہنما یہ بھی کہتی ہے کہ اجرا کے دوران پرانے 5.6 ماڈل دستیاب رہیں گے۔

max effort پر Terra کا Artificial Analysis انڈیکس اسکور 42.1 ہے، جبکہ Sonnet 5 کا اسکور 38.2 ہے۔ Terra کا فی انڈیکس کام اوسط خرچ بھی $1.40 فی انڈیکس کام ہے، جبکہ Sonnet کے لیے $5.09 ہے: تقریباً 73% کم ناپے گئے خرچ پر زیادہ اسکور۔ اس کا output-token نرخ 20% زیادہ ہے، جو دکھاتا ہے کہ ٹوکن کا استعمال اور caching کس طرح فہرستی قیمت سے زیادہ اثر انداز ہوسکتے ہیں۔ Terra کے نتائج، Sonnet کے نتائج.

Sonnet 5، 30 جون کو آیا تھا۔ Anthropic نے اب آئندہ چند ہفتوں میں Sonnet 5.5 لانے کا اعلان کیا ہے۔ وعدہ شدہ جانشین، آج کے Sonnet 5 کے موازنے کو اس وقت تک برقرار رکھتا ہے جب تک نئے ورژن کو آزمانے اور اس کی قیمت معلوم کرنے کا موقع نہ ہو۔

Luna بمقابلہ Haiku: اجرا کی عمر میں سب سے بڑا فرق

Luna ہر درج شدہ ٹوکن قسم میں دسواں حصہ خرچ کرتا ہے۔ Haiku 4.5، 15 اکتوبر 2025 کو جاری ہوا: Luna سے 342 دن پہلے۔ یہ اب بھی Anthropic کا تازہ ترین جاری شدہ Haiku ہے؛ 5.5 آئندہ چند ہفتوں میں آنے کا وعدہ کیا گیا ہے۔

آزادانہ جانچ میں بھی کارکردگی کا فرق دکھائی دیتا ہے۔ Artificial Analysis کے مطابق max پر Luna کا اسکور 37.3 ہے، جبکہ 16.9، reasoning فعال ہونے پر Haiku 4.5 کا اسکور ہے۔ یہ ایک ہی موجودہ مجموعے کے index points ہیں؛ Luna کی ٹوکن قیمت 90% کم ہے۔ Haiku reasoning کا اوسط خرچ $0.21 فی انڈیکس کام ہے؛ آپریٹر کے شائع شدہ چارٹ میں Luna کی متعلقہ لاگت تاحال درج نہیں تھی۔ Luna کے نتائج، Haiku reasoning کے نتائج.

Anthropic کے لیے مقابلے کا نمایاں کم قیمت حصہ سامنے آگیا ہے: اس کا موجودہ سب سے سستا ماڈل ایسے نئے حریف سے مقابلہ کررہا ہے جس کے ٹوکن نرخ بھی کم ہیں اور اس جانچ کا نتیجہ بھی کہیں بہتر ہے۔ اس لیے اعلان کردہ Haiku اپ ڈیٹ اُن اگلی اہم ریلیزوں میں شامل ہے جن کا بڑی تعداد میں ماڈل خریدنے والے ڈویلپر انتظار کریں گے۔

اوپر کے Artificial Analysis اعداد Intelligence Index v4.3.2 استعمال کرتے ہیں، جو دس جائزوں کا مجموعہ ہے اور 22 ستمبر کو جانچا گیا۔ اسکور کے ساتھ settings درج ہیں؛ Fable اور Opus کے نتائج میں آپریٹر کی fallback ترتیب شامل ہے۔ انڈیکس اور طریقۂ کار.

جب ایجنٹس کو کام مکمل کرنا ہو تو کیا ہوتا ہے؟

Zapier کا AutomationBench v1.0.6 فرضی کاروباری ایپلیکیشنز میں کام کو شروع سے آخر تک جانچتا ہے۔ کامیابی کے لیے اسکور کیے گئے تمام نتائج درست ہونا ضروری ہے۔ 22 ستمبر کی لیڈر بورڈ فہرست میں درج ہے:

ماڈل

آزمودہ ترتیب

کامیابی کی شرح

فی کام لاگت

GPT-6 Astra

Max

41.4%

$1.73

Claude Fable 5.1

Max، اکیلا

22.37%

$2.45

GPT-6 Sol

Xhigh

33.2%

$0.27

GPT-6 Sol

Max

32.0%

$0.34

Claude Opus 5.5

Max

40.0%

$1.28

GPT-5.6 Terra

Max

23.59%

$0.51

Claude Sonnet 5

Max

10.65%

$0.88

GPT-6 Luna

Max

20.7%

$0.04

Claude Haiku 4.5

واضح نہیں

0.46%

$0.07

Fable-plus-Opus-5 کی الگ ترتیب کا اسکور 31.4% ہے۔ Opus اس کے تقریباً 40% کام کرتا ہے؛ دکھائی گئی $2.45 لاگت میں ان fallback ٹوکنز کا خرچ شامل نہیں۔

xhigh پر Sol ہر کوشش میں تقریباً 79% کم خرچ کرتا ہے، جبکہ max پر Opus کے مقابلے کامیابی کی شرح 6.8 percentage points کم ہے۔ Luna، Haiku کو 43% کم فی کام لاگت پر پیچھے چھوڑتا ہے۔ Astra اس گروپ میں آگے ہے؛ کسی ماڈل کی کامیابی کی شرح نصف سے زیادہ نہیں۔ Zapier کے نتائج اور اسکور کرنے کا طریقہ.

اجرا کا تقویم مصروف اور غیر ہموار ہے

کمپنیوں کے API اجرا کے ریکارڈ دو منتخب سلسلے فراہم کرتے ہیں۔ OpenAI کی فہرست GPT-6 Astra تک نمبر والی GPT نسلوں کی پیروی کرتی ہے۔ اس میں مخصوص Instant اور Codex شاخیں، اور بعد کی tier توسیعات—جیسے 17 مارچ کو GPT-5.4 mini اور nano، اور 22 ستمبر کو GPT-6 Sol اور Luna—شامل نہیں۔ Anthropic کی فہرست عوامی Opus API ورژنز کی پیروی کرتی ہے۔ “وقفہ” ہر کمپنی کے منتخب سلسلے میں پچھلی اندراج کے بعد گزرے تقویمی دن ہیں۔

  • GPT-5 خاندان — 7 اگست 2025: خاندان کا اجرا؛ پہلی اندراج کے لیے وقفہ لاگو نہیں۔
  • GPT-5.1 — 13 نومبر 2025: ورژن کی تازہ کاری؛ 98 دن کا وقفہ۔
  • GPT-5.2 — 11 دسمبر 2025: ورژن کی تازہ کاری؛ 28 دن کا وقفہ۔
  • GPT-5.4 — 5 مارچ 2026: ورژن کی تازہ کاری؛ 84 دن کا وقفہ۔
  • GPT-5.5 — 24 اپریل 2026: ورژن کی تازہ کاری؛ 50 دن کا وقفہ۔
  • GPT-5.6 — 9 جولائی 2026: tiers کے ساتھ خاندان کی تازہ کاری؛ 76 دن کا وقفہ۔
  • GPT-6 Astra — 3 ستمبر 2026: نئے خاندان کا اجرا؛ 56 دن کا وقفہ۔

ماخذ: OpenAI API changelog۔ الگ طور پر، GPT-6 Sol اور Luna، Astra کے 19 دن بعد 22 ستمبر کو آئے۔ یہ وقفہ ایک ہی خاندان کے tiers کی توسیع ناپتا ہے، اوپر کے نمبر وار ورژن سلسلے کا حصہ نہیں۔

  • Opus 4 — 22 مئی 2025: بڑا ورژن؛ پہلی اندراج کے لیے وقفہ لاگو نہیں۔
  • Opus 4.1 — 5 اگست 2025: اعشاریہ ورژن کی تازہ کاری؛ 75 دن کا وقفہ۔
  • Opus 4.5 — 24 نومبر 2025: ورژن کی تازہ کاری؛ 111 دن کا وقفہ۔
  • Opus 4.6 — 5 فروری 2026: ورژن کی تازہ کاری؛ 73 دن کا وقفہ۔
  • Opus 4.7 — 16 اپریل 2026: ورژن کی تازہ کاری؛ 70 دن کا وقفہ۔
  • Opus 4.8 — 28 مئی 2026: ورژن کی تازہ کاری؛ 42 دن کا وقفہ۔
  • Opus 5 — 24 جولائی 2026: بڑا ورژن؛ 57 دن کا وقفہ۔
  • Opus 5.5 — 22 ستمبر 2026: ورژن کی تازہ کاری اور قیمت میں کمی؛ 60 دن کا وقفہ۔

ماخذ: Anthropic API release notes۔ Fable اور محدود Mythos اجرا الگ شاخیں ہیں، اس لیے انہیں Opus کے سلسلے میں شامل نہیں کیا گیا۔

OpenAI کے نمبر والے ورژنوں کے وقفے 28 سے 98 دن تک بدلتے ہیں؛ Anthropic کے Opus وقفے 42 سے 111 دن تک ہیں۔ اگر “بڑی ریلیز” سے مراد خاندان کے نمبر کی تبدیلی ہو، تو GPT-5 سے GPT-6 تک 392 دن اور Opus 4 سے Opus 5 تک 428 دن لگے۔ چھوٹے وقفے اعشاریہ updates اور tiers کی توسیع کے ہیں۔ دونوں سلسلوں میں اتار چڑھاؤ ہے: کم وقفوں کے بعد طویل وقفے آتے ہیں۔

عملی دباؤ یہ ہے کہ سوچ سمجھ کر اپ گریڈ کریں

نئے ماڈلز کا تقویم ماڈل کے انتخاب پر دوبارہ غور کی وجوہ پیدا کرتا رہتا ہے۔ آج کی چار جوڑیاں دکھاتی ہیں کہ ایک ہی فراہم کنندہ پر مجموعی فیصلہ کیوں مفید فرق چھپا دے گا: Anthropic کے پاس مضبوط نیا Opus ہے، OpenAI نے کم قیمت tier میں مقابلہ تیز کیا ہے، اور دونوں کمپنیوں کے کچھ tiers میں ابھی پرانے ماڈل موجود ہیں۔

ورژن بدلنے کے لیے انجینئرنگ کا کام بھی درکار ہوتا ہے۔ Anthropic کی Opus 5.5 منتقلی کی رہنما کہتی ہے کہ thinking ہمیشہ فعال ہے، زبردستی tool منتخب کرنے پر error آتا ہے، اور پرانی computer-use tool قسم Claude API اور Google Cloud پر رد کردی جاتی ہے۔ ان اختیارات کو استعمال کرنے والے موجودہ integrations کو تبدیل کرنا ہوگا۔

اگلی اعلان کردہ پیش رفت Anthropic کی Sonnet اور Haiku تازہ کاری ہے۔ اس سے جلد ہی کم قیمت tiers کا دوبارہ جائزہ لینے کی ٹھوس وجہ ملتی ہے۔ فی الحال قیمتوں کی فہرست اور آزاد نتائج دکھاتے ہیں کہ مقابلہ کہاں منتقل ہوا، اور کن جگہوں پر پرانا ماڈل اب بھی قابلِغور ہے۔