أصدرت OpenAI وAnthropic نماذج جديدة في 22 سبتمبر، لكن وتيرة تحديث تشكيلتيهما تختلف. انضم GPT-6 Sol وLuna إلى Astra، بينما لا يزال Terra ضمن GPT-5.6. وانتقل Claude Opus إلى الإصدار 5.5، إلى جانب Fable 5.1 وSonnet 5، في حين مضى نحو عام على Haiku 4.5.

المقارنات الأهم هي Astra مقابل Fable، وSol مقابل Opus، وTerra مقابل Sonnet، وLuna مقابل Haiku. وتكشف مقارنة الفئات الأربع منافسة أكثر إثارة للاهتمام من أي إطلاق منفرد: إذ يتحدى Opus الفئة الرائدة، ويضغط Luna على عرض Anthropic منخفض التكلفة، فيما لا يزال منتصف تشكيلتي الشركتين بلا تحديث.

التغيير الأبرز

  • ما الذي تغيّر: بات بإمكان المشترين الحصول على نماذج أحدث بأسعار متفاوتة بشدة ضمن تشكيلة المزوّد نفسه. وقد حدّثت OpenAI فئتها الاقتصادية، بينما ركزت Anthropic هذا الإصدار على Opus، تاركة Haiku متأخرًا نحو عام في جدول الإصدارات.
  • لماذا يهم: تستطيع فرق المنتجات الآن خفض تكلفة الاستخدام الروتيني للذكاء الاصطناعي، مع دفع المزيد مقابل نتائج أقوى حين تكون كلفة الأخطاء مرتفعة. والتحدي هو الاختيار وفق الأداء المثبت؛ فموقع النموذج ضمن تشكيلة المنتج لا يحدد ترتيب نتائجه المعيارية على نحو موثوق.
  • ما الذي ينبغي مراقبته: تقول Anthropic إن Sonnet 5.5 وHaiku 5.5 سيصلان خلال الأسابيع المقبلة. وستحدد أسعارهما ونتائجهما مقدار ما يبقى من الفرصة الحالية أمام OpenAI، خصوصًا في المنتجات التي تجري أعدادًا كبيرة من الطلبات منخفضة التكلفة.

الأسعار، فئةً فئة

جميع الأرقام أدناه هي أسعار واجهة API المباشرة القياسية بالدولار الأمريكي لكل مليون رمز، وقد جرى التحقق منها في 22 سبتمبر. ويعني الإدخال المخزّن مؤقتًا وجود قراءة ناجحة من الذاكرة المؤقتة. وتسري أسعار OpenAI المدرجة حتى 272,000 رمز إدخال؛ وبعد ذلك يتضاعف سعر إدخال الطلب كاملًا وترتفع أسعار الإخراج 50%. وتخضع كتابة الذاكرة المؤقتة والمعالجة الدفعية والأدوات لشروط فوترة منفصلة. المصادر: OpenAI و Anthropic.

النموذج

الإدخال

الإدخال المخزّن مؤقتًا

الإخراج

GPT-6 Astra

$10

$1

$50

Claude Fable 5.1

$10

$0.25

$50

GPT-6 Sol

$2

$0.20

$10

Claude Opus 5.5

$4

$0.20

$20

GPT-5.6 Terra

$2

$0.20

$12

Claude Sonnet 5

$2

$0.20

$10

GPT-6 Luna

$0.10

$0.01

$0.50

Claude Haiku 4.5

$1

$0.10

$5

الذكاء والإنفاق المقاس على الاختبارات

مؤشر Artificial Analysis للذكاء، الإصدار 4.3.2، وفق بيانات 22 سبتمبر. والتكلفة هي متوسط الإنفاق الموزون للمشغّل لكل مهمة في المؤشر.

النموذج

إعداد الاختبار

مؤشر الذكاء

التكلفة لكل مهمة في المؤشر

GPT-6 Astra

Max

52.7

$3.26

Claude Fable 5.1

Max مع الرجوع إلى نموذج احتياطي

53.4

$7.63

GPT-6 Sol

Max

47.5

غير مدرجة

Claude Opus 5.5

Max مع الرجوع إلى نموذج احتياطي

57.6

$5.98

GPT-5.6 Terra

Max

42.1

$1.40

Claude Sonnet 5

Max

38.2

$5.09

GPT-6 Luna

Max

37.3

غير مدرجة

Claude Haiku 4.5

الاستدلال مفعّل

16.9

$0.21

المصدر: Artificial Analysis؛ وروابط نتائج كل نموذج واردة في المقارنات أدناه.

Astra مقابل Fable: الفئة الرائدة

تتساوى أسعار الإدخال والإخراج القياسية لديهما. أما تكلفة الإدخال المخزّن مؤقتًا لدى Fable فتبلغ ربع نظيرتها لدى Astra، وهو فرق مهم للتطبيقات التي تعيد استخدام محتوى مؤهل من المطالبة باستمرار.

في مؤشر Intelligence Index الحالي من Artificial Analysis، يسجل Astra بإعداد Max 52.7، بينما يسجل Fable 5.1 بإعداد Max مع الرجوع إلى نموذج احتياطي 53.4. والنتيجتان متقاربتان. وتفيد Artificial Analysis بأن متوسط الإنفاق الموزون يبلغ 3.26 دولارات لكل مهمة في المؤشر لـAstra، مقابل 7.63 دولارات لـFable. يحقق Astra نتيجة متقاربة بإنفاق مقاس أقل بنحو 57%، رغم تطابق سعري الإدخال والإخراج بينهما. نتائج Astra، نتائج Fable.

Sol مقابل Opus: أسعار أقل ونتائج أعلى

أسعار الإدخال العادي والإخراج لدى Sol نصف أسعار Opus؛ أما تكلفة الإدخال المخزّن مؤقتًا فتتساوى. كما خفضت OpenAI سعري إدخال Sol وإخراجه إلى النصف مقارنةً بأسعار إطلاق GPT-5.6 Sol. وخفضت Anthropic الأسعار المناظرة لـOpus بنسبة 20% مقارنةً بـOpus 5. إطلاق OpenAI، إطلاق Opus.

يسجل Sol بإعداد Max في مؤشر Artificial Analysis 47.5، مقابل 57.6 لـOpus 5.5 بإعداد Max مع الرجوع إلى نموذج احتياطي. ويتقدم Opus على Sol بـ10.1 نقاط، مع أن سعري الإدخال العادي والإخراج لديه ضعفهما. كما تتجاوز نتيجته Astra وFable مع أسعار إدخال وإخراج أقل بنسبة 60%. لكن إنفاق الاختبار الفعلي يغيّر الصورة: يبلغ متوسط تكلفة Opus 5.98 دولارات لكل مهمة في المؤشر، أي نحو 84% أعلى من Astra. ولم يكن مخطط التكلفة المنشور لدى Artificial Analysis يعرض رقم Sol عند التحقق. نتائج Sol، نتائج Opus.

Terra مقابل Sonnet: نموذج GPT-6 المفقود

لا يوجد GPT-6 Terra في الإطلاق الحالي لـOpenAI أو في قائمة نماذجها. والمقارنة المتاحة هي GPT-5.6 Terra، وتؤكد وثائق API الحالية الأسعار المذكورة أعلاه. كما يذكر دليل OpenAI الخاص بـ Work وCodex أن طرازات 5.6 الأقدم ستظل متاحة أثناء الطرح.

بإعداد Max، يسجل Terra 42.1 في مؤشر Artificial Analysis، فيما يسجل Sonnet 5 38.2. كما يبلغ متوسط تكلفة Terra 1.40 دولار لكل مهمة في المؤشر، مقارنةً بـ 5.09 دولارات لـSonnet: أي نتيجة أعلى مع إنفاق مقاس أقل بنحو 73%. ومع ذلك، فسعر رمز الإخراج لديه أعلى بنسبة 20%، ما يوضح كيف يمكن لاستهلاك الرموز والتخزين المؤقت أن يتجاوزا أثر السعر المعلن. نتائج Terra، نتائج Sonnet.

وصل Sonnet 5 في 30 يونيو. وأعلنت Anthropic الآن أن Sonnet 5.5 سيصل خلال الأسابيع المقبلة. ووعد الشركة بخليفة لا يغيّر المقارنة الحالية مع Sonnet 5 إلى أن يتاح الإصدار الجديد للاختبار وتحديد السعر.

Luna مقابل Haiku: أوسع فجوة في عمر الإصدارات

تبلغ تكلفة Luna عُشر التكلفة في كل فئة رموز مدرجة. وأُطلق Haiku 4.5 في 15 أكتوبر 2025، أي قبل 342 يومًا من Luna. وما يزال أحدث إصدار Haiku متاحًا من Anthropic، فيما وعدت الشركة بإطلاق 5.5 خلال الأسابيع المقبلة.

وتظهر فجوة الأداء أيضًا في الاختبارات المستقلة. إذ يسجل Luna بإعداد Max 37.3، مقارنةً بـ 16.9 لـHaiku 4.5 مع تفعيل الاستدلال. وهذه نقاط على المؤشر نفسه ومجموعة الاختبارات الحالية، إلى جانب انخفاض سعر الرموز لدى Luna بنسبة 90%. ويبلغ متوسط تكلفة الاستدلال لدى Haiku 0.21 دولار لكل مهمة في المؤشر؛ أما التكلفة المناظرة لـLuna فلم تكن مدرجة بعد في المخطط المنشور للمشغّل. نتائج Luna، نتائج استدلال Haiku.

بالنسبة إلى Anthropic، تكشف هذه المقارنة نقطة ضعف في تشكيلتها: فأرخص نماذجها الحالية يواجه منافسًا صدر حديثًا بأسعار رموز أقل ونتيجة أقوى بكثير في ذلك التقييم. لذا يُعد تحديث Haiku المعلن أحد الإصدارات المقبلة الأهم للمطورين الذين يشترون بكميات كبيرة.

تستند الأرقام أعلاه من Artificial Analysis إلى Intelligence Index v4.3.2، وهو تجميع لعشرة تقييمات، وفق بيانات 22 سبتمبر. وتُذكر الإعدادات إلى جانب النتائج؛ وتشمل إدخالات Fable وOpus إعداد المشغّل مع نموذج احتياطي. المؤشر والمنهجية.

ماذا يحدث عندما يتعين على الوكلاء إنجاز العمل؟

يختبر AutomationBench v1.0.6 من Zapier إنجاز العمل من البداية إلى النهاية في تطبيقات أعمال محاكاة. ولا تُحتسب المهمة ناجحة إلا إذا صحت جميع النتائج المقاسة. ويعرض ترتيب 22 سبتمبر:

النموذج

إعداد الاختبار

معدل النجاح

التكلفة لكل مهمة

GPT-6 Astra

Max

41.4%

$1.73

Claude Fable 5.1

Max، منفردًا

22.37%

$2.45

GPT-6 Sol

Xhigh

33.2%

$0.27

GPT-6 Sol

Max

32.0%

$0.34

Claude Opus 5.5

Max

40.0%

$1.28

GPT-5.6 Terra

Max

23.59%

$0.51

Claude Sonnet 5

Max

10.65%

$0.88

GPT-6 Luna

Max

20.7%

$0.04

Claude Haiku 4.5

غير محدد

0.46%

$0.07

يسجل إعداد Fable مع Opus 5 الاحتياطي، بصورة منفصلة، 31.4%. ويتولى Opus نحو 40% من المهام؛ ولا تشمل تكلفة 2.45 دولار المعروضة رموز النموذج الاحتياطي.

ينفق Sol بإعداد Xhigh نحو أقل بنسبة 79% لكل محاولة من Opus بإعداد Max، مقابل معدل نجاح أقل بـ6.8 نقاط مئوية. ويتفوق Luna على Haiku بتكلفة مهمة أقل بنسبة 43%. ويتصدر Astra هذه المجموعة؛ ولا يتجاوز معدل النجاح في أي نموذج النصف. نتائج Zapier ومنهجية التقييم.

جدول الإصدارات مزدحم وغير متوازن

تعرض سجلات إصدارات API لدى الشركتين سلسلتين مختارتين. وتتبع قائمة OpenAI إصدارات GPT المرقّمة حتى GPT-6 Astra، وتستبعد فروع Instant وCodex المتخصصة، وكذلك التوسعات اللاحقة للفئات مثل GPT-5.4 mini وnano في 17 مارس وGPT-6 Sol وLuna في 22 سبتمبر. أما قائمة Anthropic فتتبع إصدارات Opus المتاحة عبر API للعامة. وتمثل «الفجوة» عدد الأيام التقويمية منذ الإدخال السابق في السلسلة المختارة للشركة.

  • عائلة GPT-5 — 7 أغسطس 2025: إطلاق العائلة؛ ولا تُحسب فجوة للإصدار الأول.
  • GPT-5.1 — 13 نوفمبر 2025: تحديث إصدار؛ فجوة 98 يومًا.
  • GPT-5.2 — 11 ديسمبر 2025: تحديث إصدار؛ فجوة 28 يومًا.
  • GPT-5.4 — 5 مارس 2026: تحديث إصدار؛ فجوة 84 يومًا.
  • GPT-5.5 — 24 أبريل 2026: تحديث إصدار؛ فجوة 50 يومًا.
  • GPT-5.6 — 9 يوليو 2026: تحديث للعائلة مع توسيع الفئات؛ فجوة 76 يومًا.
  • GPT-6 Astra — 3 سبتمبر 2026: إطلاق عائلة جديدة؛ فجوة 56 يومًا.

المصدر: سجل تغييرات OpenAI API. وبصورة منفصلة، وصل GPT-6 Sol وLuna في 22 سبتمبر، بعد Astra بـ19 يومًا. وتقيس هذه المدة توسيع فئات العائلة نفسها، ولا تدخل في سلسلة الإصدارات المرقّمة أعلاه.

  • Opus 4 — 22 مايو 2025: إصدار رئيسي؛ ولا تُحسب فجوة للإصدار الأول.
  • Opus 4.1 — 5 أغسطس 2025: تحديث فرعي؛ فجوة 75 يومًا.
  • Opus 4.5 — 24 نوفمبر 2025: تحديث إصدار؛ فجوة 111 يومًا.
  • Opus 4.6 — 5 فبراير 2026: تحديث إصدار؛ فجوة 73 يومًا.
  • Opus 4.7 — 16 أبريل 2026: تحديث إصدار؛ فجوة 70 يومًا.
  • Opus 4.8 — 28 مايو 2026: تحديث إصدار؛ فجوة 42 يومًا.
  • Opus 5 — 24 يوليو 2026: إصدار رئيسي؛ فجوة 57 يومًا.
  • Opus 5.5 — 22 سبتمبر 2026: تحديث إصدار وخفض للسعر؛ فجوة 60 يومًا.

المصدر: ملاحظات إصدارات Anthropic API. تُعد إصدارات Fable وMythos المقيّدة فرعين منفصلين، لذا لا تُدرج في سلسلة Opus.

تتراوح الفجوات بين إصدارات OpenAI المسماة من 28 إلى 98 يومًا، وبين إصدارات Opus لدى Anthropic من 42 إلى 111 يومًا. وإذا عُرّف «الإصدار الرئيسي» بتغيير رقم العائلة، فقد استغرق الانتقال من GPT-5 إلى GPT-6 مدة 392 يومًا، ومن Opus 4 إلى Opus 5 مدة 428 يومًا. أما الفجوات الأقصر فتخص التحديثات الفرعية وتوسعة الفئات. وتتذبذب السلسلتان: إذ تعقب الفترات الأقصر فترات أطول.

الضغط العملي يدفع إلى الترقية الانتقائية

يواصل جدول الإطلاق خلق أسباب لإعادة النظر في اختيار النموذج. وتوضح المقارنات الأربع اليوم لماذا قد يغفل الحكم الموحد على مزوّد كامل فروقًا مهمة: لدى Anthropic إصدار Opus جديد قوي، ولدى OpenAI فئة اقتصادية أصبحت منافسة حديثًا، ولا تزال نماذج أقدم تشغل أجزاء من تشكيلتي الشركتين.

يتطلب تغيير الإصدارات أيضًا عملًا هندسيًا. ويقول دليل الترحيل إلى Opus 5.5 لدى Anthropic إن الاستدلال مفعّل دائمًا، وإن فرض اختيار أداة يعيد خطأ، وإن نوع أداة استخدام الحاسوب السابق مرفوض في Claude API وGoogle Cloud. لذلك تحتاج عمليات التكامل الحالية التي تستخدم تلك الخيارات إلى تعديلات.

التطور المقبل المعلن هو تحديث Sonnet وHaiku من Anthropic. وهذا يمنح المشترين سببًا ملموسًا لإعادة تقييم الفئات الأدنى قريبًا. أما الآن، فتكشف قوائم الأسعار والنتائج المستقلة بالفعل أين تحولت المنافسة وأين لا يزال من المجدي النظر في نموذج أقدم.