كل المقالات

Opus 5 من Anthropic يتفوق على Fable 5 في البرمجة بنصف التكلفة

عمر حسن25 يوليو 2026 في 1:37 ص6 دقيقة للقراءة
Opus 5 من Anthropic يتفوق على Fable 5 في البرمجة بنصف التكلفة

أبرز النقاط

  • Opus 5 يتصدر اختبارات البرمجة الوكيلية بنسبة 43.3% متفوقاً على Fable 5 وGPT-5.6 Sol
  • النموذج يسجل 30.2% على ARC-AGI-3، أي أربعة أضعاف أقرب منافسيه في حل المشكلات غير النمطية
  • التسعير يبقى عند 5 دولارات لكل مليون رمز إدخال و25 دولاراً للإخراج، نصف أسعار Fable 5

أطلقت Anthropic نموذجها الجديد Claude Opus 5 الذي يحقق نتائج تنافسية مع Fable 5 في معظم الاختبارات بينما يكلّف نصف سعره بالضبط. هذا التحرك يمثل رداً مباشراً على ضغوط التسعير القادمة من GPT-5.6 Sol والمنافسين الصينيين، ويعيد رسم معادلة الأداء مقابل التكلفة في سوق النماذج اللغوية الكبيرة.

Advertisements

ما الذي يميز Opus 5 عن سابقه وعن المنافسين؟

يحتفظ Opus 5 بنفس هيكل تسعير سلفه Opus 4.8: خمسة دولارات لكل مليون رمز إدخال وخمسة وعشرون دولاراً لكل مليون رمز إخراج. نافذة السياق تبقى عند مليون رمز. لكن الأرقام الخام لا تروي القصة كاملة؛ فقد كان Opus 4.7 يكلف فعلياً ثلاثين إلى أربعين بالمئة أكثر لكل مهمة مقارنة بـ Opus 4.6 رغم تطابق الأسعار الأساسية. Anthropic تقول إن Opus 5 يقدم قيمة أفضل عند كل مستوى جهد.

5 دولارات / مليون رمز
سعر الإدخال لـ Opus 5 مقابل 10 دولارات لـ Fable 5

أضافت الشركة وضعاً سريعاً جديداً يضاعف السرعة بمقدار 2.5 مرة لكنه يضاعف السعر أيضاً. النموذج أصبح الآن الخيار الافتراضي على Claude Max وأقوى نموذج متاح على Claude Pro.

كيف تعمل إعدادات الجهد الخمسة؟

يوفر Opus 5 خمسة مستويات جهد تتيح للمستخدم الموازنة بين الأداء واستهلاك الرموز: low وmedium وhigh وxhigh وmax. في دليل الاستخدام، توصي Anthropic بالاعتماد الواسع على المستويين المنخفض والمتوسط لأنهما يقدمان نتائج جيدة بجزء صغير من الرموز وزمن الاستجابة.

  • المستوى المنخفض والمتوسط: مناسبان للمهام الروتينية بتكلفة منخفضة
  • المستوى xhigh: الموصى به للبرمجة والمهام الوكيلية
  • المستوى max: يسجل أحياناً نتائج أدنى من xhigh رغم التكلفة الأعلى
رسم بياني يوضح أداء Opus 5 على مؤشر Artificial Analysis Coding Agent مقارنة بالمنافسين
رسم بياني يوضح أداء Opus 5 على مؤشر Artificial Analysis Coding Agent مقارنة بالمنافسين

المفارقة أن Opus 5 يسجل نتائج أسوأ قليلاً عند مستوى الجهد الأقصى مقارنة بالمستوى الثاني على اختبارين: Frontier-Bench v0.1 ومؤشر Artificial Analysis Coding Agent. هذا يعني أن دفع المزيد لا يضمن دائماً نتائج أفضل.

أين يتفوق Opus 5 بوضوح؟

على اختبار Frontier-Bench v0.1 للبرمجة الوكيلية عبر الطرفية، سجل Opus 5 نسبة 43.3 بالمئة متفوقاً بفارق واسع على Fable 5 الذي حقق 33.7 بالمئة، وGPT-5.6 Sol بنسبة 34.4 بالمئة، وسلفه Opus 4.8 الذي توقف عند 21.1 بالمئة.

43.3%
نتيجة Opus 5 على Frontier-Bench v0.1 للبرمجة الوكيلية
مقارنة نتائج Opus 5 مع المنافسين على اختبار Frontier-Bench v0.1
مقارنة نتائج Opus 5 مع المنافسين على اختبار Frontier-Bench v0.1

على اختبار العمل المعرفي GDPval-AA v2، يتصدر Opus 5 بتصنيف Elo يبلغ 1861 نقطة، متقدماً على Fable 5 بـ 1747 نقطة وGPT-5.6 Sol بـ 1736 نقطة. هذا التفوق في مهام العمل المعرفي يجعله خياراً قوياً لفرق المنتجات التي تبني تطبيقات تعتمد على التحليل والتلخيص.

لماذا تعتبر نتيجة ARC-AGI-3 مفاجأة؟

ربما تكون نتيجة ARC-AGI-3 أكبر مفاجأة في إعلان Anthropic. هذا الاختبار يقيس القدرة على حل مشكلات جديدة دون الاعتماد على أنماط محفوظة، وهو ما يُعتبر مؤشراً على التعميم الحقيقي. سجل Opus 5 نسبة 30.2 بالمئة، بينما توقف GPT-5.6 Sol عند 7.8 بالمئة وOpus 4.8 عند 1.5 بالمئة فقط.

رسم بياني يوضح نتائج ARC-AGI-3 حسب التكلفة الإجمالية للتقييم
رسم بياني يوضح نتائج ARC-AGI-3 حسب التكلفة الإجمالية للتقييم
4 أضعاف
تفوق Opus 5 على أقرب منافسيه في ARC-AGI-3

هذا الفارق الهائل يثير تساؤلات مشروعة: هل سيترجم هذا التفوق في الاختبار إلى أداء ملموس في الاستخدام الفعلي؟ لا توجد نتيجة لـ Fable 5 على هذا الاختبار، مما يصعّب المقارنة الكاملة.

Advertisements

أين يتخلف Opus 5؟

لا يتصدر Opus 5 كل الاختبارات. على DeepSWE v1.1 للبرمجة الوكيلية، يقود GPT-5.6 Sol بنسبة 72.7 بالمئة، يليه Fable 5 بـ 69.7 بالمئة ثم Opus 5 بـ 68.8 بالمئة. الفارق ضئيل لكنه موجود.

  • المهام الصحية: Fable 5 يتفوق على Opus 5
  • المهام القانونية: Mythos 5 يتفوق على Opus 5
  • الأمن السيبراني: Mythos 5 يتفوق بوضوح في تطوير الاستغلالات
مقارنة أداء Opus 5 وMythos 5 في مهام الأمن السيبراني واكتشاف الثغرات
مقارنة أداء Opus 5 وMythos 5 في مهام الأمن السيبراني واكتشاف الثغرات

تقول Anthropic إنها تعمدت عدم تدريب Opus 5 على مهام الأمن السيبراني، كما كان الحال مع سلفه. النموذج يقترب من Mythos 5 في اكتشاف الثغرات لكنه يتخلف كثيراً في تطوير الاستغلالات.

ما الجديد في القدرات البصرية وبناء الأدوات؟

تشير Anthropic إلى تحسينات في توليد المخرجات البصرية وتحليل المحتوى المرئي كالرسوم البيانية والمخططات. كذلك يستطيع Opus 5 مراجعة عمله وتحسينه عبر التكرار، وبناء أدواته الخاصة من خلال البرمجة عندما يحتاج إليها.

رسم توضيحي لقدرات Opus 5 في بناء الأدوات الذاتية والتحسين التكراري
رسم توضيحي لقدرات Opus 5 في بناء الأدوات الذاتية والتحسين التكراري

هذه القدرة على بناء الأدوات ذاتياً تمثل تطوراً مهماً للوكلاء الذكيين الذين يحتاجون إلى التكيف مع مهام غير متوقعة دون تدخل بشري مستمر.

كيف يؤثر هذا على قرارات فرق المنتجات؟

المعادلة واضحة: Opus 5 يقدم أداءً قريباً من Fable 5 بنصف التكلفة في معظم السيناريوهات. لكن الاختيار يعتمد على طبيعة التطبيق. إذا كان المنتج يركز على البرمجة الوكيلية أو العمل المعرفي، فإن Opus 5 خيار منطقي. أما للمهام الصحية أو القانونية أو الأمنية، فقد تستحق النماذج المتخصصة التكلفة الإضافية.

ℹ️

رأي Logicity

تسعير Opus 5 يضع ضغطاً مباشراً على OpenAI وGoogle لإعادة النظر في هياكل التسعير. المنافسة الحقيقية لم تعد على الأداء المطلق بل على القيمة لكل دولار. بالنسبة لفرق المنتجات التي تبني وكلاء ذكيين، البدائل تشمل GPT-5.6 Sol بأداء مقارب على DeepSWE لكن بتكلفة أعلى للإدخال، وGemini 2 Ultra من Google بتسعير تنافسي لكن نتائج أضعف على الاختبارات الوكيلية. Mistral Large 3 يقدم خياراً أرخص للمهام الأبسط. القرار يعتمد على ما إذا كانت ميزانيتك تتحمل ثلاثين إلى أربعين بالمئة فرقاً في التكلفة مقابل تحسينات هامشية في مجالات محددة.

الأسئلة الشائعة

ما الفرق بين Claude Opus 5 وClaude Fable 5؟

Opus 5 يكلف نصف سعر Fable 5 (5 دولارات مقابل 10 دولارات لكل مليون رمز إدخال) ويتفوق عليه في البرمجة الوكيلية والعمل المعرفي، لكن Fable 5 يتفوق في المهام الصحية والقانونية.

هل مستوى الجهد الأعلى يعني دائماً نتائج أفضل؟

لا. على اختبارين على الأقل، سجل Opus 5 نتائج أسوأ عند مستوى max مقارنة بـ xhigh رغم التكلفة الأعلى. Anthropic توصي بالبدء من المستويات المنخفضة والمتوسطة.

كيف يقارن Opus 5 بـ GPT-5.6 Sol في البرمجة؟

على Frontier-Bench يتفوق Opus 5 بنسبة 43.3% مقابل 34.4%، لكن على DeepSWE يتخلف قليلاً بنسبة 68.8% مقابل 72.7% لـ GPT-5.6 Sol.

ما معنى نتيجة ARC-AGI-3 العالية؟

تشير إلى قدرة أفضل على حل مشكلات جديدة لم يرها النموذج من قبل، وهو مؤشر على التعميم. لكن ترجمة هذا التفوق للاستخدام العملي تحتاج إلى تحقق.

هل Opus 5 مناسب لتطبيقات الأمن السيبراني؟

لا. Anthropic تقول إنها تعمدت عدم تدريبه على مهام الأمن السيبراني. Mythos 5 يتفوق عليه بوضوح في تطوير الاستغلالات.

ℹ️

هل تحتاج مساعدة في التطبيق؟

إذا كنت تقيّم الانتقال إلى Opus 5 لتطبيقاتك الوكيلية أو تحتاج استشارة في اختيار النموذج الأنسب لميزانيتك، تواصل مع فريق Logicity للحصول على تحليل مخصص لحالتك.

ع

عمر حسن

كاتب تقني وابتكار

أُنتِج هذا المقال بمساعدة الذكاء الاصطناعي وراجعه فريق التحرير في لوجيسيتي. اعرف المزيد في سياسة التحرير.

اقرأ أيضاً