أبرز النقاط
- Opus 5 يتصدر اختبارات البرمجة الوكيلية بنسبة 43.3% متفوقاً على Fable 5 وGPT-5.6 Sol
- النموذج يسجل 30.2% على ARC-AGI-3، أي أربعة أضعاف أقرب منافسيه في حل المشكلات غير النمطية
- التسعير يبقى عند 5 دولارات لكل مليون رمز إدخال و25 دولاراً للإخراج، نصف أسعار Fable 5
أطلقت Anthropic نموذجها الجديد Claude Opus 5 الذي يحقق نتائج تنافسية مع Fable 5 في معظم الاختبارات بينما يكلّف نصف سعره بالضبط. هذا التحرك يمثل رداً مباشراً على ضغوط التسعير القادمة من GPT-5.6 Sol والمنافسين الصينيين، ويعيد رسم معادلة الأداء مقابل التكلفة في سوق النماذج اللغوية الكبيرة.
ما الذي يميز Opus 5 عن سابقه وعن المنافسين؟
يحتفظ Opus 5 بنفس هيكل تسعير سلفه Opus 4.8: خمسة دولارات لكل مليون رمز إدخال وخمسة وعشرون دولاراً لكل مليون رمز إخراج. نافذة السياق تبقى عند مليون رمز. لكن الأرقام الخام لا تروي القصة كاملة؛ فقد كان Opus 4.7 يكلف فعلياً ثلاثين إلى أربعين بالمئة أكثر لكل مهمة مقارنة بـ Opus 4.6 رغم تطابق الأسعار الأساسية. Anthropic تقول إن Opus 5 يقدم قيمة أفضل عند كل مستوى جهد.
أضافت الشركة وضعاً سريعاً جديداً يضاعف السرعة بمقدار 2.5 مرة لكنه يضاعف السعر أيضاً. النموذج أصبح الآن الخيار الافتراضي على Claude Max وأقوى نموذج متاح على Claude Pro.
كيف تعمل إعدادات الجهد الخمسة؟
يوفر Opus 5 خمسة مستويات جهد تتيح للمستخدم الموازنة بين الأداء واستهلاك الرموز: low وmedium وhigh وxhigh وmax. في دليل الاستخدام، توصي Anthropic بالاعتماد الواسع على المستويين المنخفض والمتوسط لأنهما يقدمان نتائج جيدة بجزء صغير من الرموز وزمن الاستجابة.
- المستوى المنخفض والمتوسط: مناسبان للمهام الروتينية بتكلفة منخفضة
- المستوى xhigh: الموصى به للبرمجة والمهام الوكيلية
- المستوى max: يسجل أحياناً نتائج أدنى من xhigh رغم التكلفة الأعلى

المفارقة أن Opus 5 يسجل نتائج أسوأ قليلاً عند مستوى الجهد الأقصى مقارنة بالمستوى الثاني على اختبارين: Frontier-Bench v0.1 ومؤشر Artificial Analysis Coding Agent. هذا يعني أن دفع المزيد لا يضمن دائماً نتائج أفضل.
أين يتفوق Opus 5 بوضوح؟
على اختبار Frontier-Bench v0.1 للبرمجة الوكيلية عبر الطرفية، سجل Opus 5 نسبة 43.3 بالمئة متفوقاً بفارق واسع على Fable 5 الذي حقق 33.7 بالمئة، وGPT-5.6 Sol بنسبة 34.4 بالمئة، وسلفه Opus 4.8 الذي توقف عند 21.1 بالمئة.

على اختبار العمل المعرفي GDPval-AA v2، يتصدر Opus 5 بتصنيف Elo يبلغ 1861 نقطة، متقدماً على Fable 5 بـ 1747 نقطة وGPT-5.6 Sol بـ 1736 نقطة. هذا التفوق في مهام العمل المعرفي يجعله خياراً قوياً لفرق المنتجات التي تبني تطبيقات تعتمد على التحليل والتلخيص.
لماذا تعتبر نتيجة ARC-AGI-3 مفاجأة؟
ربما تكون نتيجة ARC-AGI-3 أكبر مفاجأة في إعلان Anthropic. هذا الاختبار يقيس القدرة على حل مشكلات جديدة دون الاعتماد على أنماط محفوظة، وهو ما يُعتبر مؤشراً على التعميم الحقيقي. سجل Opus 5 نسبة 30.2 بالمئة، بينما توقف GPT-5.6 Sol عند 7.8 بالمئة وOpus 4.8 عند 1.5 بالمئة فقط.

هذا الفارق الهائل يثير تساؤلات مشروعة: هل سيترجم هذا التفوق في الاختبار إلى أداء ملموس في الاستخدام الفعلي؟ لا توجد نتيجة لـ Fable 5 على هذا الاختبار، مما يصعّب المقارنة الكاملة.
أين يتخلف Opus 5؟
لا يتصدر Opus 5 كل الاختبارات. على DeepSWE v1.1 للبرمجة الوكيلية، يقود GPT-5.6 Sol بنسبة 72.7 بالمئة، يليه Fable 5 بـ 69.7 بالمئة ثم Opus 5 بـ 68.8 بالمئة. الفارق ضئيل لكنه موجود.
- المهام الصحية: Fable 5 يتفوق على Opus 5
- المهام القانونية: Mythos 5 يتفوق على Opus 5
- الأمن السيبراني: Mythos 5 يتفوق بوضوح في تطوير الاستغلالات

تقول Anthropic إنها تعمدت عدم تدريب Opus 5 على مهام الأمن السيبراني، كما كان الحال مع سلفه. النموذج يقترب من Mythos 5 في اكتشاف الثغرات لكنه يتخلف كثيراً في تطوير الاستغلالات.
ما الجديد في القدرات البصرية وبناء الأدوات؟
تشير Anthropic إلى تحسينات في توليد المخرجات البصرية وتحليل المحتوى المرئي كالرسوم البيانية والمخططات. كذلك يستطيع Opus 5 مراجعة عمله وتحسينه عبر التكرار، وبناء أدواته الخاصة من خلال البرمجة عندما يحتاج إليها.

هذه القدرة على بناء الأدوات ذاتياً تمثل تطوراً مهماً للوكلاء الذكيين الذين يحتاجون إلى التكيف مع مهام غير متوقعة دون تدخل بشري مستمر.
كيف يؤثر هذا على قرارات فرق المنتجات؟
المعادلة واضحة: Opus 5 يقدم أداءً قريباً من Fable 5 بنصف التكلفة في معظم السيناريوهات. لكن الاختيار يعتمد على طبيعة التطبيق. إذا كان المنتج يركز على البرمجة الوكيلية أو العمل المعرفي، فإن Opus 5 خيار منطقي. أما للمهام الصحية أو القانونية أو الأمنية، فقد تستحق النماذج المتخصصة التكلفة الإضافية.
رأي Logicity
تسعير Opus 5 يضع ضغطاً مباشراً على OpenAI وGoogle لإعادة النظر في هياكل التسعير. المنافسة الحقيقية لم تعد على الأداء المطلق بل على القيمة لكل دولار. بالنسبة لفرق المنتجات التي تبني وكلاء ذكيين، البدائل تشمل GPT-5.6 Sol بأداء مقارب على DeepSWE لكن بتكلفة أعلى للإدخال، وGemini 2 Ultra من Google بتسعير تنافسي لكن نتائج أضعف على الاختبارات الوكيلية. Mistral Large 3 يقدم خياراً أرخص للمهام الأبسط. القرار يعتمد على ما إذا كانت ميزانيتك تتحمل ثلاثين إلى أربعين بالمئة فرقاً في التكلفة مقابل تحسينات هامشية في مجالات محددة.
الأسئلة الشائعة
ما الفرق بين Claude Opus 5 وClaude Fable 5؟
Opus 5 يكلف نصف سعر Fable 5 (5 دولارات مقابل 10 دولارات لكل مليون رمز إدخال) ويتفوق عليه في البرمجة الوكيلية والعمل المعرفي، لكن Fable 5 يتفوق في المهام الصحية والقانونية.
هل مستوى الجهد الأعلى يعني دائماً نتائج أفضل؟
لا. على اختبارين على الأقل، سجل Opus 5 نتائج أسوأ عند مستوى max مقارنة بـ xhigh رغم التكلفة الأعلى. Anthropic توصي بالبدء من المستويات المنخفضة والمتوسطة.
كيف يقارن Opus 5 بـ GPT-5.6 Sol في البرمجة؟
على Frontier-Bench يتفوق Opus 5 بنسبة 43.3% مقابل 34.4%، لكن على DeepSWE يتخلف قليلاً بنسبة 68.8% مقابل 72.7% لـ GPT-5.6 Sol.
ما معنى نتيجة ARC-AGI-3 العالية؟
تشير إلى قدرة أفضل على حل مشكلات جديدة لم يرها النموذج من قبل، وهو مؤشر على التعميم. لكن ترجمة هذا التفوق للاستخدام العملي تحتاج إلى تحقق.
هل Opus 5 مناسب لتطبيقات الأمن السيبراني؟
لا. Anthropic تقول إنها تعمدت عدم تدريبه على مهام الأمن السيبراني. Mythos 5 يتفوق عليه بوضوح في تطوير الاستغلالات.
هل تحتاج مساعدة في التطبيق؟
إذا كنت تقيّم الانتقال إلى Opus 5 لتطبيقاتك الوكيلية أو تحتاج استشارة في اختيار النموذج الأنسب لميزانيتك، تواصل مع فريق Logicity للحصول على تحليل مخصص لحالتك.
عمر حسن
كاتب تقني وابتكار
أُنتِج هذا المقال بمساعدة الذكاء الاصطناعي وراجعه فريق التحرير في لوجيسيتي. اعرف المزيد في سياسة التحرير.
مقالات ذات صلة
المزيد في الذكاء الاصطناعي وتعلّم الآلة
لينوفو تطلق ThinkStation P5 Gen 2 بذاكرة 1 تيرابايت ورسوميات Blackwell: محطة عمل للذكاء الاصطناعي الثقيل
بعد أشهر من الانتظار منذ الإعلان الأول في مارس 2025، بدأت لينوفو رسمياً شحن محطة العمل المكتبية ThinkStation P5 Gen 2 إلى الأسواق العالمية. هذا الجهاز ليس تحديثاً تقليدياً؛ بل هو قفزة معمارية تستهدف ا
اقرأ أيضاً

ChatGPT يطلب الوصول إلى سجلاتك الصحية في Apple Health — بعد يوم واحد من دعوى قضائية بسبب نصيحة طبية كادت تقتل مستخدماً
أعلنت شركة OpenAI عن ميزة جديدة تحمل اسم Health in ChatGPT تتيح للمستخدمين ربط بيانات تطبيق Apple Health وسجلاتهم الطبية بروبوت المحادثة الشهير، وذلك بهدف تقديم استجابات أكثر تخصيصاً في المحادثات المت





