أُطلق كلود أوبس 5 في 24 يوليو 2026، وخلال 48 ساعة صارت حقيقتان صحيحتَين في آنٍ واحد: النموذج استحوذ على المرتبة الأولى في كل لوحات الصدارة الكبرى، وفي الوقت ذاته كان المطوّرون يتذمّرون منه علناً. قالت قائدة المنتجات كلير فو ببساطة: "وصل أوبس 5... وأكره العمل معه."
هذا التوتر يستحق التفكيك بعناية. فإن رفضت النموذج بناءً على الشكاوى، ستفوّت أداءً في مستوى الحدود الأمامية بنصف تكلفة فابل 5. وإن أمسكت به دون أن تفهم طباعه، ستُضيع التوكنات والطاقة بالتساوي.
حقيقة المعايير
لنبدأ بما هو صحيح فعلاً في الأرقام.
Frontier-Bench v0.1 — معيار البرمجة الوكيلية الطرفية لـ Anthropic — سجّل أوبس 5 فيه 43.3%، متقدماً بنحو 10 نقاط على فابل 5 (33.7%) وأكثر من ضعف أوبس 4.8 (21.1%). في المهام التي تهم أكثر لوكلاء البرمجة المستقلة، لا يكون أوبس 5 أفضل من فابل فحسب — بل هو في لعبة مختلفة تماماً.
ARC-AGI-3 — معيار الاستدلال الجديد الأكثر موثوقية — سجّل أوبس 5 30.2%، مُتحقَّقاً منها بصورة مستقلة من قِبَل مؤسسة ARC Prize. ما يلفت ليس الرقم وحده: لاحظت المؤسسة أن أوبس 5 "استخدم استدلالاً منطقياً متقدماً لتحويل تخطيطات ARC-AGI-3 إلى ترميز جبري"، مطوّراً تمثيله الرياضي الخاص بدلاً من مطابقة الأنماط. هذا استدلال نوعي مختلف.
IMO 2026 — حقق أوبس 5 أداء الميدالية الذهبية (42/42 نقطة) في مسائل الأولمبياد الدولي للرياضيات.
التحقق المستقل من Artificial Analysis يتفق على ذلك: يحتل أوبس 5 المرتبة الأولى في مؤشر الذكاء ومؤشر الوكلاء (61 مقابل 60 لفابل 5)، والمرتبة الثانية في مؤشر البرمجة بفارق 0.3 نقطة فقط عن GPT-5.6 Sol.
الاختبارات الواقعية تؤكد ذلك. في بناء لعبة سباق F1 ثلاثية الأبعاد من ملف HTML واحد، قدّم أوبس 5 نتيجة مصقولة وقابلة للتشغيل مع بعض مشكلات الفيزياء الطفيفة. فابل 5 جاء متيناً لكن أبسط. GPT-5.6 Sol وKimi K3 أنتجا نسخاً غير قابلة للعب بسبب غياب هندسة المضمار.
لماذا يُحبط المطوّرين إذن؟
الشكاوى ليست عن الذكاء. إنها عن الشخصية.
يتوقف عند التناقضات. أعطِ أوبس 5 تعليمات تتجه في اتجاهات مختلفة — حتى قليلاً — وسيتوقف أو يطلب التوضيح بدلاً من اتخاذ قرار معقول. فابل 5 سيختار مساراً ويشرح منطقه. أوبس 5 يعامل الغموض كشرط للتوقف.
يتصرف من تلقاء نفسه دون طلب. النموذج يُطوّل، يضيف تحفظات، يُعيد هيكلة أشياء أردت إبقاءها كما هي. فرق المنتجات التي تبني سير عمل محكمة تُبلّغ عن قيام النموذج بـ"عمل إضافي" يكسر الخطوات اللاحقة.
"كلود سلوب" (Claudeslop). ابتكرت فو هذا المصطلح لأنماط لغوية غريبة — سلاسل من الجمل غير المترابطة، ونهايات جملية نمطية، ونبرة مميزة تجعل المخرجات تبدو مولودة من آلة بطريقة نجحت نماذج كلود السابقة في تجنبها.
في اختبار عمياء، صنّفت المراجعون أنفسهم الذين اشتكوا أوبسَ 5 فوق كل النماذج المنافسة بما فيها فابل 5 وGPT-5.6. "عبقري لكنه مزعج" هو الملخص الأدق.
التسعير: أين تكمن الفرصة
5 دولارات / 25 دولاراً لكل مليون توكن إدخال/إخراج — نفس سعر أوبس 4.8، ونصف تكلفة فابل 5 (10 / 50 دولاراً). الوضع السريع يعمل بـ10 / 50 دولاراً.
نافذة السياق البالغة مليون توكن تتيح لك تغذيته بقواعد برمجية كاملة. والأهم، أوبس 5 لا يفرض شروط الاحتفاظ بالبيانات خلافاً لفابل 5 — ميزة ذات وزن للنشر في البيئات الحساسة للخصوصية.
في سير العمل الوكيلية — حيث قد تتطلب مهمة واحدة 20-50 استدعاءً للنموذج — يتضاعف فارق التكلفة بين أوبس 5 وفابل 5 بسرعة. إذا كان أوبس 5 يتفوق على فابل 5 في معاييرك بنصف التكلفة، فحجة الأعمال واضحة.
كيف تعمل معه فعلاً
الإحباطات الواردة أعلاه حقيقية لكنها قابلة للتنبؤ، مما يعني إمكانية تجنبها.
اكتب تعليمات محكمة غير متناقضة. أوبس 5 يكشف البرامج الفوضوية التي كان فابل 5 سيغطيها. استخدم هذا كمحرّك للتحسين: إذا كان برومبت النظام الخاص بك غامضاً، أوبس 5 سيخبرك بذلك. عامل التوقفات كإشارات لتحسين برومبتاتك لا كإخفاقات في النموذج.
حدد نطاق العمل صراحةً. أخبره ما يجب ألا يفعله. "عدّل الوظيفة التي أحددها فقط. لا تُعيد هيكلة الكود المحيط." أوبس 5 يحترم القيود الصريحة بشكل أكثر موثوقية من فابل 5 — تحتاج فقط أن تذكرها.
استخدمه للأعمال المناسبة. يتفوق أوبس 5 في:
- مهام البرمجة الوكيلية طويلة الأفق
- الاستدلال المعقد ذو التبعيات المتشعبة
- المهام التي تريد فيها من النموذج الإشارة للغموض بدلاً من التخمين الخاطئ
- النشر في البيئات الحساسة للخصوصية
فكّر في نموذج آخر عندما:
- تحتاج تكراراً إبداعياً سريعاً حيث إسهابه يبطئك
- تعليماتك غامضة بطبعها وتريد النموذج أن يجسر الهوة بدلاً من التوقف
- الكمون حرج (أوبس 5 أبطأ من سونيت 5 عن قصد)
استراتيجية التوجيه
الفرق الأذكى لا تختار نموذجاً واحداً — تُوجّه المهام.
- أوبس 5 للمهام الوكيلية العميقة، توليد الأكواد المعقدة، سلاسل الاستدلال
- سونيت 5 للمهام التفاعلية السريعة، واجهات المحادثة، المسودات الأولى
- هايكو 4.5 للتصنيف، التوجيه، الاستخراج بحجم كبير
مستوى الجهد القابل للضبط في أوبس 5 (توكنات التفكير) يمنحك مقبض التحكم: جهد منخفض للإجابات السريعة، وجهد مرتفع للمشكلات التي تستحق النموذج كاملاً.
الخلاصة
كلود أوبس 5 هو أفضل نموذج لوكلاء البرمجة المستقلة والاستدلال المعقد — بلا جدال. الفجوة في Frontier-Bench على فابل 5 (43.3% مقابل 33.7%) أكبر من أن تُتجاهل، ولوحات الصدارة المستقلة تؤكد ذلك.
حكم "عبقري لكنه مزعج" دقيق، لكنه يعكس سوء الاستخدام في أغلب الأحيان. الفرق التي تكتب تعليمات دقيقة، وتُوجّه المهام بوعي، وتتعامل مع توقفاته كتغذية راجعة لا إخفاقات، ستجد أن أوبس 5 يحقق نتائج في مستوى الحدود الأمامية بنصف تكلفة البديل.
المطوّرون الذين يكرهونه في الغالب يُشغّلون عليه برومبتات فابل 5 دون تعديل. اكتب لنقاط قوة أوبس 5 وستُنجز عملاً أفضل بسرعة أكبر — حتى لو أردت إغلاق الطرفية من الإحباط أحياناً.