ماذا حدث؟
خلال أقل من ثلاثة أيام دخل نموذجان من أقوى نماذج الذكاء الاصطناعي في مواجهة مباشرة؛ أطلقت Anthropic نموذج Claude Fable 5.1 في 1 سبتمبر 2026، ثم كشفت OpenAI عن GPT-6 Astra في 3 سبتمبر. وعلى الرغم من تقديم الشركتين لنموذجيهما باعتبارهما من أقوى ما أنتجتاه للبرمجة والعمل المعرفي والمهام المعقدة، فإن الاختبارات المستقلة ترسم صورة أكثر توازناً: لا يوجد نموذج يتفوق في كل شيء.
GPT-6 Astra يظهر قوته بصورة واضحة عندما تتحول المهمة من مجرد الإجابة عن سؤال إلى تنفيذ العمل فعلياً على الكمبيوتر. نتائج الاختبارات تشير إلى تفوقه في استخدام واجهات البرامج، تشغيل المهام الوكيلة متعددة الخطوات، التعامل مع الطرفية، الرياضيات والأمن السيبراني، إلى جانب قدرته على إنتاج مستندات وجداول وعروض وأعمال احترافية. في المقابل، يحافظ Claude Fable 5.1 على أفضلية في عدد من اختبارات الاستدلال المستقلة، ويحقق نتائج قوية جداً في البرمجة عند تشغيله داخل Claude Code، إضافة إلى تميزه في المهام الطويلة التي تحتاج إلى فهم مشروع كامل ومواصلة العمل عليه لفترات طويلة.
حتى الأرقام نفسها تحتاج إلى بعض الحذر عند مقارنتها؛ فقد استشهدت تحليلات MindStudio وDataCamp بنسخة سابقة من مؤشر Artificial Analysis منحت Fable 5.1 نتيجة 66 مقابل 61 لـAstra، بينما يعرض الإصدار الأحدث من المؤشر حالياً 57 لـFable مقابل 55 لـAstra. ورغم تغير الأرقام مع تحديث منهجية الاختبار، بقي الاتجاه العام متشابهاً: Fable يتقدم بفارق صغير في مؤشر الذكاء المستقل، بينما Astra يتفوق في عدة اختبارات متخصصة مرتبطة باستخدام الكمبيوتر والعمليات الوكيلة.
ماذا يعني؟
الفرق الحقيقي بين النموذجين أصبح متعلقاً بنوع العمل أكثر من سؤال «من الأذكى؟». Astra يبدو مصمماً ليكون منفذاً قوياً للعمل من البداية إلى النهاية: يتصفح، يستخدم البرامج، يتعامل مع الطرفية وينجز مهاماً احترافية متعددة المراحل. أما Fable 5.1 فيبدو أكثر تركيزاً على الاستدلال العميق، البرمجة طويلة المدى والعمل المعرفي المعقد، خصوصاً عندما يعمل داخل منظومة Claude Code. كلا النموذجين يوفر نافذة سياق تقارب مليون رمز، وكلاهما يبدأ في الـAPI بسعر 10 دولارات لكل مليون رمز إدخال و50 دولاراً لكل مليون رمز إخراج، لكن Fable 5.1 يتميز بسعر أقل كثيراً لقراءة الـCache وعدم فرض زيادة سعرية على السياقات الطويلة بالطريقة نفسها التي يفعلها Astra.
بالنسبة للبرمجة، الصورة ليست محسومة أيضاً. Astra يحقق نتائج قوية في اختبارات الطرفية والبرمجة الوكيلة ويتميز بكفاءة استخدام الرموز في بعض الاختبارات، لكن Artificial Analysis يضع Fable 5.1 داخل Claude Code أمام Astra داخل Codex في مؤشر Coding Agent. ويجب التعامل مع هذه المقارنة بحذر لأن النموذجين اختُبرا داخل بيئتين مختلفتين، ما يعني أن جزءاً من الفارق قد يعود إلى Claude Code وCodex نفسيهما وليس إلى النموذج فقط.
لماذا يهمك؟
الانطباع المبكر عن النموذجين إيجابي جداً، لكنه أقل حماساً لفكرة أن أحدهما «سحق» الآخر. Astra أثار الاهتمام بسبب القفزة الكبيرة في التحكم بالكمبيوتر، العمل الوكيل والأمن السيبراني، بينما يرى عدد من المختبرين أن Fable 5.1 لا يزال أكثر إقناعاً في جودة الكود النهائي وبعض مهام الاستدلال والعمل الطويل. MindStudio نقل عن مختبرين مبكرين أن Astra يمثل قفزة حقيقية في القدرة البرمجية الخام، لكن الثقة في جودة الواجهات وما إذا كان الكود جاهزاً للدمج ما زالت تميل لصالح Fable 5.1.
إذا كنت تريد نموذجاً يعمل كوكيل يستخدم البرامج والمتصفح والطرفية وينجز المهمة كاملة، فإن Astra يبدو الخيار الأكثر إثارة حالياً. وإذا كانت أولويتك مشروعاً برمجياً كبيراً، مراجعة كود، استدلالاً عميقاً أو جلسات طويلة داخل Claude Code، فإن Fable 5.1 قد يكون الاختيار الأقوى. الخلاصة التي تتفق عليها المقارنات الثلاث تقريباً هي أن المنافسة لم تعد «أي نموذج يجيب بشكل أفضل؟»، بل «أي نموذج يناسب طريقة عملك بشكل أفضل؟».