ماذا حدث؟
نشر فريق كود رابيت (CodeRabbit) نتائج اختباراتهم العملية لنموذج جي بي تي 5.5 (GPT-5.5) من أوبن إيه آي. في مراجعة الكود، ارتفعت نسبة اكتشاف المشاكل الحقيقية من 55% إلى 65%، وتحسّنت الدقة من 11.6% إلى 13.2%. الأهم: النموذج يميل للتعليقات الصغيرة القابلة للتنفيذ بدلاً من الكتابة فوق الكود — وهو ما يريده المطورون فعلاً. النموذج يعمل حالياً في تشات جي بي تي (ChatGPT) وكودكس.
ماذا يعني؟
جي بي تي 5.5 أسرع وأقل استهلاكاً للتوكنز من الإصدارات السابقة، مما يجعله مناسباً لأنظمة الوكلاء التي تعتمد على دورات تكرار متعددة. لكن الفريق اكتشف نقطة ضعف واضحة: النموذج ينفّذ الطلبات كما هي حرفياً حتى لو كانت الفكرة معطوبة — لا يُصحّح المسار من تلقاء نفسه.
لماذا يهمك؟
كلما كان طلبك أكثر تحديداً للسلوك المطلوب والقيود والمعيار، كانت النتيجة أفضل. النموذج يعمل في أفضل أحواله حين يستطيع تشغيل الكود وفحص نتيجته بدلاً من الإجابة من رأسه مرة واحدة.