مايكروسوفت تتحدى «أنثروبيك» بنموذج ذكاء اصطناعي مخصص للبرمجة يتفوق على Claude
النموذج الجديد يقلل استهلاك الرموز بنسبة 60% ويتفوق في اختبارات المنطق البرمجي

أطلقت شركة مايكروسوفت اليوم نموذجها الأول للذكاء الاصطناعي المخصص كلياً لتطوير البرمجيات «MAI-Code-1-Flash»، معلنة دمجه الفوري في منصة «GitHub Copilot» ومحرر «Visual Studio Code» لمنافسة النماذج الخفيفة التي تطرحها جوجل وأنثروبيك.
وتجاوز النموذج الجديد منافسه «Claude Haiku 4.5» في أربعة اختبارات معيارية كبرى، مسجلاً 51.2% في مقياس «SWE-Bench Pro» مقابل 35.2% لنموذج شركة أنثروبيك، ما منح مايكروسوفت تفوقاً بفارق 16 نقطة في مهام هندسة البرمجيات الواقعية. في حين أظهرت النتائج فجوة أوسع في اختبارات اتباع التعليمات الدقيقة (IF Bench)، حيث وصل فارق التفوق لصالح نموذج مايكروسوفت إلى نحو 29 نقطة.
يعتمد بناء النموذج على بيانات نظيفة ومرخصة بالكامل، وتم تدريبه بشكل مستقل بناءً على تدفقات العمل الفعلية داخل «GitHub Copilot» وليس كنماذج لغوية عامة جرى تطويعها لاحقاً للبرمجة.
بينما وفرت الشركة ميزة «التحكم التكيفي في طول الحل»، التي تسمح للنموذج بتقديم ردود موجزة للمهام المباشرة مقابل استهلاك موارد تفكير أكبر للمشكلات التي تتطلب تعديلات في ملفات متعددة، وهو ما قلل استهلاك الرموز (Tokens) بنسبة 60% مقارنة بالنماذج المنافسة. وأكدت الشركة في إعلانها الرسمي تقييم نقاط التحقق أثناء التدريب بناءً على مهام هندسية حقيقية شملت إعادة هيكلة الكود والاستجابة للاستفسارات المتعلقة بالمستودعات البرمجية.
وبالتزامن مع هذا الإطلاق، كشفت مايكروسوفت عن نتائج اختبارات المنطق التي شملت 186 سؤالاً تضمنت «فخاخاً» برمجية ومسائل مستحيلة الحل، حيث حقق «MAI-Code-1-Flash» دقة بلغت 85.8% في التعرف على المشكلات التي لا تملك حلولاً منطقية. متاح الآن للمشتركين الأفراد في «GitHub Copilot» عبر محرر «Visual Studio Code»، حيث يتم تفعيله تلقائياً بناءً على طبيعة المهمة البرمجية المطلوبة.











