أطلقت مايكروسوفت نموذجها الأمني المخصص الأول MAI-Cyber-1-Flash في 27 يوليو، ودمجته في MDASH، وهو نظام لصيد الثغرات حقق 95.95% في معيار CyberGym. وتقول الشركة إن هذا التكوين يتفوق على Mythos 5 لدى Anthropic وGPT-5.6 Sol لدى OpenAI، كما أنه يكلف أقل بنسبة 50% من أفضل إعداد حالي لدى مايكروسوفت لنظام MDASH. ويعد CyberGym معيارًا تُطلب فيه من وكلاء الذكاء الاصطناعي إعادة إنتاج 1,507 ثغرات معروفة عبر 188 مشروعًا مفتوح المصدر، ثم يتم تقييمها بحسب نسبة الثغرات التي تم إعادة إنتاجها بنجاح في بيئة محكومة. وصرّح الرئيس التنفيذي لمايكروسوفت ساتيا ناديلا بأن النظام المدمج يقدّم أداءً عالمي المستوى بتكلفة نصف تكلفة النماذج الرائدة، مشيرًا إلى أنها المرة الأولى التي يتفوق فيها نموذج تركيز الكفاءة لدى مايكروسوفت على نماذج كثيفة تقودها أحدث التطورات والتي بُنيت لإمكانات عامة.
يتفوق MDASH على النماذج المنافسة في معيار CyberGym
سجّل نظام MDASH لدى مايكروسوفت 95.95% على CyberGym، وفقًا للشركة. وقد وضعه ذلك في المقدمة على GPT-5.5 Cyber التي حققت 85.6%، وMythos 5 عند 83.8%، وGPT-5.6 Sol عند 83.6%، وGemini 3.5 Flash Cyber عند 83.2%. والنتيجة مُبلّغ عنها ذاتيًا من مايكروسوفت ولم تكن قد ظهرت في اللوحة العامة لنتائج CyberGym وقت النشر، رغم أن المعيار يستخدم مجموعة اختبار عامة ومقياس نجاح محدد. ويمثل هذا الدرجات زيادة تقارب 10 نقاط عن نتيجة GPT-5.5 Cyber و7.5 نقاط فوق نتيجة MDASH السابقة.
يتولى MAI-Cyber-1-Flash 90% من عبء العمل مع نسخة احتياطية GPT-5.4
لا يعمل MAI-Cyber-1-Flash بمفرده. تقول مايكروسوفت إنه يتولى حتى 90% من المهام، بينما يرسل MDASH أصعب 10% إلى GPT-5.4. النموذج هو الذكاء الاصطناعي الذي يستدل عبر الشيفرة، بينما MDASH هو «المنظومة»—الآلية التي تشمل وكلاء وأدوات وفحوصًا ومسار عمل يقرر أين يبحث، ويتعامل مع النتائج المشكوك فيها، ويزيل التكرارات، ويثبت أنه يمكن تشغيل الأخطاء. يستخدم MDASH أكثر من 100 وكيل متخصص مُسند لتدقيق الشيفرة، والنقاش حول ما إذا كانت النتيجة حقيقية، وبناء إثبات مفهوم يبرهن على أن الخلل موجود.

تطرح مايكروسوفت معاينة خاصة عبر بوابة Defender
تضع مايكروسوفت MDASH في معاينة خاصة عبر Microsoft Security Exposure Management داخل بوابة Defender. سيتمكن العملاء من فحص مستودعات Git، ورؤية النتائج مرتبة من «غير مرجح» إلى «مُثبت»، واستخدام Defender CLI لتوليد حلول إصلاح شيفرة مقترحة لمراجعة المطورين. وتحد المعاينة حاليًا المستودعات بحجم يقارب 256MB، وتسمح بعمليات فحص متزامنة واحدة لكل مستأجر. ومن المتوقع أن يوسع Project Perception النهج متعدد الوكلاء نفسه خارج فحص الشيفرة إلى مراقبة التهديدات الأوسع ومسارات المعالجة والإصلاح.
الأسئلة الشائعة
ما الدرجة التي حققها MDASH لدى مايكروسوفت على CyberGym؟
تقول مايكروسوفت إن MDASH سجل 95.95% على CyberGym، وهو معيار يطلب من وكلاء الذكاء الاصطناعي إعادة إنتاج 1,507 ثغرات معروفة عبر 188 مشروعًا مفتوح المصدر.
كيف يوزع MAI-Cyber-1-Flash عبء عمله؟
تقول مايكروسوفت إن MAI-Cyber-1-Flash يتولى حتى 90% من المهام، بينما يرسل MDASH أصعب 10% إلى GPT-5.4. تستخدم المنظومة أكثر من 100 وكيل متخصص لتدقيق الشيفرة والتحقق من النتائج.
ما حدود المعاينة الخاصة لـ MDASH؟
تحد المعاينة حاليًا المستودعات بحجم يقارب 256MB، وتسمح بعملية فحص متزامنة واحدة لكل مستأجر عبر Microsoft Security Exposure Management داخل بوابة Defender.