سواتي خاندلوال28 يوليو 2026أمن الذكاء الاصطناعي / إدارة الثغرات الأمنية

أطلقت Microsoft أول نموذج خاص بها للأمن السيبراني في الداخل مداش، وتحديد الثغرات الأمنية المتعددة النماذج وتسخير العلاج.

تقول الشركة إن MDASH، باستخدام MAI-Cyber-1-Flash وGPT-5.4، سجل 95.95% في CyberGym. وتدعي أيضًا أن تكلفة التكوين أقل بنسبة 50% من أفضل مجموعة MDASH الحالية المكونة من GPT-5.4 وGPT-5.4 mini وGPT-5.3 Codex. يقتصر الوصول على عملاء MDASH المعتمدين من خلال معاينة خاصة لـ Azure AI Foundry.

ماي-سايبر-1-فلاش تم تصميمه للتعامل مع ما يصل إلى 90% من مهام MDASH، مع تخصيص GPT-5.4 لأصعب 10%. وهو متوفر فقط داخل MDASH، وليس كنموذج عام مستقل أو واجهة برمجة تطبيقات للأغراض العامة.

تنتمي النتيجة الرئيسية إلى MDASH الذي يقوم بتشغيل MAI-Cyber-1-Flash جنبًا إلى جنب مع GPT-5.4، وليس إلى النموذج الجديد بحد ذاته. CyberGym Level 1 هو اختبار استنساخ معروف للضعف. فهو يعطي الوكيل وصفًا للثغرة الأمنية وكود المصدر المقابل غير المصحح، ثم يتحقق مما إذا كان بإمكانه تقديم دليل عملي للمفهوم. ولا يقيس اكتشاف الثغرات الأمنية الأعمى أو ما إذا كان التصحيح الذي تم إنشاؤه صحيحًا.

لم تدرج لوحة المتصدرين العامة لـ CyberGym نتيجة Microsoft بنسبة 95.95% عند التحقق منها في 28 يوليو 2026. ولا تزال تدرج تقديم Microsoft MDASH في 12 مايو بنسبة 88.4%. لا توضح المواد العامة لشركة Microsoft ما إذا كانت النتيجة قد تم تقديمها للإدراج أم لا.

لم تحل نتيجة MDASH السابقة لـ Microsoft بنسبة 96.55% المقارنة. وقد أحصى رقم شهر يونيو أي انهيار، بما في ذلك نقاط الضعف غير المستهدفة. ولا توضح المواد المنشورة في شهر يوليو ما إذا كانت نتيجة 95.95% تستخدم نفس المعيار، وبالتالي فإن النتيجتين لا يمكن قراءتهما بأمان باعتبارهما اتجاه أداء قبل وبعد.

وفقًا لبطاقة نموذج Microsoft، فإن MAI-Cyber-1-Flash عبارة عن محول متناثر من الخبراء مع 137 مليار معلمة إجمالية، وخمسة مليارات معلمة نشطة، ونافذة سياق مكونة من 256000 رمز. إنه عبارة عن ضبط دقيق للأمن السيبراني لـ MAI-Code-1-Flash، والذي تم تطويره من نقطة تفتيش MAI-Thinking-1 في منتصف التدريب.

تشير بطاقة النموذج إلى أن التكوين الذي تم تقييمه استبدل 80% من نماذج MDASH الحالية ورفع نتيجة CyberGym المبلغ عنها من 88.4% إلى 95.95%. وهذا الرقم البالغ 80% هو حصة النماذج التي تم استبدالها. الرقم المنفصل 90% هو الحد الأقصى لمشاركة المهام التي تقول Microsoft إن النموذج الأصغر يمكنه التعامل معها.

يشير التصميم الذي تم الكشف عنه معًا إلى التوجيه باعتباره مطالبة فنية مركزية: MAI-Cyber-1-Flash مخصص للتعامل مع معظم المهام، ويتولى GPT-5.4 المهام الأصعب، وتقوم Microsoft بالإبلاغ عن النتيجة على مستوى نظام MDASH.

يحدد إعلان إطلاق Microsoft التوفير بنسبة 50% مقابل أفضل مزيج من نماذج MDASH الحالية وهي GPT-5.4 وGPT-5.4 mini وGPT-5.3 Codex. تصف صفحة المنتج بشكل منفصل النظام بأنه يقدم “أداءً مشابهًا بنسبة 50% من تكلفة النماذج الرائدة”. لا يكشف الإعلان وبطاقة النموذج عن استخدام الرمز المميز، أو حجم الاتصال، أو زمن الاستجابة، أو مزيج المهام، أو تخصيص الحساب وراء تلك المقارنة، لذلك لا يمكن بعد إعادة إنتاج الرقم بشكل مستقل أو تطبيعه مقابل الأنظمة الأخرى.

“النموذج هو مدخل واحد، والنظام من حوله هو المنتج.”

استخدم تايسو كيم، نائب رئيس Microsoft لأمن العملاء، هذا التمييز عند وصف MDASH في يونيو. تحت مجموعة أدوات طرفية خفيفة الوزن، سجلت البطاقة النموذجية درجات 0.314 على CVEBench، و0.553 على CyberSecEval4 لاستخبارات التهديدات، و0.33 في اختبار تحليل البرامج الضارة، و0.651 على CRSBench عند POV=1200.

حصل النموذج على صفر عبر فئات النواة ومساحة المستخدم والمتصفح في ExploitGym، والذي يطلب من الوكلاء تحويل الثغرات الأمنية المتوفرة والمدخلات المعطلة إلى عمليات استغلال لتنفيذ التعليمات البرمجية. تأتي هذه النتائج من مهام ومقاييس تسجيل مختلفة، لذلك لا يوجد منها نتيجة CyberGym مستقلة لـ MAI-Cyber-1-Flash.

وقالت مايكروسوفت إن جميع الاختبارات المعيارية تم إجراؤها في بيئة معزولة عن الشبكة مع عدم إمكانية الوصول إلى أنظمة الإنتاج أو الإنترنت العام أو الخدمات الخارجية. تحذر البطاقة النموذجية أيضًا من أن النص والتعليمات البرمجية التي تم إنشاؤها قد تكون غير دقيقة أو غير كاملة ويجب مراجعتها قبل الاستخدام اللاحق.

تعد إدارة الثغرات الأمنية في البرامج باستخدام MAI-Cyber-1-Flash داخل MDASH هو السيناريو الأول الذي أعلنته Microsoft لبرنامج Project Perception، وهو نظامها الأوسع لتنسيق عملاء الأمن الدفاعي. من المقرر أن يدخل Project Perception في المعاينة العامة في 3 أغسطس، مع تخطيط Microsoft لتوسيع النموذج إلى ما هو أبعد من أعمال الثغرات الأمنية في البرامج إلى سير عمل أمان إضافي.

شاركها.
اترك تعليقاً