أصدرت OpenAI يوم الجمعة ثلاثة إصدارات من جي بي تي-5.6، مُسَمًّى سول وتيرا ولونا، كمعاينة محدودة لعدد صغير من الشركات كجزء من المشاركة المستمرة مع حكومة الولايات المتحدة.

في حين أن Sol هو الطراز الرائد الأحدث والأقوى، فإن Terra يحقق التوازن بين الكفاءة والقوة، وتم ضبط Luna بدقة من أجل السرعة والقدرة على تحمل التكاليف.

“تم إطلاق GPT‑5.6 Sol مع أقوى حزمة أمان لدينا حتى الآن. لقد عززنا الحماية للأنشطة عالية المخاطر، والطلبات الإلكترونية الحساسة، وسوء الاستخدام المتكرر، وأمضينا عدة أسابيع في العثور على نقاط الضعف، واختبار الضغط على نظامنا، وتقويته ضد هجمات العالم الحقيقي،” قال OpenAI.

تم وصف النموذج أيضًا بأنه “النموذج الأكثر قدرة حتى الآن” للأمن السيبراني، مما يجعله أكثر ملاءمة لأبحاث الثغرات الأمنية واستغلالها. على ExploitBench، يتنافس GPT‑5.6 Sol مع Anthropic Mythos Preview باستخدام حوالي ثلث الرموز المميزة للمخرجات فقط، حسبما أشار OpenAI.

وأضافت أن الهدف هو تمكين الوصول إلى العمل المشروع مثل مراجعة التعليمات البرمجية، وأبحاث الثغرات الأمنية، وتطوير التصحيح، وتصحيح الأخطاء، والتعليم الأمني، والاختبار الدفاعي، مع فرض حواجز حماية قوية تمنع الأنشطة الهجومية ومعالجة عمليات كسر الحماية المكتشفة حديثًا بسرعة. يتضمن ذلك محاولات عدائية لكسر حماية النموذج ورفض ما يصفه بـ “المساعدة الإلكترونية المحظورة”.

وأوضحت شركة الذكاء الاصطناعي (AI): “مع استمرار تقدم هذه القدرات، فإن أولويتنا هي التأكد من وصولها وإفادة المدافعين، الذين يمكنهم استخدام هذه الأدوات للعثور على نقاط الضعف وتطوير التصحيحات وتعزيز الأنظمة على نطاق أوسع”.

ومع ذلك، تحذر OpenAI أيضًا من أنه قد تكون هناك سيناريوهات أثناء مرحلة المعاينة حيث قد يواجه المستخدمون ضمانات تمنع أو ترفض الطلبات المشروعة، أو يتم إيقاف طلباتهم مؤقتًا لإجراء مراجعة إضافية، نظرًا لطبيعة “الاستخدام المزدوج” للتكنولوجيا.

وفقًا لبطاقة نظام المعاينة GPT-5.6 الخاصة بـ OpenAI، على الرغم من أن النموذج أكثر مهارة في العثور على الثغرات الأمنية في التعليمات البرمجية وتطوير عمليات الاستغلال، إلا أن القدرات لا تمتد إلى تنفيذ هجمات مستقلة وشاملة ضد أهداف محصنة أو تسليح تلك الثغرات السيبرانية في هجمات حقيقية.

“فحصت التقييمات المنفصلة السلوك المنحرف في مهام التشفير الوكيل ووجدت أن GPT-5.6 يظهر ميلًا أكبر من GPT-5.5 لتجاوز نية المستخدم، بما في ذلك عن طريق اتخاذ أو محاولة إجراءات لم يطلبها المستخدم، على الرغم من أن المعدلات المطلقة لا تزال منخفضة”.

تقييم GPT-5.6 Sol ضد مشاريع البرمجيات المعززة المنتشرة على نطاق واسع باستخدام VulnLMP، وهو إطار العمل الداخلي لـ OpenAI المصمم لاختبار تطوير سلسلة الاستغلال الشاملة ضد أهداف العالم الحقيقي، وجد أن النموذج ينتج خيوط موثوقة لسلامة الذاكرة، وبعضها يمكن أن يؤدي إلى الكشف أو التحور أو التحكم في الفساد في التدفق.

وقال محدث التكنولوجيا: “يشير هذا إلى أن أجزاء كبيرة من أبحاث الضعف في العالم الحقيقي أصبحت قابلة للأتمتة بشكل متزايد عندما يتم إقران النماذج باستخدام الأدوات، وبناء الأنظمة، والبنية التحتية للتحقق”.

تعتزم OpenAI إتاحة GPT‑5.6 Sol وTerra وLuna بشكل عام في الأسابيع المقبلة، كما قامت بمعاينة قدرات النموذج لحكومة الولايات المتحدة. كما أنها تطلق معاينة محدودة لمجموعة صغيرة من الشركاء الموثوقين الذين تمت الموافقة على مشاركتهم من قبل الحكومة قبل الإطلاق على نطاق أوسع.

في وقت سابق من هذا الشهر، وقع الرئيس الأمريكي دونالد ترامب على أمر تنفيذي بشأن الذكاء الاصطناعي والأمن السيبراني، يدعو إلى إنشاء إطار يمنح الحكومة الفيدرالية القدرة على تقييم قدرات نماذج الذكاء الاصطناعي وتحديد أي منها مؤهل ليكون “نماذج حدودية مغطاة”، وهي تسمية لأنظمة الذكاء الاصطناعي ذات القدرات السيبرانية المتقدمة.

ويأتي الإصدار المتدرج بعد أيام من إصدار الشركة نسخة محسنة من نموذج GPT‑5.5‑Cyber ​​للمدافعين الموثوق بهم كجزء من مبادرة Daybreak وإطلاق مشروع جديد يسمى Patch the Planet بالتعاون مع Trail of Bits للمساعدة في تأمين المشاريع مفتوحة المصدر.

ويأتي ذلك أيضًا في أعقاب قرار حكومة الولايات المتحدة بالسماح لشركة Anthropic بإطلاق نموذج Mythos AI لمجموعة من حوالي 100 شركة موثوقة ووكالات حكومية اتحادية “تعمل وتدافع عن البنية التحتية الحيوية”، بعد أكثر من أسبوعين من سحب النماذج القوية التي تركز على الأمن السيبراني من السوق.

وقالت Anthropic في بيان نُشر على X: “إننا نستعيد إمكانية الوصول لهذه المنظمات بسرعة، ونواصل العمل مع الحكومة لتوسيع الوصول إلى Mythos 5 وإتاحة Fable 5 للاستخدام العام مرة أخرى”.

شاركها.
اترك تعليقاً