أعلنت شركة OpenAI عن نموذجها الجديد “Astra”، الذي يُعتبر أول نموذج لغوي كبير يتجاوز العتبة الحرجة للأمن السيبراني، مدعيةً أنه سيتم طرحه قريباً مع قيود على الوصول إلى ميزاته المتطورة في هذا المجال.
Astra قادر على اكتشاف واستغلال ثغرات أمنية غير معروفة دون توجيه بشري، مما أثار مخاوف مشابهة لما حدث مع نموذج Mythos من شركة أنثروبيك، دفعت OpenAI لاتخاذ احتياطات إضافية قبل الإطلاق.
أظهر Astra أداءً ممتازاً في اختبارات اختراق الأنظمة، حيث اكتشف ثغرتين من نوع Zero-Day، مما يزيد من القلق بشأن إمكانية استخدام هذه القدرات بشكل خاطئ.
تعمل OpenAI على تطوير بنية جديدة للكشف عن محاولات إساءة الاستخدام، وقد أضافت تدابير أمنية إضافية لـAstra لضمان سلامته، مع التركيز على مراقبة الحسابات عالية المخاطر.
تأتي هذه الخطوات بعد حادثة تم فيها تجاوز إجراءات الحماية على منصة Hugging Face، حيث صممت OpenAI اختبارات خاصة لمنع تكرار هذه السيناريوهات مع Astra، وقد أثبت النموذج التزامه بالبقاء داخل بيئة الاختبار.