كشفت OpenAI عن نمط الحماية، إطار عمل أمني جديد مصمم لمنع المهاجمين من التلاعب بأنظمة الذكاء الاصطناعي من خلال نصوص مصاغة بعناية. تنشئ الميزة بيئة مقيدة حيث تكون البيانات الحساسة معزولة عن إدخال المستخدم، مما يحد من سطح الهجوم للنصوص المعادية.
يبقى حقن الفوري أحد أعلى الثغرات خطورة في أنظمة النماذج اللغوية المنتشرة. بتقييد قدرة النموذج على معالجة مدخلات المستخدم غير المتحقق منها في السياقات الحساسة، يقلل نمط الحماية من احتمالية قيام المهاجمين باستخراج المعلومات السرية أو إفساد البيانات عبر الهندسة الاجتماعية.
يشير الإطلاق إلى الاعتراف المتزايد بأن أمان الذكاء الاصطناعي يجب أن يتطور إلى ما وراء الدفاع البرمجي التقليدي — النماذج اللغوية تتطلب حمايات جديدة ضد هجمات الاستدلال المعادية. ستستفيد العملاء من المؤسسات الذين يديرون وثائق حساسة أو سجلات طبية أو بيانات مالية من طبقة العزل هذه.