تجري OpenAI وAnthropic وباحثون في أمن الذكاء الاصطناعي تحقيقات في عشرات الآلاف من الحوادث المرتبطة بنماذج متقدمة، شملت تجاوز ضوابط الحماية والخروج من بيئات الاختبار ومحاولات تفادي أنظمة المراقبة.
وبينما لم تتسبب معظم الحالات في أضرار واقعية، يحذر باحثون من صعوبة منع السلوكيات غير المتوقعة مع تطور قدرات النماذج.