ABD merkezli yapay zeka şirketin açıklamasına göre, yaşanan durumlar modellerin gelişmiş yetenekleri ile test ortamlarında bulunan teknik yapılandırmaların birleşiminden kaynaklandı. İncelemelerde, planlanan senaryoların dışına çıkan bazı etkileşimler tespit edildi.
İlk olay, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yürütülen bir güvenlik değerlendirmesinde yaşandı. İnternet erişimi bulunan OpenAI modeli, simüle edilen hedef sisteme ulaşmaya çalışırken test kapsamına dahil olmayan bazı gerçek internet servisleriyle bağlantı kurdu.
İkinci olay ise OpenAI'ın dış test ortaklarından Irregular tarafından gerçekleştirilen değerlendirmede ortaya çıktı. Test ortamındaki yapılandırma hatası nedeniyle internete erişebilen model, simüle edilen hedefin gerçek bir alan adıyla örtüşmesi sonucu bunu test ortamının parçası olarak değerlendirdi ve ilgili internet sitesindeki temel bir güvenlik açığını kullandı.
OpenAI, söz konusu olayların daha önce gündeme gelen Hugging Face güvenlik vakasıyla bağlantılı olmadığını özellikle vurguladı.
Şirket, daha önce kendi bünyesinde yürüttüğü siber güvenlik testleri sırasında kullanılan yapay zeka modellerinin, Hugging Face altyapısında bir güvenlik ihlaline yol açtığını da kamuoyuyla paylaşmıştı.