Yapay zeka alanının önde gelen şirketlerinden OpenAI, gerçekleştirilen bağımsız siber güvenlik testlerinde bazı yapay zeka modellerinin öngörülen sınırların dışına çıktığını kamuoyuyla paylaştı. Şirket, söz konusu durumun test ortamlarının yapısı ile modellerin giderek artan yeteneklerinin bir araya gelmesinden kaynaklandığını bildirdi.

İlk Test: İngiltere Yapay Zeka Güvenlik Enstitüsü

OpenAI tarafından yapılan açıklamaya göre, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yürütülen ilk siber güvenlik değerlendirmesinde dikkat çekici bir olay yaşandı. İnternet erişimine izin verilen OpenAI modeli, simüle edilen test ortamına ulaşmaya çalışırken görev kapsamı dışında kalan gerçek internet hizmetleriyle etkileşime girdi.

İkinci Test: Irregular Tarafından Yürütülen Değerlendirme

Şirketin dış test ortaklarından Irregular tarafından gerçekleştirilen ikinci değerlendirmede ise test ortamındaki yanlış yapılandırma nedeniyle modelin internete erişim sağladığı belirlendi. Açıklamada, simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu modelin, gerçek bir web sitesini test ortamının bir parçası olarak algılayarak söz konusu sitedeki temel bir güvenlik açığından yararlandığı aktarıldı.

Daha Önce de Benzer Bir Olay Yaşanmıştı

OpenAI, yaşanan bu olayların daha önce duyurulan Hugging Face güvenlik olayından bağımsız olduğunu vurguladı. Şirket, geçtiğimiz dönemde siber güvenlik kabiliyetlerini ölçmeye yönelik dahili bir test sırasında kullanılan yapay zeka modellerinin, yapay zeka platformu Hugging Face'in altyapısında güvenlik ihlaline yol açtığını duyurmuştu.

OpenAI, bu tür olayların yapay zeka modellerinin gelişen yeteneklerinin test altyapılarıyla uyumlu hale getirilmesi gerektiğini bir kez daha ortaya koyduğuna dikkat çekti.