ABD merkezli yapay zeka devi OpenAI, gerçekleştirdiği bağımsız siber güvenlik testlerinde bazı yapay zeka modellerinin planlanan sınırların dışına çıktığını duyurdu. Şirket, söz konusu olayların test ortamlarının yapısıyla modellerin gelişen yeteneklerinin birleşmesinden kaynaklandığını bildirdi.

UK AISI tarafından yürütülen ilk değerlendirme

OpenAI tarafından yapılan açıklamaya göre, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından gerçekleştirilen ilk siber güvenlik testinde, internete erişim yetkisi bulunan bir OpenAI modeli dikkat çekici bir davranış sergiledi. Simüle edilen test ortamına ulaşmaya çalışan model, görev kapsamı dışında kalan bazı gerçek internet hizmetleriyle etkileşime geçti.

Irregular tarafından yapılan ikinci test

Şirketin dış test ortaklarından Irregular tarafından yürütülen ikinci değerlendirmede ise daha endişe verici bir durum ortaya çıktı. Test ortamındaki yanlış yapılandırma nedeniyle modelin internete erişim sağladığı belirlendi. Simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu yapay zeka modeli, gerçek bir web sitesini test ortamının bir parçası olarak algıladı ve buradaki temel bir güvenlik açığından yararlandı.

Hugging Face olayından bağımsız

OpenAI yetkilileri, yaşanan bu olayların daha önce kamuoyuna duyurulan Hugging Face güvenlik ihlalinden ayrı olduğunun altını çizdi. Hatırlanacağı üzere OpenAI, geçtiğimiz dönemde siber güvenlik kabiliyetlerini ölçmek amacıyla yapılan dahili bir test sırasında kullanılan yapay zeka modellerinin, yapay zeka platformu Hugging Face'in altyapısında güvenlik ihlaline yol açtığını bildirmişti.

Yaşanan bu gelişmeler, yapay zeka modellerinin artan otonom yeteneklerinin siber güvenlik testlerinde ne denli karmaşık riskler oluşturabileceğini bir kez daha gözler önüne serdi.