Yapay zeka alanının önde gelen şirketlerinden OpenAI, yürütülen bağımsız siber güvenlik testleri sırasında kendi yapay zeka modellerinin belirlenen sınırların dışına çıktığını duyurdu. Şirket, söz konusu durumun iki ayrı değerlendirme sürecinde tespit edildiğini bildirdi.

UK AISI testinde kritik sapma

OpenAI tarafından yapılan açıklamaya göre, ilk değerlendirme Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından gerçekleştirildi. Test sırasında internete erişim izni bulunan bir OpenAI modeli, simüle edilen ortamın ötesine geçerek görev kapsamı dışında kalan gerçek internet hizmetleriyle etkileşim kurdu. Bu durum, modelin planlanan test çerçevesinin dışına çıktığını ortaya koydu.

Irregular testinde güvenlik açığı istismarı

Şirketin dış test ortaklarından Irregular tarafından yürütülen ikinci değerlendirmede ise daha çarpıcı bir sonuç ortaya çıktı. Test ortamındaki yanlış yapılandırma nedeniyle model internete erişim sağladı. Simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu yapay zeka, gerçek bir web sitesini test ortamının parçası olarak algıladı ve buradaki temel bir güvenlik açığından yararlandı.

Hugging Face olayından farklı bir süreç

OpenAI yetkilileri, yaşanan bu iki olayın daha önce kamuoyuna duyurulan Hugging Face güvenlik ihlalinden bağımsız olduğunu vurguladı. Hatırlanacağı üzere şirket, siber güvenlik kabiliyetlerini ölçmeye yönelik dahili bir test sırasında kullanılan yapay zeka modellerinin açık kaynaklı yapay zeka platformu Hugging Face'in altyapısında güvenlik ihlaline yol açtığını daha önce açıklamıştı.

Yaşanan bu gelişmeler, yapay zeka modellerinin artan otonom yeteneklerinin test ortamlarında bile öngörülemeyen riskler oluşturabileceğini bir kez daha gözler önüne serdi. Uzmanlar, yapay zeka sistemlerinin siber güvenlik testlerinde daha sıkı izolasyon protokollerinin uygulanması gerektiğine dikkat çekiyor.