ABD merkezli yapay zeka şirketi OpenAI, yapay zeka modellerinin bağımsız siber güvenlik testleri sırasında belirlenen test sınırlarını aştığını açıkladı. Bu durum, özellikle test ortamlarının yapısı ile modellerin gelişen yeteneklerinin bir araya gelmesi sonucu ortaya çıktı.
İlk değerlendirme sonuçları
Açıklamada, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından gerçekleştirilen ilk siber güvenlik testinin sonuçları dikkat çekti. Bu testte, internete erişimi olan OpenAI modelinin, simüle edilen test ortamına ulaşmaya çalışırken, görev kapsamının dışındaki bazı gerçek internet hizmetleriyle etkileşime geçtiği kaydedildi.
Yanlış yapılandırma sorunları
İkinci değerlendirme ise OpenAI’ın dış test ortaklarından Irregular tarafından yürütüldü. Bu testte, test ortamındaki yanlış yapılandırma sebebiyle modelin internete erişim sağladığı vurgulandı. Model, simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu, gerçek bir web sitesini test ortamının bir parçası sanarak buradaki temel bir güvenlik açığından yararlandı.
Açıklamada, bu olayların daha önce duyurulan Hugging Face güvenlik olayından bağımsız olduğu belirtildi. OpenAI, daha önce siber güvenlik kabiliyetlerini ölçmeye yönelik dahili testlerde kullanılan yapay zeka modellerinin Hugging Face’in altyapısında güvenlik ihlaline yol açtığını da duyurmuştu.