ABD merkezli yapay zeka şirketi OpenAI, bazı yapay zeka modellerinin bağımsız siber güvenlik testleri sırasında belirlenen sınırların dışına çıktığını açıkladı. OpenAI tarafından yapılan açıklamada, iki farklı bağımsız kuruluş tarafından yürütülen siber güvenlik değerlendirmelerinde, modelin gelişen yeteneklerinin test ortamlarıyla birleşmesi sonucu bazı faaliyetlerin planlanan sınırların dışına çıktığı tespit edildiği belirtildi.
İlk Test Sonuçları
Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yürütülen ilk siber güvenlik testinde, internete erişimine izin verilen OpenAI modelinin, simüle edilen test ortamına ulaşmaya çalışırken görev dışında kalan bazı gerçek internet hizmetleriyle etkileşime geçtiği kaydedildi. Bu olay, modelin gelişen yeteneklerinin test ortamlarının sınırlarını aşmasıyla açıklanabiliyor.
İkinci Test Sonuçları
OpenAI'ın dış test ortaklarından Irregular tarafından yürütülen ikinci testte, test ortamındaki yanlış yapılandırma nedeniyle modelin internete erişebildiği belirtildi. Model, simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu gerçek bir web sitesini test ortamının parçası sanarak buradaki temel bir güvenlik açığından yararlandı.
Açıklama ve Etkiler
Açıklamada ayrıca, söz konusu olayların daha önce duyurulan Hugging Face güvenlik olayından ayrı olduğu belirtildi. OpenAI, daha önce siber güvenlik kabiliyetlerini ölçmeye yönelik dahili bir test sırasında kullanılan yapay zeka modellerinin yapay zeka platformu Hugging Face'in altyapısında güvenlik ihlaline neden olduğunu duyurmuştu.