OpenAI, ChatGPT için planlanan güncellemeyi, sistemden kaynaklanabilecek aşırı tehlike endişesi nedeniyle askıya aldı. Astra adı verilen yeni modelin otonom kodlama ve siber güvenlik alanlarında önemli ilerlemeler kaydettiği açıklandı.
Güncellemeden Kaçınma Nedenleri
Sistemin aşırı tehlikeli olabileceği endişesiyle, OpenAI güncellemeyi durdurdu. Özellikle Astra modelinin otonom kodlama yeteneğine ve siber güvenlik alanlarındaki ilerlemeleri dikkate alındığında, bu sistemlerin fazla güçlü olabileceğini ve mevcut haliyle kullanıma sunulması durumunda güvenlik tehdidi oluşturabileceğini gösteren testler yapıldı.
Astra Modelinin Performansı
Astra modeli, Hugging Face platformuna yönelik söz konusu saldırıda yer almadığı halde, sergilediği performans nedeniyle şimdilik kamuoyuna sunulmasının güvenli görülmediği ifade edildi. OpenAI, bu modelin kullanıma açılması için yeni güvenlik önlemlerinin uygulanması gerektiğini bildirdi.
Risk Eşiği
Siber güvenlik uzmanları ve yapay zeka firmaları, bu tür araçların yazılımlardaki açıkları tespit edip kapatmak amacıyla geliştirildiğini vurguluyor. Ancak bu yeteneklerin, insan yönetimine ihtiyaç duymayan otonom siber saldırılarda da kullanılabileceği belirtiliyor.
OpenAI, bu tür riskleri yönetmek amacıyla 2023 yılının sonunda "Hazırlık Çerçevesi" adını verdiği bir güvenlik yapısı oluşturmuştu. Bu çerçeve, modellerin yeteneklerindeki ilerlemeyi tespit etmeyi ve sistemleri güvenli sınırlar içinde tutmayı amaçlıyor.
Güvenlik Önlemleri
Şirket, Astra modelinin bu çerçevede tanımlanan "kritik" risk eşiğine ulaşmış olabileceğini duyurdu. Bir yapay zeka sisteminin insan denetimi olmadan kritik sistemlerde güvenlik açıkları bulup geliştirebilmesi veya gelişmiş siber saldırılar için kendi başına yeni stratejiler uygulayabilmesi halinde bu seviyeye ulaştığı kabul ediliyor.
Değerlendirmelerin sürdüğü, ancak modelin gösterdiği yüksek performans nedeniyle kritik seviyeye ulaşmış olma ihtimalinin göz ardı edilemediği kaydedildi. OpenAI, bu gelişmeler üzerine güvenlik kontrollerini ve test süreçlerini sıkılaştırdığını açıkladı.
Bu kapsamda model, sistem dışına sızmasını önlemek amacıyla daha izole test ortamlarına alındı. Yüksek güvenlik standartlarını karşılamayan koşullarda Astra üzerindeki çalışmaların durdurulacağı bildirildi.
İlgili Kurumlarla İşbirliği
Şirket ayrıca modeli riskli eylemlere karşı yakından izleyeceğini, ilgili kamu kurumları ve yetkili güvenlik kuruluşlarıyla ortak testler yürüteceğini belirtti. OpenAI tarafından yapılan açıklamada, gelişmiş siber yeteneklere sahip modellerin saldırganlardan önce güvenlik açıklarını tespit etmeye yardımcı olması gerektiği vurgulandı.
Şirket, Astra ve sonraki modellerin insanlığın yararına sorumlu bir şekilde kullanıma sunulması için uluslararası kurumlar ve siber güvenlik kuruluşlarıyla iş birliğini sürdüreceğini duyurdu.