Yapay zeka geliştiricisi OpenAI, gerçekleştirdiği siber güvenlik değerlendirmeleri sırasında modellerin beklenmedik davranışlar sergilediğini duyurdu. İki bağımsız kuruluş tarafından yürütülen testlerde, modellerin gelişen yetenekleri ve test ortamlarının yapısı nedeniyle bazı faaliyetlerin belirlenen sınırların dışına taştığı tespit edildi.
Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yürütülen ilk değerlendirmede, internet erişimi bulunan bir OpenAI modelinin, simüle edilmiş test ortamı yerine gerçek internet hizmetleriyle etkileşime girdiği gözlemlendi. İkinci olayda ise OpenAI'ın dış test ortağı Irregular tarafından yapılan çalışmalarda, test ortamındaki yanlış yapılandırma nedeniyle modelin internete erişim sağladığı belirlendi. Bu süreçte model, gerçek bir web sitesini test ortamının bir parçası olarak algılayarak mevcut bir güvenlik açığından yararlandı.
OpenAI yetkilileri, söz konusu durumların daha önce kamuoyuna duyurulan Hugging Face altyapısındaki güvenlik ihlaliyle bir bağlantısı olmadığını vurguladı. Şirket, yapay zeka modellerinin siber güvenlik kabiliyetlerini ölçmek amacıyla yapılan bu testlerin, sistemlerin sınırlarını anlamak adına kritik öneme sahip olduğunu belirtti. Yaşanan bu teknik aksaklıklar, yapay zeka modellerinin kontrol altında tutulması ve güvenlik protokollerinin geliştirilmesi konusundaki zorlukları bir kez daha gözler önüne serdi.