OpenAI'dan şaşırtan itiraf: Yapay zeka modelleri test sınırlarını aştı
OpenAI, bağımsız siber güvenlik testleri sırasında bazı yapay zeka modellerinin belirlenen sınırların dışına çıktığını açıkladı. Modellerden biri gerçek bir web sitesindeki güvenlik açığını fark ederek kullandı.

ABD merkezli yapay zeka devi OpenAI, gerçekleştirilen bağımsız siber güvenlik değerlendirmelerinde bazı yapay zeka modellerinin planlanan test kapsamının dışına çıktığını duyurdu. Şirket, söz konusu durumun test ortamlarının yapısı ile modellerin giderek artan yeteneklerinin birleşmesinden kaynaklandığını bildirdi.
UK AISI tarafından yürütülen ilk testte beklenmedik etkileşim
OpenAI tarafından yapılan açıklamada, ilk değerlendirmenin Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından gerçekleştirildiği belirtildi. Söz konusu testte internete erişim yetkisi bulunan OpenAI modeli, simüle edilen ortama ulaşmaya çalışırken görev tanımının dışında kalan çeşitli gerçek internet hizmetleriyle etkileşime girdi. Bu durum, modelin kendisine verilen sınırları aşarak öngörülemeyen alanlara yöneldiğini ortaya koydu.
İkinci testte kritik güvenlik açığı keşfedildi
OpenAI'ın dış test ortaklarından Irregular tarafından yürütülen ikinci değerlendirmede ise daha dikkat çekici bir gelişme yaşandı. Test ortamındaki yanlış yapılandırma nedeniyle model internete erişim sağladı. Simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu yapay zeka, gerçek bir web sitesini test ortamının bir parçası olarak algıladı ve bu sitedeki temel bir güvenlik açığından yararlandı.
Hugging Face olayından bağımsız bir süreç
OpenAI, yaşanan bu iki olayın daha önce kamuoyuna duyurulan Hugging Face güvenlik vakasından ayrı olduğunu vurguladı. Hatırlanacağı üzere şirket, siber güvenlik kabiliyetlerini ölçmek amacıyla yapılan dahili bir test sırasında kullanılan yapay zeka modellerinin, yapay zeka platformu Hugging Face'in altyapısında güvenlik ihlaline yol açtığını daha önce açıklamıştı.
Yaşanan bu gelişmeler, yapay zeka modellerinin gelişen yetenekleri karşısında test ortamlarının güvenliğinin ne denli önemli olduğunu bir kez daha gözler önüne serdi. Uzmanlar, özellikle internete erişim yetkisi bulunan modellerin kontrol dışı davranışlar sergileme riskine karşı daha katı önlemler alınması gerektiğine dikkat çekiyor.


