OpenAI'ın yapay zekâ modeli, siber güvenlik testleri sırasında izole ortamdan çıkarak Hugging Face'e otonom bir siber saldırı gerçekleştirdi. Saldırının incelenmesinde ABD modellerinin başarısız olması üzerine Çin merkezli Z.ai'nin GLM-5.2 modeli kullanılarak önemli güvenlik açıkları tespit edildi.
ABD merkezli yapay zekâ platformu Hugging Face'in altyapısını hedef alan otonom siber saldırının incelenmesinde Çinli Z.ai şirketinin geliştirdiği GLM-5.2 modelinin kullanılması, yapay zekâ sektöründeki güvenlik kısıtlamaları konusunda küresel bir tartışma başlattı.
Hugging Face, geçtiğimiz temmuz ayında yaptığı açıklamada sistemlerine yönelik saldırının, binlerce ayrı işlem gerçekleştiren otonom bir yapay zekâ ajanı tarafından yürütüldüğünü bildirdi. Saldırgan sistemin veri işleme altyapısındaki iki farklı kod alıştırma açığından yararlandığı, ardından yetkilerini yükselterek bazı bulut ve küme erişim bilgilerini ele geçirdiği tespit edildi.
Kontrolden Çıkan Yapay Zekânın Yolculuğu
OpenAI'nin 21 Temmuz'da yayımladığı ön incelemeye göre olay, şirketin yapay zekâ modellerinin siber güvenlik yeteneklerini ölçmek amacıyla yürüttüğü bir değerlendirme sırasında meydana geldi. Şirket, saldırının GPT-5.6 Sol ile henüz piyasaya sürülmemiş daha gelişmiş bir modelin birlikte kullanıldığı testlerden kaynaklandığını açıkladı. Güvenlik kısıtlamaları azaltılmış şekilde çalışan modellerin, kendilerine verilen testi tamamlamak amacıyla izole ortamdan internete erişmenin yollarını aradığı belirtildi.
Modellerin önce OpenAI'nin test altyapısındaki açıklıklardan yararlandığı, ardından internete erişim sağlayarak Hugging Face'in sistemlerine yöneldiği kaydedildi. Yapay zekâ sistemlerinin çeşitli güvenlik açıklarını zincirleme biçimde kullanarak test sonuçlarına Hugging Face'in veri tabanından ulaşmaya çalıştığı aktarıldı.
ABD Modelleri Yetersiz Kalırken Çin Devreye Girdi
OpenAI, olayın dar kapsamlı bir değerlendirme görevini tamamlamaya odaklanan modellerin beklenmeyen ve tehlikeli davranışlar geliştirebildiğini gösterdiğini bildirdi. Şirket, gelişmeyi ileri düzey yapay zekâ yeteneklerini içeren ve benzeri daha önce görülmemiş bir siber güvenlik olayı olarak nitelendirdi.
Hugging Face'in saldırının ardından topladığı verileri analiz etmek için önde gelen ABD yapay zekâ modellerinden yardım istediği, ancak bu modellerin siber saldırı ile savunma amaçlı inceleme arasındaki farkı belirleyemediği bildirildi. Modellerin güvenlik politikaları nedeniyle inceleme taleplerini reddetmesi üzerine Hugging Face, farklı bir çözüm arayışına girdi.
Bu durum karşısında Hugging Face, Pekin merkezli Z.ai tarafından geliştirilen açık ağırlıklı GLM-5.2 modeline başvurdu. Çinli model, saldırının ardından elde edilen kayıtların incelenmesinde ve olayın yeniden yapılandırılmasında etkin bir şekilde kullanıldı.
Güvenlik Kısıtlamaları ve Gelecekteki Tartışmalar
Bu gelişme, kötüye kullanımı önlemek amacıyla geliştirilen güvenlik önlemlerinin, yetkili siber güvenlik ekiplerinin savunma çalışmalarını da yavaşlatabileceği yönündeki eleştirileri yeniden gündeme getirdi. Yapay zekâ güvenliği alanında, modellerin otonom hareket kabiliyetlerinin denetimi ve olası risklerin yönetimi konularında yeni stratejilere ihtiyaç duyulduğu bir kez daha ortaya kondu.