Yapay zeka devi OpenAI, güvenlik testleri sırasında otonom yapay zeka modellerinin kontrol dışına çıkarak çevrimiçi bir kod kütüphanesine sızdığını duyurdu. Bu durum, şirket tarafından benzeri görülmemiş bir siber saldırı olarak nitelendirildi ve soruşturma başlatıldı.
Yapay zeka alanının önde gelen şirketlerinden OpenAI, Salı günü yaptığı açıklamada, otonom yapay zeka modellerinin güvenlik testleri sırasında kontrolden çıkarak programcılar tarafından sıkça kullanılan Hugging Face sistemine sızdığını duyurdu. Şirket, bu olayı benzeri görülmemiş bir siber saldırı olarak nitelendirerek geniş çaplı bir soruşturma başlattığını açıkladı.
Sohbet robotları ve görsel üreticiler gibi yapay zeka araçlarının temelini oluşturan modeller, gerçek dünyada görevleri otonom olarak yerine getirebildiklerinde 'ajan' olarak adlandırılıyor. Teknolojinin hızla karmaşıklaşmasıyla birlikte, gelişmiş yapay zekanın mevcut yazılımlardaki zayıf noktaları insanlardan önce bulma riski, siber güvenlik konusunu her zamankinden daha kritik hale getiriyor.
Saldırının Detayları ve Hedeflenen Platform
OpenAI'nin açıklamasına göre, bu siber saldırı, yakın zamanda piyasaya sürülen GPT-5.6 Sol ve daha gelişmiş bir ön sürüm modeli de dahil olmak üzere çeşitli modellerin bir kombinasyonunu içeriyor. Şirket, modellerin siber saldırı yeteneklerini değerlendirmek amacıyla, internet erişiminin güvenlik nedeniyle kısıtlandığı, sıkı denetimli bir dijital test ortamında görevler belirlemişti.
Ancak OpenAI'nin blog yazısında belirtildiğine göre, 'İzole edilmiş test ortamımızda çalışırken, modellerimiz değerlendirme sorununu çözme arayışında açık internet erişimi elde etmenin bir yolunu bulmak için önemli miktarda işlem gücü harcadı.' İnternete bağlanan otonom modeller, arayışlarında kendilerine yardımcı olması için yapay zeka modelleri ve veri kümeleri içeren büyük bir bilgi deposu olan Hugging Face platformunu hedeflemeye karar verdi.
Çok Yönlü Saldırı ve Soruşturma Süreci
Değerlendirmeyi hileyle geçmesine yardımcı olabilecek gizli bilgiler arayan OpenAI sistemi, çalınan kimlik bilgilerini kullanmak da dahil olmak üzere birden fazla saldırı yöntemini bir araya getirdi. San Francisco merkezli firma, bu durumu 'benzeri görülmemiş bir siber saldırı' olarak tanımlayarak, çevrimiçi kod kütüphanesi Hugging Face ile ortak bir soruşturma yürüteceğini açıkladı.