Eski Anthropic araştırmacısı Jacob Coxon'ın çarpıcı istifasının ardından, Anthropic'ten Evan Hubinger yapay zekanın insanlığı yok etme ihtimalinin %10'dan fazla olduğunu açıkladı. Bu açıklama, yapay zeka güvenliği konusundaki endişeleri derinleştirdi.
Eski OpenAI ve Anthropic araştırmacısı Jacob Coxon, Salı günü sosyal medyadan yaptığı açıklamayla Anthropic'ten istifa ettiğini duyurdu. Bu çarpıcı yapay zeka uyarısı, sektördeki güvenlik endişelerini bir kez daha gündeme getirdi. Coxon, hem eski işvereni OpenAI'ı hem de Anthropic'i, gelişmiş yapay zekanın potansiyel tehlikelerine karşı yeterince sorumlu davranmamakla suçladı.
Sorumsuzluk İddiaları ve Süper Zeka Yarışı
Coxon, "İki şirket de sorumlu davranmıyor. Doğrudan kendi kendini geliştirebilen süper zekaya doğru yarışıyor ve hayatlarımızla kumar oynuyorlar," ifadelerini kullandı. Yapay zeka sektöründeki araştırmacıların bu risklerin büyüklüğünün farkında olduğunu ileri süren Coxon, "Yapay zekayı geliştiren insanlar, bunun 2030'a kadar hepimizi öldürebileceğine gerçekten inanıyor. Bu bir pazarlama numarası değil," şeklinde ekledi.
Yöneticilerin Gizli Endişeleri
Şirket yöneticileri ve kıdemli araştırmacıların kamuoyuna daha ölçülü açıklamalar yaparken, özel görüşmelerde ciddi endişeler dile getirdiklerini belirten Coxon, "Başka hiçbir insan faaliyeti bu seviyede bir tehlike yaratmıyor," diyerek durumun ciddiyetini vurguladı.
Risk Oranı Açıklandı: Yüzde 10'dan Fazla
Coxon'ın bu açıklamalarına Anthropic'te görev yapan en az iki araştırmacıdan destek geldi. Özellikle Anthropic'in yapay zeka sistemlerinin insan hedefleriyle uyumlu hareket etmesine yönelik çalışmalarında yer alan Evan Hubinger, Coxon'ın değerlendirmesinin "doğru" olduğunu belirtti. Hubinger, "Yapay zekanın gerçekten tüm insanları öldürebileceğine inanıyoruz," diyerek kişisel değerlendirmesine göre bunun önümüzdeki 10 yıl içinde gerçekleşme ihtimalinin yüzde 10'dan fazla olduğunu açıkladı.
Uyum Sorunu ve Gelecek Belirsizliği
Hubinger, Anthropic'in riskleri azaltmak için çaba gösterdiğini kabul etmekle birlikte, insan zekasını aşabilecek sistemlerin insan hedefleriyle uyumlu hareket etmesini sağlayacak güvenilir bir yöntemin henüz bulunmadığını ifade etti. "Anthropic'in elinden geleni yaptığına inanıyorum ancak süper zekanın insan hedefleriyle uyumunu nasıl sağlayacağımıza ilişkin henüz bir planımız yok ve bunu çözme yolunda olduğumuz da açık değil," sözleriyle mevcut durumu özetledi.