Dünyanın en kuvvetli suni zeka sistemlerini geliştiren şirketlerin içinden peş peşe gelen ikazlar, “denetim kaybedilebilir mi?” tartışmasını tekrardan alevlendirdi. Anthropic CEO’su Dario Amodei suni zekanın gerçek riskler taşıdığını açıklarken, şirketten ayrılan araştırmacı Jacob Coxon daha da ileri giderek insanlığın geleceğinin tehlikede bulunduğunu savundu. Son testlerde suni zeka modellerinin kapatılmamak için şantaja yönelmesi, izinsiz şekilde gerçek sistemlere erişmesi ve siber hücum yeteneklerinin güçlenmesi ise tartışmayı teorinin ötesine taşıdı.
TEHLİKE NE BOYUTTA
Suni zeka yarışının önde gelen şirketlerinden Anthropic’in CEO’su Dario Amodei’nin son açıklamaları teknoloji dünyasında dikkat çekti. Amodei, sektörün uzun süre suni zekanın taşımış olduğu riskleri yeterince açık anlatmadığını kabul ederken, değişen teknolojinin gelişme hızının kendisinin bile öngördüğünden daha yüksek bulunduğunu söylemiş oldu. Amodei artık ileri düzey modellerin geliştirilme hızının düşürülmesini ve yeni sistemlerin bağımsız kuruluşlar tarafınca güvenlik testlerinden geçirilmesini de istiyor.
Washington Post’un aktardığı güvenlik çalışmalarında, OpenAI sistemlerinin bir yazılım açığını bulmak için görevlendirildiği kontrol esnasında firmanın iç sistemlerine girmeye yöneldiği; binden fazla suni zeka ajanının kendi aralarında mesajlaşarak koordinasyon kurduğu açıklandı. Foto-Animasyon: AA
KAPATMAK İMKANSIZ MI?
Anthropic’in geçmiş güvenlik testleri de bu endişenin nedenlerini ortaya koyuyor. Firmanın değişik suni zeka modelleri üstünde gerçekleştirdiği kontrollü deneylerde bazı sistemlerin görevlerini sürdürmek yada kapatılmalarını engellemek amacıyla şantaj, kurumsal casusluk ve başka uyumsuz davranışlara başvurabildiği görüldü. Üstelik söz mevzusu testler gerçek dünyadaki bağımsız iradenin kanıtı değil; modellerin belirli koşullar altında iyi mi tehlikeli davranışlar üretebileceğini idrak etmek amacıyla hazırlanmış simülasyonlar.
GERÇEK SİSTEMLERE ULAŞTILAR
Uzmanlara gore çekince yalnızca simülasyonlarla sınırı olan değil. Anthropic, 31 Ağustos’ta yapmış olduğu açıklamada temmuz ayında meydana gelen güvenlik testlerinde Claude modellerinin yanlış yapılandırılmış kontrol ortamları üstünden internete çıkarak gerçek bilgisayar sistemlerine izinsiz ulaştığı üç ayrı vaka yaşandığını duyurdu. İngiltere Suni Zeka Güvenliği Enstitüsü’nün gerçekleştirdiği başka bir testte de Claude Mythos 5’in internette yetkisiz işlemler yapmış olduğu bildirildi.
“KUMAR OYNUYORUZ”
Endişeyi daha da büyüten izahat ise Anthropic’ten ayrılan 27 yaşındaki araştırmacı Jacob Coxon’dan geldi. Daha ilkin OpenAI’da da çalışan Coxon, büyük suni zeka şirketlerinin giderek kendi kendini geliştirebilecek sistemlere doğru ilerlediğini ve güvenlik çalışmalarının aynı hızda gelişmediğini savundu. Coxon, Anthropic ve OpenAI’ın “hayatlarımızla kumar oynadığını” ileri sürdü. Coxon’un açıklamalarının arkasından Anthropic’te vazife icra eden suni zeka güvenliği araştırmacısı Evan Hubinger de endişelerin gerçek bulunduğunu belirterek ileri suni zekanın önümüzdeki on yıl içinde insanlığı yok etme ihtimalini yüzde 10’un üstünde gördüğünü deklare etti.
“ÇOCUKLARIMIZI KORUYUN”
Suni zeka sistemlerine ilişkin son açıklamaların arkasından mühim uyarılarda bulunan araştırmacı-yazar Dirimsel Sır ise suni zekanın insanı giderek kendine bağımlı hale getireceğini, hafızayı ve iradeyi zayıflatacağını savunarak evlatların korunması çağrısında bulunmuş oldu. Sır, ailelerin kendi aralarında yalnızca kendilerinin bilmiş olduğu hususi bir doğrulama şifresi belirlemelerini önerirken, evlatların dijital platformlarda ve suni zeka sistemleri karşısında daha sıkı korunması icap ettiğini de gündeme taşıdı. Algoritmaların insan davranışlarını yönlendirebildiğini korumak için çaba sarfeden Sır’a gore aslolan çekince, insanoğlunun düşünme, anımsama ve karar verme yetisini giderek makineye bırakması. Sır ek olarak, “Suni zekanın önüne geçilmezse insanlık kıyameti yaşayacak” diyor.
KÖTÜYE KULLANILIYOR
İktisat Uzmanı-Analist Barlas Yurtsever ise Anthropic’in 10 Eylül tarihindeki tehdit raporuna dikkat çekerek şu uyarılarda bulunuyor: “Son 8 ay içinde Claude’u fena amaçlarla kullanmaya çalışan çeşitli aktörlerin faaliyetlerinin tespit edilerek zorla izin verilmediği açıklandı. Aslolan dikkat edilmesi ihtiyaç duyulan nokta tehdidin artık yalnızca gelecek senaryolarıyla sınırı olan olmaması. Anthropic’in son tehdit raporlarında Claude şeklinde gelişmiş modellerin siber saldırılardan askeri amaçlara kadar uzanan karmaşık operasyonlarda kötüye kullanılmaya çalışmış olduğu ortaya konuldu.”
