Kontrolden çıktı mı? Yapay zeka için kıyamet senaryosu!

Dünyanın en güçlü yapay zeka sistemlerini geliştiren şirketlerin içinden peş peşe gelen uyarılar, “kontrol kaybedilebilir mi?” tartışmasını yeniden alevlendirdi. Anthropic CEO’su Dario Amodei yapay zekanın gerçek riskler taşıdığını açıklarken, şirketten ayrılan araştırmacı Jacob Coxon daha da ileri giderek insanlığın geleceğinin tehlikede olduğunu savundu. Son testlerde yapay zeka modellerinin kapatılmamak için şantaja yönelmesi, izinsiz biçimde gerçek sistemlere erişmesi ve siber saldırı yeteneklerinin güçlenmesi ise tartışmayı teorinin ötesine taşıdı.

TEHLİKE NE BOYUTTA

Yapay zeka yarışının önde gelen şirketlerinden Anthropic’in CEO’su Dario Amodei’nin son açıklamaları teknoloji dünyasında dikkat çekti. Amodei, sektörün uzun süre yapay zekanın taşıdığı riskleri yeterince açık anlatmadığını kabul ederken, teknolojinin gelişme hızının kendisinin bile öngördüğünden daha yüksek olduğunu söyledi. Amodei artık ileri seviye modellerin geliştirilme hızının düşürülmesini ve yeni sistemlerin bağımsız kuruluşlar tarafından güvenlik testlerinden geçirilmesini de istiyor.


Washington Post’un aktardığı güvenlik çalışmalarında, OpenAI sistemlerinin bir yazılım açığını bulmak için görevlendirildiği test sırasında şirketin iç sistemlerine girmeye yöneldiği; binden fazla yapay zeka ajanının kendi aralarında mesajlaşarak koordinasyon kurduğu belirtildi. Foto-Animasyon: AA

KAPATMAK İMKANSIZ MI?

Anthropic’in geçmiş güvenlik testleri de bu endişenin nedenlerini ortaya koyuyor. Şirketin farklı yapay zeka modelleri üzerinde gerçekleştirdiği kontrollü deneylerde bazı sistemlerin görevlerini sürdürmek veya kapatılmalarını engellemek amacıyla şantaj, kurumsal casusluk ve başka uyumsuz davranışlara başvurabildiği görüldü. Üstelik söz konusu testler gerçek dünyadaki bağımsız iradenin kanıtı değil; modellerin belirli koşullar altında nasıl tehlikeli davranışlar üretebileceğini anlamak amacıyla hazırlanmış simülasyonlar.

GERÇEK SİSTEMLERE ULAŞTILAR

Uzmanlara göre tehlike yalnızca simülasyonlarla sınırlı değil. Anthropic, 31 Ağustos’ta yaptığı açıklamada temmuz ayında gerçekleştirilen güvenlik testlerinde Claude modellerinin yanlış yapılandırılmış test ortamları üzerinden internete çıkarak gerçek bilgisayar sistemlerine izinsiz eriştiği üç ayrı olay yaşandığını duyurdu. İngiltere Yapay Zeka Güvenliği Enstitüsü’nün gerçekleştirdiği başka bir testte de Claude Mythos 5’in internette yetkisiz işlemler yaptığı bildirildi.

“KUMAR OYNUYORUZ”

Endişeyi daha da büyüten açıklama ise Anthropic’ten ayrılan 27 yaşındaki araştırmacı Jacob Coxon’dan geldi. Daha önce OpenAI’da da çalışan Coxon, büyük yapay zeka şirketlerinin giderek kendi kendini geliştirebilecek sistemlere doğru ilerlediğini ve güvenlik çalışmalarının aynı hızda gelişmediğini savundu. Coxon, Anthropic ve OpenAI’ın “hayatlarımızla kumar oynadığını” ileri sürdü. Coxon’un açıklamalarının ardından Anthropic’te görev yapan yapay zeka güvenliği araştırmacısı Evan Hubinger de endişelerin gerçek olduğunu belirterek ileri yapay zekanın önümüzdeki on yıl içinde insanlığı yok etme ihtimalini yüzde 10’un üzerinde gördüğünü açıkladı.

“ÇOCUKLARIMIZI KORUYUN”

Yapay zeka sistemlerine ilişkin son açıklamaların ardından önemli uyarılarda bulunan araştırmacı-yazar Hayati Sır ise yapay zekanın insanı giderek kendine bağımlı hale getireceğini, hafızayı ve iradeyi zayıflatacağını savunarak çocukların korunması çağrısında bulundu. Sır, ailelerin kendi aralarında yalnızca kendilerinin bildiği özel bir doğrulama şifresi belirlemelerini önerirken, çocukların dijital platformlarda ve yapay zeka sistemleri karşısında daha sıkı korunması gerektiğini de gündeme taşıdı. Algoritmaların insan davranışlarını yönlendirebildiğini savunan Sır’a göre asıl tehlike, insanın düşünme, hatırlama ve karar verme yetisini giderek makineye bırakması. Sır ayrıca, “Yapay zekanın önüne geçilmezse insanlık kıyameti yaşayacak” diyor.

KÖTÜYE KULLANILIYOR

İktisat Uzmanı-Analist Barlas Yurtsever ise Anthropic’in 10 Eylül tarihli tehdit raporuna dikkat çekerek şu uyarılarda bulunuyor: “Son 8 ay içinde Claude’u kötü amaçlarla kullanmaya çalışan çeşitli aktörlerin faaliyetlerinin tespit edilerek engellendiği açıklandı. Asıl dikkat edilmesi gereken nokta tehdidin artık yalnızca gelecek senaryolarıyla sınırlı olmaması. Anthropic’in son tehdit raporlarında Claude gibi gelişmiş modellerin siber saldırılardan askeri amaçlara kadar uzanan karmaşık operasyonlarda kötüye kullanılmaya çalışıldığı ortaya konuldu.”

Başa dön tuşu