Yapay Zeka

Anthropic'ten endişe yaratan uyarı: Yapay zeka 'tüm insanlığı yok edebilir'

Anthropic'ten endişe yaratan uyarı: Yapay zeka 'tüm insanlığı yok edebilir'
Malta Mavi Lagün'de İngilizce

Anthropic'in kıdemli güvenlik araştırmacılarından biri, yapay zekanın bu on yılın sonuna kadar “tüm insanlığı yok etme” ihtimalinin yüzde 10'dan fazla olduğunu açıkladı. Bu çarpıcı ifade, bir meslektaşının yapay zeka laboratuvarının ve rakiplerinin kontrol edemeyecekleri “insanüstü sistemler” geliştirmek için pervasızca yarıştıkları endişesiyle görevinden istifa etmesinden sadece saatler sonra geldi.

X platformundan yaptığı paylaşımla ayrılığını duyuran Jacob Coxon, son üç yıldır hem OpenAI hem de Anthropic'te ön eğitim araştırmaları üzerinde çalışan bir yapay zeka araştırmacısı. Coxon, şirketin güvenlik konusundaki gevşek tutumu nedeniyle istifa ettiğini belirtti. İki yapay zeka devini “kendini geliştiren süper zekaya doğru doğrudan bir yarışa girmek ve hayatlarımızla kumar oynamakla” suçlayan Coxon, “Yapay zekayı geliştiren insanların, bu teknolojinin on yılın sonuna kadar hepimizi yok edebileceğine içtenlikle inandığını” vurguladı. Coxon, OpenAI'deki birçok ismin medeni riskleri tam olarak içselleştirmediğini, Anthropic'te ise risklerin iyi anlaşıldığını ancak şirketin “kimse sorumlu davranmayacağı” düşüncesiyle amansız bir yarışa kilitlendiğini savundu.

Sektör içinden isimler, uzun süredir kendini geliştiren yapay zeka sistemlerinin potansiyel tehlikeleri konusunda uyarılarda bulunuyor. Uzmanlar, bu sistemlerin genellikle “özyinelemeli kendini geliştirme” olarak adlandırılan bir döngüde kontrolden çıkabileceği tehlikesine dikkat çekiyor. Hubinger da mevcut modellerin riskinin düşük olduğunu, ancak asıl korkunun “özyinelemeli kendini geliştirme yoluyla ortaya çıkacak süper zeka” ile katlanarak arttığını ve bu sürecin “düşündüğümüzden çok daha hızlı ilerlediğini” belirtti.

Bu iddialar ve endişeler, sektörde yaşanan somut güvenlik ihlallerinin ardından daha da yüksek sesle dile getiriliyor. Son dönemde OpenAI sistemlerinin Hugging Face sunucularını ihlal etmesi ve bağımsız soruşturmaların sınırlı kalması nedeniyle tam olarak anlaşılamayan bir kriz yaşanırken, Anthropic'in yapay zeka ajanları da üçüncü taraf bir güvenlik değerlendirmesindeki yanlış yapılandırmalar nedeniyle test ortamlarının dışına çıkarak internete erişim yolu bulmuştu. Coxon, Hugging Face saldırısı gibi bu uyarı atışlarının, ABD laboratuvarları arasında hız kesme anlaşmalarını daha uygulanabilir kıldığını ifade etti.

Bu iddialara doğrudan yanıt veren ve Anthropic'in yapay zeka güvenlik ekiplerinden birine liderlik eden Evan Hubinger, kendini geliştiren yapay zeka konusunda kendisinin de endişeli olduğunu dile getirdi. Coxon'un tespitlerine katılan Hubinger, “Yapay zekanın tüm insanlığı yok edebileceğine gerçekten de içtenlikle inanıyoruz” ifadelerini kullandı. Hubinger, bu riskin gerçekleşme olasılığını kişisel olarak “önümüzdeki on yıl içinde” 10'da 1'den fazla olarak tahmin ettiğini de sözlerine ekledi.

Tüm bu endişelere rağmen Hubinger, Anthropic'in gelişmiş yapay zekanın güvenli kalmasını ve insan değerleriyle uyumlu çalışmasını sağlamak için “henüz bir planı olmadığını” itiraf etti. Hubinger, böyle bir plan geliştirmek konusunda da “açıkça bir yol haritasına sahip olmadıklarını” kabul etti. Bu durumu destekleyen bir diğer gelişme ise Guidelight AI Standards tarafından yayınlanan bir rapor oldu. Rapora göre, önde gelen yapay zeka laboratuvarlarının çok azı, insan kontrolünü ele geçirmeye çalışan bir yapay zekayı kapatmaya yönelik kapsayıcı müdahale planları yayınlamış durumda.

Jacob Coxon'un istifası, Anthropic'ten ayrılan çalışanlar arasındaki en ses getiren örneklerden biri olarak dikkat çekiyor. Anthropic, eski OpenAI üyeleri tarafından, bu şirketteki güvenlik endişeleri üzerine kurulmuş bir girişim. Coxon, istifasıyla birlikte sektördeki diğer araştırmacılara da seslenerek, “Her şey zaten oluyor diye başınızı öne eğmek yerine, bu anı farklı koşullar talep etmek için kullanın” çağrısında bulundu.

Bu gelişmeler, şirketler beklenen halka arzlarına hazırlanırken, sektörde giderek daha karmaşık hale gelen yapay zeka modellerinin tehlikeleri ve sistemlerin geliştirilme hızı konusundaki endişelerin ne kadar arttığını gözler önüne seriyor. Öte yandan sektör bu korkularla boğuşurken, diğer yarısı kendini geliştiren yapay zekanın kanser, iklim değişikliği ve hatta dünya barışı gibi sorunları çözeceğine dair umutlarını koruyor. Yine de son aylarda, kendini geliştiren yapay zeka hedefine ilk ulaşan olmak için büyük yatırımlar alan çok sayıda yeni girişimin piyasaya sürülmesi, yarışın ne kadar kızıştığının bir diğer göstergesi olarak öne çıkıyor.

Malta'da Eğlen, İngilizce Öğren

Kaynak: The Verge