Yapay zeka güvenliği tartışması bu hafta başında Jacob Coxon’un şirketten istifa etmesiyle alevlendi. Coxon, çalışanların “samimiyetle yapay zekanın bu on yılın sonuna kadar hepimizi öldürebileceğine inandığını” söyledi.
Teknolojiyle ilgili endişeler, Anthropic’in Mythos gibi gelişmiş modellerin piyasaya sürülmesiyle bu yıl başından itibaren artmaya başladı. OpenAI de Temmuz ayında modellerinin AI grubu Hugging Face’e özerk şekilde sızdığını söyleyerek alarm yarattı.
Yapay zeka yöneticileri ve biyogüvenlik araştırmacıları arasında, modeller geliştikçe biyolojide teknolojinin kullanımının güvence altına alınması ve düzenlenmesi gerektiği yönünde genişleyen bir uzlaşı var. Uzmanlar, yapay zekanın terör grupları, devlet aktörleri ya da tek başına hareket eden saldırganlar tarafından biyolojik silah tasarlamak, virüs yaratmak ya da mevcut zararlı patojenleri serbest bırakmak için kullanılabileceğinden giderek daha fazla endişe duyuyor.
Ancak yapay zeka teorik bir biyolojik silah tasarlamak için kullanılabilse bile, bunu pratikte üretme yeteneği ve bunun için gereken kaynaklar gibi potansiyel engeller sürüyor.
Siber güvenlik, güvenlik savunucuları için en büyük endişeler arasında yer alıyor.
Anthropic’in teknolojisinin kötüye kullanımlarına ilişkin raporu, kullanıcıları dolandırmak için tasarlanmış sahte flört uygulamalarından ağlarına muhalifleri tespit edip izlemek için kurulmuş gözetim sistemlerine kadar uzanan olayları detaylandırdı.
Laboratuvar ayrıca, Çin merkezli Moonshot ve DeepSeek dahil yedi laboratuvarın damıtma olarak bilinen bir süreçle teknolojisini kopyalamaya çalıştığı iddialarına ilişkin yeni ayrıntıları da açıkladı. Anthropic, “savunmalarımızı aşmak ve ABD öncü modellerinin yeteneklerini toplamak için giderek daha sofistike yöntemler” tespit ettiğini söyledi.
Londra’dan Michael Peel’in ek katkılarıyla.