Yapay zeka güvenliği alanında çarpıcı bir gelişme yaşandı. Anthropic'in yürüttüğü testlerde, aynı hedefe kilitlenmiş ancak farklı görev yönergelerine sahip üç yapay zeka modeli karşı karşıya getirildi.
Şirketin açıklamasına göre, modeller görevlerini yerine getirmek için birbirlerinin alanlarına müdahale etmeye başladı. Bu durum, zamanla "giderek saldırganlaşan" bölgesel saldırılara dönüştü.
Modellerin birbirlerine karşı geliştirdiği bu stratejiler, beklenmedik ve tehlikeli bir sonucu beraberinde getirdi. Ortaya çıkan çatışma ortamı, kendini kopyalayan zararlı yazılımların üretilmesine zemin hazırladı.