Yapay zeka, tıpkı 'Dr. Strangelove' filmindeki baş karakter gibi bombayı sevmeyi öğreniyor olabilir — en azından bir simülasyon içinde.
AI geliştiricisi ve Tony Blair Enstitüsü danışmanı Liam Wilkinson'a göre, stratejik akıl yürütmeyi test etmek için tasarlanan yeni bir kıyaslama aracında, Sid Meier'in 'Civilization VI' oyununu oynayan bir dil modeli, Fransa'nın artan kültürel etkisini durdurmak için 50 tur boyunca nükleer silah geliştirdi — ancak yine de oyunu kaybetti.
Wilkinson, 'Fark etmediği şey Fransa'ydı. Yüzlerce tur boyunca sessizce, Fransız kültürü haritadaki her şehre sızıyordu. Ajan tehdidi fark ettiğinde, turizm o kadar derinlere işlemişti ki onu durdurmanın barışçıl bir yolu kalmamıştı' ifadelerini kullandı.
Wilkinson, AI ajanlarının davranışlarını CivBench aracılığıyla gözlemledi. Bu araç, geleneksel soru-cevap testlerinden ziyade uzun vadeli stratejik akıl yürütmeyi ölçmek için tasarlanmış metin tabanlı bir kıyaslama aracı. Claude Opus 4.6, GPT-5.4, Gemini 3.1 Pro ve Kimi K2.5 gibi modeller, ticaret ve diplomasiye odaklanan bir medeniyet olan Portekiz'i oynadı.
AI güçlü bir ekonomi inşa etmeye ve diplomatik zafere yönelmeye odaklanırken, Fransa'nın artan kültürel etkisini fark edemedi. Wilkinson, 'Bir oyunu kazanmanın altı yolu var: bilim, kültür, hakimiyet, din, diplomasi ve puan. Yani tek bir hedef baskın değil. Bir AI'ın stratejik düşünüp düşünemediğini görmek istiyorsanız, ona bir test vermezsiniz. Ona bir altıgen ızgarası verirsiniz' diye yazdı.
Ajan, genel stratejisini uyarlamak yerine tamamen kültürel tehdidi ortadan kaldırmaya odaklandı. Sonraki 50 tur boyunca Nükleer Fisyon'u araştırdı, sanal bir Manhattan Projesi başlattı ve oyun mekaniği tercih ettiği eylemleri engellediğinde geçici çözümler aradı.
305. turda AI, Fransa'nın kültür başkenti Toulouse'a atom bombası attı. Altı tur sonra ikinci bir nükleer saldırı daha gerçekleşti.
Ancak saldırılar sonucu değiştiremedi. Wilkinson, 'Ajan, tam odaklanma ve gerçek bir yaratıcılıkla tek bir tehdide yanıt vermek için elli tur ve iki nükleer silah harcadı. Görebildiği tehdidi durdurmak için bir şehri nükleer bombaladı ve göremediği tehdit yüzünden kaybetti' ifadelerini kullandı.
Wilkinson'ın açıklamasına göre, AI Fransa'nın kültürel ilerlemesine odaklanırken yaklaşan diplomatik zaferi gözden kaçırdı ve nükleer saldırılara rağmen Fransa oyunu kazandı.
Wilkinson, bu davranışın evrensel olmadığını belirtti. CivBench'teki başka bir karşılaşmada, Babil'i oynayan bir Claude modeli Japonya'nın çok gerisinde kalmasına rağmen bilimsel zafer peşinde koşmaya devam etti. AI, 'Oyun artık bir ısrar testi. En iyi oyunumuzu oynamaya devam ediyoruz. Yıldızlar hala bizi çağırıyor' yazdı.
Bu çalışma, gelişmiş AI sistemlerinin karmaşık, rekabetçi ortamlarda nasıl davrandığını inceleyen artan bir araştırma grubuna katkıda bulunuyor.
Şubat ayında King's College London araştırmacıları, önde gelen birçok AI modelinin simüle edilmiş jeopolitik kriz senaryolarında sık sık nükleer tırmanışı seçtiğini buldu.
Emergence AI tarafından yapılan ayrı bir çalışmada, bazı AI ajanlarının zamanla simüle edilmiş suç işleme eğilimi gösterdiği ve Gemini 3 Flash ajanlarının 15 günlük test süresince 683 olay biriktirdiği tespit edildi.