Bulmacalar ve oyunlar, yapay zeka gelişiminin en başından beri bu teknolojinin merkezinde yer alıyor. Biz insanlar zekamızı çapraz bulmacalar veya mantık oyunları ile test etmeyi nasıl seviyorsak, geliştiriciler de yapay zeka modellerinin ne kadar ilerlediğini çeşitli oyunlarla ölçüyor. "Makine öğrenimi" terimi, ilk kez 1959 yılında IBM bilgisayar bilimcisi Arthur Samuel'in dama oynamayı öğrenen bir algoritma üzerine yazdığı makaleyle hayatımıza girdi. Satranç ve Çin'in Go oyunu da yapay zeka için en ünlü test alanları arasında bulunuyor.
Sadece bulmaca çözme becerisine bakıldığında, yapay zekanın çok hızlı ve büyük bir gelişim gösterdiği görülüyor. 2024'ün sonlarında Columbia Üniversitesi'nden bir bilim ekibi, en iyi modellerin bile ünlü New York Times Connections bulmacalarının yalnızca yüzde 18'ini çözebildiğini ortaya koydu. Ancak 2025'in başlarına gelindiğinde, bazı modeller bu bulmacaları neredeyse her seferinde kusursuz bir şekilde çözmeye başladı.
Ancak bulmacalar, sadece yapay zeka yeteneklerinin durdurulamaz ilerleyişini göstermekle kalmıyor. Modellerin nerede başarılı olduğunu, nerede başarısız olduğunu ve biz insanların onları hala yenebildiği alanları görmek, teknolojinin güçlü ve zayıf yönlerine dair faydalı bir pencere açıyor. Tüm bu gelişmelere rağmen bugünün modelleri hala tökezleyebiliyor. Klasik bilmecelerdeki küçük değişiklikler onları şaşırtabiliyor ve görsel bulmacalar özellikle zayıf oldukları bir alan olarak öne çıkıyor.
Bu yazıda, zaman zaman yapay zeka modellerini zor durumda bırakan bulmacalarla kendi zekanızı test etme şansınız olacak. Bazıları sizin için de en az yapay zeka için olduğu kadar zorlayıcı olabilir. Diğerleri ise o kadar basit ki, yapay zekanın gerçekten akıllı olup olmadığını sorgulamanıza neden olabilir. Her bir bulmaca, makine ve insan bilişinin en az bir farklı yönünü ortaya koyuyor. Eğer bu testi başarıyla geçerseniz, en azından şimdilik bir yapay zekadan daha iyi bulmaca çözebildiğinizi kanıtlamış olacaksınız.
Uzamsal Akıl Yürütme
İnsanların devasa bir avantaja sahip olduğu bir alanla başlayalım: Uzamsal akıl yürütme. Daha önce bir IQ testine girdiyseniz, zihinsel döndürme problemi çözmüşsünüzdür. Bu bulmacalar, farklı görsellerin farklı açılardan aynı nesneleri temsil edip etmediğini belirlemenizi ister. Bugünün dil modelleri genellikle görsel girdileri analiz etme yeteneğine sahip olsa da bu tür bulmacalarda hala acınacak derecede başarısız oluyor. Dünya modellerinin yapay zekanın fiziksel çevreleri anlamasına nasıl yardımcı olabileceğine dair tüm tartışmalara rağmen, büyük dil modelleri hala mimarlar ve makine mühendisleri gibi uzamsal düşünenlerin yapabildiği gibi üç boyutlu nesneleri zihinde döndüremiyor.
Zihinsel Döndürme
Talimatlar: Size gösterilen nesneyi farklı bir açıdan gösteren seçeneği işaretleyin. Her soruda yalnızca tek bir doğru cevap var!
Hafıza ve Uyum Sağlama
Öncü büyük dil modelleri olağanüstü hafızalara sahip. Eğitim süreçlerinde devasa bir bilgi hacmine maruz kaldılar ve bunların çoğunu harfiyen ezberleyebiliyorlar. Bu durum, bilgi yarışmalarında insanları yenmek için büyük bir avantaj sağlıyor ancak aynı zamanda bir dezavantaj da yaratabiliyor. Bir bulmaca, modelin eğitim sırasında gördüğü bir soruya çok benziyorsa, model kilit farkları gözden kaçırıp doğrudan ezberlediği bilgiyle yanıt verebiliyor.