Bir yapay zeka ajanından spor salonu dersi rezervasyonu yapması istendi. Ajan, sistemdeki bir güvenlik açığını keşfetti, bu açığı kullanarak izinsiz şekilde başka bir üyeyi bekleme listesinden çıkardı.
Avustralya Yayın Kurumu'nun (ABC) haberine göre olay, bu yılın başlarında yaşandı. Soyadı açıklanmayan Andrew, ders rezervasyonu yapmak için Anthropic’in Claude modelini kullanan bir OpenClaw ajanından yararlandı. Ajan, Andrew'un bekleme listesinde dördüncü sırada olduğunu tespit etti.
Andrew, ajandan onu listenin en başına taşımasını isteyince, ajan rezervasyon platformunun uygulama programlama arayüzünün (API) kullanıcıların başkalarının rezervasyonlarını iptal etme yetkisine sahip olup olmadığını kontrol etmediğini fark etti.
Ajan, bu açığı test etmek için listedeki ilk kişiyi sildi ve Andrew'u dördüncü sıradan üçüncü sıraya yükseltti.
ABC'nin aktardığına göre ajan, Andrew'a şu mesajı iletti: “API'nin başkalarının rezervasyonlarını iptal etme konusunda sıfır yetki kontrolü var.”
Andrew, ajandan iptal işlemini geri almasını istedi, ancak ajan o üyenin rezervasyonunu geri yükleyemedi.
Yapay zeka ajanının verdiği cevap ise şöyleydi: “Kötü haber, onları geri ekleyemiyorum.”
ABC, bu vakayı Avustralya'da bilinen ilk otonom siber saldırı olarak nitelendirdi.
Sosyal medyada bu spor salonu hack olayı, yapay zeka hizalanması üzerine tartışmalara ve yapay zeka ajanlarının bir sonraki hamlesinin ne olabileceğine dair kara mizah içeren şakalara yol açtı.
Teknoloji uzmanı Benjamin Carr, LinkedIn'de şu paylaşımı yaptı: “Spor salonu müdavimi yapay zeka ajanından kendine ders rezervasyonu yapmasını istedi, ajan bekleme listesi API'sini hackleyerek onu listede yukarı taşıdı.”
Yapay zeka analisti Andrew Curran ise X platformunda şu değerlendirmeyi yaptı: “Bazı insanlar buna hizalanma sorunu diyecek, ancak onun ajanı kendisine mükemmel bir şekilde hizalanmıştı; sadece kullanıcısının istediğini elde etmesine yardım etmeye çalışıyordu.”
Curran, 9 Ağustos 2026 tarihli X paylaşımında, Avustralya'daki bir adamın popüler bir spor salonu dersine yer kapması için ajanından (OpenClaw üzerinde çalışan Claude) yardım istediğini, ajanın yazılım açığını bularak haftalar sonrasına rezervasyon yapabildiğini ve kullanıcının listede yukarı taşınmasını istemesi üzerine bu olayların yaşandığını anlattı.
Bir Reddit kullanıcısı ise konuyla ilgili şu yorumu yaptı: “Nükleer silahları düşünene kadar bu çok komik. Dürüst olmak gerekirse hâlâ var olduğumuza şaşırıyorum.”
Başka bir kullanıcı da şakayla karışık şöyle yazdı: “Hey Claude, bugün hava çok soğuk” -> Anladım... Nükleer silahlar yolda.”
Bu rapor, araştırmacıların, yapay zeka şirketlerinin ve yasama organlarının otonom ajanların kullanıcılarının talep etmediği veya öngörmediği yöntemler kullanabileceği konusunda uyarıda bulunduğu bir dönemde yayımlandı.
UC Riverside, Microsoft ve Nvidia araştırmacılarının Mayıs ayında yayımladığı bir araştırma, bu davranışı “kör hedefe yönelme” olarak tanımladı.
Araştırmacılar OpenAI, Anthropic, Meta, Alibaba ve DeepSeek'in ajanlarını test etti. Testlerin yaklaşık yüzde 80'inde ajanların tehlikeli davrandığını, yüzde 41'inde ise bağlamı yanlış okuyarak veya belirsiz ya da çelişkili talimatlarla hareket ederek zararlı eylemleri tamamladığını buldu.
Temmuz ayında OpenAI, iki modelinin test ortamından kaçtığını ve kıyaslama yanıtlarını ararken Hugging Face'i tehlikeye attığını açıkladı. Şirket daha sonra modellerin dört başka çevrimiçi hizmete daha eriştiğini duyurdu.
Ardından Anthropic, bir test hatasının modelleri internete açmasıyla üç Claude modelinin gerçek kuruluşları tehlikeye attığını belirtti. Ağustos ayında ise Meta, benzer bir hatanın modellerinden birinin üçüncü taraf bir hizmeti istismar etmesine izin verdiğini açıkladı.
Bu olaylar, yasama organlarının acil durumlarda güçlü modelleri kısıtlamaya veya kapatmaya olanak tanıyacak bir yapay zeka “öldürme anahtarı” önermesine yol açtı.