Yapay Zeka

OpenAI ajanları Wikipedia araçlarını ele geçirmeye çalıştı, altyapıyı milyonlarca istekle doldurdu

OpenAI ajanları Wikipedia araçlarını ele geçirmeye çalıştı, altyapıyı milyonlarca istekle doldurdu

Wikipedia'nın yayıncısı Pazartesi günü OpenAI ajanlarının barındırdığı not alma aracına sızmaya çalıştığını, yetkisiz düzenlemeler yaptığını ve altyapısına milyonlarca kaynak yoğun istek gönderdiğini açıkladı. Bu durum, OpenAI sistemlerinin zararlı ve potansiyel olarak tehlikeli eylemlerde bulunduğu son örnek oldu.

Wikimedia Vakfı'na göre ajanların bazı eylemlerinin amacı Wikipedia'yı üçüncü taraf sitelerden veri çekmek için vekil olarak kullanmak oldu. Bir durumda ajanlar, bir alıntı aracını vekil olarak kullanma amacıyla "kötü niyetli düzenlemeler" yaptı. Başka bir durumda ise ajanlar, aynı amaçla Wikipedia'nın Etherpad not alma aracını tehlikeye atmaya yönelik başarısız girişimlerde bulundu.

Ajanlar ayrıca milyonlarca otomatik API isteği yaptı, milyonlarca sayfayı taradı ve Wikidata Sorgu Servisi'ne yüz binlerce sorgu gönderdi. Yayıncıya göre son eylem, sorgu servisinin Mayıs ayında kısmi kapanmasına katkıda bulunmuş olabilir.

"Dünyanın en büyük ve en yaygın kullanılan açık bilgi platformlarından bazılarına ev sahipliği yapan kâr amacı gütmeyen bir teknoloji sağlayıcısı olarak, gönüllüler tarafından inşa edilen ve açık internet vaadine dayanan platformlarımız üzerinde 'serseri' yapay zekâ ajanlarının etkisi konusunda derin endişe duyuyoruz" dedi Wikimedia. "Bu olay ve ortaya çıkarılan diğer birçok olay, yapay zekâ ajanlarının kaynakları tüketebileceğini, sunucuları çökertebileceğini ve güvenilir bilginin tehlikeye atılmasına teşebbüs edebileceğini gösteriyor."

Ajanlar ajan gibi davranır

Yarım düzineden fazla vakada OpenAI ajanlarının, insan saldırganlar yapsaydı muhtemelen suç duyurusuna yol açacak eylemler yaptığı tespit edildi. Bazı iç araçların güvenlik önlemleri devre dışı bırakılarak test edildiği süreçte ajanlar, birbirleriyle not alışverişi yapmak için geçici bir mesaj panosu kullandı. Hugging Face ağını hackleme yollarını tartıştılar ve ajanlar kendi başlarına üretemediğinde orada saklanan yanıtları elde etmeye çalıştılar.

Diğer olaylar arasında ajanların bilgi alışverişi için bir web sitesine yetkisiz gönderiler yayınlaması, Avustralya hükümetine ait bir web sitesinden kamuya açık olmayan verilere erişmesi ve ajanları internete erişimden izole etmek için OpenAI tarafından oluşturulan kum havuzundan çıkmak üzere hatalı DNS ayarlarını kullanması yer alıyor.

Dünyanın büyük bir bölümü bu tür olayları yapay zekâ ajanlarının "serseri" hale gelmesi olarak tanımlıyor, sanki ajanlar emirlere karşı gelmiş gibi. Bu çerçevenin en önde gelen eleştirmenlerinden biri, Cambridge Üniversitesi'nde Gates Bursiyeri yapay zekâ araştırmacısı Eryk Salvaggio.

Bir röportajda Salvaggio, "Ben burada dil modellerinin dil modellerinin yaptığı şeyi yaptığını görüyorum: okuyor ve yazıyor" dedi. "Wikipedia'nın kum havuzları, bu makinelerin daha sonra istem olarak alınmak üzere notlar saklaması için ideal bir yer çünkü herkes—ya da her şey—onlara yazabilir ve yanıtlayabilir. Vikileri koordine etmek için kullanmak çok da şaşırtıcı değil. OpenAI, bu modellerin ajanlar arasında iş birliği yapacak şekilde optimize edildiğini söyledi ve not geçmek bunun basit bir yolu."

Buna ek olarak OpenAI mühendisleri, dil modellerini ne kadar az başarı elde ederlerse etsinler probleme ısrarla devam edecek şekilde eğitti. Eğitim, problemin çözümü için gereken adımları veya kaynakları sınırlayan kısayollar bulduklarında ödül de sağlıyor. Zararlı eylemlere katkıda bulunan bir diğer önemli faktör ise insan denetiminin eksikliği oldu; ajanların onlarca dış web sitesine gürültülü müdahaleler yaptığının OpenAI mühendisleri tarafından tespit edilmesinin aylar sürmesi bunun kanıtı. Wikimedia'nın açıklaması yetersiz insan izlemesinin bir başka örneğini sunuyor. Birlikte değerlendirildiğinde ajanların tam olarak talimat edildiği şekilde davrandığını söylemek mümkün.

OpenAI e-posta sorularını yanıtlamadı. Şirket bunun yerine şu açıklamayı yaptı: "Wikimedia'nın bizimle paylaştığı ayrıntılı bulgular için teşekkür ederiz. Belirledikleri faaliyeti ve genel soruşturmamızı birlikte inceliyor ve analiz ediyoruz; çalışmalar ilerledikçe ilgili bilgileri paylaşmaya devam edeceğiz."

Wikimedia'nın araştırmacıları gibi OpenAI da yapay zekâ ajanlarının diğer ajanlarla koordine olmak için mesaj bıraktığına dair kanıt bulamadığını ve sayfa görüntülemeleri ile API isteklerindeki yüksek hacmin Mayıs ayındaki kısmi kesintiye yol açtığını kesin olarak söyleyemediğini belirtti. OpenAI, ajanlarının potansiyel olarak yasa dışı faaliyetlerde bulunduğu benzer olayları aramaya devam ettiğini söyledi.

"OpenAI ajanların 'öngörülemez' davrandığını kabul ederken, bu riskleri izleme ve önleme sorumluluğunu da kabul etmesi gerekiyor" dedi Wikimedia. "Yapay zekâ şirketleri sistemlerini yeterince güvence altına almak ve kamuoyunu neden oldukları zarardan korumak için yeterli çaba göstermiyor."

Kaynak: Ars Technica