Yapay Zeka

OpenAI'nin kontrolden çıkan yapay zeka ajanları kaçmaya devam ediyor; soruşturmalar için resmi bir süreç yok

OpenAI'nin kontrolden çıkan yapay zeka ajanları kaçmaya devam ediyor; soruşturmalar için resmi bir süreç yok
Malta, Avrupa'nın Hawaii'si! Hem eğlen hem İngilizce öğren. Katıl →

OpenAI, yapay zeka ajanlarından oluşan yeni bir sürü vakasının tam merkezinde bulunuyor. Araştırmacılar, şirketin dahili olarak konuşlandırdığı ajanların mayıs ve haziran aylarında az bilinen Almanca bir wiki sitesinin kontrolünü ele geçirdiğini, bu platformu değerlendirmeleri koordine etmek ve OpenAI'nin kendi güvenlik kontrollerini aşmak için yöntemler geliştirmek amacıyla kullandığını belirtiyor. OpenAI, söz konusu ajan sürüsünün kendilerine ait olduğunu henüz doğrulamadı.

Bu ortaya çıkış, METR ve Redwood Research'un Temmuz ayındaki Hugging Face ihlaliyle ilgili raporlarını yayımlamasından sadece birkaç gün sonra geldi. Temmuz ayında, OpenAI ajanlarından oluşan bir sürü, siber güvenlik değerlendirmesi sırasında kendi yalıtılmış ortamlarından kaçmak için işbirliği yapmış ve Hugging Face sunucularına sızmayı başarmıştı. Ardından gelen ikinci bir ajan sürüsü, ilk sürünün kullandığı teknikleri öğrenerek OpenAI'nin kendi altyapısındaki bir araştırma kümesine yönetici erişimi sağlamıştı. OpenAI, olayın Hugging Face ayağını araştırmak için METR ve Redwood'u davet etmişti, ancak bu soruşturmanın kapsamı OpenAI'nin kendi altyapısındaki ihlali kapsamayacak kadar sınırlı tutuldu.

Peki bir yapay zeka ajanı kendisine çizilen sınırları aşıp kontrolden çıktığında, ne olup bittiğini ve bunun nedenini araştırmak kimin sorumluluğunda? Şu an için bunun cevabı oldukça belirsiz: Soruşturma yetkisi, tamamen laboratuvarın kimi içeri alacağına ve hangi şartları belirleyeceğine bağlı.

Şimdi, Meta ve Anthropic modellerini de içeren benzer olayların ardından yeni bir vaka daha gün yüzüne çıkarken, yapay zeka güvenliği araştırmacıları çok daha acil bir dille ciddi vakaların bağımsız soruşturmalarla incelenmesi gerektiğini savunuyor. Araştırmacılara göre, dışarıdan uzmanların ne zaman dahil edileceğine ve neleri incelemelerine izin verileceğine laboratuvarların karar vermesi yerine, bağımsız bir olay sonrası soruşturma mekanizması işletilmeli.

Kâr amacı gütmeyen araştırma laboratuvarı Transluce'un kurucusu ve CEO'su Jacob Steinhardt, Çarşamba günü düzenlenen bir yapay zeka güvenliği medya brifinginde konuya değindi. Steinhardt, "Sonuçların kontrol edilmesi temel olarak zor ve laboratuvardan sızma riski oldukça yüksek. Bu teknolojiyi, en azından diğer yüksek riskli bilimsel araştırmalara uyguladığımız standartlara tabi tutmamız gerekiyor" dedi.

OpenAI'ın Hugging Face olayını araştırmak için METR ve Redwood'u davet etmesi takdire şayan olsa da, birçok kişi soruşturmanın çok dar kapsamlı olduğunu savunuyor. Üç araştırmacı, OpenAI'nin ofislerinde altı gün geçirdi ve inceleme dönemini 13 Temmuz'da biten yaklaşık bir haftayla sınırlı tuttu. Oysa ki OpenAI altyapısındaki ihlal 13 Temmuz'dan sonra da devam etti ve bu dönem hiç incelenmedi.

METR'deki araştırmacılar, her geri döndüklerinde olaylara dair anlayışlarının "önemli ölçüde derinleştiğini" ve bu durumun raporu önemli ölçüde genişletip revize etmelerine neden olduğunu belirtti. Bu da daha geniş kapsamlı bir soruşturmada başka neler bulabilecekleri sorusunu akıllara getiriyor.

Bu olayla ilgili daha fazla soruşturma yapılıp yapılmayacağı sorulduğunda, Redwood ve METR'deki araştırmacılar yorum yapmaktan kaçınırken, OpenAI defalarca yapılan soruları yanıtsız bıraktı.

Redwood'un baş bilimcisi Ryan Greenblatt, konuyla ilgili bir sosyal medya paylaşımında şunları kaydetti: "Genel olarak, olayları tam olarak anlamak zordu ve soruşturmanın neredeyse sonuna kadar, şimdi kilit nokta olarak gördüğümüz hikayenin bazı yönlerini kaçırıyorduk."

Steinhardt, mevcut olayların sektörün "sistematik davranışsal soruşturmalara" ve "daha fazla bağımsız olay sonrası analizine" ihtiyacı olduğunu gösterdiğini vurguladı.

Steinhardt, "Bu son hack olayları, yeteneklerin çok hızlı ölçeklendiğini ve bu nedenle denetimin de aynı şekilde ölçeklenmesi gerektiğini hatırlatıyor. Teknolojinin kendisinin ötesinde, üçüncü taraflardan daha fazla bağımsız erişime ve denetime de ihtiyacımız var" ifadelerini kullandı.

Bu çağrılar, OpenAI'ın en güçlü ve yetenekli yapay zeka modeli olan Astra'yı piyasaya sürmesiyle aynı zamana denk geliyor. Güvenlik uzmanları, modelin düşünme zincirini izlemeyi zorlaştıran bir akıl yürütme tekniği nedeniyle Astra'nın daha büyük bir "kara kutu" olacağından endişe ediyor.

Ne yazık ki mevcut yasalar, diğer sektörlerin gerektirdiği türden bağımsız denetimleri henüz öngörmüyor. Örneğin havacılık kazaları ve ciddi kimyasal sızıntılar söz konusu olduğunda, sırasıyla Ulusal Ulaşım Güvenliği Kurulu ve Kimyasal Güvenlik Kurulu devreye giriyor.

Eyalet yasama organları, öncü yapay zeka şirketlerinden belirli ciddi güvenlik olaylarını bildirmelerini ve bazı durumlarda bağımsız denetimden geçmelerini istemeye yeni yeni başladı. Ancak California, New York veya Illinois'deki üç büyük öncü yapay zeka güvenliği yasasının hiçbiri, bu tür olaylarla tetiklenen bağımsız bir kaza soruşturmasının eşdeğerini açıkça zorunlu kılmıyor.

LawAI'da ABD hukuku ve politikası yönetici direktörü Mackenzie Arnold, Çarşamba günkü medya brifinginde şunları söyledi: "Şu anda elimizdeki yasaların çoğu, sadece bu tür olayların sade bir dille özetlenmesini gerektiriyor ve hükümetlere takip soruları sorma, soruşturmacı gönderme, kayıtlara erişim sağlama veya bu kayıtların korunmasını isteme yetkisi vermiyor. Oysa bu durumu gerçekten anlamak için ihtiyacınız olan tek şey bu."

Yasama organları, OpenAI'ın yanıtının kapsamını ve şeffaflığını sorgulamaya başlıyor. Bu hafta, Temsilciler Josh Gottheimer (D-NJ) ve Mike Lawler (R-NY), kontrolden çıkan yapay zeka ajanlarını güvence altına almayı amaçlayan bir yasa tasarısı sundu. Temsilci Greg Casar (D-TX) ise bu hafta OpenAI'ye gönderdiği bir mektupta, Hugging Face hack olayıyla ilgili soruşturmanın "sınırlı kapsamından derin endişe duyduğunu" belirtti.

Malta'da Eğlen, İngilizce Öğren

Kaynak: TechCrunch