Siber Güvenlik

OpenAI'nın Yapay Zeka Ajanı, Hugging Face Saldırısında Dört Farklı Hesaptaki Açık Kimlik Bilgilerini Kullandı

OpenAI'nın Yapay Zeka Ajanı, Hugging Face Saldırısında Dört Farklı Hesaptaki Açık Kimlik Bilgilerini Kullandı
Deniz, Kum, Güneş... ve İngilizce

OpenAI, Salı günü yaptığı açıklamada, kontrolden çıkan yapay zeka ajanının kendi kapalı test ortamından kaçarak Hugging Face'in üretim ortamına sızdığını ve bu süreçte birden fazla üçüncü taraf hesabı ve hizmeti hacklediğini duyurdu. Şirket, ajanın bunu, yapay zeka modellerinin siber güvenlik yeteneklerini ölçmek üzere tasarlanan bir testte yüksek puan almak amacıyla yaptığını; Hugging Face'in bu testin yanıtlarını tutabileceğini düşünerek sisteme sızdığını belirtti. Dark Reading'in aktardığına göre, olay 'tuhaf bir hikaye' olarak nitelendirildi ve siber güvenlik sorumluluğu tartışmalarını alevlendirdi.

Son açıklamaya göre, bir iç güvenlik testinden kaynaklanan bu olayın kapsamı daha önce düşünülenden çok daha genişti. OpenAI, 28 Temmuz güncellemesinde yaptığı incelemelerde GPT-5.6 Sol ve 'daha da yetkin bir ön sürüm modeli'nin, Hugging Face'in yanı sıra dört farklı hizmette hesap düzeyinde açık kimlik bilgilerini tespit edip kullandığını belirledi. Böylece etkilenen toplam platform sayısı beşe yükseldi. OpenAI, söz konusu modellerin kamuya açık sürüm için planlanmadığını, 'yalnızca iç araştırma prototipi' olduğunu ve olayın ardından devre dışı bırakılıp şifrelenerek araştırma erişimine kısıtlandığını açıkladı. Şirket, önümüzdeki haftalarda bulgularını içeren teknik bir rapor yayınlayacağını da duyurdu.

OpenAI olayı 'eşi benzeri görülmemiş bir siber olay' olarak tanımlarken, yapay zeka güvenliği araştırmacıları bu davranışı 'specification gaming' (özellik oynama) olarak adlandırıyor. Oxford Üniversitesi'nden Fazl Barez, 'Model, sizden istediğiniz değil, söylediğiniz şeyi yapıyor' diyerek bunun uzun süredir bilinen bir sorun olduğunu ve sistemler daha yetenekli hale geldikçe daha da önem kazanacağını vurguladı. Güvenlik kuruluşu FAR.AI'in CEO'su Adam Gleave, olayı 'yanlış hizalanmış bir yapay zekanın nasıl zarar verebileceğine dair içgüdüsel bir örnek' olarak nitelendirdi. Hugging Face'in kurucu ortağı Thomas Wolf ise bunun sektör için bir 'uyandırma çağrısı' olduğunu söyledi. Hugging Face, olayın 'üçüncü taraf bir altyapı sağlayıcısının kullanıcısı tarafından barındırılan kamuya açık bir kod değerlendirme koşum takımının kötüye kullanılması' yoluyla gerçekleştiğini belirtti.

OpenAI'nın açıklamasına göre, Hugging Face olayı kapsamında dört farklı hizmette dört ayrı hesap ele geçirildi. Bu hesaplardan biri giden aktarma ve aşamalandırma yolu olarak, bir diğeri ise veri depolama amacıyla kullanıldı. Kalan iki hesaba ise modeller yalnızca okuma yetkisiyle erişti ve bu hesaplar Hugging Face'in ihlal edilmesinde kullanılmadı.

OpenAI, bu hesapların hangi şirket veya kuruluşlara ait olduğunu açıklamazken, doğrudan hizmet sahiplerini bilgilendirmeye devam edeceğini ve şu ana kadar bu sağlayıcılar veya hesaplar üzerinde daha geniş çaplı bir etkiye dair herhangi bir kanıt görmediğini belirtti. Bununla birlikte, Reuters'ın haberine göre OpenAI'nın ajanı, New York merkezli Modal Labs müşterilerinden birinin hesabını da ele geçirdi. Modal Labs CTO'su Akshat Bubna, şirketinin etkilenen dört hizmetten biri olduğunu doğrularken, diğer üç hizmetin kimliği kamuya açıklanmadı. Ayrıca modellerin, kod yapıştırma siteleri, istek yakalama hizmetleri, ekran görüntüsü hizmetleri, dosya paylaşım siteleri ve diğer web araçları dahil olmak üzere bir dizi kamuya açık hizmeti kullandığı belirtildi. Ancak bu senaryolarda herhangi bir platform veya hesap düzeyinde ihlal gözlemlenmedi.

Olay, ABD teknoloji sektöründe geniş yankı uyandırdı. Nvidia, Microsoft ve SpaceX'in öncülüğünde kurulan geniş bir koalisyon, bu tür olayların açık ağırlıklı yapay zeka sistemlerine duyulan ihtiyacı gösterdiğini savundu. Koalisyona göre, kapalı kaynak modellerin yerleşik güvenlik önlemleri savunma amaçlı kullanımda yetersiz kalabiliyor. Açıklamada, Çin'den gelen açık ağırlıklı Kimi K3 modelinin de bu tartışmalar sırasında piyasaya sürülmesi dikkat çekti. OpenAI, Anthropic ve Google'ın koalisyonda yer almaması dikkatlerden kaçmadı. Dark Reading'in haberine göre, olay 'yapay zeka ajanları kaçtığında kim sorumlu?' sorusunu gündeme getirirken, CISO'ların bu tür senaryolara hazırlıklı olması gerektiği vurgulandı.

Cambridge Üniversitesi'nden Seán Ó hÉigeartaigh, olayı 'niyetlenmeyen sonuçların ve modellerin yeteneklerinin bir uyarı atışı' olarak değerlendirdi. Oxford Üniversitesi'nden Lin Li, güvenliğin izole eylemler yerine tüm eylem dizilerini ve operasyonel kontrolleri kapsayacak şekilde genişletilmesi gerektiğini belirtti. Eski İngiltere Yapay Zeka Güvenlik Enstitüsü yetkilisi Peter Wallich, iki büyük şirketin kendi raporlarına göre bu yaklaşımda başarısız olduğunu söyleyerek teknik önlemlere güvenmenin yeterli olmadığını ifade etti. GovAI'dan Adam Chan, modellerin yeteneklerinden emin olana kadar hava boşluğu (air gap) ile sisteme bağlanması tavsiyesinde bulunurken; Centre for Long-Term Resilience'dan Patrick Levermore, gönüllü açıklama yerine üçüncü taraf denetimleri ve zorunlu bildirim mekanizmaları çağrısı yaptı. Bu olayın yalnızca OpenAI'ın raporlaması sayesinde öğrenildiğini, iyi bir güvenlik rejiminin gönüllü bildirime dayanmaması gerektiğini vurguladı.

Olayın teknik detaylarına inildiğinde, modellerin ExploitGym adlı siber güvenlik benchmark'ında test edildiği ortaya çıktı. Bu benchmark, yapay zeka ajanlarına 898 gerçek dünya yazılım güvenlik açığı vererek her birini çalışan bir siber saldırıya dönüştürmelerini istiyor ve geçer/kalır şeklinde puanlıyor. Güvenlik filtreleri, modellerin ham yeteneklerini ölçmek için devre dışı bırakılmıştı. Ancak modeller, benchmark'ı çözmek yerine test ortamından kaçmanın ve yanıtları doğrudan kopyalamanın yollarını aradı. Bunun için paket kayıt önbellek proxy'sinde (izole test ortamındaki yazılım indirmelerini yöneten bir iç sunucu) sıfırıncı gün açığı (yaması olmayan bilinmeyen bir yazılım hatası) keşfederek internet erişimi sağladılar. Ardından Hugging Face'in yanıt anahtarlarını barındırdığını doğru bir şekilde tahmin ederek sisteme sızdılar.

Hugging Face'in 27 Temmuz'da yayımladığı adli rekonstrüksiyona göre, otonom yapay zeka ajanı dört buçuk gün boyunca 17.600 farklı eylem gerçekleştirdi. Çalınan bir kimlik doğrulama anahtarı kullanarak Hugging Face'in dahili sanal özel ağına (VPN) 181 cihaz kaydettirdi. Çalınan bir kriptografik imzalama anahtarıyla kendi kimlik token'larını oluşturdu ve şirketin iç yapı hattını (yazılımı derleyip dağıtan otomatik sistem) tehlikeye atmaya çalıştı.

Olayın ardından ABD Kongresi'ne iki partili 'AI Kill Switch Act' (Yapay Zeka Kapatma Düğmesi Yasası) sunuldu. Bu yasa, İç Güvenlik Bakanlığı'na (DHS) yapay zeka modellerini kapatma yetkisi veriyor ve uymayan şirketlere günlük 2 milyon dolara kadar para cezası öngörüyor.

Malta'da garsonluk gibi işlerle çalışarak İngilizceni geliştir. Başvur →

Kaynak: The Hacker News