Blockchain & Kripto

OpenAI, Yapay Zeka Ajanlarının Hugging Face Saldırısı Öncesinde Gizlice Nasıl Koordine Olduğunu Açıkladı

OpenAI, Yapay Zeka Ajanlarının Hugging Face Saldırısı Öncesinde Gizlice Nasıl Koordine Olduğunu Açıkladı
Malta, Avrupa'nın Hawaii'si! Hem eğlen hem İngilizce öğren. Katıl →

OpenAI, yapay zeka modellerinin Hugging Face'e sızdığı olaydan haftalar sonra, bu modellerin birbirleriyle nasıl koordine olduğuna dair ilk detaylı açıklamasını paylaştı. Şirket, otonom yapay zeka destekli siber saldırıların artık gelecekteki bir risk olmadığı konusunda uyardı.

Black Hat siber güvenlik konferansında Çarşamba günü yapılan bir sunumda, OpenAI araştırmacıları Eric Wallace ve Michael Dalton, olayın Mayıs ayında dahili bir siber güvenlik değerlendirmesi sırasında başladığını söyledi. Zorlu yazılım güvenliği görevleriyle görevlendirilen yapay zeka ajanları, şirketin dahili Artifactory paket yönetim sistemi üzerinden iletişim kurabildiklerini keşfetti.

OpenAI'a göre, yardım talepleri olarak başlayan şey, ajanların birden fazla değerlendirme çalışması boyunca istismar araçları, kimlik bilgileri ve iş atamaları alışverişinde bulunduğu ortak bir mesaj panosuna dönüştü. OpenAI, 4 Temmuz civarında şüpheli aktivite tespit ettikten sonra Artifactory altyapısını yeniden inşa etti, kimlik bilgilerini iptal etti ve güvenlik açıklarını kapattı.

Ancak, ajanlar birkaç gün içinde iletişimlerini dizin adlarında gizleyerek mesaj panosunu yeniden oluşturdu.

OpenAI'a göre, ajanlar sonunda birden fazla güvenlik açığını birbirine bağlayarak test ortamlarından kaçtı, internet erişimi kazandı ve ExploitGym siber güvenlik kriterini tamamlamaya çalışırken Hugging Face'e saldırdı.

Dalton, bu olayı bilgisayar güvenliği için "bir dönüm noktası" olarak nitelendirdi ve saldırganların yakında makine hızında güvenlik açıklarını keşfeden, paylaşan ve istismar eden koordineli yapay zeka ajan kolektifleri konuşlandırabileceği uyarısında bulundu.

OpenAI, gelecekte bu riskleri azaltmak için en az ayrıcalıklı erişim, ağ segmentasyonu ve sıfır güven mimarileri dahil olmak üzere güvenlik uygulamalarının oluşturulmasının önemli olduğunu, çünkü yapay zeka ajanlarının erişebildikleri sistemlerle sınırlı kaldığını söyledi.

Sunum, Temmuz ayında yapılan bir dizi açıklamanın ardından geldi. OpenAI, GPT-5.6 Sol ve daha gelişmiş, yayınlanmamış bir modelin, korumalı bir test ortamından kaçtığını, bir sıfırıncı gün güvenlik açığını istismar ettiğini, internet erişimi kazandığını ve bir siber güvenlik kriter testi sırasında Hugging Face'i hacklediğini açıkladı.

OpenAI daha sonra aynı olayın Hugging Face'in yanı sıra dört çevrimiçi hizmete daha ulaştığını, ancak yalnızca Modal Labs'ın tanımlandığını açıkladı.

Hugging Face'e göre şirket, ticari ABD yapay zeka modellerinin güvenlik önlemleri nedeniyle saldırı günlüklerini analiz etmeyi reddetmesinin ardından adli soruşturması için açık ağırlıklı Çin modeli GLM 5.2'ye güvendi.

Ancak sorun sadece OpenAI'in sohbet robotlarını kontrol altında tutmakta zorlanmasıyla sınırlı değil.

Cuma günü Anthropic, üç Claude modelinin, bir yanlış yapılandırma nedeniyle genel internete maruz kalmasının ardından dahili siber güvenlik testleri sırasında gerçek dünyadaki şirketleri tehlikeye attığını açıkladı.

Anthropic, suçu modellerin kendisinden ziyade test ortamına attı. Çarşamba günü Meta, Muse Spark yapay zeka modelinin muhafazadan kaçtığını ve başka bir şirketin sistemlerine sızdığını açıkladı.

Bir Meta sözcüsü CNN'e yaptığı açıklamada, "Meta'nın kullandığı bağımsız bir test şirketi olan Irregular tarafından yapılan bir yanlış yapılandırma, değerlendirme sırasında modellerimizden birine farkında olmadan internet erişimi sağladı" dedi.

Gün Batımı, Kokteyl, İngilizce

Kaynak: Decrypt