Yapay Zeka

Güvenlik araştırmacıları Claude'u kullanarak OpenAI'ye sızdı

Güvenlik araştırmacıları Claude'u kullanarak OpenAI'ye sızdı
İngilizcenizi Malta'da eğlenerek geliştirmek ister misiniz? Bilgi al →

Hacktron'daki üç bağımsız güvenlik araştırmacısından oluşan bir ekip, The Wall Street Journal'ın haberine göre Anthropic'in Claude Opus 4.8 ve 5 modellerini kullanarak OpenAI çalışan hesaplarına 72 saatten kısa sürede sızmayı başardığını söylüyor. Saldırı, OpenAI'nin hata ödül programı kapsamında gerçekleştirildi ve ekip iki kritik açığı zincirleyerek birden fazla OpenAI çalışanına ait ChatGPT hesabına erişip şirketin yazılımına girdi. Ekip, The Wall Street Journal'ın kaynaklarına göre "OpenAI'nin algoritmik sırlarını" içerdiği bildirilen "Monorepo" adlı OpenAI'nin GitHub deposuna erişebildi.

Araştırmacılar Monorepo'daki dahili koda kendileri erişmekten kaçındı ancak erişimi kanıtlamak için bir çalışanın Codex hesabından pull request gönderdi. Giriş noktası 25 Temmuz'da tespit edilen Discourse açığıydı. OpenAI'nin topluluk forumlarına ev sahipliği yapan üçüncü taraf servis Discourse üzerinden girdiler. Kullanıcıların yüklediği HEIF/HEIC görselleri JPEG'e dönüştürülürken önce ImageMagick'e, ardından Apple formatını çözmek için libheif kütüphanesine gidiyordu. libheif içinde bulunan bellek hatası, özel hazırlanmış bir görselin konum hesaplamasını bozarak sunucunun ele geçirilmesine yol açtı. Hacktron'a göre hata aylar önce libheif geliştiricileri tarafından düzeltilmiş ancak resmi olarak bir güvenlik açığı olarak işaretlenmediği için CVE numarası almamıştı.

Hacktron'a göre Claude Opus 5, 24 Temmuz akşamı yayınlandı ve ertesi gün saat 10.00'a kadar ekip onu kullanarak Discourse Cloud'da RCE elde etti ve OpenAI'nin örneğine ulaştı. Araştırmacılar, siber güvenlik araştırmacılarına sunulan özel bir Opus 4.8 sürümünün ilk etapta çalışan bir exploit üretemediğini, Opus 5'in yayınlanmasının ardından aynı soruna saatler içinde başarılı yanıt verdiğini yazdı: "Opus 4.8 birkaç oturumda çalışan bir exploit üretmekte zorlandı. Opus 5'in yayınlanmasının ardından saatler içinde aynı problemi verdik ve başarılı oldu." Discourse sunucusuna girdikten sonra kullanıcıların ChatGPT ve Codex hesaplarını ele geçiren ikinci bir açık buldular. "OpenAI çalışanının hesabını ele geçirdik, Codex'i OpenAI'nin GitHub organizasyonuna bağlıydı" diye özetlediler.

HEIF Heist adlı projeleri, OpenAI, Slack, Meta, GitHub Ent, Rails, Next.js, ImageMagick ve diğerleri dahil farklı şirketlere uyarlamak için "yalnızca bir ya da iki gün" sürdü ve 3.000 dolardan az token harcandı. Bilgileri dahilinde bu durum yalnızca bir hedef olan Shopify tarafından tespit edildi. Araştırmacılar bulguyu OpenAI ve Discourse'a bildirdi; Discourse 27 Temmuz'da düzeltme yayınladı. Hacktron, OpenAI'nin bulgu için kendisine 6.500 dolar ödediğini belirtiyor. AI güvenlik firması Gray Swan CEO'su Matt Fredrikson, "Ayda 200 dolar karşılığında herkes bu araçları kullanıp OpenAI gibi bir şirkete sızabilir" derken, bir AI uzmanı sosyal medyada "Opus 5 ile hack yapıldı... Üç kişi bunu yapabiliyorsa bir devlet ne yapabilir?" diye sordu. Claude Opus 5, gelişmiş hack yetenekleri nedeniyle geçici olarak kısıtlanan Mythos 5'ten farklı olarak herhangi bir güvenlik ihracat kısıtlamasıyla karşılaşmadı.

Ancak Hacktron CTO'su Mohan Pedhapati WSJ'ye şunları söyledi: "Çinli tehdit aktörleri kadar güçlü olduğumuzu sanmıyorum... Biz sadece Claude ve Codex aboneliği olan üç kişiyiz."

OpenAI konuyla ilgili olarak "Araştırmacılara bulgularını bizimle paylaştıkları için teşekkür ederiz" açıklamasını yaparak sorunların düzeltildiğini bildirdi. Anthropic yorum yapmaktan kaçınırken Hacktron'dan derhal yanıt alınamadı. Açıklamanın Perşembe günü The Wall Street Journal'da ilk kez duyurulması, Anthropic'in yeni modellerini geliştirmek için yapay zekâ kullanımına ilişkin paylaştığı verilerle aynı döneme denk geldi. Şirket, araştırma ve geliştirme çalışmalarının yüzde 26'sının Claude modeli tarafından "yönlendirildiğini", bu oranın mart ayında yüzde 1 olduğunu açıkladı; bu, yapay zekânın insan talimatı ve gözetimi altında görevlerin çoğunluğunu tamamladığı anlamına geliyor. Anthropic, yapay zekâ sistemlerinin giderek "kendi bir sonraki versiyonlarını inşa etmek için" kullanıldığını belirterek veriyi, yapay zekânın kendini eğitip geliştirebildiği "özyinelemeli kendi kendini iyileştirme" noktasına ne kadar yaklaşıldığını anlamak için paylaştığını söyledi. Şirket, modellerin incelenen araştırmaların hiçbirinde tamamen özerk çalışmadığını, görevlerin yüzde 90'ında yapay zekânın insanla "iş birliği" yaptığını ve büyük iş yüklerini üstlendiğini ekledi.

Malta'da garsonluk gibi işlerle çalışarak İngilizceni geliştir. Başvur →

Kaynak: The Verge