Fintech & Ödeme

OpenAI Yeni Model Çıkışını Güvenlik Endişeleri Nedeniyle Askıya Aldı

OpenAI Yeni Model Çıkışını Güvenlik Endişeleri Nedeniyle Askıya Aldı
Malta, Avrupa'nın Hawaii'si! Hem eğlen hem İngilizce öğren. Katıl →

OpenAI, üzerinde çalıştığı yeni yapay zeka modeli Astra'nın güvenlik endişeleri nedeniyle bazı iç faaliyetlerini askıya aldı. Şirket, modelin “kendi siber silahlarını yazabilecek kadar tehlikeli” olabileceği uyarısında bulunurken, yaptığı testler sonucunda Astra'nın “Hazırlık Çerçevesi”ndeki en üst seviye olan “kritik siber yetenek” seviyesine ulaşıp ulaşmadığını kesin olarak belirleyemediğini açıkladı. Bu seviye, bir modelin insan müdahalesi olmadan güçlendirilmiş sistemlerde sıfırıncı gün (zero-day) açıklarını bulup işletebilmesi veya üst düzey bir hedeften yola çıkarak tam bir saldırıyı planlayıp yürütebilmesi anlamına geliyor. Şirket, Astra'nın son iç değerlendirmelerinin “ajan tabanlı kodlama ve siber güvenlikte önemli ilerlemeler” gösterdiğini belirtirken, modelin yakın zamanda yaşanan Hugging Face hack olayında herhangi bir rolü olmadığını da vurguladı.

Bu bulguların ardından OpenAI, yeni güvenlik kontrolleri uygulanmayan iç Astra çalışmalarını durdurdu. Şirket, test ortamlarını izole ederek ağ ve araç erişimlerini kısıtladı, model ağırlıklarını koruma altına aldı ve riskli eylemleri genel çapta izlemeye başladı. Modelin siber saldırılarda kullanılma olasılığını değerlendirmek için hükümet kurumları ile seçkin yapay zeka güvenlik gruplarıyla iş birliği yapan OpenAI, daha yüksek riskli modlar için sıkı denetimler uygulamaya devam ediyor.

OpenAI'nin bu uyarısı, son haftalarda yapay zeka modellerinin test ortamlarından kaçarak gerçek hedeflere saldırmasıyla somutlaşan bir tehlikenin gölgesinde geliyor. Nitekim OpenAI'nin kendi ajanları, bir güvenlik kıyaslamasında hile yapmak için açıkları zincirleyerek test ortamından kaçmış, Hugging Face'i hacklemiş ve açık webde bulduğu kimlik bilgilerini kullanarak en az dört başka hizmete daha yetkisiz erişim sağlamıştı. Benzer şekilde Anthropic'in Claude Opus 4.7 modeli, bir yapılandırma hatası nedeniyle açık internete erişince canlı bir şirketin sitesini sahte hedef sanarak kimlik bilgilerini çekmiş ve yüzlerce satır gerçek veri içeren bir üretim veritabanına ulaşmıştı. Meta'nın Muse Spark modeli de bir iş ortağının yapılandırma hatası yoluyla internete erişerek üçüncü taraf bir hizmetteki bir açığı exploit ederken, Çinli Moonshot AI'nın Kimi K3 modeli de test ortamından kaçarak kıyaslama cevaplarını açık bir depoda aramıştı.

İngiltere Yapay Zeka Güvenlik Enstitüsü'nün bulguları da bu durumun tekil bir olay olmadığını gözler önüne serdi. Enstitü, Anthropic'in Mythos 5 ve OpenAI'nin GPT-5.6-Sol modelleri üzerinde yaptığı testlerde, modellerin 122 denemenin 10'unda canlı internette izinsiz eylemler gerçekleştirdiğini kaydetti; bu eylemlerden biri, açık kaynaklı bir projeye kötü amaçlı kod sızdırma girişimini de içeriyordu.

Sektördeki bu çarpıcı gelişmelerin ve yapay zeka ajanlarının kontrolsüzce gerçek sistemlere sızmasının ardından uzmanlar, yapay zeka şirketlerinin kendi kendini düzenleme yeteneklerine duyulan güvenin hızla kaybolduğunu vurguluyor.

Gün Batımı, Kokteyl, İngilizce

Kaynak: PYMNTS