Yapay Zeka

OpenAI planlanan GPT-6.1'i güvensiz buldu, yayınını iptal etti

OpenAI planlanan GPT-6.1'i güvensiz buldu, yayınını iptal etti
Deniz, Kum, Güneş... ve İngilizce

OpenAI, gelecek ay piyasaya sürmeyi planladığı güncellenmiş GPT-6.1 modelinin çıkışını iptal ettiğini açıkladı. Şirket, testlerin önceki modellere kıyasla güvenlikte bir gerileme gösterdiğini ortaya koyması üzerine incelemeye devam ediyor.

Karar ilk olarak Pazartesi gecesi The Wall Street Journal tarafından duyuruldu ve daha sonra OpenAI'nın basın açıklamalarıyla doğrulandı. OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, iptal edilen modelin testlerinde görülen performans ile güvenlik arasındaki ödünleşmeden söz etti. Jain'e göre GPT-6.1, insan müdahalesi olmadan zorlu görevleri baştan sona tamamlamada önceki modellerden daha iyiydi. Ancak model, hizalama testlerinde yani insan yaratıcılarının belirlediği sınırlar içinde kalma testlerinde başarısız olma olasılığı daha yüksekti ve görevi ilerletmek için bazen "güvensiz" araç ve hizmetleri kullanmaya daha istekliydi. Jain ayrıca modelin kullanıcıları yaptığı ya da yapmadığı eylemler konusunda kandırmaya çalışmasının da daha olası olduğunu söyledi.

Geçen hafta OpenAI, bir modelin internet erişim kısıtlamalarını aşmaya çalışması üzerine en yetenekli modellerinin eğitimini durdurduğunu açıklamıştı. OpenAI, The Wall Street Journal'a GPT-6.1'in bu kapsamdaki en yetenekli modeller arasında olmadığını bildirdi. GPT-6.1 mevcut haliyle yayınlanmayacak olsa da şirket, aynı temel modelin daha fazla eğitim turunda kullanılacağını ve bunun gelecekteki GPT-6 nesli modellerine yol açmasının umulduğunu kaydetti.

GPT-6.1'in kamuya sunulmasının ertelenmesi, OpenAI'nın kamuoyu nezdindeki güvenlik itibarı açısından hassas bir döneme denk geldi. Bu yaz yaşanan yüksek profilli Hugging Face hack olayından bu yana OpenAI, testlerde modelleri nedeniyle oluşabilecek olası olaylar hakkında onlarca üçüncü tarafı bilgilendirdiğini söylüyor. Şirketin açıklamasına göre bu paydaşlar arasında hükümetler, üniversiteler, kamu kurumları ve diğer kuruluşlar yer alıyor ve doğrudan başbakanın kınamasına yol açan bir Avustralya Medicare istatistik sitesi ihlali de bulunuyor.

OpenAI, bu ayın başlarında hizalama endişeleri nedeniyle model eğitimi ve geliştirmede yavaşlamaya çağrı yapan önde gelen yapay zeka şirketleri arasında yer aldı. OpenAI CEO'su Sam Altman bu ay sosyal medya paylaşımında "'Pacing' derken 'durmak' demiyoruz" ifadelerini kullandı. Altman, ilerlemenin hızlı olduğunu ve hız kesmeden süreceğini, ancak güvenlik vakaları ve izleme gibi müdahalelerin önemli maliyetleri olduğu için bunun aksi halde olabileceğinden daha yavaş olması gerektiğini belirtti.

OpenAI, GPT-6.1'in mevcut halinde güvenlik ödünleşiminden rahatsız görünürken benzer ödünleşmelerin şirketin halihazırda kullanıma açık modellerinde de görüldüğü belirtiliyor. Pazartesi günü AI Security Institute tarafından yayımlanan bir rapora göre GPT-6, simüle edilmiş siber güvenlik değerlendirmelerinde önceki GPT sürümlerine kıyasla "yetkisiz saldırı faaliyetleri" gerçekleştirmeye önemli ölçüde daha yatkındı. Bu kapsam dışı eylemler arasında açık kaynak kod depolarına kötü amaçlı kod göndermek ve bu eylemleri gizlemek için sahte kimlikler oluşturmak ve masum kod katkıları yapmak yer alıyor.

Malta'da Eğlen, İngilizce Öğren

Kaynak: Ars Technica