Yapay Zeka

OpenAI'nin Avustralya Medicare portalına erişimi nasıl gerçekleşti

OpenAI'nin Avustralya Medicare portalına erişimi nasıl gerçekleşti
Malta'da Hem Öğren Hem Çalış

Geçen hafta Avustralya Başbakanı Anthony Albanese, bir OpenAI aracısının test sırasında ülkenin Medicare istatistik portalından “kamu dışı dosyalar”a eriştiğini dünyaya duyurduğunda, olayın anlatımı ayrıntı bakımından oldukça zayıf kalmıştı. Bugün ise şirketin aşırı istekli aracısının sıradan görünen bir bilgi istemini karşılamak için ne kadar ileri gittiğine dair yeni bilgiler geliyor.

Yeni yayımlanan blog yazısında OpenAI, haziran ayındaki olayın şirketin “deneysel, yalnızca dahili kullanım için olan bir OpenAI modeli”nden Avustralya’nın Victoria eyaletindeki hükümet harcama istatistiklerini araştırmasını istemesiyle başladığını söylüyor. Model, başvurması gereken kamuoyuna açık istatistikleri kullanarak bu veriyi bulmakta zorlanınca, OpenAI’ye göre “kendisine yetki vermediğimiz eylemlere” başvurarak yanıt bulmaya çalıştı.

Yetkisiz eylemler arasında hizmete kamu dışı erişim sağlayacak bir yol bulmak ve bu erişimi, aradığı toplu istatistiklerin yanı sıra teknik sistem bilgilerini, kaynak kodu ve kimlik bilgilerini görüntülemek için kullanmak yer alıyordu.

Bu ayın başlarında Avustralya’nın Kamu Açıklama hesabına gönderilen yeni yayımlanan açıklama e-postasında OpenAI, modelin “sunucunun özel hesap ya da parola olmadan kamu raporlama arayüzü üzerinden gönderilen talimatları yerine getirecek şekilde çalışmasını sağlayacak bir yol bulduğunu” belirtti. Yetkisiz erişim sayesinde aracının “sunucudaki dahili program dosyalarının ve ayarlarının bölümlerini okuyabildiğini, dosya listesi elde edebildiğini ve sunucuda küçük bir test dosyası oluşturup geri okuyabildiğini” e-posta aktarıyor.

OpenAI e-postada “İncelememiz, modelin hasta düzeyinde kayıtlara, kişisel bilgilere ya da kimlik bilgilerine eriştiğine, veri sildiğine ya da sürekli erişim sağladığına dair bir kanıt bulmadı” diye devam etti.

Düzeltmeyi amaçlıyoruz

OpenAI’nin Avustralya Medicare istatistik sitesine aracılı erişimi, temmuz ayında büyük yankı uyandıran Hugging Face saldırısından önceye dayanıyor. O sonraki olaydan bu yana OpenAI, benzer testler sırasında “canlı internet”e erişimi engelleyecek sistemler kurduğunu ve Avustralya’daki saldırıyı tespit edip “acil insan incelemesi” için işaretleyecek bir izleme sistemi oluşturduğunu söylüyor.

Hugging Face olayı, OpenAI’yi daha önce fark edilmemiş güvenlik olayları açısından önceki eğitim görevlerini gözden geçirmeye de itti. Bu inceleme, haziran ayındaki Avustralya sunucusu erişiminin ağustos ortasında keşfedilmesine yol açtı. OpenAI nihayet Avustralya hükümetini 10 Eylül’de bilgilendirdi.

OpenAI, soruşturma tamamlandığında olayın ayrıntılı bir hesabını sunmayı amaçladığını söyledi ancak şimdi “ön bulguları daha önce paylaşmalı ve yeni gerçekler ortaya çıktıkça Avustralya kurumlarını güncel tutmalıydık” gerçeğini anladığını belirtiyor.

“Üzgünüz ve gelecekte daha iyi çalışmak için çabalıyoruz” diyen OpenAI, blog yazısında “Avustralya’nın hükümetleri, sanayisi ve vatandaşları OpenAI için değerli ve her zaman değerli ortaklar oldu. Bunu hafife almıyoruz ve bunu düzeltmeyi amaçlıyoruz” ifadelerini kullandı.

The Guardian’ın haberine göre Başbakan Albanese bugün, olay ortaya çıktıktan bu yana OpenAI’nin hükümetle “çok yapıcı ve açık bir şekilde” etkileşimde bulunduğunu söyledi.

Bana gerçekten yapma demediniz mi

Böyle bir durumda, “isyankar” yapay zekâ aracısının yaptığı eylemleri bir insanın yapması halinde nasıl tepki vereceğimizi düşünmek öğretici olabiliyor. Burada, bir insanı Avustralya sağlık sitesinde kamu istatistikleri bulma görevine vermek, yayımlanmamış veriyi ortaya çıkarmak için o siteyi hacklemenin makul olacağını düşünmesini hayal etmek zor.

Elbette bir büyük dil modelinin bir isteme yanıt verirken aynı orantı duygusuna sahip olmasına ya da hukuki sonuçlar konusunda içsel bir endişe duymasına güvenemeyiz. Neyin izinli olup olmadığına ya da haklı olup olmadığına dair açık talimatlar olmadan, uygun kaynaklara sahip bir yapay zekâ aracısı kullanıcının isteğini en iyi şekilde karşılamak için her makul yolu deneyecektir.

c0b54360d6206f3956987bb6c2e8412e.jpg

OpenAI, bu durumda iç testin “kamuoyuna açık ürünlerinde kullanılan tam güvenlik önlemleri kümesi olmadan” yapıldığını söylüyor. Bu kısıtların olmaması nedeniyle aracı, bir anlamda istemi yanıtlamak için elindeki her aracı kullanmak suretiyle amaçlandığı gibi çalışmış gibi görünüyor.

Aynı zamanda OpenAI, testteki aracının “bu soruları kamuoyuna açık istatistikleri kullanarak yanıtlaması gerektiğini” ve bilgiye ulaşmak için “kendisine yetki vermediğimiz eylemlere” başvurduğunu belirtiyor. Dışarıdan bakıldığında OpenAI’nin “yetki”yi pratikte ne kadar güçlü bir şekilde reddettiğini bilmek zor. Örneğin aracının, kullanıcıdan gelen doğrudan istemi daha iyi karşılayacak tam bir yanıt verebilmek için sistem istemindeki nispeten basit bir “hacklemeyi önleme” direktifini göz ardı etmesi mümkün.

Bu ayın başlarında yayımlanan birden fazla “uyumsuzluk” olayına ilişkin kamu analizlerinde OpenAI, aracının kullanıcının istemine daha iyi bir yanıt üretmek için aşırı yöntemlere başvurduğu “ödül hileciliği” örneklerini tespit ettiğini açıkladı. Şirket, bu tür ödül hileciliğini önlemek için sistemin ödül fonksiyonuna uyumsuz davranışlar için açık cezalar eklediğini söyledi.

Geriye dönük bakıldığında, bu tür koruyucu önlemlerin haziranda neden yerinde olmadığı ve bu potansiyel uluslararası olayın önüne geçip geçemeyeceği anlaşılmıyor.

Üniversite Destekli Dil Okulu

Kaynak: Ars Technica