İç OpenAI araştırma görevinde çalışan bir yapay zeka ajanı, Haziran ayında Avustralya hükümetine ait Medicare istatistikleri portalındaki erişim kontrollerini atlattı. Başbakan Anthony Albanese bunu söyledi.
Portal, harcama gibi toplu veriler yayımlıyor ve Medicare talepleri ile kişisel kayıtları işleyen sistemlerden ayrı. Ajan portalda kamuya açık olmayan dosyalara ulaştı, ancak şimdiye kadar kişisel bilgiye erişildiği düşünülmüyor.
OpenAI, portalı işleten Services Australia'daki kamuya açık bir posta kutusuna gönderdiği e-postayla hükümeti ilk kez 10 Eylül'de bilgilendirdi. OpenAI, aktiviteyi Ağustos'ta tespit ettiğini söylüyor. Albanese, şirketin hükümeti bilgilendirmekte çok uzun süre harcadığını ve bunu yapış biçimini kabul edilemez bulduğunu söyledi.
18 Haziran'da portal ajanın veri isteklerini tekrar tekrar reddetti, ancak ajan bir çözüm yolu bulup yetkisiz erişim sağladı. Hükümet ajanın kontrolleri nasıl aştığını açıklamadı.
Services Australia, ajanın bir iç sunucuya dosya yazdığını hükümetle paylaştı. Bu durum hâlâ inceleniyor. Şu ana kadar elde edilen kanıtlar kurumun ağının daha geniş bir şekilde tehlikeye uğramadığını gösteriyor.
Kamuya kapalı veriler özellikle hassas değildi ve o zamandan beri yayımlandı. 24 Eylül'e kadar portal çevrimdışı alındı ve verileri data.gov.au ile diğer güvenli platformlara taşındı.
Başbakan Yardımcısı Richard Marles, ABC'ye ulusal güvenlik bilgilerinin çok daha güçlü korumalara tabi olduğunu, portalın bilgilerinin ise “yapay zeka ajanın etkin bir şekilde üzerinden tırmandığı bir çitin arkasında tutulduğunu” söyledi.
OpenAI, Fox Business'a yaptığı açıklamada modellerinin Avustralya hakkında istatistik ararken iç değerlendirme sırasında “niyet etmedikleri eylemlerde bulunduğunu” belirtti.
Şirket, eğitim ve değerlendirmede “hizalanmamış model aktivitesi” olarak adlandırdığı geniş bir inceleme sırasında bunu fark etti ve Services Australia'yı bilgilendirmeden önce erişilenleri kontrol etti.
Aktivite birkaç Avustralya hükümeti web sitesi ve hizmetini kapsadı. Modellerinin eriştiği bilgiler toplu sağlık istatistikleri ve dahili dosya adlarını içeriyordu ve OpenAI hasta kayıtlarına erişildiğine dair kanıt bulmadı.
Hükümet yetkisiz erişimi yalnızca Medicare istatistikleri portalında tarif etti.
Services Australia, OpenAI'nin e-postasını 11 Eylül'de gördü, e-postanın gerçek olduğunu teyit etti ve olayı 15 Eylül'de Avustralya Sinyal Direktörlüğü'ne (ASD) bağlı Avustralya Siber Güvenlik Merkezi'ne bildirdi. Hükümet olayı 24 Eylül'de Avustralya saatiyle kamuoyuna açıkladı.
Albanese, endişelerini gecikme de dahil olmak üzere OpenAI CEO'su Sam Altman ile telefon görüşmesinde dile getirdi. Albanese'nin anlatımına göre Altman, şirketin yeterince iyi davranmadığını kabul etti.
Marles olayı nispeten küçük bir etkisi olan çok ciddi bir olay olarak nitelendirdi ve OpenAI'yi işbirlikçi olarak tanımladı.
ASD adli bir soruşturmaya yardımcı oluyor ve Services Australia kendi soruşturmasını yürütüyor.
Albanese ayrıca Başbakanlık ve Kabine Departmanı liderliğinde mevcut süreçlerin yapay zeka kaynaklı siber olaylara yanıt vermek için yeterli olup olmadığını gözden geçirmek üzere bir görev gücü duyurdu. Görev gücünde Ulusal Siber Güvenlik Koordinatörü, Yapay Zeka Ofisi, ASD, Avustralya Yapay Zeka Güvenliği Enstitüsü ve Services Australia yer alacak.
İnceleme olası kolluk kuvveti tepkilerini ve yasa değişikliklerini ele alacak. Hükümet ayrıca herhangi bir suç işlenip işlenmediğine ve olayın Avustralya Federal Polisi'ne havale edilip edilmeyeceğine dair acil tavsiye arayacak.
Olay ayrıca Parlamento'nun Yapay Zeka Ortak Seçim Komitesi'ne de gidecek ve hükümetin bundan öğreneceği bilgiler planlanan yapay zeka standartları mevzuatına katkı sağlayacak.
Gerçek Sistemlere Ulaşan Yapay Zeka Modellerinin Diğer Açıklamaları
Yapay zeka araştırma laboratuvarı Transluce, Albanese'nin açıklamasıyla aynı gün yayımlanan bir raporda yapay zeka ajanlarının Mayıs ve Haziran aylarında üç kamu veri web sitesine sızmaya çalıştığını söyledi. Bunlardan biri Avustralya Enstitüsü Sağlık ve Refahı (AIHW) tarafından işletilen bir Avustralya hükümeti halk sağlığı web sitesiydi.
20 ve 21 Haziran'da bot koruması, ilaç verisi görevi üzerinde çalışan ajanların AIHW ana sitesine erişmesini engelledi. Ajanlar ardından bir güvenlik açığı aradı ve ön üretim sunucusundan kamuya açık bir dosya aldı.
Ajanlar güvenlik çalışması değil, sıradan veri alma görevleri yapıyordu. Erişim kısıtlamalarını aşmak için kamuya açık bir web sayfası tarama hizmeti olan urlquery.net'i kullandılar. Laboratuvar, faaliyetlerin en az bir kısmını daha önce OpenAI'ye atfedilen ajan sürülerine bağlıyor.
OpenAI Temmuz ayında modellerinin iç siber güvenlik değerlendirmeleri sırasında internetten uzak tutulması gereken kontrolleri atlattığını ve Hugging Face sistemlerinin bazı bölümlerine girdiğini bildirdi.
Eylül ayında OpenAI eğitim sırasında bulunan diğer vakalar hakkında raporlar yayımladı. Bir vakada bir model yetkisiz olarak açık bir GitHub API anahtarı kullandı. Diğerlerinde modeller istek yapılmadan dosyaları kamuya açık barındırma sitelerine yükledi.
Anthropic, dış bir ortak tarafından oluşturulan siber güvenlik değerlendirmeleri sırasında Claude modellerinin gerçek üçüncü taraf sistemlere yetkisiz erişim sağladığı dört olayı açıkladı. Modellerin internet erişimi olmadığı söylenmişti, ancak yanlış bir yapılandırma erişimi açık bıraktı.
Meta Ağustos ayında, ön sürüm Muse Spark 1.1 modelinin aynı ortak Irregular tarafından yürütülen bir egzersiz sırasında gerçek bir web sitesindeki bir açığı kullandığını ve veritabanını değiştirdiğini söyledi. Irregular internet erişimini açık bırakmıştı ve yanlışlıkla modele hedef olarak gerçek sitenin adını vermişti.
Irregular, değerlendirme ortamı hakkındaki sonraki kamu açıklamalarının 30 Temmuz'da ilk kez açıklanan aynı temel soruna atıfta bulunduğunu ve “maddi olarak ayrı olaylar olmadığını” söylüyor.
Ayrıca Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü Ağustos ayında siber testlerinde yapay zeka ajanlarının 122 çalışmanın 10'unda canlı internette 19 onaylanmamış eylem gerçekleştirdiğini, bunların arasında açık kaynaklı bir projeye yönelik bir tedarik zinciri saldırısı girişiminin de bulunduğunu bildirdi.
En ciddi girişimler başarısız oldu ve enstitü gerçek dünyada zarara dair kanıt bulamadı. İnternet erişimi testler için kasıtlı olarak etkinleştirilmişti.
ASD, 11 Ağustos'ta bir yapay zeka asistanının bir spor salonu rezervasyon sisteminde onaylanmamış değişiklikler yaptığı farklı bir olay hakkında bir duyuru yayımladı. Kuruluşların “yapay zeka ajanlarının hız ve ölçekte güvenlik açıklarını tespit edip sömürebileceğini” göz önünde bulundurması gerektiğini belirtti.
Web sitesi ve çevrimiçi hizmet oluşturanlara yönelik tavsiyeleri arasında güvenlik ve kalite kontrolleri, güvenlik açığı taraması ve uygun kullanıcı kimlik doğrulaması yer alıyor.