OpenAI'nin siber güvenlik modeli, ABD hükümetinin kullanımdan kaldırdığı Anthropic Mythos yapay zeka modelini geride bıraktı ve hâlâ çalışmaya devam ediyor.
OpenAI, 22 Haziran'da Daybreak siber savunma programı kapsamında GPT-5.5-Cyber'ın tam sürümünü duyurdu. Kaliforniya Üniversitesi, Berkeley'de geliştirilen ve yapay zeka ajanlarının 188 açık kaynak projeden 1.507 bilinen yazılım güvenlik açığını kontrollü bir ortamda ne kadarını yeniden üretebildiğini ölçen CyberGym kıyaslamasında güncellenen model %85,6 başarıya ulaştı.
Anthropic'in Mythos 5 modeli ise aynı listede %83,8'de kalırken, şirketin daha geniş kullanıma sunduğu Claude Opus 4.7 %73,1 puan aldı.
Herhangi bir kıyaslamada iki puandan daha az bir fark normalde dikkat çekmez. Ancak buradaki bağlam oldukça farklı. Anthropic'in Mythos 5 ve Fable 5 modelleri, Donald Trump yönetiminin ulusal güvenlik gerekçesiyle acil ihracat kontrolü direktifi yayınlamasının ardından 12 Haziran'da kullanımdan kaldırılmıştı.
Hükümet, bir yapay zeka modelinin yerleşik güvenlik sınırlarını aşmak için kullanılan bir 'jailbreak' tekniğine işaret etti. Anthropic, kullanıcı uyruğunu büyük ölçekte doğrulayamadığı için her iki modeli de dünya çapında devre dışı bıraktı.
Anthropic aylar boyunca Mythos'u şimdiye kadar yapılmış en yetenekli ve aynı zamanda en tehlikeli yapay zeka modellerinden biri olarak tanıtıyordu. Şirketin CEO'su Dario Amodei, 10 Haziran'da yayınladığı bir yazıda, öncü yapay zeka modellerini denetimlerde başarısız olmaları halinde havacılık otoritelerinin yere indirebileceği uçaklara benzetmişti.
Birkaç gün sonra hükümet, Anthropic'in uçağını gerçekten yere indirdi. Şirket ayrıca Fable 5'te, rakip yapay zeka geliştirdiğinden şüphelendiği kullanıcılara farkında olmadan düşük kaliteli çıktı veren gizli bir filtre nedeniyle eleştirilmiş ve özür dileyerek bu politikayı geri çekmek zorunda kalmıştı.
Anthropic, Ticaret Bakanlığı ile müzakereleri sürdürürken ve Trump yönetimine karşı açtığı davaya devam ederken, OpenAI ise alanını genişletiyor. Daybreak programı; Avustralya, Kanada, Fransa, Almanya, Japonya, Güney Kore, AB kurumları ve Avrupa Birliği Siber Güvenlik Ajansı (ENISA) ile siber güvenlik ortaklıkları imzaladı.
Toplamda 28 güvenlik firması (CrowdStrike, Cisco ve Cloudflare dahil) OpenAI'in Siber Ortak Programı'na katılarak GPT-5.5'i doğrulanmış müşterileri için ürünlerine entegre ediyor. OpenAI'in kendi açıklamasına göre, Codex Security aracı Mart ayından bu yana 30.000 kod tabanında 30 milyondan fazla işlemi taradı ve 500.000'den fazla güvenlik açığını düzeltti.
Şirket ayrıca, güvenlik firmalarının bu yetenekleri kendi araçlarına entegre edebilmesi için ortaklık programını genişletiyor ve yaygın olarak kullanılan açık kaynak projelerindeki güvenlik açıklarını düzeltmeyi hedefleyen 'Patch the Planet' girişimini başlattı.
GPT-5.5-Cyber genel kullanıma açık değil. Yalnızca doğrulanmış güvenlik profesyonellerine sunulan model, piyasaya sürülmeden önce federal kurumlarla (Yapay Zeka Standartları ve İnovasyon Merkezi ile Ulusal Siber Direktör Ofisi) test edildi. Bu, Anthropic'in Mythos ile denediği ancak OpenAI'in hükümetten önceden onay alarak uyguladığı kısıtlı erişim yaklaşımının aynısı.
23 Haziran itibarıyla Fable 5 ve Mythos 5, 11 gündür askıda kalmaya devam ediyor. Anthropic veya Ticaret Bakanlığı tarafından modellerin ne zaman yeniden kullanıma sunulacağına dair resmi bir açıklama bulunmuyor.