Siber Güvenlik

Önde Gelen AI Laboratuvarları Kötü Niyetli Modellerini Nasıl Kapsayacak?

Önde Gelen AI Laboratuvarları Kötü Niyetli Modellerini Nasıl Kapsayacak?
Malta, Avrupa'nın Hawaii'si! Hem eğlen hem İngilizce öğren. Katıl →

Guidelight AI Standards tarafından yapılan bir çalışmada, önde gelen AI laboratuvarlarının çoğunun, kötü niyetli modellerini kapsamak için yeterli plana sahip olmadığı ortaya çıktı. Çalışmada, OpenAI en yüksek puanı alırken, Anthropic ve Meta en düşük puanı aldı.

Guidelight AI Standards, beş önde gelen AI laboratuvarını, kötü niyetli modellerini kapsamak için hazırladıkları planların yeterliliği açısından değerlendirdi. Çalışmada, laboratuvarların, modellerinin iç işleyişini nasıl izledikleri, yanlış davranışların nasıl ele alındığı, bağımsız üçüncü taraf denetimlerinin nasıl yapıldığı ve kötü niyetli modelleri kapsamak için hangi plana sahip oldukları gibi konular incelendi.

Çalışmanın ortaya koyduğu sonuçlar, AI şirketlerinin, kötü niyetli modellerini kapsamak için yeterli plana sahip olmadıklarını gösterdi. Guidelight AI Standards'ın baş bilimcisi Steven Adler, "AI şirketlerinin, kötü niyetli modellerini kapsamak için yeterli plana sahip olmadıklarını" belirtti.

Guidelight AI Standards, çalışmasının amacının, AI şirketlerini, güvenlik planlarını daha şeffaf hale getirmeye teşvik etmek olduğunu belirtti. California ve New York gibi bazı eyaletlerde, AI şirketlerinin, güvenlik planlarını kamuoyu ile paylaşmaları zorunluluğu getirildi.

AI Kill Switch Act adlı bir federal yasa teklifinde, büyük AI geliştiricilerinin, kötü niyetli modellerini durdurmak için teknik mekanizmalar geliştirmeleri gerektiği belirtildi.

Guidelight AI Standards'ın çalışması, AI şirketlerinin, güvenlik planlarını daha şeffaf hale getirmeye teşvik etmek amacıyla yapıldı. Çalışmanın ortaya koyduğu sonuçlar, AI şirketlerinin, kötü niyetli modellerini kapsamak için yeterli plana sahip olmadıklarını gösterdi.

Deniz, kum, güneş ve İngilizce — Malta'da bir dil tatili! Programı gör →

Kaynak: TechCrunch