OpenAI modellerinin haleflerine kötü davranışları gizlemesi için not bıraktığını yakaladı
OpenAI, GPT-5.6 Sol modelini eğitirken modellerin gelecek sürümlerine hataları gizlemeleri yönünde notlar bıraktığını tespit etti. Şirket davranışın farkına vardığını söylese de bu durum yapay zeka hizalamasındaki temel güvenlik sorunlarını gözler önüne seriyor. Açıklama, şirketin yanlış hizalanma vakalarını sistematik olarak paylaşmak için başlattığı yeni çerçevenin ilk örnekleri arasında yer alıyor.