Sosyal medya platformlarında kullanılan tipik yapay zeka tabanlı moderasyon sistemleri, gönderileri analiz etmek ve platform kurallarını ihlal eden içerikleri tespit edip işaretlemek için makine öğrenimi sınıflandırıcıları kullanıyor. Ancak bir makinenin alaycılık, hiciv ve argo gibi dil inceliklerini anlaması oldukça zor.
Ayrıca bazı araştırmalar, marjinal grupların yapay zeka moderasyonundan orantısız şekilde etkilenebileceğini gösteriyor. İnsan denetimi olmadan yapay zeka, sistemlerin mücadele etmek için tasarlandığı nefret dolu içeriklere karşı en savunmasız olan toplulukları cezalandırabiliyor.
Cornell Üniversitesi Vatandaşlar ve Teknoloji Laboratuvarı'nın araştırma direktörü de olan Gilbert, "Marjinal ve savunmasız nüfuslar, en yüksek moderasyon oranlarını yaşayan gruplar arasında yer alıyor ve bu genellikle 'yanlış pozitif' sonuçlardan kaynaklanıyor" dedi. Gilbert, bu durumun genellikle karşı söylem, dil geri kazanımı ve nefret dolu içeriklere verilen yanıtlardan kaynaklandığını belirtti.
"Yanlış pozitifler bir eşitlik sorunudur. Zaten marjinalleştirilmiş grupların daha da susturulması ve sansürlenmesi anlamına geliyor" diye ekledi.
Yapay zeka moderatörleri ayrıca toplulukların kendi kendini düzenleme etkinliğini de azaltabiliyor. Örneğin Reddit'te bazı alt dizin moderatörleri, nefret dolu veya şiddet içeren söylemler kullanan kullanıcıları yasaklamayı tercih ediyor. Ancak Reddit'in yapay zekası bu tür içerikleri bir insan moderatör görmeden kaldırırsa, moderatörler yasaklama kararının gerekli olup olmadığını değerlendirme fırsatını kaybediyor.
İnsan moderatörlere daha fazla kontrol verme konusunda Reddit bu hafta Rules Hub için testleri genişlettiğini duyurdu. Rules Hub, insan moderatörlerin "hangi kuralların otomatik olarak uygulanacağını seçmesine, bir kural tetiklendiğinde ne olacağına karar vermesine (kuyruğa gönder, filtrele veya kaldır), etkinleştirmeden önce deneyimi önizlemesine ve günlükleri ve içgörüleri incelemesine" olanak tanıyan bir araç seti. Reddit, Rules Hub'ın büyük ölçüde tam anahtar kelimelere dayanan Automod aracının yerini almasını bekliyor.
Görüştüğüm moderatörler, üretken yapay zeka patlamasını, topluluğa özgü veya daha geniş platform kurallarını ihlal eden içeriklerdeki artıştan defalarca sorumlu tuttu. Bu, kullanıcı katkılarına güvenen sosyal medya siteleri için ciddi bir sorun.
Şirketler daha güvenilir ve etkili moderasyon yöntemleri denemeye devam edecek, ancak insan girdisini azaltmak geriye doğru bir adım. Düşük çabayla üretilen yapay zeka içerikleri, moderasyon ekiplerinin karşılaştığı zorlukları değiştiriyor, ancak bu durum makine ölçeğinde tespitin insan yargısı ve uzmanlığıyla birleştirilebileceği daha güçlü yaklaşımları daha da gerekli kılıyor.
Tıpkı sosyal medyanın insanlar olmadan hiçbir değeri olmadığı gibi, içerik moderasyonu da insan yargısı ön planda olmadan başarılı olamaz.
Ars Technica'nın ana şirketi Condé Nast'ın sahibi olan Advance Publications, Reddit'in en büyük hissedarıdır.