Açık Kaynaklı Modellerde Güvenlik Açığı
Günümüzde metin, görsel ve video üreten üretken yapay zeka sistemlerinin yaygınlaşması, beraberinde önemli güvenlik sorunlarını getiriyor. Özellikle kişilerin rızası olmadan dijital olarak kıyafetlerini kaldıran veya müstehcen içerikler üreten yazılımlar sektörün en büyük tartışma konularından biri olmaya devam ediyor. Son olarak, Avrupa merkezli sivil toplum kuruluşu AI Forensics tarafından yayımlanan kapsamlı bir rapor, milyarlarca dolar değer biçilen açık kaynaklı yapay zeka platformu Hugging Face'in bu alanda ciddi bir denetim problemi yaşadığını gözler önüne serdi.
Araştırmacılar, platform üzerinde barındırılan en popüler dokuz görüntü düzenleme Alanı'nı (Space) inceledi. Yapılan testlerde, bu modellerin çoğunun herhangi bir teknik zorlukla karşılaşmadan giyinik bir kadın fotoğrafını üstsüz hâle getirebildiği tespit edildi. Benzer şekilde, bağımsız araştırmacıların ve medya kuruluşlarının incelemeleri de platform üzerinde barındırılan bazı araçların popüler kişileri ve politikacıları hedef alan müstehcen içerikler üretmek için kullanılabildiğini doğruladı.

Takip Edilen Komutlar Tehlikeyi Gösteriyor
Süreçteki kullanım alışkanlıklarını somutlaştırmak isteyen AI Forensics ekibi, platform üzerinde görsel üretmeyen tuzak niteliğinde Alanlar kurarak bir hafta boyunca gelen talepleri kaydetti. Bu süre zarfında binden fazla komut ve görsel incelendi. Elde edilen veriler, sistem üzerinden geçen taleplerin ezici bir çoğunluğunun cinsel içerikli olduğunu ortaya koydu.
Toplanan verilere göre, gelen komutların yüzde 73'ü doğrudan cinsel nitelik taşıdı. Bu grubun da yüzde 83'lük kısmını, yüklenen fotoğraflardaki kişileri dijital olarak soyma veya cinselleştirme talepleri oluşturdu. Hedef alınan kişilerin yüzde 95 gibi büyük bir oranını kadınlar oluştururken, taleplerin yüzde 6,7'lik diliminde çocukların hedef alındığı belirlendi. Araştırmayı yürüten uzmanlar, kullanıcıların bu araçları aktif olarak istismar ettiğini vurguluyor.

Platform Düzeyinde Koruma Eksikliği
OpenAI ve Google gibi büyük şirketlerin geliştirdiği ana akım üretken yapay zeka modelleri, zararlı içerik üretimini engellemek için çeşitli güvenlik katmanları (guardrails) barındırıyor. Buna karşın, Hugging Face üzerinde test edilen açık kaynaklı modellerin çoğunda bu tür korumaların bulunmadığı görüldü. Testler sırasında herhangi bir güvenlik duvarını aşma veya yazılımları hackleme girişiminde bulunulmadı; yalnızca altı kelimelik basit komutlar kullanıldı.
Uzmanlar, platform genelinde merkezi bir filtreleme mekanizmasının uygulanmamasının bu tür istismarlara zemin hazırladığını belirtiyor. Geliştiricilerin kendi inisiyatiflerine bırakılan güvenlik önlemlerinin çoğu modelde yer almadığı ifade ediliyor. Şirketin çocuk istismarı ve rızasız deepfake içeriklerini yasaklayan resmi politikaları bulunsa da, platformdaki binlerce modelin denetlenmesi konusunda yaşanan zorluklar sektördeki tartışmaları alevlendiriyor.

