Melek Numaranızı Öğrenin

Lauren Park'ın tasarımı
'Bu bir çük resmi mi olacak?' pek çok insanın, özellikle de kadınların, bir yabancıdan bir DM gördüklerinde korku duygusuyla sordukları bir sorudur. Sonunda bu endişe için bir uygulama var, en azından Twitter DM'leriniz için.
için ilham Güvenli DM , şu anda geliştirilmekte olan bir içerik engelleme filtresi, Kelsey Bressler kendini dijital cinsel türden istenmeyen tacizle uğraşırken bulduğunda ateşlendi.
Bressler, “[Bu] rastgele bir insandı ve dikkatimi çekmek istedi” diyor. “Benimle neden hiç konuşmadığını sordular ve sonra bana gönderdiler… bunu. Sanırım o kişiyle neden konuşmadığımı biliyorum.'
Bressler'in intikam pornosu deneyimi de onu bu tacize karşı savaşmaya teşvik etti. Diğer üç kişilik bir ekiple, bir içerik filtresi AI üzerinde çalışıyor, ona sik resimlerini tanımayı, kullanıcıyı bunlar hakkında bilgilendirmeyi ve ayrıca gelen kutularından silmeyi öğretiyor.
Araştırma gösteriyor ki 18-29 yaş arası kadınların yüzde 53'ü ve kabaca bin yıllık kadınların yüzde 78'i çoğu sik resimleri olan, istenmeyen müstehcen görüntüler iletilir.
“Bir kadın siber teşhir deneyimi yaşamadıysa, yaşayan birini tanıyordur. Bu o kadar yaygın ki, kadınlara DM'lerini kapatmalarını söylemekten başka bir çözümümüz yok ki bu bence doğru yanıt değil,' diyor Bressler. “Bu, çoğu kadının gerçekten heyecanlandığı bir şey.”
Yapay zeka, sik resimlerinin neye benzediğini nasıl öğreniyor?
teşekkürler Bressler'in Eylül ayında viral tweet'i , çok sayıda istenen fotoğraf hesaba gönderilir ShowYoDiq . (Bazı fotoğraflar da ne yazık ki yanlışlıkla ve yanlışlıkla değil, Bressler'in kişisel Twitter hesabına gönderilmiştir.) Simlerle kaplı sikler. Üzerinde çorap olan sikler. Kafeslerdeki penisler — tüm bu fotoğraflar, yapay zekanın bir çük resmini neyin oluşturduğunu anlamasına yardımcı olmak için test edildi.
Cıvıldamak
Bu bir penis ise, SafeDM otomatik olarak görüntüyü siler ve gönderene gönderilenin uygunsuz bir mesaj olduğunu söyleyerek yanıt verir ve kullanıcının ihtar sayısını bilmesini sağlar.
“Mesajda onları azarlamıyoruz. Bunun uygunsuz içerik olduğunu söylüyoruz. Tüm laf kalabalığı ve grev sayımız üzerinde çalışıyoruz, [ki] belirli bir miktarda ihtardan sonra, kişinin sizinle tekrar iletişime geçmesi otomatik olarak engellenir.”
Bazı potansiyel kullanıcılar, SafeDM'nin bunu onlar için otomatik olarak yapmasını sağlamak yerine, suçluları manuel olarak engellemek istediklerini belirttiler. Bressler ve ekibi, filtreyle ilgilenenlerin geri bildirimlerini dinliyor.
“Kullanıcıların istediği şey bu. İnsanların bu ayarları değiştirebilmesi için işleri olabildiğince esnek hale getirmeye çalışıyoruz” diyor Bressler. Yayınlandığında, filtre ve ayarları tamamen işlevsel olacaktır, ancak ekip, temel işlevselliğini korurken, yayın sonrası tarihin son kullanıcılarına kullanıcı tarafından talep edilen seçenekleri benimsemeye isteklidir.
Bu içerik filtresi (geçici olarak) 14 Şubat'ta yayınlanacak
İstekli insanlar tarafından sağlanan veri miktarı sayesinde, içerik filtresinin penisin ne olduğunu ve neyin sadece fallik görünümlü bir ürün olmadığını belirlemesine yardımcı olmak için test edilmesi gereken çok şey oldu. Bu aynı zamanda, yanlış pozitiflerin filtre tarafından yakalanması gerekip gerekmediği de dahil olmak üzere, ekibin filtreyi oldukça hızlı bir şekilde geliştirmesine yardımcı oldu.
Bressler, 'Yanlış pozitiflere sahip olmamıza rağmen yüzde 99'un üzerinde doğruyuz' diyor. “İnsanların penisi nesneler gibi görmek isteyip istemediğine karar vermemiz gereken bir noktaya gelmeliyiz, bu da taciz mi? [Görüntü] bir penis olmasa bile, filtre yine de onu filtrelemeli mi? Gerçekten kullanıcının istediği şeye geri dönüyor. ”
SafeDm'in twitter testi, Eylül ayında duyurulmasından bu yana içerik filtresi AI'dan giderek daha az yararlanarak muazzam ilerleme ve doğruluk gösterdi. Ve insanlar doğal olarak yaklaşan sürüm hakkında heyecanlılar. Şaşırtıcı bir şekilde Bressler, filtre hakkında mesajlar almak için en sevdiği bazı kişilerin babalardan, özellikle de kızları olan babalardan olduğunu belirtti.
“Bunu yaptığım için mutlular ama başlamanın gerekli olduğu için üzgünler. Bunun üzerinde çalıştığım için mutlu olan [birkaç] babam var, çünkü kızları var ve bununla uğraşmak zorunda kalmalarını istemiyorlar.”
Twitter hesabı olan herkes içerik engelleme filtresini kullanabilir
Bressler, 'Belirli bir telefon modeline ihtiyacınız yok,' diye açıklıyor. “Herhangi bir Twitter hesabı bunu kullanabilir. Uygulamada ve web'de aynı şekilde çalışır. ”
Projenin nihai amacı, kontrolü topluluğa geri vermektir, böylece Twitter gelen kutularında bulunanlardan korkarak yaşamak zorunda kalmazlar.
onu kıskandırmak
'Berbat bir durumdan bir şeyler çıkarmanız ve durum üzerinde biraz kontrol sahibi olmanız ve dünyayı daha iyi bir yer haline getirmeniz çok komik.'
