İçerik Haritası
Artık kimse ayırt edemiyor: Yapay zekâ sesler, insan sesinden farksız mı?
Çoğumuz, Siri yahut Alexa üzere ferdî asistanlar aracılığıyla yapay zekâ sesleriyle karşılaştık ve onların mekanik, tonlamasız yapıları sayesinde gerçek bir insan sesiyle yapay bir sesi kolay kolay ayırt edebileceğimizi düşündük. Lakin bilim insanları, ortalama bir dinleyicinin artık gerçek beşerler ve “deepfake” (sahte) sesler ortasındaki farkı söyleyemediğini belirtiyor.
PLoS One mecmuasında 24 Eylül’de yayımlanan yeni bir çalışmada, araştırmacılar insanların, gerçek insan seslerini ve bu seslerin yapay zeka tarafından üretilmiş klonlanmış versiyonlarını dinlediklerinde, hangisinin gerçek hangisinin düzmece olduğunu yanlışsız bir halde tespit edemediklerini ortaya koydu. Queen Mary Londra Üniversitesi’nden kıdemli psikoloji okutmanı ve çalışmanın başyazarı Nadine Lavan, “Yapay zeka tarafından üretilen sesler artık her yanımızda. Lakin doğal, insan sesine benzeyen konuşmalar üreten yapay zeka teknolojisi yalnızca an sıkıntısıydı,” diyor.
Gerçek ve yapay sesler ortasındaki çizgi siliniyor
Araştırma, sıfırdan oluşturulan jenerik yapay zeka seslerinin hâlâ gerçekçi bulunmadığını gösterirken, gerçek insanların sesleri üzerinde eğitilmiş klonlanmış seslerinin ise tıpkı yepyeni sesler kadar inandırıcı olduğunu gösteriyor. Çalışmaya katılanlara, 80 farklı ses örneği (40 yapay zeka ve 40 gerçek insan sesi) dinletildi. Sıfırdan üretilen yapay zeka seslerinin sadece %41’i kazara insan sesi olarak sınıflandırıldı; bu da bu çeşit sesleri hâlâ ayırt etme yeteneğimizin olduğunu gösteriyor. Fakat, gerçek insan seslerinden klonlanan YZ seslerinin büyük bir kısmı (%58) insan sesi olarak yanlış sınıflandırıldı.
Araştırmacılar, gerçek insan seslerinin ise yalnızca biraz daha yüksek bir oranda (%62) yanlışsız tanımlanabildiğini belirterek, gerçek şahıslarla onların deepfake klonlarını ayırt etme yeteneğimiz ortasında istatistiksel bir fark olmadığı sonucuna vardı.
Sahte seslerin yükselen tehlikesi
Lavan’a nazaran bu sonuçlar, etik, telif hakkı ve güvenlik açısından önemli sonuçlar doğurma potansiyeli taşıyor. Şayet hatalılar sesinizi klonlamak için yapay zeka kullanırsa, bankacılıkta kullanılan ses tanıma protokollerini aşmak yahut sevdiklerinizi para transfer etmeleri için ikna etmek çok daha kolay hale geliyor. Gerçeğe yakın yapay zeka sesleri, siyasetçiler yahut ünlülerle ilgili geçersiz demeçler yahut röportajlar oluşturmak için, bireyleri prestij kaybına uğratmak yahut toplumsal huzursuzluğu kışkırtmak hedefiyle kullanılabilir.
Araştırmacılar, bu çalışmada kullanılan ses klonlarının bile özel bir teknoloji gerektirmediğini vurguladı. Ticari olarak erişilebilen yazılımlarla ve sadece dört dakikalık insan konuşma kaydıyla eğitilmişler. Lavan, “Süreç minimal uzmanlık, yalnızca birkaç dakikalık ses kaydı ve neredeyse hiç para gerektirmiyordu. Bu da YZ ses teknolojisinin ne kadar erişilebilir ve gelişmiş hale geldiğini gösteriyor,” diyor.
Deepfake’ler makus niyetli aktörler için pek çok fırsat sunsa da, her şey berbat değil. Yapay zeka seslerini büyük ölçekte üretme gücü, erişilebilirlik, eğitim ve irtibat üzere alanlarda kullanıcı tecrübesini güzelleştirebilecek olumlu uygulamalar da getirebilir.
Chip Alıntıdır…


