Yapay Zeka Sesli Dolandırıcılık İnsanlarla Aynı Seviyede, Çok Daha Ucuz
4.100 kişilik araştırma, yapay zeka sesli dolandırıcılığın insanlarla aynı düzeyde ikna edici olduğunu, tespit oranının ise yüzde 70'te kaldığını gösteriyor.
4.100 katılımcıyla yapılan geniş çaplı bir araştırma, ABD'li yetişkinlerin yapay zeka destekli sesli dolandırıcılık (vishing) saldırılarına karşı ne kadar savunmasız olduğunu ölçtü. Llama Full Duplex, Sesame, Gemini, OpenAI'nin Gelişmiş Ses Modu, Play.AI ve ElevenLabs gibi altı önde gelen ses modeli, insan aramalarıyla karşılaştırıldı. "Sıkıntıdaki kardeş" gibi duygusal senaryolarda uyum oranı yüzde 36'ya kadar çıkarken, beş dolandırıcılık türü genelinde ortalama yüzde 16,5 gibi çarpıcı bir oran elde edildi; üstelik insan operatör maliyetine kıyasla çok daha ucuza.
Sesame ve ElevenLabs'ın ses klonlama teknolojisi, nötr bağlamlarda insan sesine yakın doğallık puanları aldı. Katılımcılar yapay zeka seslerini yalnızca yüzde 70,3 oranında doğru tespit edebildi; gerçek insanları da sıkça yapay zeka sandılar. Yapay zeka araçlarına aşinalık ya da sesli asistan kullanımı, tespit başarısını artırmadı. Asıl belirleyici faktör mesajın ikna ediciliğiydi — sesin insan mı yapay zeka mı olduğu algısından bağımsız olarak.
Bulgular, yapay zeka destekli vishing'in ekonomik bir eşiği aştığını gösteriyor: insan operatörlü dolandırıcılık ABD ücretleriyle kârsızken, birkaç yapay zeka modeli bu saldırıları ölçeklenebilir ve kârlı hale getiriyor. Ses yapay zekası geliştiren mühendisler için bu durum, filigranlama, köken doğrulama ve klonlama için onay mekanizmaları gibi güvenlik önlemlerinin aciliyetini ortaya koyuyor.