Studi Baru Menemukan Suara yang Dihasilkan AI Kini Tidak Bisa Dibedakan dengan Suara Manusia

Sebuah studi baru dari Universitas Queen Mary London telah menunjukkan bahwa suara yang dihasilkan AI telah mencapai tingkat realisme yang tidak dapat dibedakan dari suara manusia, sehingga menimbulkan pertanyaan penting tentang peran teknologi dalam komunikasi, keamanan, dan etika.

Teknologi suara AI telah mencapai tonggak sejarah yang luar biasa. Sebuah studi baru dari Queen Mary University of London mengungkapkan bahwa suara sintetis kini tidak dapat dibedakan dari suara manusia asli, menandai lompatan signifikan dalam kemampuan kecerdasan buatan.

Banyak orang telah lama menganggap ucapan yang dihasilkan AI kurang meyakinkan dan mudah dibedakan dari suara manusia. Namun, penelitian terbaru menunjukkan bahwa persepsi ini semakin ketinggalan zaman.

Diterbitkan Dalam jurnal PLOS One, penelitian tersebut membandingkan suara manusia asli dengan dua jenis suara yang dihasilkan AI: suara yang dikloning untuk meniru orang tertentu dan suara yang dibuat dari model suara besar tanpa padanan manusia tertentu.

Peserta dalam penelitian mengevaluasi realisme, dominasi, dan kepercayaan terhadap suara-suara tersebut.

Temuan ini mengungkapkan bahwa suara yang dihasilkan AI dapat terdengar senyata suara manusia, sehingga sulit bagi pendengar untuk membedakannya. Menariknya, suara-suara ini seringkali dianggap lebih dominan dan, dalam beberapa kasus, lebih dapat dipercaya daripada suara manusia.

"Suara-suara yang dihasilkan AI kini ada di sekitar kita. Kita semua pernah berbicara dengan Alexa atau Siri, atau panggilan kita dijawab oleh sistem layanan pelanggan otomatis," ujar penulis korespondensi Nadine Lavan, dosen senior psikologi di Queen Mary University of London, yang turut memimpin studi ini, dalam siaran pers. "Suara-suara itu memang tidak terdengar seperti suara manusia sungguhan, tetapi hanya masalah waktu sebelum teknologi AI mulai menghasilkan ucapan yang terdengar natural dan seperti suara manusia. Studi kami menunjukkan bahwa saat ini telah tiba, dan kita sangat perlu memahami bagaimana orang-orang mempersepsikan suara-suara realistis ini."

Lavan menyoroti kemudahan dan kecepatan tim dalam membuat klon suara menggunakan perangkat lunak yang tersedia secara komersial.

"Prosesnya hanya membutuhkan keahlian minimal, rekaman suara hanya beberapa menit, dan hampir tanpa biaya," tambahnya. "Ini menunjukkan betapa mudah diakses dan canggihnya teknologi suara AI."

Perkembangan pesat dalam sintesis suara AI memiliki implikasi etika, hak cipta, dan keamanan yang mendalam. Kekhawatiran akan misinformasi, penipuan, dan peniruan identitas menjadi sangat penting, terutama karena pembuatan suara yang realistis menjadi lebih mudah diakses dan canggih.

Namun, pada catatan positif, Lavan menekankan potensi teknologi suara AI untuk menawarkan peluang menarik.

β€œMungkin ada aplikasi untuk meningkatkan aksesibilitas, pendidikan, dan komunikasi, di mana suara sintetis berkualitas tinggi yang dirancang khusus dapat meningkatkan pengalaman pengguna,” ujarnya.

Sumber: Queen Mary University of London