La capacidad humana para detectar voces sintéticas: un estudio perceptivo en español y japonés

Abstract

Hoy día la síntesis de voz es posible a bajo coste y con resultados cada vez más realistas. Se prevé que en los próximos años el contenido generado con inteligencia artificial siga creciendo, lo que expone a la ciudadanía a posibles usos malintencionados. Sin embargo, son escasas las investigaciones que analizan la capacidad humana para identificar voces artificiales, y la mayoría se centran en la lengua inglesa. Este trabajo busca contribuir a ese campo mediante un experimento perceptivo en el que 54 oyentes (28 nativos de español y 26 nativos de japonés) clasificaron voces como naturales o sintéticas. El corpus incluyó 80 estímulos (50% artificiales), organizados según tres variables: idioma (español/japonés), estilo de habla (audiolibros/entrevistas) y familiaridad con la voz (conocido/no conocido). El objetivo del estudio es clarificar cómo estas variables influyen en la detección y poner de relieve posibles vulnerabilidades del ser humano frente a las voces artificiales.

Date
Jan 13, 2026
Location
Córdoba, Spain