El reconocimiento llega antes que la comprobación
La memoria auditiva funciona de forma económica. El cerebro compara el timbre, el ritmo y las pausas características con un patrón almacenado y responde «es mamá» antes de que puedas preguntarte nada. No es credulidad, sino el funcionamiento normal del reconocimiento: en la vida cotidiana, una voz casi nunca miente, y comprobarla cada vez sería demasiado costoso.
El problema es que, junto con el reconocimiento, se activa todo un paquete de expectativas. Si la voz es conocida, entonces las intenciones también deben serlo, el contexto debe estar claro y la petición debe ser adecuada. Ya no respondes a un sonido, sino a toda tu historia con esa persona. Ese es precisamente el paquete que se aprovecha.
Solo que el sonido coincide con un patrón de tu memoria.
Que es esa persona, que está bien, que llama por voluntad propia y que dice la verdad.
Antes, la brecha entre esas dos columnas era diminuta: falsificar una voz era difícil. Ahora basta con una grabación breve de un perfil público, y la brecha se ha ampliado. No ha cambiado la psicología, sino el coste de la falsificación.
Después no actúa la voz, sino la prisa
Por sí sola, una voz conocida no te impulsa a hacer nada. Solo elimina la primera barrera. Después aparece una estructura casi idéntica en cualquier escenario: una urgencia que no deja tiempo para pensar, un secreto que no deja a quién llamar y una petición que hay que cumplir ahora mismo.
Cada elemento ataca una capacidad: la de detenerte y comprobar. La urgencia se come el tiempo. El secreto te deja sin una segunda opinión. Y una voz reconocible hace que la idea misma de comprobarlo resulte incómoda: ¿quién vuelve a llamar a mamá para asegurarse de que es mamá?
- Reconocimiento
- Urgencia
- Secreto
- Petición
Si en una conversación aparecen los cuatro elementos, eso ya es una señal, sea quien sea la persona cuya voz escuches. Alguien cercano soportará una pausa de dos minutos. Un guion de presión no la soporta, por eso no te la conceden.
Hasta qué punto está demostrado
Los experimentos han medido lo mal que las personas distinguen el habla sintetizada de la real: acertaban más que por azar, pero se equivocaban aproximadamente en 1 de cada 4 casos, y una breve sesión de entrenamiento ayudaba muy poco. Esto es el laboratorio, no una llamada en medio del pánico: grabaciones breves, un par de idiomas, ninguna presión y ninguna historia conocida detrás de la voz.
El oído detecta mal las falsificaciones: todavía hay pocas mediciones y todas se han realizado en condiciones de laboratorio
La conclusión no cambia por eso; más bien al contrario: en una conversación real, con prisa y ansiedad, no escucharás con más atención que en un laboratorio. No conviene convertir tu propio oído en experto en autenticidad.
Termina de leer en la app Miqo
1 minuto más y, al final, un quiz. Búscalo en «Psicología → Ingeniería social»
Apunta aquí con la cámara del móvil para abrir App Store o Google Play.
Fuentes
- Mai K. T. y otros, «Warning: Humans cannot reliably detect speech deepfakes», PLOS ONE, 2023
- sobre los principios de la influencia: R. Cialdini, «Psicología de la influencia»