Узнавание приходит раньше проверки
Слуховая память устроена экономно. Тембр, темп, характерные паузы - мозг сопоставляет их с сохранённым образцом и выдаёт ответ «это мама» раньше, чем удаётся задать себе вопрос. Это не легковерие, а нормальная работа распознавания: в обычной жизни голос почти никогда не врёт, и перепроверять его каждый раз было бы слишком дорого.
Проблема в том, что вместе с узнаванием включается целый пакет ожиданий. Раз голос свой - значит, и намерения свои, и контекст понятный, и просьба уместная. Ты отвечаешь уже не звуку, а всей истории отношений с человеком. Именно этот пакет и берут в работу.
Только то, что звук совпал с образцом в твоей памяти.
Что на связи именно этот человек, что он в порядке, звонит по своей воле и говорит правду.
Раньше зазор между этими двумя колонками был крошечным: подделать голос было трудно. Сейчас хватает короткой записи из открытого профиля - и зазор стал широким. Изменилась не психология, изменилась цена подделки.
Дальше работает не голос, а спешка
Сам по себе знакомый тембр ни к чему не склоняет. Он только снимает первый барьер. За ним идёт конструкция, одинаковая почти в любом сценарии: срочность, из-за которой некогда думать; секретность, из-за которой некому позвонить; и просьба, которую надо выполнить прямо сейчас.
Каждый элемент бьёт по одной способности - остановиться и проверить. Срочность съедает время. Секретность отрезает второе мнение. А узнаваемый голос делает саму мысль о проверке неловкой: кто же перезванивает маме, чтобы убедиться, что это мама.
- Узнавание
- Срочность
- Секретность
- Просьба
Если в разговоре сходятся все четыре - это признак сам по себе, чей бы голос ни звучал. Близкий человек переживёт паузу в две минуты. Сценарий давления её не переживает, поэтому паузу и не дают.
Насколько это проверено
То, что люди плохо отличают синтезированную речь от настоящей, измеряли в экспериментах: участники угадывали чаще случайного, но ошибались примерно в каждом четвёртом случае, и короткая тренировка помогала лишь немного. Это лаборатория, а не звонок в панике: короткие записи, пара языков, никакого давления и никакой знакомой истории за голосом.
Слух ненадёжно ловит подделку: измерений пока немного, все в лабораторных условиях
Направление вывода от этого не меняется, скорее наоборот: в настоящем разговоре, где есть спешка и тревога, слушать ещё внимательнее, чем в лаборатории, ты не станешь. Назначать собственный слух экспертом по подлинности не стоит.
Дочитай в приложении Miqo
Ещё 1 минута - и квиз в конце. Статья - в разделе «Психология → Социальная инженерия»
Наведи камеру телефона - откроется App Store или Google Play.
Источники
- Mai K. T. и др., «Warning: Humans cannot reliably detect speech deepfakes», PLOS ONE, 2023
- о принципах влияния - Р. Чалдини, «Психология влияния»