認識は確認より先に起こります
聴覚記憶は、効率よく働くようにできています。脳は声の音色や速さ、特徴的な間を記憶しているパターンと照合し、疑問を持つ前に「お母さんだ」と答えを出します。これはだまされやすさではなく、認識の正常な働きです。日常生活で声がうそをつくことはほとんどなく、毎回確認するのは負担が大きすぎるからです。
問題は、認識と一緒に期待のパッケージ全体が起動することです。声が身近なものなら、意図も身近なはず、状況もわかっているはず、頼み事も適切なはずだと考えます。もう音に反応しているのではなく、その人との関係の歴史全体に反応しているのです。だましの手口は、まさにこのパッケージを利用します。
音が記憶の中のパターンと一致したことだけです。
電話の相手がその人本人で、無事で、自分の意思で電話をかけ、真実を話していることです。
以前は、この2つの欄の隔たりは小さなものでした。声を偽造するのが難しかったからです。今は公開プロフィールにある短い録音だけで十分で、隔たりは大きくなりました。変わったのは心理ではなく、偽造にかかるコストです。
その先で働くのは声ではなく焦りです
なじみのある声色だけで、何かをしようとするわけではありません。声は最初の壁を取り除くだけです。その後には、ほとんどどの場面にも共通する仕組みが続きます。考える時間を奪う緊急性、誰にも電話できなくする秘密、そして今すぐ実行しなければならない頼み事です。
どの要素も、「立ち止まって確認する」という1つの力を狙います。緊急性は時間を奪い、秘密は第三者の意見から切り離します。そして聞き覚えのある声は、確認しようという考えそのものを気まずくさせます。お母さんかどうか確かめるために、お母さんにかけ直す人なんているでしょうか。
- 認識
- 緊急性
- 秘密
- 頼み事
会話の中でこの4つがそろったら、相手の声が誰のものかにかかわらず、それ自体がサインです。身近な人なら、2分間の中断くらい待てます。プレッシャーをかける筋書きは待てないので、そもそも中断させてくれません。
どの程度確かめられているのでしょうか
人が合成音声と本物の音声をうまく聞き分けられないことは、実験で確かめられています。参加者は偶然より高い確率で当てましたが、およそ4回に1回は間違え、短い訓練で改善したのもわずかでした。これは研究室での結果であって、パニック状態の電話ではありません。短い録音、2つほどの言語、プレッシャーなし、そして声の背後にある身近な関係の記憶もない条件です。
聴覚は偽音声を確実に見抜けません。測定はまだ少なく、すべて研究室での条件です
このことから導かれる結論の方向は変わりません。むしろ逆です。緊急性や不安のある実際の会話では、研究室にいるとき以上に注意深く聞くことはできないでしょう。自分の聴覚を本物かどうかの専門家にするのは、賢明ではありません。
続きはMiqoアプリで
あと1分で読み終わり、最後にクイズがあります。 「心理学 → ソーシャルエンジニアリング」にあります
スマホのカメラをここに向けると、App StoreまたはGoogle Playが開きます。
出典
- Mai K. T.ほか、「警告:人間は音声ディープフェイクを確実には検出できない」、PLOS ONE、2023年。影響の原理については、R. Cialdini『影響力の心理学』。