辨識先於查證
聽覺記憶講求效率。你的大腦會把音色、語速和特有的停頓,與記憶中的樣本比對,還沒等你來得及質疑,就先回答「是媽媽」。這不是輕信,而是辨識系統的正常運作:在日常生活中,聲音幾乎從不說謊,每次都重新確認,代價太高了。
問題在於,辨識會同時啟動一整套預期。既然聲音是熟悉的,那對方的意圖一定也熟悉,情境一定很清楚,請求也一定合理。你回應的已經不只是聲音,而是你和這個人的全部關係歷史。對方利用的正是這整套預期。
只有聲音與你記憶中的樣本相符。
確定那就是本人、對方平安、是自願打來,而且說的是真話。
過去,這兩欄之間的落差很小:偽造聲音很困難。現在,只要有一段從公開個人檔案取得的短錄音,落差就變大了。改變的不是心理,而是偽造的成本。
接下來起作用的不是聲音,而是急迫感
熟悉的音色本身不會讓你做任何事。它只會移除第一道防線。接著出現的結構,在幾乎所有情境中都一樣:讓你沒時間思考的急迫感、讓你找不到其他人求證的保密要求,以及必須立刻完成的請求。
每個元素都在攻擊同一種能力-停下來查證的能力。急迫感吃掉時間。保密要求切斷第二種意見。熟悉的聲音則讓「查證」這個念頭本身變得尷尬:誰會回撥給媽媽,只為確認那真的是媽媽?
- 辨識
- 急迫感
- 保密
- 請求
如果一段對話中四者全都出現,不管你聽到的是誰的聲音,這本身就是一個警訊。親近的人等得起兩分鐘的停頓。施壓話術等不起,所以它不會給你停頓的時間。
這有多少證據支持
人們很難分辨合成語音和真實語音,這點已經在實驗中測量過:參與者的猜測表現高於隨機機率,但大約每4次就會錯1次,而短時間的訓練只能帶來些微幫助。這是實驗室研究,不是恐慌中的電話:錄音很短,只涵蓋幾種語言,沒有壓力,也沒有聲音背後那段熟悉的關係歷史。
聽覺不可靠,難以辨認偽造聲音:目前測量仍然不多,而且全都在實驗室條件下進行
這並不會改變結論的方向-如果要說有差別,反而是相反:在有急迫感和焦慮的真實對話中,你不會比在實驗室裡聽得更仔細。不要把自己的聽覺指定為判斷真偽的專家。
在 Miqo App 讀完全文
再讀 1 分鐘就能讀完,文末有測驗。 可在「心理學 → 社交工程」中找到
用手機相機掃描這裡,即可開啟 App Store 或 Google Play。
來源
- Mai K. T. 等人,《警告:人類無法可靠辨識語音深度偽造》,PLOS ONE,2023;關於影響的原理-R. Cialdini,《影響力》。