Herkenning komt vóór controle
Je auditieve geheugen werkt efficiënt. Je brein vergelijkt klankkleur, tempo en kenmerkende pauzes met een opgeslagen patroon en komt met het antwoord "dat is mama" voordat je jezelf een vraag hebt kunnen stellen. Dat is geen goedgelovigheid, maar normale herkenning: in het dagelijks leven liegt een stem bijna nooit, en elke keer controleren zou te veel moeite kosten.
Het probleem is dat herkenning een heel pakket aan verwachtingen activeert. Als de stem bekend klinkt, zijn de bedoelingen dat blijkbaar ook, is de context duidelijk en is het verzoek gepast. Je reageert niet meer op een geluid, maar op je hele geschiedenis met die persoon. Precies dat pakket wordt uitgebuit.
Alleen dat het geluid overeenkomt met een patroon in je geheugen.
Dat het die persoon is, dat het goed met diegene gaat, dat diegene uit vrije wil belt en de waarheid spreekt.
Vroeger was de kloof tussen die twee kolommen klein: een stem namaken was moeilijk. Nu is een korte opname uit een openbaar profiel al genoeg - en is de kloof groter geworden. De psychologie is niet veranderd, wel de prijs van het namaken.
Daarna werkt niet de stem, maar de haast
Een bekende klank zet je op zichzelf nergens toe aan. Hij neemt alleen de eerste drempel weg. Daarna volgt in bijna elk scenario dezelfde opbouw: haast waardoor je geen tijd hebt om na te denken; geheimhouding waardoor je niemand kunt bellen; en een verzoek dat je meteen moet uitvoeren.
Elk element tast één vaardigheid aan: stoppen en controleren. Haast snoept tijd weg. Geheimhouding sluit een second opinion uit. En een herkenbare stem maakt het idee van controle zelf ongemakkelijk: wie belt mama terug om zeker te weten dat het mama is?
- Herkenning
- Haast
- Geheimhouding
- Verzoek
Als alle vier in een gesprek samenkomen, is dat op zichzelf al een signaal, ongeacht wiens stem je hoort. Iemand die je na staat, kan een pauze van twee minuten wel verdragen. Een drukscenario niet, en daarom krijg je die pauze ook niet.
Hoe goed is dit onderbouwd?
Dat mensen gesynthetiseerde spraak slecht van echte spraak kunnen onderscheiden, is in experimenten gemeten: deelnemers raadden vaker goed dan op basis van toeval, maar zaten ongeveer in een op de vier gevallen fout, en een korte training hielp maar weinig. Dit was een laboratoriumsituatie, geen paniekerig telefoongesprek: korte opnames, een paar talen, geen druk en geen vertrouwde geschiedenis achter de stem.
Je gehoor herkent vervalsingen niet betrouwbaar: er zijn nog maar weinig metingen, allemaal onder laboratoriumomstandigheden
De richting van de conclusie verandert daardoor niet, eerder het tegenovergestelde: in een echt gesprek, met haast en angst, ga je niet aandachtiger luisteren dan in een laboratorium. Je eigen gehoor als expert op het gebied van echtheid beschouwen, is geen goed idee.
Lees de rest in de Miqo-app
Nog 1 minuut lezen, en aan het eind een quiz. Te vinden onder ‘Psychologie → Sociale beïnvloeding’
Richt de camera van je telefoon hierop om de App Store of Google Play te openen.
Bronnen
- Mai K. T. et al., "Waarschuwing: mensen kunnen deepfakes van spraak niet betrouwbaar herkennen", PLOS ONE, 2023
- over beïnvloedingsprincipes - R. Cialdini, "Invloed"