NB
Last nedLast ned

Hvorfor en kjent stemme ikke beviser noe

Miqo-redaksjonen · 2 kilder

Gjenkjenningen kommer før kontrollen

Hørselshukommelsen er laget for å være effektiv. Hjernen sammenligner klang, tempo og karakteristiske pauser med et lagret mønster og svarer «det er mamma» før du rekker å stille deg selv spørsmålet. Det er ikke godtroenhet, men normal gjenkjenning: I hverdagen lyver en stemme nesten aldri, og det ville kostet for mye å kontrollere den hver gang.

Problemet er at gjenkjenningen aktiverer en hel pakke med forventninger. Når stemmen er kjent, antar du også at intensjonene er gode, at konteksten er klar, og at forespørselen er rimelig. Du svarer ikke lenger på en lyd, men på hele historien du har med personen. Det er denne pakken som blir utnyttet.

Hva stemmen beviser

Bare at lyden samsvarer med et mønster i hukommelsen din.

Det du legger til selv

At det er denne personen, at hun har det bra, ringer frivillig og snakker sant.

Før var avstanden mellom disse to kolonnene liten: Det var vanskelig å forfalske en stemme. Nå holder det med et kort opptak fra en åpen profil, og avstanden har blitt større. Psykologien har ikke endret seg, men det har prisen for å forfalske.

Det som virker videre, er ikke stemmen, men presset

En kjent klang får deg ikke til å gjøre noe i seg selv. Den fjerner bare den første barrieren. Deretter følger en struktur som er nesten lik i alle scenarier: hastverk som ikke gir deg tid til å tenke, hemmelighold som gjør at du ikke har noen å ringe, og en forespørsel som må oppfylles med en gang.

Hvert element rammer én evne: evnen til å stoppe opp og kontrollere. Hastverk spiser opp tiden. Hemmelighold stenger ute en annen vurdering. Og en gjenkjennelig stemme gjør selve tanken på å kontrollere ubehagelig: Hvem ringer mamma tilbake for å forsikre seg om at det er mamma?

  1. Gjenkjenning
  2. Hastverk
  3. Hemmelighold
  4. Forespørsel

Hvis alle fire opptrer i samme samtale, er det et tegn i seg selv, uansett hvilken stemme du hører. En nær person tåler en pause på to minutter. Et pressende manus gjør ikke det, og derfor får du heller ingen pause.

Hvor godt er dette dokumentert?

Hvor dårlig mennesker skiller syntetisk tale fra ekte tale, er blitt målt i eksperimenter: Deltakerne gjettet oftere riktig enn ved ren tilfeldighet, men tok feil omtrent i hvert fjerde tilfelle, og en kort treningsøkt hjalp bare litt. Dette er laboratorieforskning, ikke en panisk telefonsamtale: korte opptak, et par språk, ikke noe press og ingen kjent historie bak stemmen.

Hørselen er dårlig til å oppdage forfalskninger: Det finnes foreløpig få målinger, alle under laboratorieforhold

Det endrer ikke konklusjonens retning, snarere tvert imot: I en virkelig samtale, der det finnes hastverk og uro, kommer du ikke til å lytte enda mer oppmerksomt enn i et laboratorium. Det er ikke lurt å gjøre din egen hørsel til ekspert på ekthet.

Les resten i Miqo-appen

1 minutt igjen, og til slutt en quiz. Finn den under «Psykologi → Sosial manipulering»

QR-kode for å laste ned Miqo-appen

Rett mobilkameraet hit for å åpne App Store eller Google Play.

Kilder

  1. Mai K. T. mfl., «Warning: Humans cannot reliably detect speech deepfakes», PLOS ONE, 2023
  2. om prinsipper for påvirkning - R. Cialdini, «Påvirkning»