Uncanny valley – varför AI kan skapa känslor av obehag

Du har helt säkert varit med om det i dessa AI-tider. En bild på en människa som inte känns riktigt mänsklig. En text som är välskriven, men har en konstig tonalitet. En röst som sjunger vackert, men låter konstlad på ett oförklarligt vis. Känslan har ett namn: ”uncanny valley” (”kusliga dalen” på svenska).

Ett begrepp från 1970

Uncanny valley är ett begrepp som myntades av den japanske robotforskaren Masahiro Mori 1970. Han skrev en essä om hur vi reagerar på saker som liknar människor. Tanken var: Ju mer mänsklig en robot ser ut, desto mer sympati känner vi för den. Men bara upp till en viss punkt. När den blir nästan-mänsklig försvinner sympatin och ersätts av obehag.

Mori illustrerade förhållandet mellan mänsklighetsgrad och graden av välbehag/obehag med ett koordinatssystem. Fenomenet med att stigande välbehag som följer robotars människolikhet avbryts när roboten är nästan-mänsklig såg ut som en dal rent grafiskt. Mori kallade det ”bukimi no tani”, japanska för ”kusliga dalen”.

Mori tog exempel med en handprotes som ser verklig ut. Så länge du bara tittar på den är det okej. Men om du rör vid den syntetiska handen och känner att den är kall och stel, väcks obehaget. Förväntningen säger en sak och upplevelsen en annan. Mori menade att rörelse förstärker effekten. Något som nästan rör sig som en människa kan kännas mer obehagligt än något som står stilla.

Vad säger forskningen?

Forskningen har testat idén med uncanny valley under femtio år och resultaten är blandade. Den klassiska kurvan, med sin tydliga dal, får ganska svagt stöd.

Det som däremot håller bättre är en närliggande förklaring. I en genomgång av forskningen diskuterar Wang, Lilienfeld och Rochat mismatch som en möjlig förklaring till obehaget. Det handlar om att olika mänskliga och artificiella drag inte riktigt stämmer överens. Obehaget kan till exempel uppstå när vi ser mänskliga ögon i ett ansikte som i övrigt ser artificiellt ut, eller en realistisk figur som rör sig lite för jämnt.

Det som stör oss är alltså inte att något är konstgjort, utan att det finns en förväntan som inte överensstämmer riktigt med verkligheten. Det liknar en människa, men beter sig inte fullt ut som en människa.

Uncanny valley och AI

Moris idéer gällde robotar. I dag möter vi samma känsla som han beskrev i de AI-verk som förekommer i vår vardag. Det kan vara en bild där händerna har ett finger för mycket eller ett ansikte som ler med en ”död” blick. Det kan vara en text där varje mening är korrekt, men där ”berättarrösten” känns konstig och off. Audiovisuellt kan det röra sig om en kundtjänströst som pausar på fel ställen, eller en sångerska som har lite fel känslouttryck jämfört med vad ”hon” sjunger om.

Det har forskats även på detta. I en studie från 2022 lät forskarna Sophie Nightingale och Hany Farid människor bedöma porträtt och avgöra hur pålitliga de såg ut. Hälften av porträtten föreställde riktiga människor, hälften var skapade med AI.

Resultatet var att deltagarna inte kunde skilja dem åt bättre än slumpen, och de AI-skapade ansiktena bedömdes till och med som något mer pålitliga.

Tekniken har alltså i vissa fall tagit sig förbi den kusliga dalen. Men känslan har inte försvunnit. Den har flyttat. Förr satt obehaget i det vi såg. Nu sitter det lika ofta i det vi inte vet. Är det här en människa? Har någon faktiskt tänkt det här? Osäkerheten blir en egen sorts mismatch, när vi inte längre kan vara säkra på vad som är äkta och AI-genererat.

Förlorad tillit

I text kan vi avslöja AI på olika sätt, inte bara genom de omtalade långa bindestrecken. Ibland gör människor ordval som inte är de mest självklara eller korrekta. Vi tar exempel som är typiska för just oss. Meningslängden kanske blir lite för klumpig. Ojämnheterna ger en viss stil.

AI-skriven text tenderar att sakna ojämnheterna. Den är jämn, balanserad och allmängiltig. Varje stycke har sin tes och sin sammanfattning. Det finns mönster. Inget är fel, men det känns nästan-mänskligt, och det är just det som får många läsare att ana oråd. De kanske inte kan peka på vad, men misstankar väcks och tilliten sjunker.

Samtidigt är det långt ifrån alla AI-genererade texter som är lätta att avslöja. När en skicklig skribent sköter promptarna och går igenom texten efter generering, blir det nästan omöjligt att se var gränsen mellan människa och maskin går.

Människor gillar människor

Jag må jobba med att skriva, och använder i mitt jobb AI-assistenter som Claude och ChatGPT. Denna text är inget undantag. Men jag är också en vanlig internetanvändare som använder sociala medier på daglig basis och exponeras där allt oftare för AI-genererat innehåll.

En stor del av innehållet missar jag troligen att är AI-genererat, eftersom människorna som styr AI:n har gjort ett proffsigt och bra jobb. Så hoppas jag att mina egna texter upplevs. För det som faktiskt skapar en stor del av den mening jag känner, i mitt yrke som skribent, är att lyckas nå ut – människa till människa.

Det Masahiro Mori beskrev är något som många med mig säkerligen känner igen. I dag är det framför allt illa genererad AI som väcker dessa känslor. Uppenbara fall. Samtidigt är det nog fler än jag som tycker att det är roligt med filmer där katter lagar mat och hundratals skäggiga män slickar på omslaget till Grand Theft Auto. Dvs uppenbart AI-genererade reels.

Som vanligt handlar det inte om att försöka välja mellan två alternativ, utan om att försöka hålla balansen mitt i all komplexitet. Förståelsen av hur vi människor fungerar är en viktig del i detta.

Fler bloggposter: