Jill Rettberg har delt denne artikkelen med deg.

Jill Rettberg har delt denne artikkelen

Bli abonnent
Kronikk

KI-språket er ikke nøytralt

Selv bruk av KI til enkel språkvask kan endre både form og innhold i en tekst.

IKKE ET MENNESKE, MEN EN MASKIN: Store språkmodeller skaper tekst basert på matematiske beregninger. Dette forklarer blant annet hvorfor de bruker så mange motsetninger, skriver Jill Walker Rettberg. Her viser en menneskelignende robot seg fram i Japan. Foto: Eugene Hoshiko, AP/NTBIKKE ET MENNESKE, MEN EN MASKIN: Store språkmodeller skaper tekst basert på matematiske beregninger. Dette forklarer blant annet hvorfor de bruker så mange motsetninger, skriver Jill Walker Rettberg. Her viser en menneskelignende robot seg fram i Japan. Foto: Eugene Hoshiko, AP/NTB

Hvis vi antar at KI-språk er en nøytral beholder for menneskelig kommunikasjon, så er valget om å bruke KI et verdivalg. Da kan KI-teksten i seg selv være god selv om det å bruke KI kan forstås som en form for juks, som miljøskadelig, som tyveri av åndsverk, og som støtte til tekoligarkenes overvåkingsøkonomi.

Men hvis KI-språket ikke er nøytralt, men former hva som er mulig å uttrykke, så blir KI-språk et problem uavhengig av verdier. Mer og mer forskning tyder på dette: at selv bruk av KI til enkel språkvask endrer både form og innhold i en tekst. Det skjer fordi språkmodeller ikke egentlig skriver, men beregner tekst ved å løse ligninger.

Professor Lars Fr. H. Svendsen er den siste som er anklaget for å ha brukt KI, og som de fleste andre mener han at det ikke spiller noen rolle. «Alt innhold i boken er mitt,» sier han til Manifest Media, det er «basert på foredragsmanus, podkastmanus, artikler og bøker». På Facebook skriver han at han har skrev manuset til boken «Trump og filosofene» raskt og deretter brukte KI til «språkvask og forenkling av språket».

Selv en prompt som bare ber KI-en om å gjøre en språkvask kan endre standpunktene som uttrykkes i teksten. Artikkelen «How LLMs Distort Written Language» beskriver en stor kvantitativ analyse som viser at selv lett språkvask med KI gjør teksten mer abstrakt og mer oppramsende enn menneskespråk. Det blir mindre personlig pronomen («jeg») og flere substantiv, adjektiv og konjunksjoner.

«KI-språket produseres gjennom motsetninger og likheter»

Både Teknologirådets evaluering av sin egen KI-bruk og en australsk undersøkelse fra 2024 fant at KI-sammendrag av rapporter kunne endre nyanser og utelate viktige elementer. Du husker kanskje KI-sammendraget av Telenors sikkerhetsrapport, som NTB publiserte ved en glipp i fjor? KI-en endret den viktigste trusselen fra hybridkrigføring til «ekstremvær, aldrende infrastruktur og digitale risikoer». Språkmodeller er jo designet for ikke å kunne nevne sensitive temaer som sex, vold, krig og politikk. De er også trent opp på amerikanske tekster. «Aldrende infrastruktur» er ikke nevnt i Telenors rapport, men er et vanlig problem i USA.

Men la oss fokusere her på motsetningene, som også Gisle Selnes trekker fram i sin anmeldelse av Svendsens bok (Klassekampen 30. september). KI-språket produseres gjennom motsetninger og likheter. Motsetningene produserer ikke-men-konstruksjoner, og likheter produserer lister. Det kan være de velkjente listene på tre ord som nesten er like, eller oppramsinger av nesten like setninger.

Mennesker bruker også binære motsetninger og forhold mellom ord for å bygge tankerekker. Walter Benjamin, en av filosofene Svendsen omtaler, har et klassisk eksempel i avslutningen av essayet «Kunstverket i reproduksjonsalderen»: Fascismen estetiserer politikken, skriver Benjamin, og kommunismen må svare ved å politisere kunst.

Å estetisere politikk står altså som motsats til å politisere kunst, som en klassisk kiasme (en retorisk stilfigur der tilsvarende setningsledd eller ord gjentas i omvendt rekkefølge, red.anm.) i A-B-B-A form. Men Benjamin bruker dette som slagkraftig konklusjon etter en lang, argumenterende tekst, ikke som et standardisert mønster som repeteres i nesten hver setning. Mennesker bruker språklige mønstre som rytme, rim, allitterasjon og kiasmer til å framheve ideer som er viktige. Språkmodeller bruker mønstre hele tiden.

Grunnen til at språkmodeller overdriver nettopp motsetninger så voldsomt, er at relasjoner mellom ord-par er selve grunnlaget for hvordan språkmodeller produserer tekst. En språkmodell er en matematisk modell av forholdene mellom ord, altså hvilke ord som pleier å opptre nær hverandre i en tekst. For modellen er et ord en vektor, en liste med tall som kan plottes inn i et multidimensjonalt koordinatsystem. Tenk på koordinatsystemet fra grunnskolens mattetimer, hvor vi plottet inn punkter på x-aksen og y-aksen, men med mange tusen akser.

Relasjonene mellom ord i dette koordinatsystemet kan så brukes til å generere ny tekst. Forholdet mellom «konge» og «dronning» tilsvarer for eksempel forholdet mellom «mann» og «kvinne». Dermed kan man regne med ord: «konge» minus «mann» pluss «dronning» = «kvinne». Jeg har skrevet mye mer om hvordan dette fungerer og hva det betyr for hva slags tekst som kan genereres i forskningsartikkelen «LLMs are Metaphor Machines».

En KI-tekst er altså ikke egentlig skrevet, den er beregnet. Litt forenklet kan vi si teksten er beregnet ut fra kvantitative forhold mellom ord-par. Ta denne setningen fra «Trump og filosofene», side 213: «I stedet for argumenter får vi bilder, symboler og myter.» Her har vi en liste på tre ord som framstilles som omtrent likeverdige: «bilder, symboler og myter», og som settes opp som en motsetning til «argumenter».

Lister av ting som ligner hverandre er enkle å generere, men kan være utmattende å lese fordi tolkningsarbeidet legges over på leseren. Setningen kunne like gjerne vært en ligning: a = – (b+c+d). For en språkmodell finnes ikke mening: ord er for den bare variabler som er like eller ulike andre variabler. Ordene kan byttes ut for å produsere neste setning som betyr omtrent det samme: «Folket skal ikke tenke, men føle».

Når språkmodellen ser «tenke», henter den automatisk inn motsetningen «føle», slik at summen blir lik null. Dette er statistikk, ikke argumentasjon.

«Jeg kan stille meg bak hver eneste setning i boken,» sa Svendsen til Manifest Media, og det stemmer sikkert. Jeg vil likevel si at summen av enkeltsetninger utgjør noe Svendsen ikke ville ha skrevet selv.

Lyst å lese mer fra Klassekampen?

Bli abonnent

Du kan enkelt registrere deg med

Kronikk

AfDs brakvalg er også et spark til EU. Det kan få store følger.

Kan man utvikle leseglede når lesingen først og fremst er en ferdighet man skal øve på og måles i?

Staten prøver å omgå en dom i Høy­este­rett ved å flytte belast­ningen over på en uskyldig tredjepart.