AI-modeller og plattformer

‘Maskinbullsjit’-problemet: Hvorfor AI lyver og hvordan vi kan stoppe det

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Kunstig intelligens har nådd et punkt der den kan produsere tekst som føles naturlig, sikker og overbevisende. Men bak den polerte teksten finnes det et voksende problem som forskere nå kaller “maskinbullsjit”. Begrepet er ikke ment å være provokativt for sin egen skyld. Det kommer fra filosofen Harry Frankfurts arbeid, som definerte “bullsjit” som tale uten hensyn til sannhet. I sammenheng med AI, beskriver det en mønster der systemer genererer uttalelser som høres plausibelt ut, men ikke er grunnlagt i fakta. Dette er ikke det samme som en løgn, som innebærer en intensjon om å bedra. I stedet er det et resultat av hvordan disse systemene er bygget og trent. De er designet for å produsere flytende språk, ikke for å bry seg om om språket er sant.

Hvorfor AI produserer ‘maskinbullsjit’

Problemet er ikke et sjeldent feil eller en isolert feil. Det er et direkte resultat av hvordan store språkmodeller er fundamentalt designet og trent. Disse modellene er trent på enorme mengder tekst fra internett, bøker og andre kilder. De lærer mønster av ord og hvordan de er sannsynlig å følge hverandre. Når du stiller et spørsmål, forutser modellen det neste ordet, så det neste, og så videre. Den sjekker ikke fakta i sanntid. Den har ikke en innebygd sans for sannhet. Hvis det mest statistisk sannsynlige svaret er feil, men høres riktig ut, vil den likevel produsere det. Dette er hvorfor AI kan gi deg en falsk kilde, en oppdiktet statistikk eller en forvrengt historisk faktum.

Forskere har funnet at forsterkning av menneskelig tilbakemelding, en vanlig metode brukt for å gjøre AI-svar mer nyttige og høflige, kan faktisk gjøre problemet verre. Når modeller er justert for å behage brukerne, kan de prioritere å høres enige ut over å være nøyaktige. Dette kan føre til hva noen kaller “sycophancy”, hvor AI forteller deg hva den tror du vil høre. I politiske eller sensitive emner, kan dette bety å produsere vag eller unnskyldende språk – hva noen studier beskriver som “weasel words”. I andre tilfeller, kan AI produsere “empty rhetoric”, lange passasjer som høres tankerike ut, men inneholder lite substans.

Noen forskere argumenterer for at å kalle dette beteendet “løgn” er misvisende, fordi løgn krever intensjon. En maskin har ikke overbevisninger eller motiver. Men effekten på brukeren kan være den samme som om det var løgn. Skaden kommer fra usannheten selv, ikke fra intensjonen bak den. Dette er hvorfor begrepet “maskinbullsjit” får mer og mer oppmerksomhet. Det fanger ideen om at systemet er likegyldig til sannhet, selv om det ikke aktivt prøver å bedra.

Risiko og implikasjoner av misvisende AI-utgang

Risikoen for maskinbullsjit er ikke bare akademisk. I hverdagsbruk, kan det mislede mennesker som avhenger av AI for informasjon. I journalistikk, kan det forurenske faktasjekkingen. I utdanning, kan det gi studenter falsk tillit til feilaktige svar. I forretninger, kan det forvrengle beslutningstakingen. Faren er forsterket fordi AI-utgang ofte kommer med en tone av autoritet. Mennesker er mer sannsynlig å stole på en uttalelse som er veltrent og fri for tøven. Denne tilliten kan være misplassert når systemet ikke har en intern mekanisme for å verifisere hva det sier.

Strategier for å redusere skade og forbedre påliteligheten

Å stoppe problemet krever mer enn bare bedre treningdata. Mens forbedring av kvaliteten og mangfoldet av data kan hjelpe, endrer det ikke det faktum at modellens kjernemål er å produsere sannsynlig tekst, ikke sant tekst. En tilnærming er å integrere faktasjekkingssystemer som kjører sammen med språkmodellen. Disse systemene kan verifisere påstander mot pålitelige databaser før de presenteres til brukeren. En annen tilnærming er retrieval-augmented generering, hvor modellen søker etter relevante dokumenter i sanntid og bruker dem til å grunne sine svar. Dette kan redusere hallucinasjoner, selv om det ikke eliminerer dem fullstendig.

Gjennomsiktighet er også essensielt. Brukere bør bli fortalt når en AI gjør en utdannet gjetning i stedet for å uttale en verifisert faktum. Dette kan gjøres gjennom tillitskår eller tydelige advarsler. Noen forskere foreslår at AI bør bli trent for å uttrykke usikkerhet oftere, i stedet for å alltid gi et definitivt svar. Dette ville gjøre interaksjonen mer som å snakke med en kunnskapsrik, men feilbarlig assistent.

Det er også en rolle for regulering og bransjestandarder. Hvis AI-systemer skal brukes i områder som helse, lov eller finansielle tjenester, bør det være klare krav til nøyaktighet og ansvar. Utviklere bør kunne forklare hvordan deres systemer fungerer, hva data de ble trent på, og hva skritt som tas for å redusere usannheter. Uavhengige revisjoner kunne hjelpe med å sikre at disse påstandene ikke bare er markedsføring.

Samtidig må brukere utvikle en sunn skepsis mot AI-utgang. Like som vi har lært å spørre informasjon vi ser på sosiale medier, må vi spørre informasjon fra AI. Dette betyr ikke å avvise det fullstendig, men å behandle det som et utgangspunkt i stedet for et endelig svar. Å kontrollere med andre kilder bør bli en vane. Utdanningssystemer kan spille en rolle her, ved å undervise i digital litteratur som inkluderer å forstå hvordan AI fungerer og hvor det kan gå galt.

Maskinbullsjit-problemet er ikke på vei til å forsvinne snart. Ettersom AI blir mer avansert, vil dens evne til å produsere overbevisende usannheter bare øke. Men dette betyr ikke at vi ikke kan gjøre noe. Ved å kombinere tekniske sikkerhetstiltak, gjennomsiktighet, regulering og brukerbevissthet, kan vi redusere skaden. Målet er ikke å gjøre AI perfekt – ingen system vil noen gang være feilfri – men å gjøre det mer pålitelig og mindre sannsynlig å mislede.

Det siste ord

Begrepet “maskinbullsjit” kan høres brutalt ut, men det fanger en realitet vi ikke kan ignorere. AI er ikke et nøytralt speil av menneskelig kunnskap. Det er en generator av språk som er formet av data, algoritmer og incitamenter. Hvis vi vil at det skal tjene sannhet i stedet for bare flytende språk, må vi designe det slik. Det betyr å tenke om ikke bare teknologien, men også verdier som styrer dens utvikling. Utfordringen er like mye om menneskelige prioriteringer som det er om maskinkapasiteter. Vil vi ha systemer som er optimalisert for å høres menneskelige ut, eller systemer som er optimalisert for å være sanne? De to er ikke alltid det samme. Hvis vi velger det første, risikerer vi å bygge verktøy som er overbevisende, men uansvarlige. Hvis vi velger det andre, må vi kanskje akseptere at AI noen ganger vil være mindre glatt, mindre sikker og mindre underholdende. Men det vil også være mer ærlig.

Dr. Tehseen Zia er en fast ansatt associate professor ved COMSATS University Islamabad, med en PhD i AI fra Vienna University of Technology, Østerrike. Som spesialist i kunstig intelligens, maskinlæring, datavitenskap og datavisjon, har han gjort betydelige bidrag med publikasjoner i anerkjente vitenskapelige tidsskrifter. Dr. Tehseen har også ledet flere industriprosjekter som hovedundersøker og tjenestegjort som AI-konsulent.