Tankeledere

Proctoring i AI‑alderen, Hvorfor eksamensdesign fortsatt er viktigst

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Fremtidssikring av nettbaserte eksamener i møte med økende etterspørsel og strengere personvernlovgivning.

Det globale markedet for nettbasert eksamensprogramvare, verdsatt til $9.4b i 2025, er forventet å nå $28.7b innen 2034, ettersom opplæringsleverandører, fagorganer og utdanningsinstitusjoner i økende grad flytter vurderinger til nett.

Populariteten til nettbaserte eksamener er lett å forstå, ettersom utdanningsinstitusjoner håndterer finansieringsbegrensninger og begrenset campusplass, mens arbeidsgivere og fagorganer søker mer fleksible måter å vurdere kandidater på. Fjernprøving gjør det mulig for enkeltpersoner å balansere læring og sertifisering med arbeid og personlige forpliktelser, noe som gjør vurderinger mer tilgjengelige enn tradisjonelle, fysiske formater.

Like er imidlertid bransjens største utfordring ikke skala; det er den eldgamle varen, tillit. Etter hvert som AI‑verktøy gjør juks vanskeligere å oppdage, er institusjonene under økende press for å bevise at nettbaserte vurderinger er rettferdige, sikre og i samsvar med regelverk.

Nylig fikk Association of Chartered Certified Accountants oppmerksomhet etter å ha kunngjort sin beslutning om å avskaffe fjernprøver på grunn av AI‑juks‑bekymringer, mens Ofqual har rapportert at lærere i økende grad synes AI er vanskelig å identifisere i vurdert arbeid. Selv Princeton University, ett av verdens fremste universiteter, har endret sin 133 år gamle æreskodeks for å innføre overvåking ved fysiske eksamener.

Gitt dette presset er det lett å anta at mer overvåking er løsningen. Imidlertid fører mer overvåkning på et visst tidspunkt ikke nødvendigvis til bedre standarder eller mer nøyaktige resultater. I mange tilfeller kan overdreven overvåkning skade tilgjengelighet, redusere kandidatens tillit og skape personvernutfordringer.

Overvåking er ingen snarvei til god vurderingsdesign

Overvåking er et effektivt verktøy for å forhindre uredelighet, men det er ingen enkeltstående løsning på dårlig vurderingsdesign. Fysiske oppsynspersoner kan ikke overvåke alle kandidater samtidig. Men nettbasert overvåking har sine egne begrensninger, ettersom studenter har blitt kjent for å bruke smarte enheter for å unngå nettbaserte overvåkningsmetoder.

Når en eksamen fokuserer på å teste en kandidats hukommelse, som i en standardisert flervalgseksamen, øker insentivet til å jukse fordi det finnes et begrenset antall riktige svar å velge mellom. Hvis den eksamenen har betydelig vekt i den endelige karakteren, øker dette insentivet ytterligere. Slike eksamensformater er iboende mer sårbare for AI, som er dyktig til å hente og gjenskape denne typen informasjon.

Når eksamener er utformet for å teste en kandidats evne til å analysere informasjon og anvende teori i ulike sammenhenger, reduseres AI‑fordelen raskt. Dette reflekterer bedre moderne profesjonelle miljøer, hvor ansatte sjelden kreves å operere kun fra hukommelsen.

I praksis ser dette ut som et kontekstspørsmål bygget rundt et hypotetisk scenario som ber kandidatene begrunne svarene sine. Når dette kombineres med tidsbegrensninger, nettleserlåser eller kopier‑/lim‑restriksjoner, blir selv et velkonstruert AI‑svar vanskelig å bruke på en meningsfull måte. Slike spørsmål krever original resonnering, ikke gjenfinnbare fakta.

Ved å tilby åpenbok‑eksamener, case‑studier og andre kritisk tenkende oppgaver under kontrollerte forhold, kan institusjoner utvikle vurderingsmodeller hvor sikkerhetstiltak er fordelt på flere deler av vurderingsprosessen. Dette gjør det mulig å redusere avhengigheten av overvåkning, fordi integritet er bygget inn i eksamensstrukturen i stedet for å bli pålagt gjennom overvåkning.

Selv om hukommelsesbasert testing fortsatt er viktig for å teste en kandidats grunnleggende kunnskap, kan institusjoner få en mye mer detaljert forståelse av en kandidats evne når den kombineres med andre anvendte testformater.

Eksamenens vektfordeling kan også omstruktureres for å dempe juks. Hvis karaktersettingen fordeles jevnere mellom eksamener, opplever kandidatene langt mindre press for å oppnå høy poengsum, noe som naturlig reduserer insentivet til å jukse. Dette gir et annet alternativ for å sikre eksamener uten å ty til omfattende overvåkning.

Overvåking er essensielt i alle eksamener, men det bør aldri være den eneste mekanismen for å opprettholde integritet. I stedet for å fokusere på ulike måter å overvåke kandidater på, bør eksamensformater og spørsmål konstrueres slik at alle former for juks, ikke bare AI, blir vanskeligere av design.

Hvorfor etterlevelse er avgjørende

Når institusjoner innfører overvåkningstiltak i nettbaserte eksamener, må de også navigere personvern- og databeskyttelseslover for å sikre at overvåkningsmetodene er rettferdige og lovlig i samsvar.

I henhold til GDPR anses innsamling av video‑strømmer, lydopptak og andre biometriske data som svært sensitivt; derfor må innsamlingen begrunnes, og kandidatene må vite hvordan deres data brukes. 

EU AI Act har også innført restriksjoner på fullt automatisert eksamensovervåkning, og understreker at høy‑risiko vurderinger må beholde menneskelig tilsyn, reviderbare resultater og muligheten for ansatte til å gripe inn eller overstyre automatiserte beslutninger.

Samtidig bør institusjoner vurdere den langsiktige risikoen ved å lagre store mengder overvåkingsdata, ettersom jo mer overvåkning en nettbasert eksamen innfører, desto mer data må håndteres over tid. Dette utgjør en betydelig risiko, gitt det høye antallet cyber‑sikkerhetsangrep som retter seg mot utdanningssektoren i Storbritannia.

Dette er grunnen til at en standardisert overvåkingsmodell ikke lenger er juridisk holdbar. For å unngå generell overvåkning bør institusjoner adoptere en dataminimerings‑tilnærming og konfigurere overvåkingsmodeller basert på eksamenens risikonivå.

Når gjennomtenkt eksamensdesign støttes av proporsjonal overvåkning, blir nettbaserte eksamener mer sikre. Enda viktigere viser det til regulatorer og kandidater at testforholdene er rettferdige og i samsvar med regelverk, samtidig som det gir den nødvendige revisjonssporen for å validere resultater.

Fremtiden for vurdering

Hastigheten som nettbaserte eksamener vokser med, gir en enorm mulighet for læring og faglig utvikling. Det reiser imidlertid også en grunnleggende utfordring i hvordan eksamenssikkerhet defineres og håndteres.

Opplæringsleverandører, fagorganer og utdanningsinstitusjoner som lykkes, vil være de som ser på eksamensdesign og overvåkning som komplementære snarere enn å kun stole på overvåkning. Integritet er ikke noe som kan overvåkes utenfra. Den må bygges inn fra starten.

Dr. James Gupta er administrerende direktør og grunnlegger av nettbasert eksamenplattform, Synap, som hjelper organisasjoner med å levere profesjonelle eksamener og vurderinger med tillit. James studerte medisin og har en mastergrad i helseinformatikk, og kombinerer frontlinjeerfaring fra helsevesenet med dypt ekspertise innen utdanning og teknologi. Synap ble opprinnelig laget for å støtte James' egen medisinske eksamen, og ga ham første-hånds innsikt i utfordringene som møter lærende og institusjoner. Det som begynte som en personlig løsning, har siden utviklet seg til en pålitelig global plattform som brukes av bedrifter, utdanningsleverandører og universiteter for å levere høyrisikovurderinger og storstilte vurderinger. I dag støtter Synap over 500 000 registrerte brukere verden over. Over 300 millioner spørsmål har blitt besvart på plattformen, og over 10 millioner tester har blitt levert, noe som reflekterer Synaps skala, pålitelighet og innvirkning på flere områder. Under James' ledelse har Synap vokst til en sikker, skalerbar vurderingsinfrastruktur designet for å møte dagens profesjonelle landskap, og muliggjør at organisasjoner kan levere digitale eksamener med tillit, integritet og målbare ytelsesindikatorer.