Domstoladministrasjonen (DA) har de siste årene undersøkt mulighetene for bruk av KI i domstolene. Ifølge en ny veileder fra DA som nå er på høring foreslås det at dommere skal kunne bruke generativ KI som støtte i domskrivingen. Dette skaper debatt i det juridiske miljøet. Nylig har mistanker om KI-bruk ført til opphevelse av en kjennelse fra Hardanger og Voss tingrett.
Veilederen understreker at KI ikke skal brukes til å vurdere bevis, tolke eller anvende rettsregler, eller brukes til å avgjøre faktiske eller rettslige premisser. De sentrale juridiske og bevismessige vurderingene skal med andre ord fortsatt foretas av dommeren selv. Når det er sagt, diskuteres også mer avansert bruk av KI i det bredere fagmiljøet. For eksempel har det blitt fremhevet at KI kan være aktuelt å ta i bruk i straffeutmåling hvor skjønnsmessige avgjørelser forutsetter at dommeren skal ha oversikt over et stort og komplekst praksisfelt. Det er nettopp i denne konteksten vi har undersøkt hva norske innbyggere mener om bruk av KI i domstolene.
Hvordan stiller folk seg?
I studien Algoritmic Sentencing and Fairness Perceptions har vi undersøkt hvor rettferdig befolkningen oppfatter ulike former for bruk av KI i straffeutmålingen. Vi stilte et representativt utvalg på 2222 innbyggere overfor ulike hypotetiske scenarioer. Én gruppe fikk beskrevet dagens ordning der dommere alene fastsetter straffen. Andre grupper fikk scenarioer der KI enten fungerte som beslutningsstøtte for dommeren eller der KI var den som traff den endelige avgjørelsen. Vi undersøkte også betydningen av forklarbarhet.
To spørsmål sto dermed sentralt: Hjelper det at dommeren fortsatt har kontroll over avgjørelsen? Og hjelper det at det er mulig å forklare hvordan KI-systemet har kommet frem til resultatet?
Det første resultatet fra studien er gjennomgående for alle respondentene: Når KI blir brukt, faller opplevelsen av rettferdighet. Sammenlignet med dagens ordning der dommere alene fastsetter straffen, blir straffeutmålingen oppfattet som mindre rettferdig når KI introduseres i beslutningsprosessen. Folk er altså generelt skeptiske til bruk av KI i straffeutmåling. Dette er kanskje ikke overraskende gitt at straffeutmåling er en beslutning med alvorlige konsekvenser for den enkelte.
Det andre funnet er imidlertid mer interessant: Skepsisen mot KI er ikke den samme i alle KI-scenarioene. Folk er mindre skeptiske når KI-en er forklarbar og når den brukes som beslutningsstøtte fremfor som endelig beslutningstaker. Det betyr ikke at KI som beslutningsstøtte blir oppfattet som like rettferdig som dagens ordning. Det gjør den ikke. Men forskjellen mellom de ulike scenarioene tyder på at måten KI introduseres på har betydning for hvor rettferdig bruken oppfattes.
Bare én del av bildet
Det er samtidig grunn til å være forsiktig med å trekke for bastante konklusjoner. I studien beskrev vi dagens ordning svært generelt. Vi ga dem ikke et detaljert bilde av hvordan dagens system faktisk fungerer. Det kan ha betydning. Tenk for eksempel på tilgangen til tidligere avgjørelser. I dag har ikke norske domstoler en felles database der dommere uten videre kan søke i alle tidligere avgjørelser og få frem relevante saker på tvers av domstolene. En KI-løsning kunne potensielt endre dette. Dersom deltakerne hadde fått vite mer om slike begrensninger ved dagens ordning, kunne forskjellen mellom menneskelig beslutningstaking og KI-baserte beslutningsverktøy kanskje ha blitt vurdert annerledes.
Videre er det viktig å understreke at studien vår undersøker folks synspunkter på et hypotetisk scenario. Vi undersøker ikke om KI faktisk fører til bedre eller dårligere straffeutmåling og det finnes en rekke andre spørsmål som må besvares før KI eventuelt tas i bruk på dette området.
Mulighetsrom for prediktiv KI i domstolene?
Når det er sagt, peker studien vår på et mulighetsrom for bruk av prediktiv KI i domstolene. Diskusjonen om KI i domstolene kan fort bli fremstilt som et spørsmål om enten å ta teknologien i bruk eller å la være. Våre funn peker mot et mer nyansert bilde. Det kan være mulig å øke den offentlige aksepten for KI gjennom menneskelig kontroll og forklarbarhet.
Resultatene våre gjenspeiler også internasjonale funn på temaet, nemlig at det er et gap mellom hvor rettferdig innbyggere oppfatter beslutninger tatt med og uten KI (såkalt human-AI fairness gap), men at dette gapet i opplevd rettferdighet kan reduseres ut ifra hvordan KI innføres og tas i bruk i domstolene, spesielt når det gjelder grad av menneskelig kontroll og muligheter for å etterprøve KI-støttede avgjørelser, og i hvilken grad KI-støttede avgjørelser kan begrunnes og forklares.
Dette kan være relevant kunnskap å ta hensyn til når vi nå diskuterer om, og i så fall hvordan, KI kan tas i bruk i domstolene.