Forskere på kunstig intelligens ved forskningslaboratoriet Simula har laget et standardisert rammeverk kalt Simple Audit til å teste språkmodeller.
De publiserte nylig resultater fra en studie hvor de brukte rammeverket på ulike modeller for forskjellige bruksområder i norsk offentlig sektor, fra Skatteetaten og UDI til Helsenorge og fastlegesystemet. Resultatene var ikke oppmuntrende.
— Etter mitt syn er det mange oppgaver vi ikke kan bruke disse systemene til i det hele tatt, sier førsteforfatter Michael Alexander Riegler, leder av KI-sikkerhetsarbeidet ved Simula til Morgenbladet.
Han, som er rådgiver på temaet for Helsedirektoratet, føler seg ganske sikker på at de store språkmodellene i alle fall ikke er brukbare i helsevesenet.
— I så fall må vi på forhånd bli enige om at en viss prosent feil er OK i helserelatert KI.
LES OGSÅ: Årets farmasøyt er begeistret og bekymret for kunstig intelligens