Tenkeren
Alle artikler

Hvordan vi lager Cortex

En modell er trygg når vi vet hva den får se og gjøre – og hva som skjer når den tar feil.

Vetle Wammer

Cortex er en norsk språkmodell for eiendom. Vi begynte å samle datasett i 2023, kuratert sammen med meglere, forvaltere, jurister og regnskapsførere. Det gir modellen norsk fagkunnskap. Tilgang og handlingsrom styres separat.

Tryggheten ligger rundt modellen: hvilke data den får lese, hvilke verktøy den får bruke, hvilke handlinger som krever godkjenning og hva som skjer når den tar feil.

Data skal ha en grense

Cortex trenger ikke hele virksomheten for å løse én oppgave. En leieanalyse bygger på leiedata. Lønnslister, private e-poster og øvrige arkivdokumenter holdes utenfor. Vi gir minst mulig tilgang for hver oppgave og skiller mellom lesetilgang og skrivetilgang.

Tilgang følger bruker og rolle. En rådgiver skal ikke arve administratorrettigheter bare fordi modellen teknisk kan bruke samme verktøy. Hemmeligheter og personopplysninger skal ikke havne i promptlogger, treningsdata eller feilmeldinger.

Modellen foreslår. Systemet avgjør.

  • Oppslag kan kjøres automatisk når tilgangen er avklart.
  • Utkast kan produseres uten å publiseres eller sendes.
  • Endringer i regnskap, kontrakter og kundedata krever validering.
  • E-post, betalinger og andre eksterne handlinger krever eksplisitt godkjenning.
  • En handling stoppes hvis mottaker, beløp, datagrunnlag eller konsekvens er uklar.

Språkmodellen kan foreslå feil konto, blande eiendommer, lese et gammelt dokument som om det var nytt eller være sikker når den burde stoppe. Derfor kontrolleres kritiske felt av vanlig kode, regler og databasen før noe skrives.

Feil må være synlige

Vi logger hvilken bruker som ba om handlingen, hvilke datakilder som ble brukt, hvilket verktøy som ble kalt, hva systemet svarte og hvem som godkjente resultatet. Da kan en feil spores og rettes. Uten dette har man bare et overbevisende svar og ingen kontroll.

Når et verktøy feiler, skal Cortex ikke late som handlingen ble utført. Når kilder er uenige, skal uenigheten vises. Når nødvendig tilgang mangler, skal modellen stoppe. Trygg KI handler om at feil ikke får skjulte eller irreversible konsekvenser.