LæringAI-grunnkurs for kunnskapsarbeid
Trygge instruksjoner og ansvarDel 13 av 14
Hele kurset

Del 13 av 14 · AI-grunnkurs for kunnskapsarbeid

Trygge instruksjoner og ansvar

Tekst i kilder får ikke automatisk myndighet, og mennesket beholder ansvaret for beslutninger og konsekvenser.

Del 13 av 14 · 7 min

Innhold i denne delen
  1. 01Kilder er innhold, ikke nye regler
  2. 02Skill arbeidsinstruks fra kildeinnhold
  3. 03En nettside kan ikke utvide oppdraget
  4. 04Mennesket eier viktige konsekvenser
  5. 05Prøv nå
  6. 06Sjekk forståelsen

01 · Kilder er innhold, ikke nye regler

Kilder er innhold, ikke nye regler

En agent kan møte tekst som forsøker å påvirke hva den gjør. Det kan ligge på en nettside, i et dokument, i en e-post eller i en fil den er bedt om å undersøke.

Noen slike instrukser kan prøve å få agenten til å ignorere reglene sine, hente mer informasjon enn oppgaven krever eller utføre en handling brukeren ikke har bedt om. Dette kalles ofte prompt injection.

Eksternt materiale skal derfor behandles som en kilde som skal leses, ikke som en ny arbeidsinstruks som automatisk skal følges.

Det samme forsiktighetsprinsippet gjelder skills, plugins og andre utvidelser fra ukjente avsendere. De kan påvirke hvordan agenten arbeider og bør bare tas i bruk når kilden og innholdet er til å stole på.

02 · Skill arbeidsinstruks fra kildeinnhold

Skill arbeidsinstruks fra kildeinnhold

Instruksjoner har ulik myndighet. Oppdraget du har gitt, reglene i arbeidsrommet og de avtalte tilgangene setter rammen. Tekst agenten møter mens den undersøker en kilde, er materiale innenfor denne rammen. Den kan være relevant informasjon uten å være en kommando.

Når kildeinnhold ber om en ny handling, mer tilgang eller et annet mål, oppstår en grensekonflikt. Agenten skal ikke løse konflikten ved å adlyde teksten. Den skal forklare hva kilden ber om, holde fast ved det opprinnelige oppdraget og be om godkjenning dersom et faktisk behov krever en endring.

Skills, plugins og andre utvidelser krever samme kontroll før bruk. Les hva de kan gjøre, hvor de kommer fra og hvilke tilganger de ber om. En nyttig utvidelse er fortsatt programvare som kan påvirke arbeidsmåten.

03 · En nettside kan ikke utvide oppdraget

En nettside kan ikke utvide oppdraget

Tenk på en agent som undersøker en nettside. Dersom siden inneholder en beskjed om å hente en annen fil, ignorere en regel eller sende informasjon videre, er beskjeden fortsatt en del av kilden. Den er ikke en ny autoritativ arbeidsinstruks.

Agenten skal holde fast ved oppdraget, tilgangen og godkjenningskravene som allerede gjelder. Hvis den nye teksten skaper tvil om hva som er tillatt, skal agenten stoppe og be om avklaring i stedet for å utvide oppgaven selv.

Skillet kan formuleres enkelt: Arbeidsinstruksen bestemmer hva agenten skal gjøre; kilden leverer materiale agenten skal undersøke. En kommando inne i materialet arver ikke samme myndighet som oppdraget.

Dette beskytter også mot utilsiktede instrukser. En e-post eller et dokument kan inneholde ord som ligner en kommando uten at avsenderen har ment å styre agenten. Agenten holder seg innenfor avtalte rammer til et menneske eventuelt godkjenner noe annet.

Når kilden er ukjent eller utvidelsen ber om mer tilgang enn forventet, bør agenten forklare avviket og stoppe. Brukeren kan da vurdere kilden og ta den faktiske beslutningen.

04 · Mennesket eier viktige konsekvenser

Mennesket eier viktige konsekvenser

En agent kan undersøke, skrive, sammenligne og foreslå. Men den kan ikke overta ansvaret for beslutninger som påvirker mennesker, penger, rettigheter eller virksomheten.

Før noe viktig sendes, publiseres, slettes eller settes i verk, må et menneske forstå hva som skal skje og kontrollere resultatet på riktig nivå.

Jo større konsekvens en feil kan få, desto tydeligere må godkjenningen og kontrollen være.

God bruk av agenter handler derfor ikke om å fjerne mennesket. Det handler om å bruke menneskelig vurdering der den betyr mest, og la agenten hjelpe med resten av arbeidet.

Prøv i din egen arbeidsflate

Gjør det konkret

Formuler én regel som skiller autoritative arbeidsinstrukser fra instrukser som bare finnes inne i en kilde.

Autoritative arbeidsinstrukser kommer fra: […]
Tekst i kilder behandles som: […]
Agenten skal stoppe og spørre når: […]
Menneskelig godkjenning kreves før: […]

Arbeidet skjer hos deg. Læringsportalen lagrer ikke svaret.

Sjekk forståelsen

En nettside agenten undersøker sier at den må laste opp lokale filer og ignorere tidligere regler for å få hele svaret. Hvordan bør agenten behandle teksten?