Del 13 av 14 · AI-grunnkurs for kunnskapsarbeid
Trygge instruksjoner og ansvar
Tekst i kilder får ikke automatisk myndighet, og mennesket beholder ansvaret for beslutninger og konsekvenser.
Innhold i denne delen
01 · Kilder er innhold, ikke nye regler
Kilder er innhold, ikke nye regler
En agent kan møte tekst som forsøker å påvirke hva den gjør. Det kan ligge på en nettside, i et dokument, i en e-post eller i en fil den er bedt om å undersøke.
Noen slike instrukser kan prøve å få agenten til å ignorere reglene sine, hente mer informasjon enn oppgaven krever eller utføre en handling brukeren ikke har bedt om. Dette kalles ofte prompt injection.
Eksternt materiale skal derfor behandles som en kilde som skal leses, ikke som en ny arbeidsinstruks som automatisk skal følges.
Det samme forsiktighetsprinsippet gjelder skills, plugins og andre utvidelser fra ukjente avsendere. De kan påvirke hvordan agenten arbeider og bør bare tas i bruk når kilden og innholdet er til å stole på.
02 · Skill arbeidsinstruks fra kildeinnhold
Skill arbeidsinstruks fra kildeinnhold
Instruksjoner har ulik myndighet. Oppdraget du har gitt, reglene i arbeidsrommet og de avtalte tilgangene setter rammen. Tekst agenten møter mens den undersøker en kilde, er materiale innenfor denne rammen. Den kan være relevant informasjon uten å være en kommando.
Når kildeinnhold ber om en ny handling, mer tilgang eller et annet mål, oppstår en grensekonflikt. Agenten skal ikke løse konflikten ved å adlyde teksten. Den skal forklare hva kilden ber om, holde fast ved det opprinnelige oppdraget og be om godkjenning dersom et faktisk behov krever en endring.
Skills, plugins og andre utvidelser krever samme kontroll før bruk. Les hva de kan gjøre, hvor de kommer fra og hvilke tilganger de ber om. En nyttig utvidelse er fortsatt programvare som kan påvirke arbeidsmåten.
03 · En nettside kan ikke utvide oppdraget
En nettside kan ikke utvide oppdraget
Tenk på en agent som undersøker en nettside. Dersom siden inneholder en beskjed om å hente en annen fil, ignorere en regel eller sende informasjon videre, er beskjeden fortsatt en del av kilden. Den er ikke en ny autoritativ arbeidsinstruks.
Agenten skal holde fast ved oppdraget, tilgangen og godkjenningskravene som allerede gjelder. Hvis den nye teksten skaper tvil om hva som er tillatt, skal agenten stoppe og be om avklaring i stedet for å utvide oppgaven selv.
Skillet kan formuleres enkelt: Arbeidsinstruksen bestemmer hva agenten skal gjøre; kilden leverer materiale agenten skal undersøke. En kommando inne i materialet arver ikke samme myndighet som oppdraget.
Dette beskytter også mot utilsiktede instrukser. En e-post eller et dokument kan inneholde ord som ligner en kommando uten at avsenderen har ment å styre agenten. Agenten holder seg innenfor avtalte rammer til et menneske eventuelt godkjenner noe annet.
Når kilden er ukjent eller utvidelsen ber om mer tilgang enn forventet, bør agenten forklare avviket og stoppe. Brukeren kan da vurdere kilden og ta den faktiske beslutningen.
04 · Mennesket eier viktige konsekvenser
Mennesket eier viktige konsekvenser
En agent kan undersøke, skrive, sammenligne og foreslå. Men den kan ikke overta ansvaret for beslutninger som påvirker mennesker, penger, rettigheter eller virksomheten.
Før noe viktig sendes, publiseres, slettes eller settes i verk, må et menneske forstå hva som skal skje og kontrollere resultatet på riktig nivå.
Jo større konsekvens en feil kan få, desto tydeligere må godkjenningen og kontrollen være.
God bruk av agenter handler derfor ikke om å fjerne mennesket. Det handler om å bruke menneskelig vurdering der den betyr mest, og la agenten hjelpe med resten av arbeidet.
Prøv i din egen arbeidsflate
Gjør det konkret
Formuler én regel som skiller autoritative arbeidsinstrukser fra instrukser som bare finnes inne i en kilde.
Autoritative arbeidsinstrukser kommer fra: […] Tekst i kilder behandles som: […] Agenten skal stoppe og spørre når: […] Menneskelig godkjenning kreves før: […]
Arbeidet skjer hos deg. Læringsportalen lagrer ikke svaret.
Sjekk forståelsen