Gratis værktøjFå en AI-drevet diagnose af dit website på få minutterPrøv AI Site Doctor
Lad os tale
← Udforsk AI-ordbogen
Prompting & inference

Instruktionshierarki

Et instruktionshierarki angiver, hvilke instruktioner en AI skal prioritere, når systemregler, brugerønsker og tekst fra dokumenter er i konflikt.

Også kaldet: Instruction hierarchy

Moselstudio · AI-ordbog2 min. læsning
Se mulighederne i jeres virksomhed ↗
En lille skål er hævet over flere ringformede niveauer med klodser.
Niveauerne illustrerer, at instruktioner kan have forskellig prioritet.

Hvad betyder Instruktionshierarki?

Et instruktionshierarki hjælper en sprogmodel med at skelne mellem en opgave og det materiale, opgaven handler om. En kundes besked kan eksempelvis være data, som skal opsummeres, uden at beskeden får ret til at ændre assistentens regler.

Den konkrete inddeling afhænger af platformen. OpenAI beskriver blandt andet forskellige autoritetsniveauer for instruktioner, mens forskning i instruction hierarchy undersøger træning til at ignorere modstridende instruktioner med lavere prioritet. Det er derfor nødvendigt at kende den valgte platforms beskedroller frem for at antage, at overskrifter i en lang tekst skaber samme adskillelse.

For en virksomhed er formålet at bevare opgavens rammer, selv om eksternt materiale indeholder kommandoer. Et hierarki gør ikke modellen ufejlbarlig. Adgang til systemer og godkendelse af handlinger skal også håndhæves uden for den genererede tekst.

En besked kan indeholde tekst uden autoritet

Når en assistent læser en vedhæftet tilbudsbeskrivelse, bør et afsnit med “ignorér tidligere regler” behandles som indhold i dokumentet. Afsnittet er ikke automatisk en ny instruktion fra brugeren. Samme skel gælder søgeresultater, webindhold og svar fra andre systemer.

Applikationen bør bevare oplysninger om, hvor indholdet kommer fra. Hvis alle kilder blandes sammen i én udifferentieret tekstblok, bliver grænsen vanskeligere at kontrollere og efterprøve.

Test konflikter før adgang udvides

En relevant prøve beskriver både den legitime opgave og et dokument, der forsøger at ændre den. Resultatet vurderes på, om assistenten stadig løser opgaven inden for de aftalte rammer. Det er utilstrækkeligt, at den blot nægter at behandle alle dokumenter.

Skriv også ned, hvilke handlinger programmet selv afviser, eksempelvis læsning af en anden kundes sag. En tekstlig regel om at holde kunder adskilt kan ikke erstatte en adgangskontrol baseret på den aktuelle bruger.

FRA BEGREB TIL ARBEJDSDAG

Et eksempel fra praksis

Et tilbudsteam modtager et udbud med kundens krav. En intern assistent skal finde leverancer og frister, men dokumentet indeholder også tekst, som beder den sende interne priser til en anden adresse.

I en kontrolleret test skal assistenten udtrække de relevante udbudskrav og markere den uvedkommende instruktion som dokumentindhold. Mailværktøjet er samtidig utilgængeligt i denne arbejdsgang. Teamet kan dermed undersøge både modellens fortolkning og programmets faktiske begrænsning uden at sende oplysninger til nogen.

Typiske faldgruber

  • En overskrift med “system” i et dokument forveksles med en rigtig systembesked.
  • Instruktionshierarki bruges som eneste beskyttelse af data og handlinger.
  • Testen belønner total afvisning, selv når den legitime opgave kunne løses.

Det skal I afklare

  1. Adskil udviklerinstruktioner, brugeropgave og eksternt materiale.
  2. Test en legitim opgave med modstridende dokumenttekst.
  3. Håndhæv tilladelser i de systemer, assistenten kan bruge.

Spørgsmål og svar

Gælder samme hierarki for alle modeller?

Nej. Roller og håndtering varierer mellem platforme og modeller. Læs den aktuelle dokumentation og test jeres konkrete sammensætning af beskeder.

Kan en prompt alene stoppe prompt injection?

Den kan være en del af løsningen, men den giver ikke en sikker adgangsgrænse. Programmet skal begrænse dataadgang og handlinger, også hvis modellen fortolker tekst forkert.

Kilder og videre læsning

De tekniske begreber bygger på nedenstående kilder. Eksemplerne er illustrative og viser, hvordan I kan arbejde med emnet.

  1. Wallace m.fl.: The Instruction HierarchyForskning i prioritering af privilegerede instruktioner.
  2. OpenAI Model Spec, 18. december 2025Versionsfast eksempel på autoritetsniveauer; ikke en universel standard.
FRA VIDEN TIL JERES NÆSTE SKRIDT

Fra begreb til en løsning, I kan bruge.

Beskriv den opgave, I gerne vil gøre lettere. Vi hjælper med at afklare data, muligheder og et overskueligt første skridt.

  • En personlig vurdering af jeres opgave
  • Afklaring af data, systemer og begrænsninger
  • Et konkret forslag til næste skridt
M
Et svar fra mennesker, der bygger.Mosel Studio · Svendborg · Hele Danmark
kontakt@moselstudio.dk
Hvordan vil du helst starte?

Uforpligtende henvendelse · Ingen automatisk tilmelding