Avancerede prompt engineering teknikker

Avancerede teknikker til modelinstruktioner handler om at styre opgave, kontekst, eksempler, ræsonnement, værktøjer og outputformat mere præcist. De giver størst værdi, når du kan beskrive ønsket resultat, teste fejltyper og afgrænse, hvad modellen må gøre med data og eksterne systemer.

Artiklens hovedpointer:

Avancerede teknikker til modelinstruktioner handler om at styre opgave, kontekst, eksempler, værktøjer og outputformat mere præcist. Overblikket forklarer, hvornår få eksempler, trinvis problemløsning, strukturerede svar og sikkerhedskontrol giver bedre resultater end en enkelt løs besked.

Hvad gør en teknik avanceret?

En teknik bliver avanceret, når den ikke kun ændrer ordlyden i en besked, men styrer selve arbejdsformen omkring modellen. Det kan være brug af eksempler, opdeling i trin, faste schemaer, værktøjsadgang, hentet kontekst, evaluering eller sikkerhedsregler. Pointen er at reducere tilfældighed og gøre output lettere at kontrollere.

Avanceret instruktionsdesign handler derfor ikke om at skrive længere. Det handler om at gøre instruktionen mere præcis, testbar og egnet til den konkrete opgave. I praksis minder det mere om applikationsdesign end almindelig tekstforfatning, især når teknikken indgår i generativ AI i forretningsstrategi.

Hvordan bruges få eksempler?

Få eksempler betyder, at modellen får et lille antal par med input og ønsket output, før den selv skal løse en ny opgave. Teknikken er nyttig, når format, tone, kategorier eller beslutningsregler er svære at beskrive fuldt ud med almindelige instruktioner. Eksemplerne viser mønsteret mere konkret end en abstrakt regel.

Metoden er stærkest, når eksemplerne er varierede og realistiske. Tre næsten ens eksempler lærer modellen et snævert mønster. Et bedre sæt viser både typiske tilfælde, svære grænser og uønskede svar. Det kan for eksempel være en korrekt klassifikation, en tvivlsom sag og et input, der bør afvises, fordi informationen mangler.

Hvornår bør du bruge nul eksempler i stedet?

Nul eksempler kan være bedre, når opgaven er enkel, kriterierne er entydige, eller der ikke findes repræsentative eksempler endnu. En simpel instruktion med et klart formatkrav er ofte lettere at vedligeholde end et lille eksempelbibliotek, som hurtigt bliver forældet eller misvisende.

Valget bør afhænge af fejltypen. Hvis modellen misforstår selve opgaven, kan eksempler hjælpe. Hvis den allerede forstår opgaven, men outputtet varierer i format, er et schema eller en strengere struktur ofte bedre. Hvis den mangler fakta, skal løsningen typisk have bedre kontekst eller datakilde, ikke flere eksempler.

Hvordan fungerer trinvis problemløsning?

Trinvis problemløsning bruges, når opgaven kræver flere delbeslutninger. I stedet for at bede modellen give et samlet svar med det samme kan instruktionen adskille analyse, udtræk, kontrol og konklusion. Det gør især forskel ved beregning, sammenligning, argumentanalyse, prioritering og komplekse klassifikationsopgaver.

Der er dog en praktisk afgrænsning. I mange driftssituationer bør modellen ikke nødvendigvis vise lange mellemregninger til slutbrugeren. Det kan være nok at lade systemet arbejde med deltrin internt og returnere en kort konklusion, de vigtigste begrundelser og eventuelle usikkerheder. Dermed får du mere struktur uden at gøre svaret tungt.

Hvad betyder struktureret output?

Struktureret output betyder, at modellen skal svare i et fast format, som et system kan læse videre. Det kan være felter for kategori, begrundelse, risiko, dato, beløb eller anbefalet næste handling. Teknikken er særlig nyttig, når AI-output ikke kun skal læses af et menneske, men også bruges i et workflow, et dashboard eller en database.

Struktur virker bedst, når formatet passer til formålet. En tabel er god til sammenligning. Et schema er bedre til systemintegration. En kort liste passer til beslutningsstøtte. Hvis du bruger generativ AI sammenlignet med andre AI-modeller, er strukturen ofte det, der gør outputtet praktisk anvendeligt frem for blot sprogligt flydende.

Hvordan kan kontekst styres bedre?

Kontekststyring handler om at give modellen de oplysninger, den faktisk skal bruge, og holde resten ude. Det kan være et dokumentuddrag, en kundetype, en intern standard, et dataskema eller en tidligere beslutning. For meget kontekst kan gøre svaret rodet, mens for lidt kontekst får modellen til at udfylde huller med antagelser.

En god kontekstsektion adskiller fakta, brugerinput og systemregler. Fakta er det materiale, modellen må bygge på. Brugerinput er det spørgsmål eller den opgave, der skal løses. Systemregler er de krav, der ikke må ændres af brugeren. Den adskillelse bliver særlig vigtig, når teksten kommer fra e-mails, dokumenter eller websider, som ikke kan behandles som betroede instruktioner.

Hvordan bruges værktøjer og funktionskald?

Værktøjer og funktionskald gør det muligt at lade modellen hente data, slå noget op, kalde en beregning eller foreslå en handling i et eksternt system. Teknikken er relevant, når modellen ikke selv bør gætte svaret, men skal bruge en kontrolleret datakilde eller udføre et afgrænset trin i en applikation.

Værktøjsadgang kræver klare grænser. Modellen bør kun have adgang til de funktioner, der er relevante for opgaven, og output fra værktøjer bør kontrolleres, før det bruges. I praksis hænger dette tæt sammen med databeskyttelse ved brug af AI-API’er, fordi værktøjer ofte flytter oplysninger mellem systemer.

Hvordan vælger du mellem teknikkerne?

Valget bør starte med den fejl, du prøver at reducere. Hvis outputtet er uens, kan et fast format hjælpe. Hvis modellen overser vigtige oplysninger, kan bedre kontekst være svaret. Hvis opgaven kræver vurdering, kan eksempler eller trinvis problemløsning give bedre struktur. Hvis svaret afhænger af aktuelle eller interne data, er værktøjsadgang ofte mere relevant end mere tekst.

Valg af teknik efter typisk problem
ProblemMulig teknikHvad du bør teste
Uens formatStruktureret outputOm alle krævede felter udfyldes korrekt
Forkert tolkning af opgavenFå eksemplerOm eksemplerne dækker reelle grænsetilfælde
Svag argumentationTrinvis problemløsningOm konklusionen følger af input og deltrin
Manglende faktaHentet kontekst eller værktøjOm kilden er korrekt, relevant og tilladt

Der er sjældent én teknik, der passer til alle opgaver. En stabil løsning kombinerer ofte flere små greb: tydelig rolle, korte regler, få gode eksempler, fast outputformat og en test, der fanger de fejl, der betyder mest.

Hvilke sikkerhedsproblemer følger med avancerede teknikker?

Avancerede teknikker kan gøre en AI-løsning mere nyttig, men også mere risikabel. Hvis modellen kan bruge værktøjer, påvirke et system eller behandle fortrolige data, får fejl større konsekvens. Hvis ubetroede input blandes med faste regler, kan en bruger eller ekstern tekst forsøge at ændre, hvad modellen gør.

Derfor bør avanceret instruktionsdesign kobles til risikostyring i AI-implementeringer. Det omfatter adgangsbegrænsning, logging, outputvalidering, afvisningsregler og menneskelig godkendelse ved opgaver med økonomisk, juridisk, sikkerhedsmæssig eller personfølsom betydning.

Hvordan tester du, om teknikken virker?

Test bør ske på et fast datasæt, der ikke ændres hver gang, og på nye eksempler, der ligner driftssituationen. Det faste datasæt viser, om en ændring forbedrer kendte problemer. De nye eksempler viser, om teknikken generaliserer, eller om den blot er tilpasset de gamle testtilfælde.

  • Definér, hvilken fejl teknikken skal reducere.
  • Gem eksempler, forventet output og bedømmelseskriterier.
  • Sammenlign ny og gammel version på samme input.
  • Kontrollér både indhold, format, sikkerhed og afvisning af dårlige input.
  • Brug menneskelig gennemgang på de fejltyper, der har størst konsekvens.

Resultatet bør ikke kun være en samlet score. Det er mere nyttigt at vide, hvilke fejltyper der blev færre, hvilke der blev værre, og om ændringen påvirker bestemte grupper af input. Ellers kan en gennemsnitlig forbedring skjule en alvorlig forringelse i en sjælden, men vigtig situation.

Hvad betyder teknikkerne for organisationer i Danmark?

For organisationer i Danmark bliver avancerede teknikker især relevante, når AI indgår i sagsbehandling, kundedialog, HR, undervisning, analyse eller interne beslutningsprocesser. Her er kvalitet ikke kun et spørgsmål om gode formuleringer. Det handler også om datagrundlag, adgang, dokumentation, ansvar og mulighed for at forklare, hvorfor et output blev brugt.

Hvis løsningen behandler personoplysninger eller fortroligt materiale, skal teknikken passe til organisationens datakrav. Det kan betyde, at kontekst skal minimeres, værktøjer skal begrænses, og output skal gemmes på en måde, der kan revideres. Det praktiske spørgsmål er ikke kun, om modellen kan løse opgaven, men om løsningen kan bruges forsvarligt i den konkrete arbejdsgang.

Hvordan undgår du overdesign?

Overdesign opstår, når en enkel opgave får for mange regler, eksempler, deltrin eller værktøjer. Det kan gøre løsningen dyrere, langsommere og sværere at fejlfinde. En lang instruktion kan også skabe konflikter, hvor modellen ikke ved, hvilken regel der har forrang.

Start derfor med den enkleste version, der kan testes. Tilføj kun en ny teknik, når den løser et dokumenteret problem. Hvis et schema retter formatfejl, så brug schemaet. Hvis et eksempelbibliotek ikke forbedrer resultaterne, så fjern det. En god avanceret løsning er ikke den mest omfattende; den er den mest kontrollerbare.

Hvilke kompetencer kræver arbejdet?

Arbejdet kræver en blanding af faglig forståelse, sproglig præcision, dataforståelse og teknisk testdisciplin. En domæneperson kan beskrive, hvad der er et godt svar. En udvikler kan gøre instruktionen robust i en applikation. En sikkerheds- eller complianceansvarlig kan vurdere, hvilke data og handlinger der kræver særlige grænser.

Det er derfor naturligt at behandle avanceret instruktionsdesign som en del af implementering af generativ AI i en organisation. Teknikkerne virker bedst, når de ikke ligger hos én person alene, men bliver koblet til fælles standarder for kvalitet, ændringer og godkendelse.

Hvilke kilder ligger til grund?

De tekniske afsnit bygger på GPT-3-studiet om få eksempler, studiet om kædetænkning i store sprogmodeller, OpenAI-vejledningen om strukturerede output og OpenAI-vejledningen om funktionskald.

Sikkerhedsafsnittene bygger desuden på OWASP Top 10 for LLM-applikationer, som beskriver centrale risici ved moderne LLM-systemer.