AI & automation · 12

Prompt-design

Forskellen på en middelmådig og en fremragende AI-løsning ligger ofte i prompten.

Kontakt os

Sådan arbejder vi med prompt-design

Prompt-design er arbejdet med de instruktioner, der styrer en model: systeminstruktioner, prompts pr. opgave, eksempler, formatkrav og grænser. Vi designer, tester og versionerer prompts, så resultaterne er konsistente, korrekte og i jeres tone, og vi bygger evalueringer, så ændringer kan måles. Ydelsen findes, fordi en løsning, der virker på fem eksempler i en chat, ofte fejler på hundrede rigtige sager.

Vi starter med at samle rigtige eksempler: henvendelser, produkter, dokumenter, og det svar, I ville kalde korrekt. Ud fra dem skrives prompts som specifikationer med rolle, kontekst, data, format og grænser. Hver version køres mod evalueringssættet, og resultaterne sammenlignes, før noget ændres i drift. Det gælder både chat-assistenter, automatiseringer og indholdsproduktion, og vi arbejder på tværs af Claude, GPT og Gemini.

I står med et prompt-bibliotek med versionshistorik, et evalueringssæt af rigtige eksempler med kriterier, og en testmetode, jeres team kan bruge, når prompts skal ændres. Kvaliteten kan måles i tal i stedet for fornemmelser, og I kan skifte model eller udvide løsningen uden at miste det, der virker.

Hvornår det giver mening

  • Jeres assistent svarer forskelligt på det samme spørgsmål fra dag til dag, og ingen kan sige, hvorfor.
  • En kollega ændrede i systeminstruktionen for at rette én fejl, og nu er tre andre ting holdt op med at virke.
  • AI-teksterne lyder generiske eller forkerte i tonen, selv om I har givet modellen jeres brandguide.
  • I vil skifte fra én model til en anden for pris eller kvalitet, men tør ikke, fordi ingen ved, om resultaterne bliver de samme.

Det får du

  1. Systeminstruktioner og prompt-bibliotek
  2. Evalueringssæt med rigtige eksempler
  3. Versionering og test
  4. Oplæring af jeres team
Kontakt os

Sådan foregår det

  1. Indsamling af eksempler og kriterier

    Vi samler 50 til 200 rigtige eksempler på opgaven sammen med jer og fastlægger, hvad et korrekt resultat er: indhold, format, tone og grænser. Det bliver evalueringssættet, alt måles mod.

  2. Design af prompts

    Systeminstruktion og opgaveprompts skrives som specifikationer med rolle, data, format, grænser og eksempler. Vi laver flere varianter og kører dem mod evalueringssættet for at se, hvad der virker.

  3. Evaluering og versionering

    Den bedste variant forfines, til scoren er på det aftalte niveau, og prompts lægges i et bibliotek med versionshistorik. Evalueringen automatiseres, så den kan køres ved hver ændring og ved modelskift.

  4. Oplæring og overlevering

    Jeres team lærer at ændre prompts, tilføje eksempler til evalueringssættet og læse resultaterne. Vi dokumenterer biblioteket og aftaler, hvornår vi gennemgår kvaliteten sammen.

I dybden

En prompt er en specifikation, ikke en sætning

En god prompt er ikke en sætning, men en specifikation: rolle, kontekst, data, format og grænser. Vi designer prompts, der giver stabile resultater, også når input varierer. Det betyder eksplicitte regler for, hvad modellen skal gøre ved manglende data, hvilket format svaret skal have, hvad den aldrig må påstå, og eksempler på godt og dårligt. Systeminstruktion og opgaveprompt holdes adskilt, så de kan ændres hver for sig.

Evalueringssæt og versionering

Prompts testes på rigtige eksempler med målbare kriterier, og versioneres, så I kan se, hvad der ændrede sig, når kvaliteten gjorde. Evalueringssættet er 50 til 200 rigtige sager med det ønskede resultat. Hver ny version af en prompt køres mod hele sættet, og vi sammenligner andel korrekte, formatfejl og tonefejl før og efter. Ingen ændring går i drift uden en bedre score.

Prompts som del af et system med data og logning

Prompts lever i workflows med data, kontrol og logning. Vi designer dem som en del af løsningen, ikke som løse tekster i en chat. Hver kørsel logges med prompt-version, så en fejl kan spores til den version, der gav den. Når data eller værktøjer ændres, ændres prompten med, og evalueringssættet køres igen.

Fejl, vi ofte finder

  • Prompts ændres direkte i drift uden testEn rettelse for ét tilfælde ændrer modellens adfærd for alle, og fejlen opdages først hos kunder eller i publicerede tekster. Vi indfører evalueringssæt og versionering, så hver ændring testes og kan rulles tilbage.
  • Ingen regel for manglende dataNår prompten ikke siger, hvad modellen skal gøre, hvis en attribut eller et ordrenummer mangler, udfylder den hullet selv og skriver noget, der ser rigtigt ud. Vi skriver eksplicitte regler for manglende data: stop, spørg eller markér.
  • Tone of voice som adjektiver i stedet for regler"Skriv venligt og professionelt" giver samme tekst som hos alle andre. Vi oversætter tone of voice til konkrete regler med eksempler: ord der bruges og undgås, sætningslængde, tiltaleform og hvad der aldrig påstås.

Prompten er specifikationen

Samme opgave. To prompts. To vidt forskellige svar.

Uden prompt-design
Skriv en produkttekst til den her stol.

Svar

Denne flotte stol er et fantastisk valg til dit hjem. Med sit tidløse design og sin gode kvalitet er den et must-have for enhver.

  • Ingen rolle, ingen data, ingen grænser
  • Modellen fylder selv hullerne ud
  • To kørsler giver to forskellige tekster
Med prompt-designkører…
ROLLE: Du skriver produkttekster for en dansk møbelwebshop.OPGAVE: Skriv en produkttekst til produktet i DATA.DATA: {navn}, {materiale}, {mål}, {farver}, {pris}, {leveringstid}KRAV:- 60-90 ord, dansk, du-form, ingen superlativer- Første sætning nævner materialet og målene- Slut med leveringstid, hvis den er under 5 dageFORBUDT: at opfinde egenskaber, der ikke står i DATAFORMAT: ren tekst, ét afsnit

Svar

Stolen er lavet i massiv eg med sæde i uldmelange og måler 78 x 52 x 54 cm. Rammen er samlet med tapsamlinger, så den holder til daglig brug ved spisebordet. Betrækket findes i tre farver, og træet er behandlet med hvidpigmenteret olie, som du selv kan efterbehandle. Pris fra 2.499 kr. Leveres inden for tre hverdage.

  • Rolle, data, krav og forbud står sort på hvidt
  • Formatet er defineret, så output kan bruges direkte
  • Prompten kan versioneres og testes som kode

Sådan ser det ud

12Placering i Google

Fra side to til toppen: teknisk fundament, indhold der svarer på det, folk faktisk søger, og autoritet der bygges over tid.

  1. jeres-webshop.dk › b2bJeres webshop – den, kunderne finder førstJer
  2. konkurrent.dk › blogSådan vælger du platform til din webshop
  3. bureau-x.dk › ydelserWebshop-udvikling – priser og pakker
  4. magasin.dk › artiklerB2B webshop: 7 ting du skal vide
  5. platform-blog.dk › guidesPrestaShop vs. Shopify – en sammenligning

Sådan måler vi effekten

  • Andel korrekte svar i evalueringssættet pr. prompt-version
  • Andel svar med formatfejl eller brud på grænser
  • Antal rettelser pr. 100 tekster fra redaktør eller kundeservice

Rammer

Pris
Fra 15.000 kr.
Varighed
2–3 uger
Hvem
AI-specialist og jeres fagperson som bedømmer
Kontakt os

Eksempel: Junia

Produktteksterne i Junias content-pipeline lød i første version ens på tværs af kategorier, og redaktøren rettede hver tredje tekst. Vi samlede 120 produkter med godkendte tekster som evalueringssæt og oversatte brandguiden til konkrete regler: ord der bruges og undgås, struktur pr. kategori, hvad der aldrig må påstås om sundhed. Prompts blev delt op pr. kategori og versioneret. Efter tre versioner godkendte redaktøren 9 af 10 tekster uden rettelser, og evalueringssættet køres nu ved hver ændring og ved skift af model.

Se det i praksis

Cases

t.i.n.g. shop

t.i.n.g. shop

Skræddersyet design og udvikling af møbelshop. Markedsføring gennem PPC med 200% vækst.

Se alle cases
Rigtig Kaffe A/S

Rigtig Kaffe A/S

All-around design, udvikling, branding, strategi og søgemaskineoptimering

Sokkeposten

Sokkeposten

Nyt PrestaShop site og 360 graders digital marketing med SEO og PPC annoncering.

Poetzsch Padborg

Poetzsch Padborg

Avanceret Google Tag Manager setup til konverteringstracking

Bolighuset Werenberg A/S

Bolighuset Werenberg A/S

Et digitalt sats på e-handel, der gav pote. Se vores arbejde for Werenberg, og hvordan vækstkurven blev stejl med en stabil og udviklingsdygtig webshop.

Ofte stillede spørgsmål

  • Ja. Vi bygger et bibliotek og en testmetode, så I kan ændre uden at ødelægge noget.

  • Gennemgang og forbedring af en eksisterende løsning med evalueringssæt fra 15.000 kr. Er det en del af en større løsning, er det indregnet i prisen for den.

  • Rigtige eksempler på opgaven, typisk 50 til 200, og en person, der kan afgøre, hvad et korrekt svar er. Eksemplerne bliver evalueringssættet.

  • Med en AI-audit: en halv dags workshop og en uge med analyse. I får en prioriteret liste over processer, hvor AI giver mest, og hvad det kræver.

  • Vi bruger modeller og opsætninger, hvor jeres data ikke bruges til træning, og vi dokumenterer, hvor data flyder. GDPR og jeres egne politikker indgår i designet.

Næste AI-kurser for teams →