Prompt-design er arbejdet med de instruktioner, der styrer en model: systeminstruktioner, prompts pr. opgave, eksempler, formatkrav og grænser. Vi designer, tester og versionerer prompts, så resultaterne er konsistente, korrekte og i jeres tone, og vi bygger evalueringer, så ændringer kan måles. Ydelsen findes, fordi en løsning, der virker på fem eksempler i en chat, ofte fejler på hundrede rigtige sager.
Vi starter med at samle rigtige eksempler: henvendelser, produkter, dokumenter, og det svar, I ville kalde korrekt. Ud fra dem skrives prompts som specifikationer med rolle, kontekst, data, format og grænser. Hver version køres mod evalueringssættet, og resultaterne sammenlignes, før noget ændres i drift. Det gælder både chat-assistenter, automatiseringer og indholdsproduktion, og vi arbejder på tværs af Claude, GPT og Gemini.
I står med et prompt-bibliotek med versionshistorik, et evalueringssæt af rigtige eksempler med kriterier, og en testmetode, jeres team kan bruge, når prompts skal ændres. Kvaliteten kan måles i tal i stedet for fornemmelser, og I kan skifte model eller udvide løsningen uden at miste det, der virker.