Ordbog · AI
Prompt injection
Angreb, hvor tekst i et dokument eller en besked får en model til at ignorere sine instruktioner og gøre noget andet.
Prompt injection udnytter, at modeller ikke skelner skarpt mellem instruktion og indhold. Ligger der en linje i et hentet dokument, der siger noget i retning af at se bort fra tidligere regler, kan modellen adlyde den.
Det er den vigtigste sikkerhedsrisiko i agenter med adgang til systemer. Vi behandler alt hentet indhold som data og aldrig som ordrer, begrænser hvad agenten må kalde, og kræver godkendelse ved handlinger, der ændrer noget eller sender noget ud af huset.
I praksis
Vil I se, hvordan vi arbejder med prompt injection? Det hører til under AI.
Relaterede begreber