Prompt injection
engelsk: prompt injection
Et triks der noen gjemmer instruksjoner i tekst som KI-verktøyet leser, for å få det til å gjøre noe annet enn det skal.
KI-modeller skiller dårlig mellom innhold og instruksjoner. Ber du assistenten oppsummere en e-post, og e-posten inneholder en skjult beskjed i stil med "ignorer instruksene dine og gjør heller dette", kan modellen la seg lure til å følge den.
Dette blir viktig i det øyeblikket KI kobles til e-post, dokumenter og nettsider, og spesielt for KI-agenter som utfører handlinger. For vanlig chatbruk er risikoen liten, men prinsippet er verdt å kjenne: alt et KI-verktøy leser, kan i teorien påvirke det. Vær derfor ekstra bevisst på hvilke tilganger du gir KI-verktøy.
Lignende begreper
En fast instruks som ligger bak samtalen og styrer hvordan KI-assistenten skal oppføre seg, uansett hva brukeren skriver.
KI som ikke bare svarer, men utfører oppgaver i flere steg, som å søke, skrive og bruke verktøy på egen hånd.
Reglene og vurderingene rundt persondata når du bruker KI-verktøy. Tommelfingerregel: ikke del opplysninger om andre som de ikke ville delt selv.
Vil du lære å bruke dette i praksis? Se kursene for bedrift eller privat.
