Prompt injection jako obrona. Tracebit opisuje „kontekstowe bombardowanie”

Zdjęcie: © julien Tromeur / Unsplash
Źródło: unsplash.com/photos/XsqN28c422c
Kluczowe informacje
- Prompt injection może zostać użyty do zatrzymania atakującego agenta AI.
- Metoda polega na umieszczeniu zakazanych poleceń obok chronionych danych.
- Kontekstowe bombardowanie działa przede wszystkim wobec modeli z guardrails.
- Modele lokalne bez takich zabezpieczeń mogą być odporne na tę formę obrony.


