Prompt Injection
Prompt injection to klasa podatności, w której odpowiednio spreparowane dane wejściowe skłaniają duży model językowy do zignorowania pierwotnych instrukcji i wykonania instrukcji atakującego. W przeciwieństwie do błędu w tradycyjnym kodzie atak ten wykorzystuje niezdolność modelu do niezawodnego oddzielania zaufanych instrukcji od niezaufanych danych — co jest szczególnie groźne dla agentów AI, które czytają zewnętrzne treści, wywołują narzędzia lub działają na kodzie, środkach i infrastrukturze w systemach fintech i Web3.
Na tej stronie znajdziesz artykuły o tym, jak działa prompt injection, o bezpośrednich i pośrednich wektorach ataku, rzeczywistych incydentach dotyczących produktów opartych na LLM, dlaczego nie da się tego załatać jak SQL injection oraz o strategiach obrony wielowarstwowej przy budowaniu agentów AI i aplikacji LLM bezpiecznych w środowisku produkcyjnym.