Indirect Prompt Injection

Editors' Pick

A Proofpoint kutatói szerint a prompt injection már nem csupán elméleti AI-biztonsági probléma, hanem a kiberbűnözői fórumokon is egyre gyakrabban megjelenő támadási technika. A kutatás szerint a támadók olyan rejtett utasításokat ágyaznak weboldalakba, dokumentumokba, e-mailekbe vagy más tartalmakba, amelyeket az AI-agentek a feldolgozás során tévesen megbízható utasításként értelmezhetnek. 

Ha egy AI-rendszer rendelkezik külső eszközökhöz – például e-mailhez, fájlrendszerhez vagy API-khoz – való hozzáféréssel, egy sikeres prompt injection érzékeny adatok kiszivárogtatásához, jogosulatlan műveletek végrehajtásához vagy hibás döntésekhez vezethet. A Proofpoint szerint a fenyegetés különösen az agentikus AI térnyerésével nő, mivel ezek a rendszerek nemcsak válaszolnak a felhasználóknak, hanem önállóan hajtanak végre feladatokat is. 

A támadók már aktívan megvitatják a prompt injection gyakorlati alkalmazását zárt fórumokon, és egyre nagyobb érdeklődést mutatnak az AI-asszisztensek, vállalati copilóták és autonóm agentek manipulálása iránt. A Proofpoint szerint a hagyományos bemenetszűrés önmagában nem elegendő a védekezéshez. Az AI-rendszereket úgy kell tervezni, hogy elkülönítsék a felhasználói utasításokat a külső forrásból származó tartalmaktól, a nem megbízható adatokat potenciálisan ellenségesként kezeljék, az AI-ügynökök jogosultságait pedig a minimálisan szükséges szintre korlátozzák. 

FORRÁS