PROMPT INJECTION CHECK
Ce detectăm și FAQ
Ghidul semnalelor, straturilor și limitelor scannerului local.
Indicii de prompt injection
Conținutul extern poate include instrucțiuni adresate unui sistem AI, nu doar informații de citit. Verificările bazate pe reguli caută indicii acceptate de instrucțiuni și manipulare a rolurilor, dar nu acoperă orice formulare posibilă.
Text ascuns și canale alternative
Verificările acceptate pot arăta text ascuns, fonturi foarte mici sau aproape albe, foi de calcul ascunse, comentarii, HTML ascuns inline, preheader-e de email și unele metadate sau canale textuale. Acoperirea depinde de format.
Conținut codificat și mascat
Unele transformări acceptate, inclusiv cazuri Base64 analizate limitat, pot fi interpretate. Pot fi raportate și caractere invizibile sau direcționale. Transformarea singură nu este o instrucțiune; verifică fragmentul și contextul sursei.
Valori structurate
JSON, CSV, TSV și XML pot conține instrucțiuni în câmpuri, celule, atribute sau valori apropiate. CDATA XML și fragmentele locale acceptate sunt inspectate când este posibil. Locațiile te ajută să revii la datele originale.
Formate și straturi inspectate
Exemplele descriu canale acceptate, nu garantează verificarea fiecărei părți din fișier. Consultă acoperirea fiecărui rezultat.
- TXT
- Text simplu și indicii de instrucțiune acceptate.
- Markdown
- Text, comentarii și destinațiile linkurilor.
- HTML
- Text parsat, comentarii, unele atribute, metadate și ascundere inline acceptată.
- DOCX
- Text, formatare acceptată și alte părți precum note ori comentarii.
- Text extractibil, adnotări, câmpuri și metadate; atașamente inventariate.
- JSON
- Valori structurate și context limitat între câmpuri vecine.
- CSV
- Celule textuale și context local acceptat.
- TSV
- Celule textuale și context local acceptat.
- XML
- Text, atribute și conținut CDATA acceptat.
- EML
- Textul mesajului, antete și conținut HTML/preheader acceptat.
- PPTX
- Text extractibil din slide-uri și canale acceptate.
- XLSX
- Textul celulelor și structura acceptată, inclusiv foi ascunse.
HIGH, INFO și NONE
HIGH indică un semnal puternic de verificat. INFO marchează un element neobișnuit sau dependent de context. NONE înseamnă că metodele executate nu au găsit un tipar cunoscut. Numărul constatărilor nu este un scor numeric de risc.
De ce poate apărea un conținut benign
Un atac citat ca exemplu, materialele educaționale sau textul ascuns legitim pentru editare ori accesibilitate pot semăna cu un atac. Contextul reduce unele alerte inutile, fără să rezolve toate cazurile. Compară fragmentul cu scopul original.
Când nu apare nicio constatare
Absența unui tipar cunoscut prin metodele disponibile nu dovedește că fișierul este sigur. Verifică straturile indisponibile, în special paginile doar cu imagini și conținutul încorporat.
Limitări actuale
Nu există OCR sau analiză de imagini. Unele ascunderi vizuale, CSS extern sau calculat, conținutul atașamentelor și obiectele încorporate nu sunt interpretate. Acoperirea expresiilor în alte limbi este incompletă, iar reacția unui AI ulterior nu este testată.
Acoperire lingvistică
Toate seturile disponibile de reguli lingvistice rulează la fiecare scanare, indiferent de limba interfeței. Expresiile acoperă engleza, germana, româna, chineza mandarină, hindi, spaniola, franceza, araba, bengaleza, rusa, portugheza, urdu, indoneziana, japoneza, pidginul nigerian, marathi, telugu, turca, tamila, chineza Yue și vietnameza. Semnalele structurale pot fi independente de limbă; lista de expresii nu este exhaustivă.
Ce faci cu o constatare
Verifică locația și compară fragmentul cu sursa. Stabilește dacă este o instrucțiune, un exemplu sau conținut ascuns legitim. Elimină sau izolează elementele neașteptate și scanează o copie revizuită când ajută. Separă conținutul extern de instrucțiunile agentului AI.