PROMPT INJECTION CHECK

Ce detectăm și FAQ

Ghidul semnalelor, straturilor și limitelor scannerului local.

Indicii de prompt injection

Conținutul extern poate include instrucțiuni adresate unui sistem AI, nu doar informații de citit. Verificările bazate pe reguli caută indicii acceptate de instrucțiuni și manipulare a rolurilor, dar nu acoperă orice formulare posibilă.

Text ascuns și canale alternative

Verificările acceptate pot arăta text ascuns, fonturi foarte mici sau aproape albe, foi de calcul ascunse, comentarii, HTML ascuns inline, preheader-e de email și unele metadate sau canale textuale. Acoperirea depinde de format.

Conținut codificat și mascat

Unele transformări acceptate, inclusiv cazuri Base64 analizate limitat, pot fi interpretate. Pot fi raportate și caractere invizibile sau direcționale. Transformarea singură nu este o instrucțiune; verifică fragmentul și contextul sursei.

Valori structurate

JSON, CSV, TSV și XML pot conține instrucțiuni în câmpuri, celule, atribute sau valori apropiate. CDATA XML și fragmentele locale acceptate sunt inspectate când este posibil. Locațiile te ajută să revii la datele originale.

Formate și straturi inspectate

Exemplele descriu canale acceptate, nu garantează verificarea fiecărei părți din fișier. Consultă acoperirea fiecărui rezultat.

TXT
Text simplu și indicii de instrucțiune acceptate.
Markdown
Text, comentarii și destinațiile linkurilor.
HTML
Text parsat, comentarii, unele atribute, metadate și ascundere inline acceptată.
DOCX
Text, formatare acceptată și alte părți precum note ori comentarii.
PDF
Text extractibil, adnotări, câmpuri și metadate; atașamente inventariate.
JSON
Valori structurate și context limitat între câmpuri vecine.
CSV
Celule textuale și context local acceptat.
TSV
Celule textuale și context local acceptat.
XML
Text, atribute și conținut CDATA acceptat.
EML
Textul mesajului, antete și conținut HTML/preheader acceptat.
PPTX
Text extractibil din slide-uri și canale acceptate.
XLSX
Textul celulelor și structura acceptată, inclusiv foi ascunse.

HIGH, INFO și NONE

HIGH indică un semnal puternic de verificat. INFO marchează un element neobișnuit sau dependent de context. NONE înseamnă că metodele executate nu au găsit un tipar cunoscut. Numărul constatărilor nu este un scor numeric de risc.

De ce poate apărea un conținut benign

Un atac citat ca exemplu, materialele educaționale sau textul ascuns legitim pentru editare ori accesibilitate pot semăna cu un atac. Contextul reduce unele alerte inutile, fără să rezolve toate cazurile. Compară fragmentul cu scopul original.

Când nu apare nicio constatare

Absența unui tipar cunoscut prin metodele disponibile nu dovedește că fișierul este sigur. Verifică straturile indisponibile, în special paginile doar cu imagini și conținutul încorporat.

Limitări actuale

Nu există OCR sau analiză de imagini. Unele ascunderi vizuale, CSS extern sau calculat, conținutul atașamentelor și obiectele încorporate nu sunt interpretate. Acoperirea expresiilor în alte limbi este incompletă, iar reacția unui AI ulterior nu este testată.

Acoperire lingvistică

Toate seturile disponibile de reguli lingvistice rulează la fiecare scanare, indiferent de limba interfeței. Expresiile acoperă engleza, germana, româna, chineza mandarină, hindi, spaniola, franceza, araba, bengaleza, rusa, portugheza, urdu, indoneziana, japoneza, pidginul nigerian, marathi, telugu, turca, tamila, chineza Yue și vietnameza. Semnalele structurale pot fi independente de limbă; lista de expresii nu este exhaustivă.

Ce faci cu o constatare

Verifică locația și compară fragmentul cu sursa. Stabilește dacă este o instrucțiune, un exemplu sau conținut ascuns legitim. Elimină sau izolează elementele neașteptate și scanează o copie revizuită când ajută. Separă conținutul extern de instrucțiunile agentului AI.