PROMPT INJECTION CHECK
Détections et FAQ
Les signaux, les couches de fichiers et les limites de l’analyse locale.
Signaux d’injection de prompt
Un contenu externe peut contenir des instructions adressées à une IA plutôt que des informations à lire. Les règles cherchent certains signaux d’instruction ou de manipulation des rôles, sans couvrir toutes les formulations possibles.
Texte caché et canaux alternatifs
Les vérifications prises en charge peuvent révéler du texte masqué, une police minuscule ou presque blanche, des feuilles masquées, des commentaires, du HTML caché en ligne, des préambules d’e-mail et certaines métadonnées ou voies textuelles. La couverture dépend du format.
Contenu encodé ou dissimulé
Certaines transformations prises en charge, dont des cas Base64 limités, peuvent être interprétées. Des caractères invisibles ou directionnels peuvent être signalés. Une transformation seule n’est pas une instruction; examinez l’extrait et sa source.
Valeurs structurées
JSON, CSV, TSV et XML peuvent porter des instructions dans des champs, cellules, attributs ou valeurs voisines. Les CDATA XML et fragments locaux pris en charge sont examinés si possible. Les emplacements facilitent le retour à la source.
Formats et couches examinés
Ces exemples décrivent des canaux pris en charge, pas une analyse exhaustive de chaque partie du fichier. Consultez la couverture du résultat.
- TXT
- Texte brut et signaux d’instruction pris en charge.
- Markdown
- Texte, commentaires et destinations des liens.
- HTML
- Texte analysé, commentaires, certains attributs, métadonnées et masquage en ligne pris en charge.
- DOCX
- Texte, mise en forme prise en charge et autres parties comme notes ou commentaires.
- Texte extractible, annotations, champs de formulaire et métadonnées; inventaire des pièces jointes.
- JSON
- Valeurs structurées et contexte limité entre champs voisins.
- CSV
- Cellules textuelles et contexte local pris en charge.
- TSV
- Cellules textuelles et contexte local pris en charge.
- XML
- Texte, attributs et contenu CDATA pris en charge.
- EML
- Texte du message, en-têtes et contenus HTML/préambule pris en charge.
- PPTX
- Texte extractible des diapositives et canaux pris en charge.
- XLSX
- Texte des cellules et structure prise en charge, dont les feuilles masquées.
HIGH, INFO et NONE
HIGH signale un indice fort à examiner; INFO, un élément inhabituel ou dépendant du contexte. NONE signifie qu’aucun motif connu n’a été trouvé avec les méthodes exécutées. Le nombre de résultats n’est pas un score de risque.
Pourquoi un contenu inoffensif peut ressortir
Des exemples d’attaques cités, des supports pédagogiques ou des textes masqués à des fins éditoriales ou d’accessibilité peuvent ressembler à une attaque. Le contexte réduit certaines fausses alertes sans résoudre tous les cas. Comparez l’extrait à son usage.
Quand aucun résultat ne paraît
L’absence de motif connu avec les méthodes disponibles ne prouve pas qu’un fichier soit sûr. Vérifiez les couches indisponibles, notamment les pages en image et les contenus intégrés.
Limites actuelles
Pas d’OCR ni d’analyse des images. Certains masquages visuels, CSS externes ou calculés, contenus de pièces jointes et objets intégrés ne sont pas interprétés. La couverture linguistique est incomplète et le comportement d’une IA destinataire n’est pas testé.
Couverture linguistique
Tous les jeux de règles disponibles s’exécutent indépendamment de la langue de l’interface. Les expressions couvrent actuellement l’anglais, l’allemand, le roumain, le mandarin, l’hindi, l’espagnol, le français, l’arabe, le bengali, le russe, le portugais, l’ourdou, l’indonésien, le japonais, le pidgin nigérian, le marathi, le télougou, le turc, le tamoul, le chinois yue et le vietnamien. Les signaux structurels peuvent être indépendants de la langue; les expressions restent incomplètes.
Que faire après un résultat?
Examinez son emplacement et l’extrait dans la source. Distinguez instruction, exemple et contenu masqué légitime. Retirez ou isolez un élément inattendu et réanalysez une copie corrigée si utile. Séparez le contenu externe des instructions de l’agent IA.