PROMPT INJECTION CHECK
Erkennung & FAQ
Ein Überblick über Signale, Dateiebenen und Grenzen der lokalen Analyse.
Prompt-Injection-Signale
Fremde Inhalte können Anweisungen an ein KI-System enthalten statt bloßer Informationen. Regelbasierte Prüfungen suchen nach unterstützten Anweisungs- und Rollenmanipulationssignalen, erfassen aber nicht jede mögliche Formulierung.
Verborgener und alternativer Text
Unterstützte Prüfungen können verborgenen Dokumenttext, sehr kleine oder fast weiße Schrift, ausgeblendete Tabellenblätter, Kommentare, inline verborgenes HTML, E-Mail-Preheader und bestimmte Metadaten oder Textkanäle anzeigen. Der Prüfumfang hängt vom Format ab.
Kodierte und verschleierte Inhalte
Einige unterstützte Texttransformationen, darunter begrenzte Base64-Fälle, können für die Analyse interpretiert werden. Unsichtbare oder richtungssteuernde Zeichen können ebenfalls gemeldet werden. Eine Transformation allein ist keine Anweisung; Auszug und Kontext prüfen.
Strukturierte Werte
JSON, CSV, TSV und XML können Anweisungen in Feldern, Zellen, Attributen oder benachbarten Werten enthalten. Unterstützte XML-CDATA und lokale Fragmente werden nach Möglichkeit geprüft. Fundstellen helfen beim Vergleich mit der Quelle.
Unterstützte Formate und Ebenen
Die Beispiele zeigen unterstützte Kanäle, keine vollständige Prüfung jeder Dateikomponente. Den Prüfumfang jedes Ergebnisses beachten.
- TXT
- Klartext und unterstützte Anweisungssignale.
- Markdown
- Text, Kommentare und Linkziele.
- HTML
- Geparster Text, Kommentare, ausgewählte Attribute, Metadaten und unterstütztes Inline-Verbergen.
- DOCX
- Text, unterstützte Formatierung und weitere Dokumentteile wie Notizen oder Kommentare.
- Extrahierbarer Seitentext, Anmerkungen, Formularfelder und Metadaten; Anhänge nur als Inventar.
- JSON
- Strukturierte Werte und begrenzter Kontext benachbarter Felder.
- CSV
- Textzellen und unterstützter lokaler Kontext.
- TSV
- Textzellen und unterstützter lokaler Kontext.
- XML
- Text, Attribute und unterstützte CDATA-Inhalte.
- EML
- Nachrichtentext, Header und unterstützte HTML-/Preheader-Inhalte.
- PPTX
- Extrahierbarer Folientext und unterstützte Präsentationskanäle.
- XLSX
- Zelltext und unterstützte Arbeitsmappenstruktur einschließlich ausgeblendeter Blätter.
HIGH, INFO und NONE
HIGH zeigt ein starkes Signal zur Prüfung. INFO markiert einen auffälligen oder kontextabhängigen Hinweis. NONE bedeutet, dass die ausgeführten Methoden kein bekanntes Muster fanden. Die Anzahl ist kein numerischer Risikowert.
Warum harmlose Inhalte auffallen können
Zitierte Angriffsbeispiele, Schulungsmaterial oder legitimer redaktionell oder für Barrierefreiheit verborgener Text können einem Angriff ähneln. Kontextregeln verringern manche Fehlalarme, klären aber nicht jeden Fall. Auszug und Zweck vergleichen.
Wenn kein Fund erscheint
Keine bekannten Muster mit den verfügbaren Methoden zu finden, beweist nicht, dass die Datei sicher ist. Prüfe nicht verfügbare Ebenen, besonders Bildseiten und eingebettete Inhalte.
Aktuelle Grenzen
Keine OCR oder Bildanalyse. Einige visuelle Verbergungen, externe oder berechnete CSS-Stile, Anhanginhalte und eingebettete Objekte werden nicht interpretiert. Sprachliche Abdeckung ist unvollständig; das Verhalten einer nachgelagerten KI wird nicht getestet.
Sprachabdeckung
Alle verfügbaren Sprachregelsätze laufen bei jedem Scan unabhängig von der Oberflächensprache. Phrasenregeln umfassen Englisch, Deutsch, Rumänisch, Mandarin, Hindi, Spanisch, Französisch, Arabisch, Bengalisch, Russisch, Portugiesisch, Urdu, Indonesisch, Japanisch, Nigerianisches Pidgin, Marathi, Telugu, Türkisch, Tamil, Yue-Chinesisch und Vietnamesisch. Strukturelle Signale können sprachunabhängig sein; die Phrasenabdeckung ist nicht vollständig.
Was tun bei einem Fund?
Fundstelle und Auszug im Original prüfen und klären, ob es eine Anweisung, ein Beispiel oder legitimer verborgener Inhalt ist. Unerwartetes entfernen oder isolieren und eine überarbeitete Kopie erneut prüfen. Fremde Inhalte von den maßgeblichen Anweisungen eines KI-Agenten trennen.