PROMPT INJECTION CHECK

Erkennung & FAQ

Ein Überblick über Signale, Dateiebenen und Grenzen der lokalen Analyse.

Prompt-Injection-Signale

Fremde Inhalte können Anweisungen an ein KI-System enthalten statt bloßer Informationen. Regelbasierte Prüfungen suchen nach unterstützten Anweisungs- und Rollenmanipulationssignalen, erfassen aber nicht jede mögliche Formulierung.

Verborgener und alternativer Text

Unterstützte Prüfungen können verborgenen Dokumenttext, sehr kleine oder fast weiße Schrift, ausgeblendete Tabellenblätter, Kommentare, inline verborgenes HTML, E-Mail-Preheader und bestimmte Metadaten oder Textkanäle anzeigen. Der Prüfumfang hängt vom Format ab.

Kodierte und verschleierte Inhalte

Einige unterstützte Texttransformationen, darunter begrenzte Base64-Fälle, können für die Analyse interpretiert werden. Unsichtbare oder richtungssteuernde Zeichen können ebenfalls gemeldet werden. Eine Transformation allein ist keine Anweisung; Auszug und Kontext prüfen.

Strukturierte Werte

JSON, CSV, TSV und XML können Anweisungen in Feldern, Zellen, Attributen oder benachbarten Werten enthalten. Unterstützte XML-CDATA und lokale Fragmente werden nach Möglichkeit geprüft. Fundstellen helfen beim Vergleich mit der Quelle.

Unterstützte Formate und Ebenen

Die Beispiele zeigen unterstützte Kanäle, keine vollständige Prüfung jeder Dateikomponente. Den Prüfumfang jedes Ergebnisses beachten.

TXT
Klartext und unterstützte Anweisungssignale.
Markdown
Text, Kommentare und Linkziele.
HTML
Geparster Text, Kommentare, ausgewählte Attribute, Metadaten und unterstütztes Inline-Verbergen.
DOCX
Text, unterstützte Formatierung und weitere Dokumentteile wie Notizen oder Kommentare.
PDF
Extrahierbarer Seitentext, Anmerkungen, Formularfelder und Metadaten; Anhänge nur als Inventar.
JSON
Strukturierte Werte und begrenzter Kontext benachbarter Felder.
CSV
Textzellen und unterstützter lokaler Kontext.
TSV
Textzellen und unterstützter lokaler Kontext.
XML
Text, Attribute und unterstützte CDATA-Inhalte.
EML
Nachrichtentext, Header und unterstützte HTML-/Preheader-Inhalte.
PPTX
Extrahierbarer Folientext und unterstützte Präsentationskanäle.
XLSX
Zelltext und unterstützte Arbeitsmappenstruktur einschließlich ausgeblendeter Blätter.

HIGH, INFO und NONE

HIGH zeigt ein starkes Signal zur Prüfung. INFO markiert einen auffälligen oder kontextabhängigen Hinweis. NONE bedeutet, dass die ausgeführten Methoden kein bekanntes Muster fanden. Die Anzahl ist kein numerischer Risikowert.

Warum harmlose Inhalte auffallen können

Zitierte Angriffsbeispiele, Schulungsmaterial oder legitimer redaktionell oder für Barrierefreiheit verborgener Text können einem Angriff ähneln. Kontextregeln verringern manche Fehlalarme, klären aber nicht jeden Fall. Auszug und Zweck vergleichen.

Wenn kein Fund erscheint

Keine bekannten Muster mit den verfügbaren Methoden zu finden, beweist nicht, dass die Datei sicher ist. Prüfe nicht verfügbare Ebenen, besonders Bildseiten und eingebettete Inhalte.

Aktuelle Grenzen

Keine OCR oder Bildanalyse. Einige visuelle Verbergungen, externe oder berechnete CSS-Stile, Anhanginhalte und eingebettete Objekte werden nicht interpretiert. Sprachliche Abdeckung ist unvollständig; das Verhalten einer nachgelagerten KI wird nicht getestet.

Sprachabdeckung

Alle verfügbaren Sprachregelsätze laufen bei jedem Scan unabhängig von der Oberflächensprache. Phrasenregeln umfassen Englisch, Deutsch, Rumänisch, Mandarin, Hindi, Spanisch, Französisch, Arabisch, Bengalisch, Russisch, Portugiesisch, Urdu, Indonesisch, Japanisch, Nigerianisches Pidgin, Marathi, Telugu, Türkisch, Tamil, Yue-Chinesisch und Vietnamesisch. Strukturelle Signale können sprachunabhängig sein; die Phrasenabdeckung ist nicht vollständig.

Was tun bei einem Fund?

Fundstelle und Auszug im Original prüfen und klären, ob es eine Anweisung, ein Beispiel oder legitimer verborgener Inhalt ist. Unerwartetes entfernen oder isolieren und eine überarbeitete Kopie erneut prüfen. Fremde Inhalte von den maßgeblichen Anweisungen eines KI-Agenten trennen.