4-stufige Erkennungspipeline Muster → Entitäten → Ausdrücke → Tiefenanalyse, mit automatischer Zusammenführung. Jede Ebene findet, was die anderen übersehen.
promptShield verkettet vier sich ergänzende Erkennungsebenen. Muster erfassen strukturierte Daten wie Telefonnummern, Sozialversicherungsnummern und IBANs mit nahezu perfekter Präzision. Entitäten nutzen Transformer-Modelle, um kontextabhängige sensible Daten wie Namen, Organisationen und Adressen zu identifizieren. Mit Ausdrücken markieren Sie jedes beliebige Wort oder jede Phrase – Mandantennamen, Projektcodes, interne Kennungen. Die Tiefenanalyse fügt für Grenzfälle, die den anderen Ebenen entgehen, einen optionalen LLM-Durchlauf hinzu. Die Ergebnisse aller Ebenen werden automatisch zusammengeführt und entdoppelt. 14 Entitätserkennungs-Modelle Findet Namen, Organisationen, Orte, medizinische Begriffe und Dutzende weiterer kontextabhängiger sensibler Datentypen – die Art, die ein reiner Musterabgleich nicht erfassen kann. Wählen Sie aus 14 spezialisierten Modellen oder lassen Sie den Auto-Modus das beste auswählen. Jedes Modell wird vor der Veröffentlichung auf Schadcode geprüft.
Wählen Sie das Entitätsmodell, das zu Ihrem Einsatzzweck passt. Piiranha verarbeitet mehrere Sprachen in einem Durchlauf. Das englische Comprehensive-Modell erkennt 54 sensible Datentypen, darunter medizinische Aktennummern, Finanzkonten und Aktenzeichen. Das medizinische Modell ist auf klinische Dokumente abgestimmt. Sprachspezifische Modelle liefern höhere Genauigkeit für französische, deutsche, spanische, italienische, portugiesische und niederländische Texte. Jedes Entitätsmodell wird außerdem vor der Veröffentlichung mit picklescan statisch auf Schadcode geprüft – die Build-Pipeline weigert sich, ein Modell auszuliefern, das die Prüfung nicht besteht, sodass alles, was auf Ihr Gerät gelangt, als sicher ladbar verifiziert ist. Integrierte & eigene Muster Integrierte Muster für Sozialversicherungsnummern, Kreditkarten, IBANs, Telefonnummern, Handelsregisternummern und mehr, zugeschnitten auf 14 Länder. Erstellen Sie eigene mit dem einfachen Block-Builder oder dem erweiterten Modus, plus einem Live-Testbereich.
promptShield wird mit Dutzenden vorgefertigter Muster für gängige sensible Datentypen ausgeliefert, lokalisiert für 14 Länder. Sie brauchen etwas Eigenes? Der einfache Modus bietet einen visuellen Block-Builder, mit dem Sie Muster definieren, ohne Code zu schreiben. Der erweiterte Modus gibt Ihnen die volle Mustersyntax mit Erfassungsgruppen. Beide Modi enthalten einen Live-Testbereich, in dem Sie Beispieltext einfügen und Treffer in Echtzeit hervorgehoben sehen, bevor Sie sie auf Ihre Dokumente anwenden. Lokales oder entferntes LLM Führen Sie ein lokales GGUF-Modell auf Ihrer GPU aus oder verbinden Sie sich mit einer beliebigen OpenAI-kompatiblen API (OpenAI, Claude, Groq, Mistral, Ollama, vLLM) für eine tiefe, kontextbewusste Analyse.
Für maximale Erkennungsgenauigkeit fügen Sie der Pipeline eine Tiefenanalyse-Ebene hinzu. Führen Sie ein GGUF-Modell lokal auf Ihrer GPU für vollständig offline ablaufende Verarbeitung aus oder verbinden Sie sich mit einem beliebigen OpenAI-kompatiblen API-Endpunkt. Das Modell analysiert Text im Kontext und erfasst subtile sensible Daten, die Muster und Entitäten übersehen könnten – angedeutete Verweise, Spitznamen oder fachspezifische Kennungen. Konfigurieren Sie Temperatur, Max-Tokens und System-Prompts, um das Verhalten anzupassen. Geben Sie bestimmte Wörter oder Phrasen zum Auffinden ein, fügen Sie sie aus Excel oder CSV ein. Jeder Treffer kann auf Codieren oder Entfernen gesetzt werden, mit einstellbarer Unschärfe.
Mit dem Ausdrucksraster geben Sie genaue Begriffe an, die erkannt werden sollen – ideal für Mandantennamen, Projektcodes oder interne Bezeichner, die der automatischen Erkennung entgehen könnten. Fügen Sie direkt aus Excel oder CSV für die Massenerfassung ein. Jeder Begriff kann auf Codieren (umkehrbar) oder Entfernen (dauerhafte Schwärzung) gesetzt werden, und der Unschärfe-Regler steuert, wie genau der Text übereinstimmen muss. Das ist Ihr Sicherheitsnetz für fachspezifische Daten, von denen nur Sie wissen.
Unschärfe & Empfindlichkeit Justieren Sie die Erkennungsaggressivität mit einem Unschärfe-Regler, Schaltern pro Typ und einer Regionengruppierung dafür, wie nahe beieinanderliegende Wörter zusammengeführt werden.
Stimmen Sie die Erkennung exakt auf Ihre Bedürfnisse ab. Der Unschärfe-Regler steuert, wie aggressiv promptShield Treffer auf den umgebenden Kontext ausweitet. Schalter pro Typ aktivieren oder deaktivieren bestimmte Kategorien sensibler Daten (z. B. Telefonnummern erkennen, aber Organisationsnamen überspringen). Die Regionengruppierung bestimmt, wie nahe beieinanderliegende erkannte Wörter zu einzelnen Regionen verschmelzen – wichtig für mehrteilige Namen und Adressen. Länderspezifische Muster für die USA, Großbritannien, Kanada, Australien, Frankreich, Deutschland, Spanien, Mexiko, Italien, die Niederlande, Belgien, Portugal, Brasilien und die Schweiz – einschließlich Handelsregisternummern, nationaler Ausweise und länderspezifischer Steuerkennungen.
Jedes Länderprofil enthält lokalisierte Muster für nationale Ausweise (SSN, NI-Nummer, SIN, TFN, NIR usw.), Steuerkennungen, Handelsregisternummern, Postleitzahlen, Telefonformate, Gesundheitsnummern und mehr. Wenn Sie ein Länderprofil auswählen, wird die Erkennungs-Engine mit den passenden Mustern konfiguriert. Der Auto-Modus erkennt das wahrscheinliche Land aus dem Dokumentinhalt und aktiviert das passende Profil. Seitenübergreifende Propagierung Erkannte sensible Daten propagieren automatisch über alle Seiten – einschließlich teilweisem Abgleich von Organisationsnamen und Typvereinheitlichung für Konsistenz.
Wenn promptShield einen Namen auf Seite 1 erkennt, findet und markiert es automatisch jedes Vorkommen dieses Namens auf allen anderen Seiten, selbst bei leichten Abweichungen (z. B. „Smith & Associates“ vs. „Smith & Assoc.“). Die Typvereinheitlichung stellt sicher, dass eine als PERSON klassifizierte Entität diese Klassifizierung überall behält. So ist eine konsistente Codierung über das gesamte Dokument garantiert.
Visuelle Regionenwerkzeuge Zeiger-, Lasso- und Zeichenwerkzeuge zum Auswählen und Erstellen von Regionen. Zusammenführen, teilen, neu beschriften oder löschen mit voller Rückgängig-/Wiederherstellen-Unterstützung.
Mit interaktiven Werkzeugen verwalten Sie erkannte Regionen visuell auf der Dokumentleinwand. Nutzen Sie den Zeiger, um bestehende Regionen auszuwählen, das Lasso, um mehrere Regionen auf einmal zu wählen, oder das Zeichenwerkzeug, um Bereiche manuell zu markieren, die die KI übersehen hat. Klicken Sie mit der rechten Maustaste auf eine Region, um sie zusammenzuführen, zu teilen, den Typ sensibler Daten neu zu klassifizieren oder zu löschen. Jede Aktion unterstützt Rückgängig/Wiederherstellen, sodass Sie frei experimentieren können, ohne Arbeit zu verlieren. Speichern und laden Sie benannte Erkennungskonfigurationen (Unschärfe, aktivierte Typen, Ausdrücke), um sie über Dokumente hinweg wiederzuverwenden.
Erstellen Sie Erkennungsvorlagen für wiederkehrende Dokumenttypen. Eine Vorlage erfasst Ihre gesamte Erkennungskonfiguration: Unschärfegrad, aktivierte sensible Datentypen, Ausdrücke, eigene Muster und die Auswahl des Entitätsmodells. Speichern Sie Vorlagen mit aussagekräftigen Namen wie „Rechtsverträge“ oder „Patientenakten“ und wenden Sie sie sofort auf neue Dokumente an. Das beseitigt repetitives Einrichten und sorgt für eine konsistente Verarbeitung im gesamten Team. Wählen Sie pro Region: codieren (umkehrbare Ersetzung) oder entfernen (dauerhafte Schwärzung mit schwarzem Kasten). Wenden Sie es im Stapel oder einzeln an.
Nicht alle sensiblen Daten brauchen dieselbe Behandlung. Die Codierung ersetzt Daten durch umkehrbare Codes, sodass Sie sie nach der KI-Verarbeitung wiederherstellen können. Das Entfernen schwärzt die Daten dauerhaft mit einem schwarzen Kasten – ideal für Informationen, die niemals wiederherstellbar sein sollten. Legen Sie den Standard pro sensiblem Datentyp fest oder überschreiben Sie einzelne Regionen. Mit der Mehrfachauswahl ändern Sie den Modus für Dutzende Regionen auf einmal. Rauschfilterung & Konfidenz Integrierte Rauschfilter verringern Fehltreffer bei den Typen Organisation, Ort, Person und Adresse. Jede Erkennung enthält einen Konfidenzwert.
Die Entitätserkennung kann mitunter übereifrig sein und gängige Wörter als Organisationen oder generische Orte als sensible Daten markieren. promptShield enthält integrierte Rauschfilter, die häufige Fehltreffer für jeden Entitätstyp unterdrücken. Jede Erkennung trägt zudem einen Konfidenzwert, sodass Sie unsichere Treffer, die eine manuelle Prüfung verdienen, schnell erkennen. Das Ergebnis ist eine sauberere Erkennung mit weniger Fehltreffern von Haus aus. Unterdrückung von Metadaten & versteckten Daten Alle Dokument-Metadaten, versteckten Felder, nachverfolgten Änderungen, eingebetteten Objekte und unsichtbaren Inhalte werden während der Verarbeitung automatisch entfernt – sodass keine sensiblen Daten über nicht sichtbare Kanäle entweichen.
Dokumente enthalten oft versteckte sensible Daten, die auf der Seite nicht sichtbar sind: Autorennamen in den Metadaten, GPS-Koordinaten in Bildern, einen Revisionsverlauf mit nachverfolgten Änderungen, Kommentare, versteckte Textfelder und eingebettete Objekte. promptShield entfernt all das während der Verarbeitung automatisch. Das verhindert das häufige Szenario, in dem jemand sichtbaren Text sorgfältig schwärzt, aber die Metadaten vergisst, die dieselben Informationen preisgeben. Tastenkürzel für Power-User Prüfen und schützen Sie Dokumente, ohne die Maus zu berühren. Werkzeuge wechseln, auf Regionen reagieren, durch Seiten navigieren und rückgängig machen – alles über die Tastatur.
Werkzeugwechsel: V (Zeiger), S (Lasso), D (Zeichnen), Leertaste (zum zuletzt genutzten Werkzeug umschalten). Regionenaktionen: T (Auswahl codieren), D oder Rücktaste (Auswahl entfernen), Entf (Region löschen oder Stapel löschen). Navigation: Tab / Umschalt+Tab, um durch offene Regionen zu wechseln, Pfeil links / rechts für den Seitenwechsel. Zoom: + / - / 0 (zurücksetzen). Auswahl: Strg+A, um alle Regionen der Seite auszuwählen. Zwischenablage: Strg+C / Strg+V, um Regionen seitenübergreifend zu kopieren und einzufügen. Rückgängig/Wiederherstellen: Strg+Z / Strg+Umschalt+Z. Schützen-Panel: Strg+F. Alle Tastenkürzel werden in Texteingabefeldern unterdrückt, sodass sie die Eingabe niemals stören.