Pipeline de détection à 4 couches Motifs → Entités → Expressions → Analyse approfondie, avec fusion automatique. Chaque couche rattrape ce que les autres laissent passer.
promptShield enchaîne quatre couches de détection complémentaires. Les Motifs repèrent les données structurées comme les numéros de téléphone, de sécurité sociale et les IBAN, avec une précision quasi parfaite. Les Entités font appel à des modèles transformeurs pour identifier les données sensibles contextuelles : noms, organisations, adresses. Les Expressions vous permettent de signaler n'importe quel mot ou expression précis — noms de clients, codes de projet, identifiants internes. L'Analyse approfondie ajoute un passage LLM facultatif pour les cas limites que les autres couches manquent. Les résultats de toutes les couches sont fusionnés et dédupliqués automatiquement. 14 modèles de détection d'entités Repère les noms, organisations, lieux, termes médicaux et des dizaines d'autres types de données sensibles contextuelles — celles qu'une simple recherche de motifs ne peut pas attraper. Choisissez parmi 14 modèles spécialisés, ou laissez le mode Auto sélectionner le meilleur. Chaque modèle est analysé à la recherche de code malveillant avant publication.
Sélectionnez le modèle d'entités adapté à votre usage. Piiranha traite plusieurs langues en un seul passage. Le modèle anglais complet détecte 54 types de données sensibles, dont les numéros de dossier médical, les comptes financiers et les références d'affaires juridiques. Le modèle médical est optimisé pour les documents cliniques. Les modèles propres à chaque langue offrent une précision supérieure sur les textes en français, allemand, espagnol, italien, portugais et néerlandais. Chaque modèle d'entités est par ailleurs analysé statiquement avec picklescan pour détecter tout code malveillant avant sa publication — le pipeline de build refuse de livrer le moindre modèle qui échoue à cette analyse, de sorte que ce qui arrive sur votre machine a été vérifié comme sûr à charger. Motifs intégrés et personnalisés Motifs intégrés pour les numéros de sécurité sociale, cartes bancaires, IBAN, téléphones, numéros d'entreprise et plus, adaptés à 14 pays. Créez les vôtres avec le constructeur Simple par blocs ou le mode Avancé, accompagnés d'un terrain d'essai en direct.
promptShield est livré avec des dizaines de motifs préconçus pour les types de données sensibles courants, localisés pour 14 pays. Besoin de quelque chose de sur mesure ? Le mode Simple propose un constructeur visuel par blocs, où vous définissez vos motifs sans écrire la moindre ligne de code. Le mode Avancé vous donne accès à la syntaxe complète des motifs, groupes de capture compris. Les deux modes intègrent un terrain d'essai en direct : collez un texte d'exemple et voyez les correspondances surlignées en temps réel avant de les appliquer à vos documents. Exécutez un modèle GGUF local sur votre GPU, ou connectez-vous à n'importe quelle API compatible OpenAI (OpenAI, Claude, Groq, Mistral, Ollama, vLLM) pour une analyse contextuelle approfondie.
Pour une précision de détection maximale, ajoutez une couche d'Analyse approfondie au pipeline. Exécutez un modèle GGUF localement sur votre GPU pour un traitement entièrement hors ligne, ou connectez-vous à n'importe quel point d'accès d'API compatible OpenAI. Le modèle analyse le texte en contexte et capte les données sensibles subtiles que les Motifs et les Entités pourraient manquer — références implicites, surnoms ou identifiants propres à un métier. Réglez la température, le nombre maximal de jetons et les invites système pour ajuster son comportement. Saisissez des mots ou expressions précis à rechercher, ou collez-les depuis Excel ou un CSV. Chaque correspondance peut être réglée sur Encoder ou Supprimer, avec une tolérance ajustable.
La grille d'expressions vous permet d'indiquer les termes exacts que vous souhaitez détecter — idéale pour les noms de clients, codes de projet ou désignations internes que la détection automatique pourrait manquer. Collez directement depuis Excel ou un CSV pour une saisie en masse. Chaque terme peut être réglé sur Encoder (réversible) ou Supprimer (caviardage définitif), et le curseur de tolérance détermine le degré de similarité requis. C'est votre filet de sécurité pour les données métier que vous êtes seul à connaître. Réglez l'intensité de la détection à l'aide d'un curseur de tolérance, de bascules par type et d'un contrôle de regroupement des régions qui détermine la fusion des mots voisins.
Affinez la détection selon vos besoins précis. Le curseur de tolérance détermine avec quelle intensité promptShield étend les correspondances au contexte environnant. Les bascules par type vous permettent d'activer ou de désactiver des catégories précises de données sensibles (par exemple détecter les numéros de téléphone mais ignorer les noms d'organisations). Le contrôle de regroupement des régions détermine la façon dont les mots détectés voisins fusionnent en une seule région — un point important pour les noms et adresses en plusieurs mots. Motifs propres à chaque pays pour les États-Unis, le Royaume-Uni, le Canada, l'Australie, la France, l'Allemagne, l'Espagne, le Mexique, l'Italie, les Pays-Bas, la Belgique, le Portugal, le Brésil et la Suisse, y compris les numéros d'entreprise, les pièces d'identité nationales et les identifiants fiscaux propres à chaque pays.
Chaque profil pays comprend des motifs localisés pour les pièces d'identité nationales (numéro de sécurité sociale, NI number, SIN, TFN, NIR, etc.), les identifiants fiscaux, les numéros d'immatriculation d'entreprise, les codes postaux, les formats de téléphone, les numéros de santé et bien plus. Lorsque vous sélectionnez un profil pays, le moteur de détection est configuré avec les bons motifs. Le mode Auto déduit le pays probable à partir du contenu du document et active le profil correspondant. Propagation entre les pages Les données sensibles détectées se propagent automatiquement à toutes les pages, avec correspondance partielle des noms d'organisations et unification des types pour assurer la cohérence.
Lorsque promptShield détecte un nom à la page 1, il retrouve et marque automatiquement chaque occurrence de ce nom sur toutes les autres pages, même en cas de légères variations (par exemple « Dupont & Associés » et « Dupont & Assoc. »). L'unification des types garantit qu'une entité classée comme PERSONNE sur une page conserve cette classification partout. La cohérence de l'encodage est ainsi assurée sur l'ensemble du document.
Outils visuels de gestion des régions Outils pointeur, lasso et dessin pour sélectionner et créer des régions. Fusionnez, divisez, réétiquetez ou supprimez, avec une prise en charge complète de l'annulation et du rétablissement.
Des outils interactifs vous permettent de gérer visuellement les régions détectées sur la zone de travail du document. Utilisez le pointeur pour sélectionner des régions existantes, le lasso pour en sélectionner plusieurs à la fois, ou l'outil de dessin pour marquer manuellement les zones que l'IA a manquées. Faites un clic droit sur n'importe quelle région pour la fusionner, la diviser, reclasser son type de donnée sensible ou la supprimer. Chaque action prend en charge l'annulation et le rétablissement : vous pouvez expérimenter librement sans rien perdre de votre travail. Enregistrez et chargez des configurations de détection nommées (tolérance, types activés, expressions) pour les réutiliser d'un document à l'autre.
Créez des modèles de détection pour les types de documents récurrents. Un modèle capture l'intégralité de votre configuration de détection : niveau de tolérance, types de données sensibles activés, expressions, motifs personnalisés et choix du modèle d'entités. Enregistrez vos modèles sous des noms parlants comme « Contrats juridiques » ou « Dossiers médicaux » et appliquez-les instantanément à de nouveaux documents. Vous évitez ainsi une configuration répétitive et garantissez un traitement cohérent au sein de votre équipe. Choisissez région par région : encoder (remplacement réversible) ou supprimer (caviardage définitif par rectangle noir). Appliquez en masse ou une par une.
Toutes les données sensibles ne requièrent pas le même traitement. L'encodage remplace la donnée par des codes réversibles, que vous pourrez restaurer après le traitement par l'IA. La suppression caviarde la donnée de façon définitive par un rectangle noir, idéale pour les informations qui ne doivent jamais pouvoir être récupérées. Définissez le réglage par défaut pour chaque type de donnée sensible, ou modifiez chaque région individuellement. La sélection groupée vous permet de changer le mode pour des dizaines de régions d'un seul coup. Filtrage du bruit et confiance Des filtres anti-bruit intégrés réduisent les faux positifs pour les types Organisation, Lieu, Personne et Adresse. Chaque détection est assortie d'un score de confiance.
La détection d'entités peut parfois se montrer trop zélée, en signalant des mots courants comme des organisations ou des lieux génériques comme des données sensibles. promptShield intègre des filtres anti-bruit qui suppriment les faux positifs les plus fréquents pour chaque type d'entité. Chaque détection porte par ailleurs un score de confiance, qui vous permet de repérer rapidement les correspondances incertaines méritant une vérification manuelle. Résultat : une détection plus propre, avec moins de faux positifs dès le départ. Suppression des métadonnées et données cachées Toutes les métadonnées du document, champs cachés, modifications suivies, objets intégrés et contenus invisibles sont automatiquement supprimés lors du traitement, garantissant qu'aucune donnée sensible ne fuit par des canaux non visibles.
Les documents contiennent souvent des données sensibles cachées, invisibles sur la page : noms d'auteurs dans les métadonnées, coordonnées GPS dans les images, historique des révisions avec modifications suivies, commentaires, champs de texte masqués et objets intégrés. promptShield supprime automatiquement tout cela lors du traitement. Cela évite le scénario classique où l'on caviarde soigneusement le texte visible tout en oubliant des métadonnées qui révèlent la même information. Des raccourcis pour les utilisateurs avancés Vérifiez et protégez vos documents sans toucher la souris. Changez d'outil, agissez sur les régions, naviguez entre les pages et annulez — le tout au clavier.
Changement d'outil : V (pointeur), S (lasso), D (dessin), Espace (revenir au dernier outil). Actions sur les régions : T (encoder la sélection), D ou Retour arrière (supprimer la sélection), Suppr (effacer une région ou en supprimer plusieurs en lot). Navigation : Tab / Maj+Tab pour parcourir les régions en attente, flèches Gauche / Droite pour changer de page. Zoom : + / - / 0 (réinitialiser). Sélection : Ctrl+A pour sélectionner toutes les régions de la page. Presse-papiers : Ctrl+C / Ctrl+V pour copier et coller des régions d'une page à l'autre. Annuler/Rétablir : Ctrl+Z / Ctrl+Maj+Z. Panneau de détection : Ctrl+F. Tous les raccourcis sont désactivés à l'intérieur des champs de texte, pour ne jamais gêner la saisie.