Canalización de detección de 4 capas Patrones → Entidades → Expresiones → Análisis profundo, con fusión automática. Cada capa detecta lo que las demás pasan por alto.
promptShield encadena cuatro capas de detección complementarias. Patrones detecta datos estructurados como números de teléfono, de la seguridad social e IBAN con una precisión casi perfecta. Entidades emplea modelos transformer para identificar datos sensibles que dependen del contexto, como nombres, organizaciones y direcciones. Expresiones le permite marcar cualquier palabra o frase concreta: nombres de clientes, códigos de proyecto, identificadores internos. Análisis profundo añade una pasada opcional con LLM para los casos límite que las demás capas no detectan. Los resultados de todas las capas se fusionan y se eliminan duplicados de forma automática. 14 modelos de detección de entidades Encuentra nombres, organizaciones, ubicaciones, términos médicos y decenas de otros tipos de datos sensibles que dependen del contexto, los que la coincidencia de patrones por sí sola no puede detectar. Elija entre 14 modelos especializados o deje que el modo Automático escoja el mejor. Cada modelo se analiza en busca de código malicioso antes de su publicación.
Seleccione el modelo de entidades que mejor se ajuste a su caso de uso. Piiranha gestiona varios idiomas en una sola pasada. El modelo Comprehensive en inglés detecta 54 tipos de datos sensibles, incluidos números de historia clínica, cuentas financieras e identificadores de casos jurídicos. El modelo médico está optimizado para documentos clínicos. Los modelos específicos por idioma ofrecen mayor precisión para textos en francés, alemán, español, italiano, portugués y neerlandés. Cada modelo de entidades también se analiza estáticamente con picklescan en busca de código malicioso antes de publicarse: la canalización de compilación se niega a distribuir cualquier modelo que no supere el análisis, de modo que lo que llega a su dispositivo se ha verificado como seguro de cargar. Patrones integrados y personalizados Patrones integrados para números de la seguridad social, tarjetas de crédito, IBAN, teléfonos, números de empresa y más, adaptados a 14 países. Cree los suyos con el constructor de bloques Simple o el modo Avanzado, con un entorno de pruebas en vivo.
promptShield incluye decenas de patrones predefinidos para los tipos de datos sensibles más habituales, localizados para 14 países. ¿Necesita algo a medida? El modo Simple ofrece un constructor visual de bloques donde define patrones sin escribir código. El modo Avanzado le da la sintaxis completa de patrones con grupos de captura. Ambos modos incluyen un entorno de pruebas en vivo donde puede pegar texto de ejemplo y ver las coincidencias resaltadas en tiempo real antes de aplicarlas a sus documentos. Ejecute un modelo GGUF local en su GPU o conéctese a cualquier API compatible con OpenAI (OpenAI, Claude, Groq, Mistral, Ollama, vLLM) para un análisis profundo y consciente del contexto.
Para una precisión de detección máxima, añada una capa de Análisis profundo a la canalización. Ejecute un modelo GGUF localmente en su GPU para un procesamiento totalmente sin conexión o conéctese a cualquier endpoint de API compatible con OpenAI. El modelo analiza el texto en contexto y detecta datos sensibles sutiles que Patrones y Entidades podrían pasar por alto: referencias implícitas, apodos o identificadores específicos del dominio. Configure la temperatura, el máximo de tokens y las instrucciones del sistema para ajustar su comportamiento. Cuadrícula de expresiones Introduzca palabras o frases concretas que buscar, péguelas desde Excel o CSV. Cada coincidencia puede configurarse como Codificar o Eliminar, con una tolerancia ajustable.
La cuadrícula de expresiones le permite especificar términos exactos que quiere detectar, ideal para nombres de clientes, códigos de proyecto o designadores internos que la detección automática podría pasar por alto. Pegue directamente desde Excel o CSV para una entrada masiva. Cada término puede configurarse como Codificar (reversible) o Eliminar (ocultación permanente), y el control de tolerancia regula cuán parecido debe ser el texto para coincidir. Es su red de seguridad para los datos específicos de su dominio que solo usted conoce.
Tolerancia y sensibilidad Ajuste la intensidad de la detección con un control de tolerancia, conmutadores por tipo y un control de agrupación de regiones que decide cómo se fusionan las palabras cercanas.
Ajuste la detección exactamente a sus necesidades. El control de tolerancia regula con qué intensidad promptShield amplía las coincidencias al contexto circundante. Los conmutadores por tipo le permiten activar o desactivar categorías concretas de datos sensibles (p. ej. detectar números de teléfono pero omitir nombres de organizaciones). El control de agrupación de regiones determina cómo se fusionan en una sola región las palabras detectadas cercanas, algo importante para nombres y direcciones de varias palabras. Patrones específicos por país para Estados Unidos, Reino Unido, Canadá, Australia, Francia, Alemania, España, México, Italia, Países Bajos, Bélgica, Portugal, Brasil y Suiza, incluidos números de empresa, documentos de identidad nacionales e identificadores fiscales propios de cada país.
Cada perfil de país incluye patrones localizados para documentos de identidad nacionales (SSN, NI number, SIN, TFN, NIR, etc.), identificadores fiscales, números de registro mercantil, códigos postales, formatos de teléfono, números sanitarios y más. Cuando selecciona un perfil de país, el motor de detección se configura con los patrones adecuados. El modo Automático detecta el país probable a partir del contenido del documento y activa el perfil correspondiente. Propagación entre páginas Los datos sensibles detectados se propagan automáticamente por todas las páginas, incluida la coincidencia parcial de nombres de organización y la unificación de tipos para mayor coherencia.
Cuando promptShield detecta un nombre en la página 1, encuentra y marca automáticamente cada aparición de ese nombre en todas las demás páginas, incluso con ligeras variaciones (p. ej. «Smith & Associates» frente a «Smith & Assoc.»). La unificación de tipos garantiza que, si una entidad se clasifica como PERSON en una página, mantenga esa clasificación en todas. Esto garantiza una codificación coherente en todo el documento.
Herramientas visuales de regiones Herramientas de puntero, lazo y dibujo para seleccionar y crear regiones. Fusione, divida, reetiquete o elimine con soporte completo de deshacer y rehacer.
Unas herramientas interactivas le permiten gestionar visualmente las regiones detectadas en el lienzo del documento. Use el puntero para seleccionar regiones existentes, el lazo para seleccionar varias a la vez o la herramienta de dibujo para marcar manualmente las zonas que la IA pasó por alto. Haga clic derecho en cualquier región para fusionar, dividir, reclasificar el tipo de dato sensible o eliminar. Cada acción admite deshacer y rehacer, así que puede experimentar con libertad sin perder trabajo. Guarde y cargue configuraciones de detección con nombre (tolerancia, tipos activados, expresiones) para reutilizarlas entre documentos.
Cree plantillas de detección para los tipos de documento recurrentes. Una plantilla captura toda su configuración de detección: nivel de tolerancia, tipos de datos sensibles activados, expresiones, patrones personalizados y selección del modelo de entidades. Guarde las plantillas con nombres descriptivos como «Contratos jurídicos» o «Historias clínicas» y aplíquelas al instante a documentos nuevos. Esto elimina la configuración repetitiva y garantiza un procesamiento coherente en todo su equipo. Elija por región: codificar (sustitución reversible) o eliminar (ocultación permanente con recuadro negro). Aplíquelo en lote o de una en una.
No todos los datos sensibles necesitan el mismo tratamiento. La codificación sustituye los datos por códigos reversibles para que pueda restaurarlos más tarde tras el procesamiento de la IA. La eliminación oculta los datos de forma permanente con un recuadro negro, ideal para información que nunca debería poder recuperarse. Establezca el valor predeterminado por tipo de dato sensible o anule regiones concretas. La selección múltiple le permite cambiar el modo de decenas de regiones a la vez. Filtrado de ruido y confianza Unos filtros de ruido integrados reducen los falsos positivos para los tipos ORG, Ubicación, Persona y Dirección. Cada detección incluye una puntuación de confianza.
La detección de entidades puede a veces resultar demasiado agresiva y marcar palabras comunes como organizaciones o ubicaciones genéricas como datos sensibles. promptShield incluye filtros de ruido integrados que suprimen los falsos positivos habituales de cada tipo de entidad. Cada detección lleva además una puntuación de confianza, lo que le permite identificar rápidamente las coincidencias dudosas que merecen una revisión manual. El resultado es una detección más limpia y con menos falsos positivos desde el primer momento. Supresión de metadatos y datos ocultos Todos los metadatos del documento, los campos ocultos, los cambios registrados, los objetos incrustados y el contenido invisible se eliminan automáticamente durante el procesamiento, garantizando que ningún dato sensible se filtre por canales no visibles.
Los documentos suelen contener datos sensibles ocultos que no se ven en la página: nombres de autor en los metadatos, coordenadas GPS en las imágenes, historial de revisiones con cambios registrados, comentarios, campos de texto ocultos y objetos incrustados. promptShield los elimina todos automáticamente durante el procesamiento. Esto evita el escenario habitual en el que un usuario oculta cuidadosamente el texto visible pero se olvida de los metadatos que revelan la misma información. Atajos para usuarios avanzados Revise y proteja documentos sin tocar el ratón. Cambie de herramienta, actúe sobre las regiones, navegue por las páginas y deshaga, todo desde el teclado.
Cambio de herramienta: V (puntero), S (lazo), D (dibujo), Espacio (alternar con la última herramienta). Acciones sobre regiones: T (codificar la selección), D o Retroceso (eliminar la selección), Supr (borrar una región o varias). Navegación: Tab / Mayús+Tab para recorrer las regiones pendientes, flechas Izquierda / Derecha para cambiar de página. Zoom: + / - / 0 (restablecer). Selección: Ctrl+A para seleccionar todas las regiones de la página. Portapapeles: Ctrl+C / Ctrl+V para copiar y pegar regiones entre páginas. Deshacer/Rehacer: Ctrl+Z / Ctrl+Mayús+Z. Panel de detección: Ctrl+F. Todos los atajos se desactivan dentro de los campos de texto para que nunca interfieran con la escritura.