Pipeline de deteção de 4 camadas Padrões → Entidades → Expressões → Análise profunda, com fusão automática. Cada camada apanha o que as outras deixam escapar.
O promptShield encadeia quatro camadas de deteção complementares. Os Padrões apanham dados estruturados, como números de telefone, números de segurança social e IBAN, com precisão quase perfeita. As Entidades usam modelos transformer para identificar dados sensíveis dependentes do contexto, como nomes, organizações e moradas. As Expressões permitem-lhe assinalar qualquer palavra ou frase específica — nomes de clientes, códigos de projeto, identificadores internos. A Análise profunda acrescenta uma passagem opcional por LLM para os casos-limite que as outras camadas deixam escapar. Os resultados de todas as camadas são automaticamente fundidos e desduplicados. 14 modelos de deteção de entidades Encontra nomes, organizações, localizações, termos médicos e dezenas de outros tipos de dados sensíveis dependentes do contexto — do género que a correspondência por padrões, por si só, não consegue apanhar. Escolha entre 14 modelos especializados ou deixe o modo Automático escolher o melhor. Cada modelo é analisado em busca de código malicioso antes do lançamento.
Selecione o modelo de entidades adequado ao seu caso de utilização. O Piiranha lida com vários idiomas numa só passagem. O modelo English Comprehensive deteta 54 tipos de dados sensíveis, incluindo números de registo médico, contas financeiras e identificadores de processos judiciais. O modelo médico está otimizado para documentos clínicos. Os modelos específicos de cada idioma oferecem maior precisão para texto em francês, alemão, espanhol, italiano, português e neerlandês. Cada modelo de entidades é também analisado estaticamente em busca de código malicioso com o picklescan antes de ser publicado — o pipeline de compilação recusa-se a lançar qualquer modelo que falhe a análise, pelo que o que chega ao seu dispositivo foi verificado como seguro para carregar. Padrões integrados e personalizados Padrões integrados para números de segurança social, cartões de crédito, IBAN, telefones, números de empresa e mais, adaptados a 14 países. Crie os seus próprios com o construtor de blocos Simples ou o modo Avançado, além de um campo de testes ao vivo.
O promptShield inclui dezenas de padrões pré-construídos para os tipos de dados sensíveis mais comuns, localizados para 14 países. Precisa de algo personalizado? O modo Simples disponibiliza um construtor visual de blocos onde define padrões sem escrever uma única linha de código. O modo Avançado dá-lhe a sintaxe completa de padrões, com grupos de captura. Ambos os modos incluem um campo de testes ao vivo onde pode colar texto de exemplo e ver as correspondências realçadas em tempo real antes de as aplicar aos seus documentos. Execute um modelo GGUF local na sua GPU, ou ligue-se a qualquer API compatível com OpenAI (OpenAI, Claude, Groq, Mistral, Ollama, vLLM) para uma análise profunda e sensível ao contexto.
Para uma precisão de deteção máxima, acrescente uma camada de Análise profunda ao pipeline. Execute um modelo GGUF localmente na sua GPU para um processamento totalmente offline, ou ligue-se a qualquer endpoint de API compatível com OpenAI. O modelo analisa o texto no contexto, apanhando dados sensíveis subtis que os Padrões e as Entidades poderiam deixar escapar — referências implícitas, alcunhas ou identificadores específicos de um domínio. Configure a temperatura, o número máximo de tokens e os prompts de sistema para afinar o comportamento. Introduza palavras ou frases específicas a encontrar, cole a partir do Excel ou de CSV. Cada correspondência pode ser definida como Codificar ou Remover, com tolerância ajustável.
A Grelha de expressões permite-lhe especificar os termos exatos que quer detetar, perfeita para nomes de clientes, códigos de projeto ou designadores internos que a deteção automática poderia deixar escapar. Cole diretamente do Excel ou de CSV para introdução em massa. Cada termo pode ser definido como Codificar (reversível) ou Remover (ocultação permanente), e o controlo de tolerância determina quão exata tem de ser a correspondência do texto. Esta é a sua rede de segurança para dados específicos de um domínio que só você conhece.
Tolerância e sensibilidade Ajuste a agressividade da deteção com um controlo de tolerância, comutadores por tipo e um controlo de agrupamento de regiões para a forma como palavras próximas se juntam.
Afine a deteção às suas necessidades exatas. O controlo de tolerância determina com que agressividade o promptShield expande as correspondências para o contexto envolvente. Os comutadores por tipo permitem-lhe ativar ou desativar categorias específicas de dados sensíveis (por exemplo, detetar números de telefone mas ignorar nomes de organizações). O controlo de agrupamento de regiões determina como as palavras detetadas próximas se juntam numa única região, importante para nomes e moradas com várias palavras. Padrões específicos por país para os EUA, Reino Unido, Canadá, Austrália, França, Alemanha, Espanha, México, Itália, Países Baixos, Bélgica, Portugal, Brasil e Suíça — incluindo números de empresa, documentos de identificação nacionais e identificadores fiscais próprios de cada país.
Cada perfil de país inclui padrões localizados para documentos de identificação nacionais (SSN, NI number, SIN, TFN, NIR, etc.), identificadores fiscais, números de registo comercial, códigos postais, formatos de telefone, números de saúde e muito mais. Quando seleciona um perfil de país, o motor de deteção é configurado com os padrões certos. O modo Automático deteta o país provável a partir do conteúdo do documento e ativa o perfil correspondente. Os dados sensíveis detetados propagam-se automaticamente por todas as páginas, incluindo correspondência parcial de nomes de organizações e unificação de tipos para garantir consistência.
Quando o promptShield deteta um nome na página 1, encontra e assinala automaticamente cada ocorrência desse nome em todas as outras páginas, mesmo com ligeiras variações (por exemplo, «Smith & Associates» vs. «Smith & Assoc.»). A unificação de tipos garante que, se uma entidade for classificada como PESSOA numa página, mantém essa classificação em todo o lado. Isto garante uma codificação consistente em todo o documento.
Ferramentas visuais de região Ferramentas de ponteiro, laço e desenho para selecionar e criar regiões. Junte, divida, reclassifique ou elimine com suporte completo de anular/refazer.
Ferramentas interativas permitem-lhe gerir visualmente as regiões detetadas na tela do documento. Use o ponteiro para selecionar regiões existentes, o laço para selecionar várias regiões de uma vez, ou a ferramenta de desenho para marcar manualmente as áreas que a IA deixou escapar. Clique com o botão direito em qualquer região para a juntar, dividir, reclassificar o tipo de dado sensível ou eliminar. Todas as ações suportam anular/refazer, pelo que pode experimentar à vontade sem perder trabalho. Guarde e carregue configurações de deteção com nome (tolerância, tipos ativados, expressões) para reutilizar em vários documentos.
Crie modelos de deteção para tipos de documento recorrentes. Um modelo capta toda a sua configuração de deteção: nível de tolerância, tipos de dados sensíveis ativados, expressões, padrões personalizados e seleção do modelo de entidades. Guarde os modelos com nomes descritivos, como «Contratos jurídicos» ou «Registos médicos», e aplique-os instantaneamente a novos documentos. Isto elimina a configuração repetitiva e garante um processamento consistente em toda a sua equipa. Escolha por região: codificar (substituição reversível) ou remover (ocultação permanente com caixa preta). Aplique em lote ou um de cada vez.
Nem todos os dados sensíveis precisam do mesmo tratamento. A codificação substitui os dados por códigos reversíveis, para que os possa restaurar mais tarde, após o processamento pela IA. A remoção oculta os dados de forma permanente com uma caixa preta, ideal para informação que nunca deve poder ser recuperada. Defina a predefinição por tipo de dado sensível, ou substitua regiões individuais. A seleção em lote permite-lhe alterar o modo de dezenas de regiões de uma só vez. Filtragem de ruído e confiança Filtros de ruído integrados reduzem os falsos positivos nos tipos Organização, Localização, Pessoa e Morada. Cada deteção inclui uma pontuação de confiança.
A deteção de entidades pode, por vezes, ser demasiado agressiva, assinalando palavras comuns como organizações ou localizações genéricas como dados sensíveis. O promptShield inclui filtros de ruído integrados que suprimem os falsos positivos mais comuns de cada tipo de entidade. Cada deteção tem também uma pontuação de confiança, permitindo-lhe identificar rapidamente as correspondências incertas que merecem revisão manual. O resultado é uma deteção mais limpa, com menos falsos positivos logo de início. Supressão de metadados e dados ocultos Todos os metadados do documento, campos ocultos, alterações registadas, objetos incorporados e conteúdo invisível são automaticamente removidos durante o processamento, garantindo que nenhum dado sensível escapa por canais não visíveis.
Os documentos contêm muitas vezes dados sensíveis ocultos que não estão visíveis na página: nomes de autores nos metadados, coordenadas GPS nas imagens, histórico de revisões com alterações registadas, comentários, campos de texto ocultos e objetos incorporados. O promptShield remove automaticamente tudo isto durante o processamento. Isto evita o cenário comum em que um utilizador oculta cuidadosamente o texto visível, mas se esquece dos metadados que revelam a mesma informação. Atalhos para utilizadores avançados Reveja e proteja documentos sem tocar no rato. Mude de ferramenta, atue sobre regiões, navegue entre páginas e anule — tudo a partir do teclado.
Mudança de ferramenta: V (ponteiro), S (laço), D (desenho), Espaço (alternar com a última ferramenta). Ações sobre regiões: T (codificar a seleção), D ou Backspace (remover a seleção), Delete (eliminar uma região ou eliminar em lote). Navegação: Tab / Shift+Tab para percorrer as regiões pendentes, setas Esquerda / Direita para mudar de página. Zoom: + / - / 0 (repor). Seleção: Ctrl+A para selecionar todas as regiões da página. Área de transferência: Ctrl+C / Ctrl+V para copiar e colar regiões entre páginas. Anular/Refazer: Ctrl+Z / Ctrl+Shift+Z. Painel de deteção: Ctrl+F. Todos os atalhos são desativados dentro de campos de texto, para que nunca interfiram com a escrita.