Pipeline di rilevamento a 4 livelli Pattern → Entità → Espressioni → Analisi approfondita, con unione automatica. Ogni livello coglie ciò che gli altri si lasciano sfuggire.
promptShield concatena quattro livelli di rilevamento complementari. I Pattern colgono i dati strutturati come numeri di telefono, codici fiscali e IBAN con una precisione quasi perfetta. Le Entità usano modelli transformer per identificare dati sensibili dipendenti dal contesto come nomi, organizzazioni e indirizzi. Le Espressioni ti permettono di segnalare qualsiasi parola o frase specifica — nomi di clienti, codici di progetto, identificatori interni. L'Analisi approfondita aggiunge un passaggio LLM facoltativo per i casi limite che gli altri livelli non colgono. I risultati di tutti i livelli vengono uniti e deduplicati automaticamente. 14 modelli di rilevamento delle entità Trova nomi, organizzazioni, luoghi, termini medici e decine di altri tipi di dati sensibili dipendenti dal contesto — quelli che il solo riconoscimento dei pattern non riesce a cogliere. Scegli tra 14 modelli specializzati, oppure lascia che la modalità Auto scelga il migliore. Ogni modello viene analizzato alla ricerca di codice malevolo prima della pubblicazione.
Seleziona il modello di entità adatto al tuo caso d'uso. Piiranha gestisce più lingue in un solo passaggio. Il modello English Comprehensive rileva 54 tipi di dati sensibili, compresi numeri di cartella clinica, conti finanziari e identificativi di pratiche legali. Il modello medico è ottimizzato per i documenti clinici. I modelli specifici per lingua offrono una maggiore accuratezza sui testi in francese, tedesco, spagnolo, italiano, portoghese e olandese. Ogni modello di entità viene inoltre analizzato staticamente alla ricerca di codice malevolo con picklescan prima della pubblicazione — la pipeline di build si rifiuta di rilasciare qualsiasi modello che non superi l'analisi, così ciò che arriva sul tuo dispositivo è stato verificato come sicuro da caricare. Pattern integrati e personalizzati Pattern integrati per codici fiscali, carte di credito, IBAN, telefoni, partite IVA e altro ancora, su misura per 14 Paesi. Crea i tuoi con il costruttore a blocchi Semplice o la modalità Avanzata, più un'area di prova in tempo reale.
promptShield include decine di pattern predefiniti per i tipi di dati sensibili più comuni, localizzati per 14 Paesi. Hai bisogno di qualcosa di personalizzato? La modalità Semplice offre un costruttore visivo a blocchi con cui definisci i pattern senza scrivere codice. La modalità Avanzata ti dà accesso alla sintassi completa dei pattern con i gruppi di cattura. Entrambe le modalità includono un'area di prova in tempo reale in cui puoi incollare un testo di esempio e vedere le corrispondenze evidenziate al volo prima di applicarle ai tuoi documenti. Esegui un modello GGUF locale sulla tua GPU, oppure collegati a qualsiasi API compatibile con OpenAI (OpenAI, Claude, Groq, Mistral, Ollama, vLLM) per un'analisi approfondita e consapevole del contesto.
Per la massima accuratezza di rilevamento, aggiungi un livello di Analisi approfondita alla pipeline. Esegui un modello GGUF in locale sulla tua GPU per un'elaborazione completamente offline, oppure collegati a qualsiasi endpoint API compatibile con OpenAI. Il modello analizza il testo nel contesto, cogliendo dati sensibili sottili che i Pattern e le Entità potrebbero lasciarsi sfuggire — riferimenti impliciti, soprannomi o identificatori specifici di settore. Configura temperatura, numero massimo di token e prompt di sistema per regolarne il comportamento. Griglia delle espressioni Inserisci parole o frasi specifiche da trovare, incollale da Excel o CSV. Ogni corrispondenza può essere impostata su Codifica o Rimuovi, con tolleranza regolabile.
La Griglia delle espressioni ti permette di specificare i termini esatti che vuoi rilevare, perfetta per nomi di clienti, codici di progetto o sigle interne che il rilevamento automatico potrebbe lasciarsi sfuggire. Incolla direttamente da Excel o CSV per l'inserimento in blocco. Ogni termine può essere impostato su Codifica (reversibile) o Rimuovi (oscuramento permanente), e il cursore della tolleranza controlla quanto da vicino il testo deve corrispondere. È la tua rete di sicurezza per i dati specifici del tuo settore che conosci solo tu. Regola l'aggressività del rilevamento con un cursore di tolleranza, interruttori per tipo e un controllo del raggruppamento delle aree per stabilire come si uniscono le parole vicine.
Calibra il rilevamento sulle tue esigenze precise. Il cursore della tolleranza controlla quanto aggressivamente promptShield estende le corrispondenze al contesto circostante. Gli interruttori per tipo ti permettono di attivare o disattivare specifiche categorie di dati sensibili (ad es. rilevare i numeri di telefono ma saltare i nomi di organizzazioni). Il controllo del raggruppamento delle aree determina come le parole rilevate vicine si uniscono in aree singole, importante per nomi e indirizzi composti da più parole. Pattern specifici per Paese relativi a Stati Uniti, Regno Unito, Canada, Australia, Francia, Germania, Spagna, Messico, Italia, Paesi Bassi, Belgio, Portogallo, Brasile e Svizzera. Comprese partite IVA, documenti d'identità nazionali e codici fiscali propri di ciascun Paese.
Ogni profilo Paese include pattern localizzati per documenti d'identità nazionali (SSN, NI number, SIN, TFN, NIR, ecc.), codici fiscali, numeri di registrazione delle imprese, codici postali, formati telefonici, numeri sanitari e altro ancora. Quando selezioni un profilo Paese, il motore di rilevamento viene configurato con i pattern giusti. La modalità Auto rileva il Paese probabile dal contenuto del documento e attiva il profilo corrispondente. Propagazione tra le pagine I dati sensibili rilevati si propagano automaticamente su tutte le pagine, inclusi il riconoscimento parziale dei nomi di organizzazioni e l'unificazione dei tipi per garantire coerenza.
Quando promptShield rileva un nome a pagina 1, trova e contrassegna automaticamente ogni occorrenza di quel nome in tutte le altre pagine, anche con leggere variazioni (ad es. «Smith & Associates» rispetto a «Smith & Assoc.»). L'unificazione dei tipi garantisce che, se un'entità è classificata come PERSON in una pagina, mantenga quella classificazione ovunque. Questo garantisce una codifica coerente sull'intero documento.
Strumenti visivi per le aree Strumenti puntatore, lazo e disegno per selezionare e creare aree. Unisci, dividi, rietichetta o elimina con pieno supporto per annulla/ripeti.
Strumenti interattivi ti permettono di gestire visivamente le aree rilevate sulla tela del documento. Usa il puntatore per selezionare le aree esistenti, il lazo per selezionare più aree contemporaneamente, oppure lo strumento di disegno per contrassegnare manualmente le zone che l'IA ha mancato. Clicca col tasto destro su un'area per unirla, dividerla, riclassificarne il tipo di dato sensibile o eliminarla. Ogni azione supporta annulla/ripeti, così puoi sperimentare liberamente senza perdere il lavoro. Salva e carica configurazioni di rilevamento con nome (tolleranza, tipi attivati, espressioni) da riutilizzare tra i documenti.
Crea modelli di rilevamento per i tipi di documento ricorrenti. Un modello cattura l'intera configurazione di rilevamento: livello di tolleranza, tipi di dati sensibili attivati, espressioni, pattern personalizzati e scelta del modello di entità. Salva i modelli con nomi descrittivi come «Contratti legali» o «Cartelle cliniche» e applicali all'istante ai nuovi documenti. Questo elimina la configurazione ripetitiva e garantisce un'elaborazione coerente in tutto il tuo team. Scegli per ogni area: codifica (sostituzione reversibile) o rimuovi (oscuramento permanente con rettangolo nero). Applica in blocco o uno alla volta.
Non tutti i dati sensibili richiedono lo stesso trattamento. La codifica sostituisce i dati con codici reversibili, così potrai ripristinarli in seguito, dopo l'elaborazione dell'IA. La rimozione oscura i dati in modo permanente con un rettangolo nero, ideale per le informazioni che non devono mai essere recuperabili. Imposta il valore predefinito per tipo di dato sensibile, oppure modifica le singole aree. La selezione in blocco ti permette di cambiare la modalità per decine di aree in una sola volta. Filtraggio del rumore e affidabilità I filtri antirumore integrati riducono i falsi positivi per i tipi ORG, Luogo, Persona e Indirizzo. Ogni rilevamento include un punteggio di affidabilità.
Il rilevamento delle entità può a volte essere troppo aggressivo, segnalando parole comuni come organizzazioni o luoghi generici come dati sensibili. promptShield include filtri antirumore integrati che sopprimono i falsi positivi più comuni per ciascun tipo di entità. Ogni rilevamento porta inoltre con sé un punteggio di affidabilità, che ti permette di individuare rapidamente le corrispondenze incerte che meritano una revisione manuale. Il risultato è un rilevamento più pulito con meno falsi positivi fin da subito. Soppressione di metadati e dati nascosti Tutti i metadati del documento, i campi nascosti, le revisioni tracciate, gli oggetti incorporati e i contenuti invisibili vengono rimossi automaticamente durante l'elaborazione, garantendo che nessun dato sensibile trapeli attraverso canali non visibili.
I documenti contengono spesso dati sensibili nascosti che non sono visibili sulla pagina: nomi degli autori nei metadati, coordinate GPS nelle immagini, cronologia delle revisioni con modifiche tracciate, commenti, campi di testo nascosti e oggetti incorporati. promptShield rimuove automaticamente tutto questo durante l'elaborazione. Questo previene lo scenario comune in cui un utente oscura con cura il testo visibile ma si dimentica dei metadati che rivelano le stesse informazioni. Scorciatoie per utenti esperti Rivedi e proteggi i documenti senza toccare il mouse. Cambia strumento, agisci sulle aree, naviga tra le pagine e annulla — tutto da tastiera.
Cambio strumento: V (puntatore), S (lazo), D (disegno), Spazio (alterna con l'ultimo strumento). Azioni sulle aree: T (codifica la selezione), D o Backspace (rimuovi la selezione), Canc (elimina l'area o elimina in blocco). Navigazione: Tab / Maiusc+Tab per scorrere le aree in sospeso, frecce Sinistra / Destra per cambiare pagina. Zoom: + / - / 0 (reimposta). Selezione: Ctrl+A per selezionare tutte le aree della pagina. Appunti: Ctrl+C / Ctrl+V per copiare e incollare le aree tra le pagine. Annulla/Ripeti: Ctrl+Z / Ctrl+Maiusc+Z. Pannello di rilevamento: Ctrl+F. Tutte le scorciatoie sono disattivate all'interno dei campi di testo, così non interferiscono mai con la digitazione.