Blog
Benchmark, metodologia, note di ingegneria.
Come oscurare i dati personali nei PDF legali senza caricarli nel cloud
Caricare documenti riservati in uno strumento di oscuramento online mette una copia dei dati confidenziali del tuo cliente sui server di qualcun altro. Ecco come oscurare correttamente i dati personali nei PDF legali — sulla tua macchina, con il testo sottostante davvero rimosso, non solo nascosto dietro un rettangolo nero.
Leggi l'articoloL'oscuramento reversibile spiegato: come la tokenizzazione ti permette di annullare l'oscuramento di un documento
L'oscuramento reversibile sostituisce ogni nome o identificativo con un codice stabile e conserva sulla tua macchina la mappa codice-valore, così puoi condividere un documento con le identità rimosse e decodificarlo in seguito. Ecco come funziona la tokenizzazione, quando usarla al posto dell'oscuramento permanente e perché il punto in cui è conservata la chiave è ciò che decide tutto.
Leggi l'articoloAnonimizzazione dei documenti secondo il GDPR: cosa conta davvero come «anonimizzato» (e cosa no)
Secondo il GDPR, un dato è davvero anonimizzato solo se nessuno può realisticamente re-identificare la persona — e a quel punto esce completamente dall'ambito del regolamento. Se conservi una corrispondenza, l'hai soltanto pseudonimizzato, e resta pienamente soggetto al regolamento. Ecco la distinzione che la maggior parte degli strumenti di anonimizzazione confonde, e perché è importante per la tua conformità.
Leggi l'articoloCome oscurare PDF e immagini scansionati (dove l'oscuramento del testo ordinario fallisce)
Un PDF scansionato è un'immagine, non testo — così gli strumenti di oscuramento basati sul testo non trovano nulla e in silenzio si lasciano sfuggire tutto. Ecco la pipeline basata sull'OCR che oscura davvero documenti e immagini scansionati, e perché farlo sul dispositivo conta più di tutto per i tuoi file più sensibili.
Leggi l'articoloPerché ci siamo costruiti il nostro Demo Studio — e cosa significa per il SaaS che affittiamo
Siamo partiti da uno strumento preconfezionato per i video dimostrativi. Due temi, sette lingue e un'interfaccia che cambia ogni settimana l'hanno mandato in crisi. Così abbiamo costruito il nostro — e il fatto che ci siamo riusciti conta più dello strumento stesso.
Leggi l'articoloDove si colloca promptShield: una mappa di come le aziende proteggono i dati personali — e la lacuna che colmiamo
Le aziende proteggono i dati personali in quattro grandi modi — piattaforme di governance, API di oscuramento nel cloud, oscuramento gestito e mascheramento manuale. Ognuno è pensato per una forma di problema diversa. Ecco la mappa onesta, e la lacuna precisa per cui è costruito promptShield: un numero ridotto di documenti ad alto valore per i quali una persona deve poter mettere la faccia.
Leggi l'articoloPerché abbiamo costruito il nostro motore di rilevamento dei dati personali invece di adottare Presidio
Presidio è un'eccellente cassetta degli attrezzi. Abbiamo comunque scritto il nostro motore di rilevamento — perché ciò che consegniamo è un PDF delimitato sul portatile di qualcuno, non un flusso di testo in una pipeline nel cloud. La tesi architetturale, raccontata con franchezza.
Leggi l'articoloUna macchina non può essere responsabile. Tu sì — ed è per questo che un umano resta nel circuito
Essere responsabili significa essere disposti a pagarne il prezzo quando le cose vanno male — e una macchina non ha nulla in gioco da perdere. Nel momento in cui garantisci ciò che produce un'IA, non puoi più farlo alla cieca. È questa singola esigenza a tenere un umano nel circuito dell'anonimizzazione responsabile.
Leggi l'articoloÈ prudente incollare documenti in ChatGPT?
Risposta breve: a volte — e in quale caso vi trovate dipende interamente da voi. Una guida pratica a ciò che determina il rischio, a ciò che accade davvero al testo che incollate, e all'unico passo che rende la domanda priva di oggetto.
Leggi l'articoloA chi condivide di nascosto documenti di clienti con un chatbot
Gli strumenti di IA rendono l'esposizione di dati riservati senza alcuno sforzo — e le conseguenze non sono né teoriche né lontane. Ecco ciò che i professionisti rischiano davvero quando incollano documenti di clienti in ChatGPT, Claude o Gemini.
Leggi l'articoloLa protezione dei dati personali appare completamente diversa quando l'IA entra in gioco
Per 30 anni, proteggere i dati personali ha significato controllare chi poteva raggiungere il database. Gli strumenti di IA hanno mandato in frantumi quel modello aprendo un percorso senza attrito dai documenti controllati al trattamento esterno nel cloud. Ecco ciò che richiede il nuovo approccio.
Leggi l'articoloAbbiamo confrontato il nostro rilevamento dei dati personali con Microsoft Presidio — ecco cosa abbiamo imparato
Un benchmark riproducibile e diretto su 14 documenti PDF in 7 lingue europee. L'installazione di default di Microsoft Presidio emette 666 rilevazioni; promptShield ne emette 252 sullo stesso corpus. Gran parte dello scarto non è capacità — è rumore che noi filtriamo e Presidio no.
Leggi l'articolo