Sicurezza dell'IA
· 9 min di lettura

È prudente incollare documenti in ChatGPT?

Risposta breve: a volte. E in quale caso vi trovate dipende quasi interamente da voi.

È una delle domande più cercate sugli strumenti di IA, e merita una risposta vera invece di un'alzata di spalle o di un allarme. La versione onesta è che la «sicurezza» non è una proprietà di ChatGPT — è una proprietà di ciò che incollate, dell'account in cui lo incollate, e degli obblighi che vi vincolano quando lo fate. Mettete a posto questi tre elementi e il rischio è trascurabile. Sbagliateli e potete violare un contratto, una normativa e un dovere professionale con una sola battuta sulla tastiera.

Ecco come capire in quale situazione siete davvero.

Cosa significa qui «sicuro»

Le persone di solito intendono una di due cose diverse con questa domanda, ed è confondendole che inizia la confusione:

  • «Il contenuto trapelerà o sarà usato in modo improprio?» — una domanda sulla sicurezza e sul trattamento dei dati da parte del fornitore.
  • «Ho il diritto di farlo?» — una domanda sui vostri contratti, sul vostro regolatore e sui vostri doveri professionali.

La prima vi sfugge in gran parte. La seconda dipende interamente da voi — ed è quella che mette le persone nei guai. Un fornitore di IA perfettamente sicuro non rende per ciò lecito inviargli i dati personali di un cliente senza un fondamento per farlo.

Le tre cose che decidono la questione

1. Cosa contiene realmente il documento

È la variabile più determinante, e la più facile da ignorare sotto scadenza. Una bozza di articolo, un atto pubblico, i vostri appunti di riunione senza alcun nome — incollate pure. Un contratto firmato, una cartella clinica, un CV, un estratto conto, un elenco di clienti — quelli sono dati personali di persone reali che non hanno acconsentito a che venissero inviati a un terzo.

La trappola è che i documenti raramente annunciano di che tipo sono. Un foglio di calcolo «noioso» ha nomi e stipendi nella colonna C. Un modello che state riutilizzando conserva ancora l'indirizzo dell'ultimo cliente nel piè di pagina. L'abitudine prudente è presumere che un documento reale contenga identificatori finché non avete verificato che non li contiene.

2. In quale account state incollando

Il trattamento dei dati varia nettamente per livello, e la maggior parte delle persone non sa su quale si trova:

  • Gli account gratuiti e personali in genere consentono al fornitore di usare le vostre conversazioni per migliorare i propri modelli. Il documento che avete incollato diventa materiale idoneo all'addestramento.
  • Gli account Team / Enterprise / API in genere prevedono l'impegno a non addestrare sui vostri dati e condizioni di trattamento più solide — ma quel «in genere» sta facendo un lavoro vero in questa frase. Dovete davvero trovarvi su quel livello, con quelle impostazioni, perché valga.
  • In entrambi i casi, i dati lasciano comunque il vostro dispositivo e sono trattati sui server di qualcun altro, spesso oltre i confini. «Non usato per l'addestramento» non è lo stesso di «non ha mai lasciato il vostro controllo».

E le politiche cambiano. Il livello di cui siete sicuri oggi è il livello com'era descritto l'ultima volta che avete letto le condizioni.

3. A cosa siete tenuti

Se il documento contiene i dati personali di altri, la legge e i vostri contratti potrebbero già vincolarvi a prescindere da quanto sia sicuro lo strumento. Ai sensi del GDPR siete il titolare del trattamento; inviare dati personali a un fornitore di IA ne fa un responsabile del trattamento, il che richiede una base giuridica e di solito un accordo sul trattamento dei dati. La maggior parte degli accordi di riservatezza vieta di comunicare i dati di un cliente a «terzi» — e un fornitore di IA è un terzo. Avvocati, medici, commercialisti e professionisti delle HR portano doveri di riservatezza che esistono interamente al di fuori di qualsiasi informativa sulla privacy di un fornitore.

Abbiamo approfondito esattamente ciò che è in gioco in ciò che i professionisti rischiano davvero quando incollano documenti di clienti in un chatbot.

Cosa accade davvero al testo che incollate

Conviene essere concreti. Quando incollate un documento in un chatbot web, il testo viaggia su Internet fino al cloud del fornitore, viene archiviato almeno in modo transitorio, viene elaborato dal modello, e — a seconda del vostro livello — può essere conservato, campionato per la revisione qualitativa da parte di esseri umani, o usato per addestrare modelli futuri. Anche dove l'addestramento è disattivato, il contenuto ha comunque lasciato il vostro dispositivo ed è entrato in sistemi che non controllate e non potete verificare.

È di questo scarto che la domanda parla davvero. Non è se OpenAI sia affidabile — è se «aver lasciato il vostro dispositivo» sia accettabile per questo contenuto specifico, secondo i vostri obblighi specifici.

Quando probabilmente va bene

  • Il contenuto è già pubblico, o solo vostro, senza alcun terzo identificabile.
  • Avete rimosso — o non avete mai incluso — nomi, indirizzi, numeri di conto, identificatori e altri dati identificativi.
  • Siete su un livello senza addestramento e il contenuto non porta alcun obbligo contrattuale o normativo di riservatezza.

Quando non va bene

  • Il documento identifica persone reali che non hanno acconsentito — clienti, pazienti, dipendenti, candidati.
  • È coperto da un accordo di riservatezza, da una clausola di riservatezza o da un dovere professionale.
  • Non siete certi del livello del vostro account, né di cosa dicano le sue condizioni attuali.
  • Sareste a disagio nello spiegare il caricamento alla persona a cui i dati si riferiscono. Quell'istinto di solito ha ragione.

Una verifica di 10 secondi prima di incollare

  1. Di chi sono questi dati? Se la risposta include qualcuno che non siete voi, rallentate.
  2. Ci sono identificatori? Nomi, indirizzi, numeri, date di nascita, identificativi.
  3. Ho il diritto di condividerli? Controllate l'accordo di riservatezza e il vostro regolatore, non l'informativa del fornitore.
  4. All'IA servono davvero le identità per aiutarmi? Quasi sempre: no.

Quest'ultimo punto è la chiave che sblocca tutto il resto.

Il passo che rende la domanda priva di oggetto

Al modello non serve sapere che la controparte è «Acme GmbH, Friedrichstraße 123, Berlino» per analizzare la struttura di un contratto, riassumere un report o redigere una risposta. Gli serve la logica, la lingua, la forma della cosa — non le identità. Quindi rimuovetele prima che il testo lasci il vostro dispositivo.

Anonimizzate il documento, sostituendo i nomi con [P0ABCD], gli indirizzi con [A1WXYZ], i numeri di conto con [B2KLMN], poi incollate la versione anonimizzata. L'analisi torna altrettanto acuta, e dopo riconducete i token agli originali. Ora le domande scomode — su quale livello sono, il mio accordo di riservatezza copre questo, qual è la politica di conservazione del fornitore — semplicemente non si pongono, perché nessun dato personale ha lasciato il vostro dispositivo in partenza.

È lo spostamento di cui abbiamo scritto in perché la protezione dei dati personali appare completamente diversa quando l'IA entra in gioco: smettete di provare a controllare il database e iniziate a controllare ciò che attraversa il confine verso il cloud.

Dunque: è prudente incollare documenti in ChatGPT? Se prima li avete anonimizzati, sì — davvero. Se non l'avete fatto, non state davvero chiedendo se sia sicuro. State chiedendo se vi beccheranno.

Domande frequenti

Un account ChatGPT Enterprise rende sicuro incollare dati dei clienti?

Risolve un problema e lascia intatto quello più difficile. I piani Enterprise e API prevedono di solito l’impegno a non addestrare i modelli sui tuoi contenuti e condizioni di conservazione più severe, il che riguarda il riutilizzo. Non ti danno però una base giuridica per trasferire dati personali altrui, e non prevalgono su un accordo di riservatezza né su un obbligo deontologico. Se prima serviva un contratto di responsabile del trattamento, serve ancora.

Se cancello la conversazione, il caricamento è annullato?

No. Cancellare una chat la rimuove dalla cronologia e, secondo le politiche della maggior parte dei fornitori, dai sistemi attivi entro un termine dichiarato — ma la comunicazione è avvenuta nel momento dell’invio. Copie possono restare nei backup, e un contenuto segnalato per la revisione di sicurezza potrebbe essere già stato letto da una persona. Cancellare è buona igiene, non una ritrattazione.

Incollare il testo è più sicuro che caricare il file?

Per il testo in sé non c’è differenza: lo stesso contenuto lascia la tua macchina in entrambi i casi. Caricare il file è spesso peggio, perché i documenti portano con sé ciò che la pagina visibile non mostra: metadati di autore e revisione, revisioni tracciate, commenti, colonne nascoste dei fogli di calcolo e aree di immagine ritagliate anziché eliminate. Se qualcosa deve partire, un testo riletto espone meno del file originale.

Vale anche per Claude e Gemini?

Sì. La domanda non è quale assistente usi, ma se dati identificativi lasciano il tuo computer, e ogni modello ospitato ha la stessa forma di risposta. Il rimedio è lo stesso: l'oscuramento reversibile, applicato prima di incollare.

Ti è stato utile? Faccelo sapere.

Condividi