Sécurité de l'IA
· 9 min de lecture

Est-il prudent de coller des documents dans ChatGPT ?

Réponse courte : parfois. Et le cas dans lequel vous vous trouvez ne dépend, à peu de chose près, que de vous.

C'est l'une des questions les plus recherchées au sujet des outils d'IA, et elle mérite une vraie réponse plutôt qu'un haussement d'épaules ou une mise en garde alarmiste. La version honnête, c'est que la « sécurité » n'est pas une propriété de ChatGPT — c'est une propriété de ce que vous collez, du compte dans lequel vous le collez, et des obligations qui vous lient quand vous le faites. Réunissez ces trois conditions et le risque devient négligeable. Manquez-en une et vous pouvez enfreindre un contrat, une réglementation et un devoir déontologique d'une seule frappe au clavier.

Voici comment savoir dans quelle situation vous êtes réellement.

Ce que « sûr » veut dire ici

Les gens entendent généralement deux choses bien différentes par cette question, et c'est en les confondant que naît la confusion :

  • « Le contenu va-t-il fuiter ou être détourné ? » — une question sur la sécurité et le traitement des données chez le fournisseur.
  • « Ai-je le droit de faire cela ? » — une question sur vos contrats, votre régulateur et vos devoirs professionnels.

La première vous échappe en grande partie. La seconde dépend entièrement de vous — et c'est elle qui met les gens en difficulté. Un fournisseur d'IA parfaitement sécurisé ne rend pas pour autant licite l'envoi des données personnelles d'un client sans fondement pour le faire.

Les trois choses qui tranchent la question

1. Ce que contient réellement le document

C'est la variable la plus déterminante, et la plus facile à négliger dans l'urgence. Un brouillon d'article, un document public, vos propres notes de réunion sans aucun nom — collez sans crainte. Un contrat signé, un dossier médical, un CV, un relevé bancaire, une liste de clients — voilà des données personnelles concernant de vraies personnes qui n'ont pas accepté qu'on les transmette à un tiers.

Le piège, c'est que les documents annoncent rarement de quel type ils relèvent. Un tableur « banal » comporte des noms et des salaires en colonne C. Un modèle que vous réutilisez garde encore l'adresse du dernier client en pied de page. La bonne habitude consiste à présumer qu'un document réel contient des identifiants tant que vous n'avez pas vérifié le contraire.

2. Le compte dans lequel vous collez

Le traitement des données varie nettement selon la formule, et la plupart des gens ignorent laquelle est la leur :

  • Les comptes gratuits et personnels autorisent en général le fournisseur à utiliser vos conversations pour améliorer ses modèles. Le document que vous avez collé devient une matière exploitable pour l'entraînement.
  • Les comptes Team / Entreprise / API s'accompagnent généralement d'un engagement de ne pas s'entraîner sur vos données et de conditions plus protectrices — mais le « généralement » pèse lourd dans cette phrase. Encore faut-il être réellement sur cette formule, avec ces réglages, pour que cela s'applique.
  • Dans tous les cas, les données quittent quand même votre machine et sont traitées sur les serveurs d'autrui, souvent au-delà des frontières. « Non utilisé pour l'entraînement » n'équivaut pas à « n'a jamais échappé à votre contrôle ».

Et les politiques évoluent. La formule dont vous êtes certain aujourd'hui, c'est la formule telle qu'elle était décrite la dernière fois que vous avez lu les conditions.

3. Ce à quoi vous êtes tenu

Si le document contient les données personnelles d'autrui, la loi et vos contrats vous contraignent peut-être déjà, quelle que soit la sécurité de l'outil. Au regard du RGPD, vous êtes le responsable du traitement ; envoyer des données personnelles à un fournisseur d'IA en fait un sous-traitant, ce qui exige une base légale et, le plus souvent, un accord de traitement des données. La plupart des accords de confidentialité interdisent de communiquer les données d'un client à des « tiers » — et un fournisseur d'IA est un tiers. Avocats, médecins, experts-comptables et professionnels des RH sont tenus à des devoirs de confidentialité qui existent en dehors de toute politique de confidentialité d'un prestataire.

Nous avons détaillé précisément ce qui est en jeu dans ce que risquent réellement les professionnels qui collent des documents clients dans un chatbot.

Ce qu'il advient réellement du texte que vous collez

Il vaut mieux être concret. Quand vous collez un document dans un chatbot web, le texte transite par Internet jusqu'au cloud du fournisseur, y est stocké au moins de façon transitoire, est traité par le modèle, et — selon votre formule — peut être conservé, échantillonné pour relecture humaine ou utilisé pour entraîner de futurs modèles. Même lorsque l'entraînement est désactivé, le contenu a quand même quitté votre appareil pour entrer dans des systèmes que vous ne contrôlez pas et ne pouvez pas auditer.

C'est de cet écart que la question parle vraiment. Il ne s'agit pas de savoir si OpenAI est digne de confiance — mais si le simple fait d'« avoir quitté votre appareil » est acceptable pour ce contenu précis, au regard de vos obligations précises.

Quand c'est probablement sans danger

  • Le contenu est déjà public, ou n'appartient qu'à vous, sans aucun tiers identifiable.
  • Vous avez retiré — ou n'avez jamais inclus — noms, adresses, numéros de compte, identifiants et autres données identifiantes.
  • Vous êtes sur une formule sans entraînement et le contenu ne porte aucune obligation contractuelle ou réglementaire de confidentialité.

Quand ça ne l'est pas

  • Le document identifie de vraies personnes qui n'ont pas consenti — clients, patients, salariés, candidats.
  • Il est couvert par un accord de confidentialité, une clause de confidentialité ou un devoir déontologique.
  • Vous n'êtes pas certain de la formule de votre compte, ni de ce que disent ses conditions actuelles.
  • Vous seriez mal à l'aise d'expliquer ce téléversement à la personne que les données concernent. Cet instinct a généralement raison.

Une vérification de 10 secondes avant de coller

  1. À qui appartiennent ces données ? Si la réponse inclut quelqu'un d'autre que vous, ralentissez.
  2. Contiennent-elles des identifiants ? Noms, adresses, numéros, dates de naissance, identifiants.
  3. Ai-je le droit de les partager ? Vérifiez l'accord de confidentialité et votre régulateur, pas la politique du prestataire.
  4. L'IA a-t-elle vraiment besoin des identités pour m'aider ? Presque toujours : non.

Ce dernier point est la clé qui débloque tout le reste.

L'étape qui rend la question sans objet

Le modèle n'a pas besoin de savoir que la contrepartie est « Acme GmbH, Friedrichstraße 123, à Berlin » pour analyser la structure d'un contrat, résumer un rapport ou rédiger une réponse. Il a besoin de la logique, de la langue, de la forme de la chose — pas des identités. Alors retirez-les avant que le texte ne quitte votre machine.

Anonymisez le document en remplaçant les noms par [P0ABCD], les adresses par [A1WXYZ], les numéros de compte par [B2KLMN], puis collez la version anonymisée. L'analyse revient tout aussi fine, et vous rétablissez ensuite la correspondance des jetons avec les originaux. Désormais, les questions embarrassantes — quelle est ma formule, mon accord de confidentialité couvre-t-il ce cas, quelle est la durée de conservation du fournisseur — ne se posent tout simplement plus, puisque aucune donnée personnelle n'a quitté votre appareil au départ.

C'est le basculement que nous décrivions dans pourquoi la protection des données personnelles change du tout au tout dès que l'IA entre en jeu : vous cessez de vouloir contrôler la base de données pour contrôler ce qui franchit la frontière vers le cloud.

Alors : est-il prudent de coller des documents dans ChatGPT ? Si vous les avez anonymisés au préalable, oui — réellement. Sinon, vous ne demandez pas vraiment si c'est sûr. Vous demandez si vous allez vous faire prendre.

Questions fréquentes

Un compte ChatGPT Enterprise rend-il sûr le collage de données clients ?

Il règle un problème et laisse le plus difficile entier. Les offres Enterprise et API s’accompagnent généralement d’un engagement de ne pas entraîner les modèles sur vos contenus et de conditions de conservation plus strictes, ce qui traite la réutilisation. Elles ne vous donnent pas pour autant de base légale pour transférer les données personnelles d’autrui, et ne priment ni sur un accord de confidentialité ni sur le secret professionnel. Si un contrat de sous-traitance était nécessaire auparavant, il l’est toujours.

Si je supprime la conversation, l’envoi est-il annulé ?

Non. Supprimer une conversation la retire de votre historique et, selon la politique de la plupart des fournisseurs, des systèmes actifs dans un délai annoncé — mais la divulgation a eu lieu à l’instant de l’envoi. Des copies peuvent subsister dans les sauvegardes, et un contenu signalé pour contrôle de sécurité a pu être lu par une personne. La suppression est une bonne hygiène, pas une rétractation.

Coller le texte est-il plus sûr que téléverser le fichier ?

Pour le texte lui-même, aucune différence : le même contenu quitte votre machine dans les deux cas. Téléverser le fichier est souvent pire, car un document transporte ce que la page visible ne montre pas : métadonnées d’auteur et de révision, modifications suivies, commentaires, colonnes masquées d’un tableur, zones d’image rognées plutôt que supprimées. Si quelque chose doit partir, un texte relu expose moins que le fichier d’origine.

Cela vaut-il aussi pour Claude et Gemini ?

Oui. La question n'est pas quel assistant vous utilisez, mais si des données identifiantes quittent votre machine ; tout modèle hébergé a la même forme de réponse. Le remède est identique : le caviardage réversible, appliqué avant de coller.

Ça vous a été utile ? Dites-le-nous.

Partager