Respuesta corta: a veces. Y en qué caso se encuentra depende, casi por completo, de usted.
Es una de las preguntas más buscadas sobre las herramientas de IA, y merece una respuesta de verdad en lugar de un encogimiento de hombros o un susto. La versión honesta es que «seguro» no es una propiedad de ChatGPT — es una propiedad de lo que pega, de la cuenta en la que lo pega y de las obligaciones que le vinculan cuando lo hace. Acierte en esas tres y el riesgo es insignificante. Falle en ellas y puede incumplir un contrato, una normativa y un deber profesional con una sola pulsación de tecla.
Así se sabe en qué situación se encuentra realmente.
Qué significa aquí «seguro»
La gente suele querer decir una de dos cosas distintas con esta pregunta, y confundirlas es donde empieza la confusión:
- «¿Se filtrará el contenido o se usará indebidamente?» — una pregunta sobre la seguridad y el tratamiento de datos del proveedor.
- «¿Tengo permitido hacer esto?» — una pregunta sobre sus contratos, su regulador y sus deberes profesionales.
La primera se le escapa en gran medida. La segunda depende enteramente de usted — y es la que mete a la gente en problemas. Un proveedor de IA perfectamente seguro no hace que sea lícito enviar allí los datos personales de un cliente sin un fundamento para hacerlo.
Las tres cosas que lo deciden
1. Qué contiene realmente el documento
Es la variable que más importa y la más fácil de ignorar con un plazo encima. Un borrador de artículo, un documento público, sus propias notas de reunión sin ningún nombre — pegue sin miedo. Un contrato firmado, un historial médico, un currículum, un extracto bancario, una lista de clientes — eso son datos personales sobre personas reales que no aceptaron que se enviaran a un tercero.
La trampa es que los documentos rara vez anuncian de qué tipo son. Una hoja de cálculo «aburrida» tiene nombres y sueldos en la columna C. Una plantilla que está reutilizando todavía conserva la dirección del último cliente en el pie de página. El hábito seguro es presumir que un documento real contiene identificadores hasta que haya confirmado que no.
2. La cuenta en la que está pegando
El tratamiento de datos difiere de forma acusada según la modalidad, y la mayoría de la gente no sabe en cuál está:
- Las cuentas gratuitas y personales permiten en general al proveedor usar sus conversaciones para mejorar sus modelos. El documento que ha pegado se convierte en material apto para el entrenamiento.
- Las cuentas Team / Enterprise / API suelen venir con el compromiso de no entrenar con sus datos y con condiciones de tratamiento más fuertes — pero ese «suelen» pesa de verdad en la frase. Tiene que estar realmente en esa modalidad, con esos ajustes, para que se aplique.
- En cualquier caso, los datos salen igualmente de su dispositivo y se procesan en los servidores de otra persona, a menudo más allá de las fronteras. «No se usa para el entrenamiento» no es lo mismo que «nunca salió de su control».
Y las políticas cambian. La modalidad de la que está seguro hoy es la modalidad tal como se describía la última vez que leyó las condiciones.
3. A qué está obligado
Si el documento contiene datos personales de otras personas, la ley y sus contratos puede que ya le obliguen, por muy seguro que sea la herramienta. Conforme al RGPD, usted es el responsable del tratamiento; enviar datos personales a un proveedor de IA lo convierte en un encargado del tratamiento, lo que exige una base legal y, por lo general, un acuerdo de tratamiento de datos. La mayoría de los acuerdos de confidencialidad prohíben revelar datos de un cliente a «terceros» — y un proveedor de IA es un tercero. Abogados, médicos, contables y personal de recursos humanos tienen deberes de confidencialidad que existen por completo al margen de la política de privacidad de cualquier proveedor.
Profundizamos en exactamente lo que está en juego en lo que arriesgan de verdad los profesionales cuando pegan documentos de clientes en un chatbot.
Qué le ocurre de verdad al texto que pega
Conviene ser concreto. Cuando pega un documento en un chatbot web, el texto viaja por internet hasta la nube del proveedor, se almacena al menos de forma transitoria, lo procesa el modelo y — según su modalidad — puede conservarse, muestrearse para revisión humana de calidad o usarse para entrenar futuros modelos. Incluso cuando el entrenamiento está desactivado, el contenido ha salido igualmente de su dispositivo y ha entrado en sistemas que usted no controla ni puede auditar.
De ese hueco trata en realidad la pregunta. No es si OpenAI es de fiar — es si «salir del dispositivo siquiera» es aceptable para este contenido concreto, bajo sus obligaciones concretas.
Cuándo probablemente no hay problema
- El contenido ya es público, o solo suyo, sin terceros identificables dentro.
- Ha retirado — o nunca incluyó — nombres, direcciones, números de cuenta, identificadores y otros datos identificativos.
- Está en una modalidad sin entrenamiento y el contenido no conlleva ninguna obligación contractual o normativa de confidencialidad.
Cuándo sí lo hay
- El documento identifica a personas reales que no consintieron — clientes, pacientes, empleados, candidatos.
- Está cubierto por un acuerdo de confidencialidad, una cláusula de confidencialidad o un deber profesional.
- No está seguro de en qué modalidad de cuenta está, ni de qué dicen sus condiciones actuales.
- Le incomodaría explicar la subida a la persona a la que se refieren los datos. Ese instinto suele tener razón.
Una comprobación de 10 segundos antes de pegar
- ¿De quién son estos datos? Si la respuesta incluye a alguien que no es usted, vaya más despacio.
- ¿Hay identificadores dentro? Nombres, direcciones, números, fechas de nacimiento, identificadores.
- ¿Tengo permitido compartirlo? Consulte el acuerdo de confidencialidad y su regulador, no la política del proveedor.
- ¿La IA necesita de verdad las identidades para ayudarme? Casi siempre: no.
Ese último punto es la llave que abre todo lo demás.
El paso que deja la pregunta sin sentido
El modelo no necesita saber que la contraparte es «Acme GmbH, Friedrichstraße 123, Berlín» para analizar la estructura de un contrato, resumir un informe o redactar una respuesta. Necesita la lógica, el idioma, la forma de la cosa — no las identidades. Así que retírelas antes de que el texto salga siquiera de su dispositivo.
Anonimice el documento, sustituyendo los nombres por [PERSON_1], las direcciones por [ADDRESS_1], los números de cuenta por [IBAN_1], y luego pegue la versión anonimizada. El análisis vuelve igual de afilado, y después usted vuelve a asignar los tokens a los originales. Ahora las preguntas incómodas — en qué modalidad estoy, mi acuerdo de confidencialidad cubre esto, cuál es la política de conservación del proveedor — sencillamente no se aplican, porque ningún dato personal salió de su dispositivo en primer lugar.
Es el giro del que escribimos en por qué la protección de datos personales cambia por completo cuando la IA entra en juego: deja de intentar controlar la base de datos y empieza a controlar lo que cruza la frontera hacia la nube.
Así que: ¿es seguro pegar documentos en ChatGPT? Si los ha anonimizado primero, sí — de verdad. Si no, en realidad no está preguntando si es seguro. Está preguntando si lo van a pillar.