¿Es seguro subir un documento con datos a ChatGPT?
Pegar una nómina para que te expliquen un concepto, subir un contrato para que te resuma las cláusulas o pasarle un informe a un asistente para entenderlo mejor se ha vuelto tan cómodo que casi nadie se detiene a mirar qué va dentro del archivo. El asistente responde bien, cierto, pero el documento ha salido entero de tu equipo con todo lo que llevaba, tu DNI, tu dirección, tu número de cuenta y a veces los datos de otras personas. Esta guía explica qué ocurre con lo que pegas, qué conviene quitar antes y cómo seguir aprovechando la IA sobre un texto que ya no te identifica.
Qué ocurre con el documento que pegas
Lo primero que conviene asumir es que el archivo sale de tu dispositivo y viaja a un servidor ajeno, donde queda asociado a tu cuenta y a la conversación. Qué sucede después depende del proveedor, del plan contratado y de los ajustes que tengas puestos, y esas políticas cambian con el tiempo, así que merece la pena leerlas en lugar de darlas por sabidas. Lo que no cambia es el punto de partida, que el envío ya se ha producido. Desactivar el entrenamiento o borrar la conversación afecta a lo que venga después, no al documento completo que ya salió de tu equipo.
Hay además un caso en el que la decisión no es solo tuya. Si el documento contiene datos de clientes, pacientes, empleados o de la otra parte de un contrato, esas personas confiaron en ti, y el RGPD pide tratarlos con la misma prudencia dentro de una IA que fuera de ella. Anonimizar antes de pegar es la forma más simple de resolverlo, porque lo que nunca sale no hay que justificarlo después.
El problema no es la IA, es mandar el documento entero
Casi ninguna consulta necesita el documento completo. Preguntas por una cláusula y envías doce páginas, quieres pulir la redacción de tu currículum y va con el DNI y el teléfono dentro, pides ayuda para cuadrar una nómina y va dentro el número de la Seguridad Social junto al IBAN. Es el mismo principio de minimización que aplicamos al entregar una copia a un tercero, dar solo lo necesario para la finalidad concreta, y aquí encaja todavía mejor, porque a la IA le sirve el texto y no tu identidad.
Marcadores en vez de tachones
Cuando el documento lo va a leer una persona, basta con tapar el dato. Cuando lo va a leer una IA conviene dar un paso más, porque un hueco en blanco le quita contexto y la empuja a conjeturar. La salida es sustituir cada dato por un marcador que diga de qué tipo era, [DNI_1] o [NOMBRE_2] en lugar de un rectángulo negro. El asistente entiende que ahí había un DNI, razona con normalidad sobre el documento y, como el mismo valor recibe siempre el mismo marcador, no pierde el hilo de quién es quién. Esa numeración por instancia es justo lo que evita el error contrario, que dos personas distintas acaben confundidas en una sola. Técnicamente esto es seudonimizar, y la diferencia con anonimizar del todo la contamos en la guía sobre anonimización o seudonimización.
Cómo lo hace Ofusca
Ofusca funciona en tu navegador y el documento no se sube a ningún servidor. Censuras lo que sobra, con la detección automática proponiéndote los datos personales que encuentra, y después «Exportar para IA» genera una versión del texto en Markdown, un formato de texto plano que cualquier asistente lee con soltura, con cada dato censurado sustituido por su marcador numerado. El contenido sale de la capa de texto del PDF o del OCR local, así que también sirve para un escaneo, y ocupa una fracción de los tokens que costaría subir el PDF. La cabecera del propio Markdown le pide al asistente que conserve los marcadores tal cual, sin traducirlos ni renumerarlos, que es lo que permite deshacer la sustitución a la vuelta.
Antes de llevarte el texto puedes repasarlo en la tabla de detecciones, que muestra cada marcador con su tipo, el valor que sustituye y cuántas veces aparece. Ahí corriges el tipo asignado, quitas una detección que sobre o añades a mano un dato que se haya escapado, y cada cambio regenera el texto y renumera los marcadores. La vista previa es además editable, así que puedes retocar a mano lo que quede suelto, y conviene dejarlo para el final porque cualquier cambio en la tabla regenera el texto y se lleva por delante esos retoques. Ten en cuenta que la tabla actúa solo sobre este texto, de modo que quitar una detección no destapa nada en el documento que exportes como PDF o PNG, y añadir un dato a mano tampoco lo censura allí.
Si además vas a necesitar los datos reales dentro de la respuesta, marca la casilla del fichero clave. Es un JSON que se descarga a tu equipo con la correspondencia entre cada marcador y su valor original, y puedes cifrarlo con una contraseña. Ese fichero y el propio diálogo de exportación son los dos únicos sitios donde vive el valor original, porque Ofusca no lo guarda en el navegador ni lo conserva junto al documento.
Recuperar los datos en la respuesta de la IA
El viaje de vuelta cierra el círculo, y el método es el mismo lo hagas con la herramienta que lo hagas. Si conservaste la correspondencia entre marcadores y valores, deshacer la sustitución sobre la respuesta es un buscar y reemplazar al revés, con dos precauciones. Revisa qué marcadores no aparecen, porque son la señal de que el modelo tocó o tradujo alguno por el camino, y no confundas números, porque [DNI_11] no es [DNI_1] por mucho que se parezcan. Los modelos además estropean marcadores con facilidad, pierden corchetes, cambian mayúsculas o alteran separadores, así que conviene buscar con manga ancha. En Ofusca ese paso es «Recuperar datos de la IA», que pega la respuesta, carga el fichero clave, tolera esos estropicios y te dice qué sustituyó y qué no encontró, también sin salir del navegador y aunque ya no tengas el documento abierto.
Errores frecuentes al usar una IA con documentos
- Subir el PDF entero porque es más rápido. Un minuto de censura evita entregar doce páginas para una pregunta de tres líneas, y de paso la respuesta suele mejorar, porque el asistente se centra en lo que le importa.
- Fiarlo todo a desactivar el entrenamiento. Ese ajuste gobierna el uso posterior, no el envío. Si el dato no debía salir, la solución es que no salga.
- Guardar el fichero clave junto al texto anonimizado. Si los dos viajan por el mismo canal o acaban en la misma carpeta compartida, la anonimización deja de servir. La clave se queda contigo.
- Anonimizar solo tus datos. En un contrato o en una nómina aparecen terceros. Sus datos merecen el mismo trato que los tuyos, y tú eres quien decide si salen o no.
Preguntas frecuentes
¿ChatGPT se queda con los documentos que subo?
El documento sale de tu dispositivo y queda asociado a tu cuenta y a la conversación. Qué se hace después con él depende del proveedor, del plan contratado y de los ajustes que tengas puestos, y esas políticas cambian con el tiempo. Lo que no depende de nada es el envío, que ya se ha producido, así que la única forma segura de que un dato no salga es no incluirlo.
¿Basta con desactivar el entrenamiento del modelo?
Ayuda, pero gobierna el uso posterior y no el envío. El documento completo ha viajado igualmente, y borrar la conversación tampoco lo deshace. Si el dato no debía salir de tu equipo, lo que resuelve el problema es sustituirlo antes de pegar el texto.
¿Puedo usar una IA con datos de clientes o pacientes?
Esos datos no son tuyos, son de las personas que confiaron en ti, y el RGPD pide tratarlos con la misma prudencia dentro de una IA que fuera de ella. Anonimizar antes de pegar el texto resuelve la mayoría de los casos, porque el asistente puede trabajar igual de bien sobre un documento donde cada dato personal aparece sustituido por un marcador.
¿La IA entiende un texto con los datos sustituidos?
Sí, y suele responder mejor que ante un texto con huecos en blanco. Un marcador tipado como [DNI_1] le dice qué clase de dato había ahí, y como el mismo valor recibe siempre el mismo marcador, el asistente no confunde a dos personas ni pierde el hilo. Después puedes devolver los valores originales a la respuesta con el fichero clave.
Publicada el 6 de agosto de 2026.