Anonimización o seudonimización, cuál necesitas
Seudonimizar es sustituir los datos por marcadores conservando aparte la correspondencia que permite deshacerlo. Anonimizar es eliminar cualquier camino de vuelta, también el tuyo, y se evalúa por el resultado, porque el contexto que queda también identifica.
- Lectura
- 5 min
- Publicada
- Actualizada
Las dos palabras suenan parecido y se usan como si fueran intercambiables, pero describen operaciones distintas con consecuencias distintas. Cuando sustituyes el nombre de una persona por un código y guardas la correspondencia en otro sitio, has seudonimizado. Cuando nadie, ni siquiera tú, puede volver a saber de quién hablaba el documento, has anonimizado. Esta guía explica la diferencia con ejemplos y cómo decidir cuál necesitas antes de compartir un documento, en especial si el destinatario es una IA. El término paraguas de todo esto, la ofuscación, y las técnicas que lo componen los repasamos en la guía sobre qué es la ofuscación de datos.
Seudonimizar, sustituir con camino de vuelta
Seudonimizar es sustituir los datos que identifican a una persona por marcadores o códigos, de forma que el documento deja de identificarla por sí solo. La clave está en el «por sí solo», porque la correspondencia entre cada marcador y su valor real sigue existiendo, guardada aparte. Si alguien consigue el documento y además esa correspondencia, la sustitución se deshace, así que la separación entre las dos piezas es lo que sostiene todo el esquema.
A cambio, la seudonimización conserva lo que hace útil al documento. Un texto donde pone [NOMBRE_1] y [DNI_1] se puede leer, resumir, analizar y comentar con normalidad, y quien tenga la correspondencia devuelve cada valor a su sitio cuando el trabajo termina. Es la herramienta natural cuando necesitas que un tercero, humano o máquina, trabaje sobre el contenido sin conocer a las personas.
Anonimizar, romper el vínculo del todo
Anonimizar es ir un paso más allá y eliminar cualquier camino de vuelta, no solo el tuyo. Llegar ahí cuesta más de lo que parece, porque no basta con quitar nombres y números, ya que el contexto también identifica. Si el texto habla de «la única profesora de música del pueblo», o combina un cargo, una fecha y un municipio pequeño, cualquiera del entorno sabe de quién se trata aunque el nombre no aparezca. Esos identificadores indirectos son la razón de que la anonimización se evalúe por el resultado y no por la operación, y de que borrar la clave no la produzca automáticamente. Antes de describir un texto como anónimo, revisa qué sigue contando por contexto.
Los identificadores indirectos que más se escapan
- Un cargo único. «El responsable de mantenimiento del centro» señala a una persona en cuanto se sabe de qué centro se habla.
- Fechas exactas. Una fecha de ingreso, de alta o de un incidente concreto reduce el conjunto de candidatos a uno.
- Lugares pequeños. Un municipio, un barrio o una planta de un edificio funcionan como un nombre en un grupo reducido.
- Cifras poco comunes. Un importe, una antigüedad o una combinación de idiomas que solo encaja con alguien.
- El nombre del archivo. Se olvida siempre y a menudo lleva el apellido o el expediente del que se creyó haber limpiado el documento.
Cuál necesitas según lo que vayas a hacer
La pregunta que lo decide es si vas a necesitar volver atrás. Para pedirle a una IA que resuma un contrato o revise una nómina, la seudonimización es la opción, porque la respuesta llegará llena de marcadores y querrás reponer los valores reales al final. Para publicar un caso, compartir estadísticas o subir un ejemplo a un foro, apunta a la anonimización, revisa los identificadores indirectos y asume que no habrá vuelta atrás. En los dos supuestos rige lo mismo, y es que cada dato que no viaja es un problema que no hay que gestionar después.
Nada de esto pide una herramienta concreta. En un documento corto, seudonimizar es un buscar y reemplazar por cada dato y una tabla aparte con la correspondencia. Lo que aporta automatizarlo es no saltarse repeticiones y numerar los marcadores sin tener que pensarlo, que es justo donde falla el trabajo a mano.
Cómo lo hace Ofusca
Ofusca aplica este esquema sin que el documento salga de tu navegador. Al censurar y exportar el texto para una IA, cada dato tapado se sustituye por un marcador tipado y numerado, [DNI_1] o [NOMBRE_2], y la correspondencia con los valores reales solo existe si marcas la casilla del fichero clave, un JSON que se descarga a tu equipo y que puedes cifrar con contraseña. Guardarlo aparte del texto es lo que mantiene la seudonimización en pie. El viaje de vuelta lo hace «Recuperar datos de la IA», que reinyecta los valores originales en la respuesta del asistente. Si no descargas la clave, no queda ningún camino de vuelta que dependa de Ofusca, aunque para hablar de anonimización conviene revisar además lo que el texto restante cuenta por contexto. El método completo está en la guía sobre subir documentos con datos a ChatGPT.
Sobre un texto suelto, la herramienta para detectar datos personales en un texto hace las dos cosas de esta guía: reconoce los identificadores y los tapa, o los sustituye por marcadores numerados con un fichero clave para recuperarlos después.
Y como el nombre del archivo se seudonimiza tan poco como se anonimiza, la herramienta para comprobar el nombre del archivo avisa si lleva datos como un DNI, un teléfono o un IBAN y propone uno neutro.
Errores frecuentes al anonimizar o seudonimizar
- Llamar anonimizado a lo que está seudonimizado. No es un matiz de vocabulario. Mientras exista una correspondencia que deshaga la sustitución, el documento sigue apuntando a personas concretas.
- Guardar la clave junto al documento. Una correspondencia que viaja en el mismo correo o vive en la misma carpeta compartida deja el esquema en nada. Separada y, si los datos son delicados, cifrada.
- Olvidar los identificadores indirectos. Un cargo, unas fechas o un municipio identifican sin necesidad de nombre.
- Sustituir sin numerar. Imagina un contrato de alquiler donde el casero y el inquilino aparecen los dos como [NOMBRE]. Ya no se sabe quién paga a quién ni quién se comprometió a qué. Con [NOMBRE_1] para uno y [NOMBRE_2] para el otro, cualquiera sigue la historia sin saber cómo se llaman.
Fuentes
- Reglamento (UE) 2016/679, Reglamento General de Protección de Datos, en el BOE, que define la seudonimización en su artículo 4.5.
Dudas habituales
Preguntas frecuentes
¿Qué diferencia hay entre anonimizar y seudonimizar?
Seudonimizar sustituye los datos por marcadores y conserva aparte la correspondencia que permite deshacer la sustitución. Anonimizar elimina cualquier camino de vuelta, también el tuyo, y se evalúa por el resultado, no por la operación.
¿Cuándo se considera anonimizado un documento?
Cuando nadie puede reidentificar a la persona con medios razonables, ni con el documento solo ni combinándolo con otra información. Por eso no basta con quitar nombres y números, también cuentan los identificadores indirectos.
¿Cuáles son esos identificadores indirectos?
Un cargo único, unas fechas exactas, un municipio pequeño, una cifra poco común o una combinación de idiomas que solo encaja con alguien. Y el nombre del archivo, que se olvida siempre y suele llevar el apellido o el expediente.
¿Destruir la clave convierte la seudonimización en anonimización?
Elimina el camino de vuelta que dependía de ti, que es un paso enorme, pero no es automático. Si el texto restante sigue identificando por contexto, el documento no está anonimizado por mucho que la clave haya desaparecido.
Esta guía cuenta qué lleva el documento y qué suele comprobarse en el trámite, que es lo que sabemos por hacer la herramienta. Lo que se exija en tu caso concreto lo fija quien te lo pide.
Publicada el 6 de agosto de 2026. Actualizada el 14 de septiembre de 2026. Lectura de 5 min.