La respuesta rápida
Para anonimizar un PDF antes de usarlo con una IA: ábrelo en una herramienta que procese el archivo en tu navegador, deja que detecte y sustituya los datos personales por etiquetas coherentes, revisa el resultado y copia solo el texto protegido. Se lo pegas a ChatGPT, trabajas con él, y cuando te responda recuperas los nombres reales en tu equipo. El PDF original nunca sale de tu ordenador.
Por qué no deberías pegar el PDF tal cual
Cuando subes o pegas un documento en una IA, ese contenido viaja al servidor del proveedor. Si el PDF contiene datos personales de un cliente, un empleado o un tercero, estás comunicando esos datos a una empresa externa, con su propia política de retención y, en algunos planes, de entrenamiento. En un contexto profesional —un despacho, una asesoría, una empresa— eso puede suponer una cesión de datos que exige base jurídica y, a menudo, un contrato de encargo con el proveedor.
La solución no es renunciar a la IA: es que el modelo trabaje con el contenido sin conocer a quién pertenece. Para eso se anonimiza antes.
Qué datos lleva un PDF que conviene proteger
- Nombres de personas y empresas.
- DNI, NIE y CIF, que identifican de forma directa.
- IBAN y tarjetas bancarias.
- Correos, teléfonos y direcciones postales.
- Números de expediente, referencias y fechas que, cruzadas, permiten reidentificar.
Cómo anonimizar el PDF, paso a paso
- Abre la herramienta. En el anonimizador de Anónimo IA, arrastra tu PDF. Se procesa dentro del navegador: puedes desconectar el wifi antes de soltarlo y comprobar que sigue funcionando.
- Deja que detecte. El motor convierte el PDF a texto y localiza los identificadores, validándolos con su dígito de control (un número de ocho cifras no se marca como DNI si la letra no cuadra). Si el PDF es escaneado, el reconocimiento de texto (OCR) también se ejecuta en local.
- Revisa. Cada hallazgo es revisable uno a uno. La detección automática es un filtro, no una certificación: un apellido raro o un dato partido en dos líneas puede escaparse, así que este paso importa.
- Copia el texto protegido. Los datos aparecen sustituidos por etiquetas coherentes: el mismo cliente es siempre
[PERSONA_01]en todo el documento. - Pégalo en ChatGPT o Claude y trabaja con normalidad: resumir, comparar cláusulas, extraer datos. El modelo no sabe de quién es.
- Recupera los datos reales. Cuando la IA te responda, pega su respuesta de vuelta en la herramienta y pulsa «Devolver los datos reales». La correspondencia entre etiqueta y dato vive solo en tu navegador.
Un ejemplo real
Antes:
Contrato entre Juan Pérez García, con DNI 52867411Z, y la empresa…
Lo que le pegas a la IA:
Contrato entre [PERSONA_01], con DNI [DNI_01], y la empresa…
La IA resume el contrato igual de bien, porque el contenido jurídico está intacto: solo ha perdido la identidad de las partes.
¿Y si el PDF está escaneado?
Muchos PDF son en realidad una foto: no tienen texto seleccionable. En ese caso hace falta un reconocimiento óptico de caracteres (OCR) antes de poder anonimizar. La herramienta lo hace en tu propio navegador, en español, sin enviar la imagen a ningún servidor. Ten en cuenta que el OCR no es perfecto con datos ambiguos (puede confundir una letra con un número), y por eso la revisión manual es especialmente importante en escaneados.
Lo que esto sí y no resuelve
Anonimizar antes de usar la IA reduce mucho lo que expones y, si el archivo no sale de tu equipo, evita convertir a la herramienta en un encargado del tratamiento. Pero el resultado está seudonimizado, no anonimizado: sigue siendo dato personal para quien conserva la correspondencia. Tu base jurídica para tratar esos datos y tu registro de actividades siguen siendo tuyos. No sustituye al cumplimiento; lo facilita y deja constancia.
Preguntas frecuentes
¿Es seguro subir un PDF a ChatGPT?
Depende de lo que contenga. Si lleva datos personales, subirlo tal cual comunica esos datos al proveedor. Anonimizarlo antes elimina ese problema en su origen: el modelo trabaja con el contenido sin los datos reales.
¿Anonimizar el PDF en el navegador es de verdad local?
Sí. La herramienta se sirve con una política de seguridad que bloquea las conexiones de salida: puedes desconectar la red y sigue funcionando. Es comprobable en la pestaña de red del navegador.
¿Puedo recuperar los datos originales después?
Sí. La bóveda guarda la correspondencia entre cada etiqueta y su dato real, solo en tu equipo. Pegas la respuesta de la IA y recuperas los nombres. Si cierras la pestaña sin exportarla, la correspondencia desaparece.
¿Funciona con PDF escaneados?
Sí, mediante OCR ejecutado en el propio navegador, en español. Revisa el resultado con atención, porque el reconocimiento puede fallar en datos ambiguos.
¿Sirve para documentos de clientes en un despacho?
Sí. Al no salir el documento de tu equipo, no hay comunicación de datos a un tercero ni contrato de encargo que firmar con la herramienta. El único tercero real es el modelo de IA, y a él solo le llega texto ya sustituido.
Anonimiza tu PDF ahora
Ábrelo, arrastra el archivo y mira qué detecta. No se sube nada: puedes desconectar el wifi antes de soltarlo.
![Diagrama: un PDF con nombre, DNI, IBAN y correo se convierte en un PDF anonimizado con etiquetas [PERSONA_01], [DNI_01], [IBAN_01] antes de enviarlo a ChatGPT, todo en local.](/assets/img/guias/anonimizar-pdf-antes-chatgpt.webp)