Escáner de privacidad de PDF
Descubre qué dice de ti un PDF antes de enviarlo: metadatos, rutas y datos personales.
El escáner de privacidad de PDF lee tu documento en tu dispositivo y enmascara cada ejemplo que informa. Nada del archivo se sube ni se registra.
Redacta lo impreso en la página
Acerca de Escáner de privacidad de PDF
Todo PDF lleva más de lo que muestra la página. El diccionario de propiedades suele nombrar a un autor, registra qué aplicación produjo el archivo y cuándo, y a veces conserva una ruta local completa con nombre de usuario y estructura de carpetas. La capa de texto puede guardar bastante más: un correo en un pie, un número de cuenta en una tabla, un número de tarjeta en un anexo que nadie releyó. Este escáner informa de ambas cosas. Los hallazgos de metadatos se gradúan por lo identificativos que son, y el texto se compara con patrones de direcciones, tarjetas, identificadores nacionales y códigos de cuenta.
Características
- Lee autor, título, asunto, palabras clave, productor, creador y marcas de tiempo
- Detecta rutas locales, que suelen exponer un nombre de usuario y un árbol de carpetas
- Localiza correos, teléfonos, IBAN, tarjetas, direcciones IP e identificadores nacionales
- Los números de tarjeta se comprueban con el algoritmo de Luhn para reducir falsos positivos
- Cada ejemplo se enmascara en el informe en vez de mostrarse entero
- Una puntuación de riesgo única con una lectura en lenguaje claro
- Limpieza de todos los campos de metadatos con un clic, guardada como documento nuevo
Cómo usar Escáner de privacidad de PDF
- Suelta el PDF en la página
- Lee los hallazgos de metadatos y los datos personales localizados en el texto
- Fíjate en la puntuación de riesgo y decide qué tiene que cambiar
- Limpia los metadatos, y redacta el contenido si los hallazgos de texto importan
Ejemplo
Entrada
tender-response.pdf
Salida
High risk: author "J. Whitfield", path C:\Users\jwhitfield\Bids\…, 4 email addresses in the text.
La ruta es el hallazgo que más sorprende: nombra la cuenta de usuario de la máquina.
Errores comunes y solución de problemas
- El análisis no informa de nada. — Algunos productores no escriben metadatos, lo cual es buena señal. Comprueba aparte los hallazgos de texto: un diccionario de propiedades limpio no dice nada sobre lo impreso en la página.
- Una coincidencia de teléfono es en realidad un número de referencia. — Los patrones de dígitos se solapan. El escáner tiende a informar de más: lee el ejemplo enmascarado y descarta los que no son lo que parecen.
- Limpiar los metadatos no quitó un nombre de la página. — Los metadatos y el contenido de la página son cosas distintas. Un nombre impreso en el documento hay que redactarlo de la propia página.
- El análisis de texto no encontró nada en un documento claramente lleno de datos. — El PDF es un escaneo sin capa de texto, así que no hay nada que comparar. Reconoce el texto primero y vuelve a analizar.
Preguntas frecuentes
- ¿Qué es lo que más suele filtrar un PDF?
- El campo de autor, seguido de la aplicación que lo produjo. Ambos los fija automáticamente lo que creó el archivo, y ninguno se ve al leer el documento.
- ¿Se sube mi documento para analizarlo?
- No. Leer los metadatos y comparar el texto ocurren en esta pestaña: subir un documento para comprobar su privacidad echaría por tierra el ejercicio.
- ¿Por qué se enmascaran los ejemplos?
- Para que el propio informe se pueda capturar o compartir sin riesgo. Ves que se encontró una dirección y aproximadamente cuál, sin el valor completo en pantalla.
- ¿Limpiar los metadatos cambia las páginas?
- No. Solo se reescriben las propiedades del documento; cada página, su texto y sus fuentes quedan exactamente como estaban.
- ¿Con qué puntuación puedo enviar tranquilo?
- Con cualquiera que el escáner valore como baja. Media suele significar un nombre y una marca de tiempo, aceptable en interno y conveniente de limpiar antes de que el documento salga fuera.
Herramientas relacionadas
Todas las herramientas de ArrayKit