Eliminador de metadatos de PDF
¿Qué son los metadatos de un PDF?
Un PDF guarda su información oculta en dos lugares: el diccionario Info (título, autor, asunto, palabras clave, fechas y el software que generó el archivo) y un flujo de metadatos XMP, un bloque XML que contiene los mismos datos y a menudo más. Los procesadores de texto rellenan estos campos automáticamente, así que un documento exportado suele incluir el nombre completo que figura en tu cuenta del sistema operativo o en la licencia de tu suite ofimática. Cualquiera que abra las propiedades del archivo puede leerlo.
¿Cómo elimino el nombre del autor de un PDF?
Suelta el archivo en la zona de arriba. La herramienta muestra todos los campos con datos que encuentra, incluidos Autor y Aplicación creadora, y luego reescribe el documento sin ellos. Elimina el diccionario Info y el flujo XMP enteros en lugar de vaciar sus valores, de modo que el archivo limpio ya ni siquiera declara esos campos. Como comprobación final, vuelve a analizar su propio resultado e informa de lo que un escáner de metadatos aún encontraría: cero campos.
¿Puedo eliminar los metadatos de un PDF sin subir el archivo?
Sí, y esa es precisamente la razón de ser de esta página. La mayoría de los limpiadores de PDF en línea envían tu documento a sus servidores y suelen guardarlo allí durante una hora o más antes de borrarlo. Esta herramienta analiza y reescribe el PDF con JavaScript en tu propia máquina. Puedes comprobarlo tú mismo: abre la pestaña Red de DevTools de tu navegador y limpia un archivo. La única petición que quizá veas es el pequeño ping de analítica del propio sitio; tu documento nunca forma parte de ninguna petición. Eso importa cuando el archivo es un contrato, un currículum o un manuscrito.
¿Qué elimina esta herramienta y qué se conserva?
Se elimina: el diccionario Info del documento, los flujos de metadatos XMP, los bloques PieceInfo privados de aplicación que programas como InDesign y Photoshop esconden en el archivo, y el ID del archivo (trailer) que puede vincular una copia limpia con el original. Se conserva: el contenido visible. Las páginas, el texto, las imágenes, los enlaces y los campos de formulario quedan intactos. Dos límites que conviene conocer: los PDF protegidos con contraseña deben desbloquearse antes de limpiarlos, y las imágenes incrustadas en el PDF conservan sus propios datos EXIF. Para las fotos en sí, usa el Eliminador de metadatos de imágenes, la misma idea para archivos JPEG y PNG.
¿Es legal eliminar los metadatos de un PDF?
Sí. Limpiar los metadatos de un documento que te pertenece es una práctica habitual, no una manipulación. Los bufetes de abogados y los organismos públicos limpian los archivos salientes como política rutinaria, y los metadatos olvidados han puesto en aprietos a ambos más de una vez. La excepción es un archivo que estés obligado a conservar sin alteraciones, por ejemplo bajo una retención legal. En ese caso, limpia una copia y guarda el original.