Removedor de metadados de PDF
O que são metadados de PDF?
Um PDF guarda suas informações ocultas em dois lugares: o dicionário Info (título, autor, assunto, palavras-chave, datas e o software que gerou o arquivo) e um fluxo de metadados XMP, um bloco XML que contém os mesmos dados e muitas vezes mais. Os processadores de texto preenchem esses campos automaticamente, então um documento exportado costuma trazer o nome completo associado à sua conta do sistema operacional ou à licença da sua suíte de escritório. Qualquer pessoa que abrir as propriedades do arquivo pode ler tudo isso.
Como remover o nome do autor de um PDF?
Solte o arquivo na área acima. A ferramenta lista todos os campos preenchidos que encontrar, incluindo Autor e Aplicativo de criação, e depois reescreve o documento sem eles. Ela apaga o dicionário Info e o fluxo XMP por inteiro, em vez de apenas esvaziar os valores, então o arquivo limpo nem sequer declara mais esses campos. Como verificação final, ela reanalisa o próprio resultado e informa o que um scanner de metadados ainda encontraria: zero campos.
É possível remover metadados de um PDF sem enviar o arquivo?
Sim, e é justamente essa a proposta desta página. A maioria das ferramentas on-line que limpam PDFs envia seu documento para os próprios servidores e costuma guardá-lo lá por uma hora ou mais antes de apagá-lo. Esta ferramenta analisa e reescreve o PDF com JavaScript na sua própria máquina. Você pode verificar essa afirmação: abra a aba Network do DevTools do seu navegador e limpe um arquivo. A única requisição que talvez apareça é o minúsculo ping de estatísticas do próprio site; seu documento nunca faz parte de requisição alguma. Isso importa quando o arquivo é um contrato, um currículo ou um manuscrito.
O que esta ferramenta remove e o que permanece?
Removido: o dicionário Info do documento, os fluxos de metadados XMP, os blocos privados PieceInfo que programas como InDesign e Photoshop escondem no arquivo e o ID do arquivo no trailer, que pode vincular uma cópia limpa ao original. Intacto: o conteúdo visível. Páginas, texto, imagens, links e campos de formulário permanecem como estavam. Dois limites que vale conhecer: PDFs protegidos por senha precisam ser desbloqueados antes da limpeza, e as imagens incorporadas no PDF mantêm seus próprios dados EXIF. Para as fotos em si, use o Removedor de metadados de imagens, a mesma ideia para arquivos JPEG e PNG.
É permitido por lei remover metadados de um PDF?
Sim. Limpar os metadados de um documento seu é prática comum, não adulteração. Escritórios de advocacia e órgãos públicos limpam os arquivos que enviam como política de rotina, e metadados esquecidos já causaram constrangimento a ambos mais de uma vez. A exceção é um arquivo que você é obrigado a preservar sem alterações, por exemplo, sob uma ordem judicial de preservação. Nesse caso, limpe uma cópia e guarde o original.