O que são os metadados de um PDF
Os PDFs guardam metadados em dois lugares. O dicionário de informações do documento tem alguns campos padrão: título, autor, assunto, palavras-chave, o aplicativo que criou o documento original, o programa que gerou o PDF e as datas de criação e modificação. Um fluxo XMP, bloco de XML incorporado ao arquivo, costuma repetir esses dados e pode acrescentar outros, como identificadores do documento, nomes de ferramentas de edição e entradas de histórico gravadas pelos programas que mexeram no arquivo. Quase nada disso é digitado por uma pessoa. Editores de texto preenchem o autor com o nome da conta, scanners e impressoras acrescentam seu modelo, e modelos de documento levam o título original para todo documento criado a partir deles.
O que os metadados podem revelar
O campo de autor costuma trazer um nome completo ou o nome de usuário do computador, o que importa quando um documento precisa ser anônimo, por exemplo em uma revisão cega por pares ou em uma denúncia. O nome de uma empresa, de um departamento ou de um cliente pode aparecer no título ou no assunto de um modelo. As versões dos programas mostram que ferramentas uma organização usa, e as datas podem contradizer uma versão dos fatos: um relatório apresentado como recém-escrito pode ter data de criação de anos atrás, e uma data de modificação pode mostrar que um documento supostamente final foi alterado depois. As palavras-chave às vezes preservam nomes de projetos internos. Nada disso aparece quando o destinatário simplesmente lê as páginas, mas qualquer pessoa que abra as propriedades do documento consegue ver.
Confira primeiro os metadados do PDF
A maioria dos leitores de PDF mostra os principais campos em uma opção de menu como Propriedades do documento. Você também pode adicionar o arquivo ao Ver e editar metadados, que lê título, autor, assunto e palavras-chave assim que o PDF é carregado e permite alterá-los. Os leitores raramente mostram o fluxo XMP, então um documento que parece limpo nas propriedades ainda pode ter dados ali. Se você não tem certeza do que um arquivo contém, remover todos os metadados é a escolha mais segura.
Removendo metadados com o VelloDoc
Remover metadados limpa o dicionário de informações do documento e exclui o fluxo XMP, e depois salva uma cópia limpa. As páginas em si, com todo o texto e as imagens, continuam exatamente iguais. Adicione o PDF, digite a senha se ele for protegido, clique em Remover metadados e baixe o resultado. Se o arquivo publicado ainda precisar de um título útil, por exemplo para que buscadores e leitores de tela o apresentem corretamente, abra depois a cópia limpa no Ver e editar metadados e preencha só os campos que quiser compartilhar. Confira o resultado nas propriedades do documento do seu leitor antes de enviar.
O que a remoção de metadados não remove
Os metadados são só uma camada de um PDF. Comentários e anotações podem conter o nome de quem os escreveu, campos de formulário guardam os valores digitados, arquivos anexados viajam dentro do PDF, marcadores podem ter rótulos reveladores e camadas ocultas podem guardar conteúdo que não aparece. Fotos incorporadas às páginas ainda podem ter dados da câmera, incluindo localização, nos próprios dados da imagem. E o conteúdo da página em si, dos nomes no texto ao texto escondido em branco ou sob uma imagem, não é alterado. Para o conteúdo da página, use Censurar PDF, que exclui o que está dentro das áreas marcadas. Quando você precisa de uma cópia só com o que está visível, Achatar PDF reconstrói cada página como uma nova imagem, deixando de fora anotações, anexos, texto oculto e as fotos originais, mas também tornando o texto não selecionável. O nome do arquivo é independente de tudo isso, então renomeie o arquivo também.
Uma lista de verificação antes de compartilhar
Trabalhe do conteúdo para as propriedades. Primeiro defina o que o destinatário realmente precisa e remova todo o resto com Remover páginas ou Extrair páginas. Censure os dados sensíveis nas páginas que ficaram e achate o documento se comentários, dados de formulário ou conteúdo oculto puderem ser um problema. Remova os metadados como última etapa de edição, para que nenhuma etapa anterior deixe dados para trás. Se o arquivo precisar de senha, adicione-a com Proteger PDF depois que os metadados forem removidos. Por fim, dê ao arquivo um nome neutro e abra-o mais uma vez para confirmar que as páginas e as propriedades estão como você espera. O guia sobre o que um PDF pode revelar aprofunda cada um desses riscos.
Perguntas
Remover os metadados altera as páginas?
Não. Remover metadados limpa as propriedades do documento e o fluxo XMP; o texto e as imagens das páginas continuam exatamente iguais.
O nome do arquivo vai continuar mostrando meu nome?
Sim, se o seu nome estiver nele. O nome do arquivo não faz parte dos metadados do PDF, então renomeie o arquivo antes de enviar.
Comentários e anotações são removidos?
Não. As anotações podem incluir o nome de quem as fez. Exclua-as em um editor de PDF ou use Achatar PDF para criar uma cópia só com imagens das páginas.
A ferramenta remove os dados de localização das fotos dentro do PDF?
Não. Remover metadados não altera as imagens incorporadas. Achatar PDF reconstrói cada página como uma nova imagem, deixando de fora as fotos originais e os dados da câmera.
Devo remover os metadados antes ou depois de colocar uma senha?
Antes. Remova primeiro os metadados e depois proteja a cópia limpa com Proteger PDF.