Metadados do PDF
Lê e remove título, autor e produtor.
Esta ferramenta funciona com JavaScript. Para usá-la, ative o JavaScript no navegador e recarregue a página.
A INFORMAÇÃO POR TRÁS DO DOCUMENTO.
«Metadados do PDF» lê as informações de documento guardadas dentro de um arquivo PDF. Na parte do arquivo ficam o nome, o tamanho, a versão do PDF e o número de páginas. Na parte de informações do documento aparecem o título, o autor, o assunto, as palavras-chave, o programa que criou o documento, o software que produziu o PDF e as datas de criação e de alteração. A parte de medida de página lista os tamanhos das páginas do documento em milímetros e quantas páginas há de cada medida; assim fica fácil distinguir A4 (210 × 297 mm) de Letter.
Uma das linhas mais úteis é a camada de texto: a ferramenta olha as primeiras páginas e diz se há texto selecionável no documento, mostrando as primeiras linhas se houver. Se não houver camada de texto, as páginas são muito provavelmente uma imagem digitalizada; ferramentas de texto como «PDF → Word» e «PDF → Excel» não dão resultado com documentos assim. Também serve para ver, antes de compartilhar um documento, se o seu nome ou os dados da sua instituição continuam lá dentro. Abaixo do relatório também fica pronta uma cópia sem metadados: as informações do documento (título, autor, programa, datas) e o XMP são retirados; páginas, marcadores e campos de formulário continuam como estão. Em documentos com assinatura digital a cópia não é criada, porque a assinatura deixaria de valer.
Do início ao fim
- Envie seu PDF. Arraste o arquivo ou selecione-o. São lidos documentos de até 1 GB.
- Leia o relatório. As partes de arquivo, informações do documento, medida de página e conteúdo aparecem linha a linha.
- Baixe a cópia limpa. Use «Baixar o arquivo sem metadados» para obter a cópia sem a informação do autor; salve o relatório em JSON, se quiser. As cópias no servidor são excluídas ao sair da ferramenta.
Perguntas frequentes
O que quer dizer «não há camada de texto»?
As páginas estão guardadas como imagem e não como escrita; o documento foi digitalizado ou montado a partir de fotos. Nesses documentos o texto não pode ser selecionado nem pesquisado e as ferramentas de texto não funcionam. Para isso é preciso reconhecimento de texto (OCR); a ferramenta «OCR de PDF (reconhecimento de texto)» transforma essas páginas em PDF pesquisável ou em texto.
Posso remover a informação do autor?
Sim. Quando o relatório aparecer, clique em «Baixar o arquivo sem metadados»: você baixa uma cópia sem título, autor, programa, datas e XMP. Não há como alterar (gravar um novo autor). Já as outras ferramentas de PDF do RUPO Studio preservam o título e o autor.
O que a versão do PDF indica?
Segundo qual norma de PDF o documento foi escrito, por exemplo 1.4 ou 1.7. No uso diário costuma não importar; versões muito antigas ou muito novas podem causar problemas de compatibilidade em alguns leitores.
O meu arquivo fica no servidor?
Não. O arquivo chega ao servidor apenas para ser processado e é excluído quando o trabalho termina; o resultado também é excluído depois de baixado, ao sair da ferramenta. Não é preciso conta, nome nem e-mail, e os seus arquivos nunca são enviados a serviços de terceiros. O uso é gratuito: não há cota por hora nem por dia para o número de operações, não é preciso assistir a anúncios antes do processamento e não adicionamos marca d’água ao resultado.
Mais ferramentas de PDF
RUPO Studio