Metadados do PDF
Lê e remove título, autor e produtor.
Esta ferramenta funciona com JavaScript. Para a usar, ative o JavaScript no navegador e recarregue a página.
A INFORMAÇÃO POR TRÁS DO DOCUMENTO.
«Metadados do PDF» lê as informações de documento guardadas dentro de um ficheiro PDF. Na parte do ficheiro ficam o nome, o tamanho, a versão do PDF e o número de páginas. Na parte de informações do documento aparecem o título, o autor, o assunto, as palavras-chave, o programa que criou o documento, o software que produziu o PDF e as datas de criação e de alteração. A parte de medida de página lista os tamanhos das páginas do documento em milímetros e quantas páginas há de cada medida; assim fica fácil distinguir A4 (210 × 297 mm) de Letter.
Uma das linhas mais úteis é a camada de texto: a ferramenta olha as primeiras páginas e diz se há texto selecionável no documento, mostrando as primeiras linhas se houver. Se não houver camada de texto, as páginas são muito provavelmente uma imagem digitalizada; ferramentas de texto como «PDF → Word» e «PDF → Excel» não dão resultado com documentos assim. Também serve para ver, antes de partilhar um documento, se o seu nome ou os dados da sua instituição continuam lá dentro. Abaixo do relatório também fica pronta uma cópia sem metadados: as informações do documento (título, autor, programa, datas) e o XMP são retirados; páginas, marcadores e campos de formulário continuam como estão. Em documentos com assinatura digital a cópia não é criada, porque a assinatura deixaria de valer.
Do início ao fim
- Envie o seu PDF. Arraste o ficheiro ou selecione-o. São lidos documentos de até 1 GB.
- Leia o relatório. As partes de ficheiro, informações do documento, medida de página e conteúdo aparecem linha a linha.
- Transfira a cópia limpa. Use «Transferir o ficheiro sem metadados» para obter a cópia sem a informação do autor; guarde o relatório em JSON, se quiser. As cópias no servidor são eliminadas ao sair da ferramenta.
Perguntas frequentes
O que quer dizer «não há camada de texto»?
As páginas estão guardadas como imagem e não como escrita; o documento foi digitalizado ou montado a partir de fotos. Nesses documentos o texto não pode ser selecionado nem pesquisado e as ferramentas de texto não funcionam. Para isso é preciso reconhecimento de texto (OCR); a ferramenta «OCR de PDF (reconhecimento de texto)» transforma essas páginas em PDF pesquisável ou em texto.
Posso remover a informação do autor?
Sim. Quando o relatório aparecer, clique em «Transferir o ficheiro sem metadados»: é transferida uma cópia sem título, autor, programa, datas e XMP. Não é possível alterar (gravar um novo autor). Já as outras ferramentas de PDF do RUPO Studio preservam o título e o autor.
O que a versão do PDF indica?
Segundo qual norma de PDF o documento foi escrito, por exemplo 1.4 ou 1.7. No uso diário costuma não importar; versões muito antigas ou muito novas podem causar problemas de compatibilidade em alguns leitores.
O meu ficheiro fica no servidor?
Não. O ficheiro chega ao servidor apenas para ser processado e é eliminado quando o trabalho termina; o resultado também é eliminado depois de transferido, ao sair da ferramenta. Não é preciso conta, nome nem e-mail, e os seus ficheiros nunca são enviados a serviços de terceiros. A utilização é gratuita: não há quota por hora nem por dia para o número de operações, não é preciso ver anúncios antes do processamento e não adicionamos marca de água ao resultado.
Mais ferramentas de PDF
RUPO Studio