Metadatos de PDF
Lee y elimina el título, el autor y el productor.
Esta herramienta funciona con JavaScript. Para usarla, activa JavaScript en tu navegador y recarga la página.
LA INFORMACIÓN DETRÁS DEL DOCUMENTO.
«Metadatos de PDF» lee la información de documento guardada dentro de un archivo PDF. En la sección de archivo están el nombre, el tamaño, la versión de PDF y el número de páginas. En la sección de información del documento aparecen el título, el autor, el asunto, las palabras clave, el programa que creó el documento, el software que produjo el PDF y las fechas de creación y de modificación. La sección de medida de página lista los tamaños de página del documento en milímetros y cuántas páginas hay de cada medida; así distinguir A4 (210 × 297 mm) de Letter resulta fácil.
Una de las líneas más útiles es la capa de texto: la herramienta mira las primeras páginas y te dice si en el documento hay texto seleccionable, mostrando las primeras líneas si lo hay. Si no hay capa de texto, lo más probable es que las páginas sean una imagen escaneada; herramientas de texto como «PDF → Word» y «PDF → Excel» no dan resultado con esos documentos. También se usa para ver, antes de compartir un documento, si dentro sigue estando tu nombre o los datos de tu organización. Debajo del informe también queda lista una copia sin metadatos: se quitan la información del documento (título, autor, programa, fechas) y el XMP; las páginas, los marcadores y los campos de formulario quedan como están. En los documentos con firma digital no se crea la copia, porque la firma dejaría de ser válida.
De principio a fin
- Sube tu PDF. Arrastra el archivo o selecciónalo. Se leen documentos de hasta 1 GB.
- Lee el informe. Las secciones de archivo, información del documento, medida de página y contenido aparecen línea a línea.
- Descarga la copia limpia. Con «Descargar el archivo sin metadatos» obtienes la copia sin el dato del autor; guarda el informe en JSON si quieres. Las copias del servidor se eliminan al salir de la herramienta.
Preguntas frecuentes
¿Qué significa «no hay capa de texto»?
Las páginas están guardadas como imagen y no como letra; el documento se ha escaneado o se ha creado a partir de fotos. En estos documentos el texto no se puede seleccionar ni buscar y las herramientas de texto no funcionan. Para eso hace falta reconocimiento de texto (OCR); la herramienta «OCR de PDF (reconocimiento de texto)» convierte esas páginas en un PDF con búsqueda o en texto.
¿Puedo borrar el dato del autor?
Sí. Cuando aparezca el informe, pulsa «Descargar el archivo sin metadatos»: se descarga una copia sin título, autor, programa, fechas ni XMP. No se pueden cambiar (escribir un autor nuevo). Las demás herramientas de PDF de RUPO Studio, en cambio, conservan el título y el autor.
¿Qué indica la versión de PDF?
Con arreglo a qué norma de PDF se escribió el documento, por ejemplo 1.4 o 1.7. En el uso diario no suele importar; las versiones muy antiguas o muy nuevas pueden dar problemas de compatibilidad en algunos visores.
¿Mi archivo se queda en el servidor?
No. Tu archivo solo llega al servidor para procesarse y se elimina al terminar el trabajo; el resultado también se elimina cuando lo descargas y sales de la herramienta. No necesitas cuenta, nombre ni correo electrónico, y tus archivos nunca se envían a un servicio de terceros. El uso es gratuito: no ponemos ninguna cuota por hora ni por día al número de procesos, no te hacemos ver anuncios antes de procesar y no añadimos marca de agua al resultado.
Otras herramientas de PDF
RUPO Studio