Comprimir PDF
Tu archivo no sale de este dispositivo
Casi todo el peso de un PDF grande son imágenes. Esta herramienta decodifica cada JPEG incrustado, lo reduce si es más grande que el objetivo, lo vuelve a codificar a la calidad que elijas y reescribe el archivo con flujos de objetos y los campos de información del documento vaciados. Los documentos escaneados suelen bajar a la mitad o más; un PDF solo de texto ahorra unos pocos por ciento. Suelta varios archivos a la vez y los resultados vuelven en un ZIP.
Cómo comprimir un PDF
Saber exactamente qué hace es lo que te deja prever si va a servir. Recorre el documento buscando imágenes incrustadas y recodifica un solo tipo: datos JPEG básicos, en color normal o en escala de grises normal, sin matriz de decodificación personalizada. Cada una se decodifica, se reduce si su lado más largo supera el objetivo, se recodifica a la calidad elegida y solo se vuelve a poner si el resultado es de verdad más pequeño. Después todo el archivo se reescribe con flujos de objetos y con los campos de título, autor, asunto, palabras clave, productor y creador vaciados.
Todo lo demás se queda exactamente como estaba. El dibujo vectorial, las fuentes, los campos de formulario y el texto no se tocan. Tampoco las imágenes guardadas de cualquier otra forma, y ese grupo es más grande de lo que se cree: imágenes sin pérdida de tipo PNG dentro de un PDF, imágenes JPEG 2000, imágenes en espacio de color CMYK y la codificación binaria de tipo fax que producen muchos escáneres de documentos para las páginas en blanco y negro. Un PDF hecho solo de eso volverá únicamente con el ahorro estructural.
Eso hace que la respuesta a «¿por qué no ha pasado nada?» sea casi siempre la misma. Un informe lleno de texto ya está comprimido con eficacia y no hay datos de imagen con los que trabajar. Un escaneo en escala de grises es un caso a medias: recodificarlo pasa por un lienzo de color, así que el sustituto a menudo no es más pequeño que el original y se descarta al momento. Cuando la salida fuera más grande que la entrada, se rechaza el archivo entero en lugar de ofrecerlo, porque devolver un archivo más grande etiquetado como «comprimido» es peor que decir que no se ha podido hacer nada.
Lo que deliberadamente no hace es la lista de cosas que hacen las herramientas de escritorio y que pierden información sin avisar: no vuelve a pasar el texto por OCR, no recorta ni elimina fuentes, no aplana campos de formulario, no convierte el dibujo vectorial en mapas de bits ni descarta capas. Cada una de esas cosas ahorra espacio y cada una puede tirar algo que necesitabas.
Un efecto secundario parece una ventaja de privacidad y solo lo es a medias. Lo que se vacía es el diccionario de información del documento, los seis campos que un lector muestra en Propiedades, incluidos Autor y Productor. Casi todos los PDF escritos por un procesador de textos, un programa de maquetación o Acrobat llevan además una segunda copia de esa información en un paquete de metadatos XMP, y ese paquete se queda tal cual: un archivo de prueba cuyo XMP nombraba a su autor seguía nombrándolo después de comprimirlo. El panel de propiedades puede quedar vacío mientras el nombre sigue dentro de los bytes. Tómalo como una limpieza, no como una anonimización.
Los límites de la sede electrónica
La razón más habitual para comprimir un PDF en España es un trámite en línea: la sede electrónica de un organismo, el portal de una universidad o el de una aseguradora, que limitan el tamaño de cada archivo adjunto. Un contrato o un certificado escaneado con el móvil suele pasar de ese límite por mucho, y al ser casi todo imagen JPEG, es justo el caso en el que esta herramienta ahorra más.
Para qué la usa la gente
- Dejar un escaneo por debajo del límite de adjuntos del correo
- Cumplir el límite de tamaño de una sede electrónica o de la web del banco
- Reducir un contrato escaneado con el móvil antes de reenviarlo
- Aligerar un informe lleno de fotos para una conexión lenta
- Reducir un archivo sin entregar el documento a un servicio web
- Vaciar los campos Autor y Productor que un lector muestra en Propiedades
Preguntas
Porque es casi todo texto y vectores, que ya se comprimen con eficacia. Sin datos de imagen que recodificar, solo queda el ahorro estructural de unos pocos por ciento.
Datos JPEG básicos en color normal o en escala de grises normal. Todo lo demás del archivo se deja como está.
Muchos escáneres de documentos guardan las páginas en blanco y negro con una codificación binaria de tipo fax en lugar de JPEG. Eso ya es muy compacto y aquí no se toca.
Se saltan. Recodificarlas a través de un lienzo del navegador las pasaría a color de pantalla y cambiaría cómo se imprime el documento, y ese cambio no merece hacerse en silencio.
La recodificación pasa por un lienzo de color, así que el sustituto a menudo no es más pequeño que el original en grises. Cuando pasa eso, se conserva el original.
A calidad 70 y 1600 píxeles en el lado más largo, una página escaneada sigue siendo legible en pantalla y al imprimir a tamaños normales. Sube los dos controles si necesitas calidad de archivo.
La calidad va de 30 a 95 y el lado más largo de 600 a 3000 píxeles. Cambiar cualquiera de los dos vuelve a procesar todo el lote.
Calidad 85 y al menos 2400 en el lado más largo, unos 205 ppp en una página A4. Los 1600 de serie salen cerca de 137 ppp, bien en pantalla y visiblemente blandos en papel.
Sí. Suelta los que quieras. Se procesan uno detrás de otro y vuelven en un solo ZIP, porque los navegadores bloquean una serie de descargas separadas.
Se descarta y el archivo se da como ya casi tan pequeño como puede. En ese caso tu original es el mejor archivo.
No. El texto, las fuentes, el dibujo vectorial, los campos de formulario y la geometría de las páginas no se tocan. Solo cambian los datos de imagen y la estructura del archivo.
Seis campos del diccionario de información del documento: título, autor, asunto, palabras clave, productor y creador. No se quita nada visible de ninguna página.
No. Solo se vacía el diccionario de información. Un PDF escrito por un procesador de textos o un programa de maquetación suele llevar los mismos datos otra vez en un paquete XMP, que no se toca, así que el panel de propiedades puede quedar vacío con el nombre del autor todavía en el archivo.
Reescribir el archivo invalida cualquier firma existente, como con cualquier herramienta que cambie los bytes. Firma después de comprimir, no antes.
No. Un PDF cifrado tiene que desbloquearse primero, y eso solo puedes hacerlo tú.
La biblioteca que lee los PDF se descarga la primera vez que eliges un archivo. Son unos 175 KB, se carga una vez para todo el lote y después queda en caché.
Eso rasteriza todo el documento, así que el texto deja de ser texto y pasa a ser una foto de texto. Queda más pequeño y ya no se puede buscar ni seleccionar.
Lo limita la memoria, no una cifra fija, porque el documento entero se mantiene en el navegador mientras se reescribe. Un móvil se queda corto mucho antes que un portátil.
No. Todo ocurre en esta página. La biblioteca se descarga a tu navegador al elegir un archivo; el archivo no va a ninguna parte.