Cómo extraer las imágenes de un PDF (no capturas de las páginas)
Por el equipo de FreePDF ·
Un proveedor te manda un catálogo de 40 páginas y tú solo quieres las fotos de los productos. Capturar la pantalla una por una tira resolución a la basura, y convertir el PDF a JPG te devuelve páginas enteras con el texto incrustado. Lo que quieres son las imágenes en sí: los archivos que alguien arrastró al documento antes de exportarlo.
Extraer imágenes no es convertir páginas
Son dos tareas distintas y los nombres de las herramientas se parecen demasiado, así que conviene tener claro cuál necesitas.
- PDF a JPG renderiza cada página como una sola imagen plana: texto, fotos, números de página y todo lo demás, a la resolución que pidas.
- Extraer imágenes entra en el archivo y saca cada imagen incrustada por separado, con la resolución exacta a la que se guardó.
No se vuelve a codificar nada por el camino. Una foto de 3000×2000 sale como una foto de 3000×2000 aunque en la maquetación apareciera como una miniatura, porque el PDF conservó la imagen completa y solo la mostraba pequeña. Suele ser una sorpresa agradable: las fotos son más grandes de lo que parecían en la página.
Qué encontrarás en el ZIP
Todo vuelve en un único ZIP para que no tengas que pulsar en 60 descargas. Cada archivo lleva el nombre de la página de la que salió, en orden de aparición, así que page7_23_Im4.png es el cuarto objeto de imagen de la página 7. Al ordenar la carpeta por nombre tienes las imágenes en orden de lectura, lo que facilita relacionarlas con el documento.
Los formatos son los que guardó el PDF, normalmente PNG o JPG. Puede que salgan más archivos de los que esperabas: un fondo de página, un logotipo repetido en la cabecera de cada página, una línea fina guardada como una imagen de dos píxeles. Revisa y borra en lugar de dar por hecho que cada archivo es una foto.
Cuando la imagen que quieres no sale
La herramienta solo encuentra imágenes de mapa de bits, las que están hechas de píxeles. Algunas cosas que parecen imágenes en la página no se guardan así:
- Logotipos, iconos y gráficos dibujados como vectores. Un gráfico exportado desde Illustrator o generado por una herramienta de informes suele ser un conjunto de instrucciones de dibujo, no una imagen. No hay ningún objeto de imagen que sacar, y la herramienta te dirá que no encontró ninguna.
- Fotos cortadas en tiras. Algunos programas de maquetación parten una imagen grande en bandas horizontales al escribir el PDF. Recibes las bandas, en orden, y te toca volver a unirlas.
- Imágenes recortadas en la maquetación. El recorte es una instrucción de visualización, así que recuperas la imagen original completa, incluida la parte que quedaba oculta en la página.
Para todo lo del primer punto, renderiza la página y recorta el resultado. Pierdes la resolución original, pero una página renderizada a 300 PPP de un gráfico vectorial se ve nítida en una presentación o en un documento.
Los documentos escaneados se comportan distinto
Si el PDF salió de un escáner o de una app de escaneo del móvil, cada página es una única imagen grande. Extraer te da exactamente eso: una foto por página, el escaneo tal cual, a la resolución a la que se escaneó. Es muy útil cuando quieres recuperar los escaneos originales de un paquete que alguien fusionó, e inútil si esperabas aislar una figura impresa en la página. Para una figura, extrae la imagen de la página y recórtala.
Preguntas frecuentes
¿Las imágenes extraídas tendrán peor calidad que en el PDF?
No. Los datos de la imagen incrustada se copian tal cual en lugar de volver a guardarse, así que no hay una segunda ronda de compresión. Si una foto ya venía aplastada a 72 PPP cuando se creó el documento, eso es lo que recibes. La extracción no la empeora, pero tampoco puede recuperar un detalle que el PDF nunca contuvo.
¿Puedo sacar las imágenes de una sola página?
No directamente, pero son dos pasos: extrae primero esa página a su propio PDF y luego pásale la extracción de imágenes. En un documento largo suele ser más rápido que rebuscar en un ZIP lleno de cabeceras y filetes, y los nombres de archivo quedan más limpios.