Ir al contenido principal
PPDF123

Extraer imágenes de un PDF

Extraer imágenes saca las imágenes ráster incrustadas de un PDF y las entrega en un ZIP como archivos PNG o JPEG. Los dibujos vectoriales y el texto de la página no son imágenes y no se incluyen.

Arrastra archivos aquí, o haz clic para elegir

Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez

También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.

Extraer imágenes recorre las imágenes XObject de cada página, decodifica flujos Flate/ASCII85/DCT y las empaqueta en un ZIP de `image_N.png` o `image_N.jpeg`. `format` es png (por defecto) o jpeg. Un XObject compartido se extrae una sola vez.

Una imagen con filtro LZW responde error interno (`LZW images unsupported`). Las páginas sin diccionario XObject se saltan. Un archivo sin imágenes extraíbles sigue devolviendo un ZIP, que puede no tener los miembros que esperas.

Esto no es rasterizar cada página a PNG (eso es PDF a imagen) ni OCR. El vector no es un XObject de imagen y no aparece.

Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña.

La subida es temporal. No guardamos tu biblioteca de imágenes.

Funciones

  • Imágenes XObject en un ZIP PNG o JPEG
  • Deduplicación por id de objeto; LZW no soportado
  • No es rasterización de página ni OCR
  • API anónima: /api/v1/misc/extract-images

Cuándo usarla

  • Sacar fotos de un informe digital
  • Con format=jpeg, evitar recodificar un flujo JPEG de foto
  • Quedarte con las imágenes sin rasterizar la página entera

¿Cómo extraigo imágenes de un PDF?

  1. Sube un PDF con fotos o ráster incrustados.
  2. Deja PNG o cambia a JPEG.
  3. Pulsa Procesar y descarga `{name}_extracted_images.zip`.
  4. Si el ZIP no tiene archivos útiles, el PDF no tenía XObject de imagen decodificables.

Límites y casos límite

  • No es un renderizador de páginas
  • LZW hace fallar el trabajo
  • La salida PNG es RGB, así que se pierden la transparencia y las máscaras suaves
  • Sin OCR
  • Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.

Ejemplos

  • Un PDF con tres XObject de foto distintos da image_1 a image_3 en el ZIP
  • Una página de logotipo vectorial puede no aportar nada

Privacidad de esta herramienta

Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.

Preguntas frecuentes

¿Por qué no hay una imagen por página?
Solo se extraen XObject de imagen incrustados. Una página de texto más vector puede no aportar ninguna.
¿En qué se diferencia de PDF a imagen?
PDF a imagen renderiza páginas. Extraer imágenes saca los objetos de imagen que ya están en el archivo.
¿Y LZW?
La decodificación LZW no está implementada. La tarea falla en vez de saltar esa imagen.
¿Se tratan máscaras y SMask?
Trata la salida como un export de píxeles a ciegas. Máscaras suaves y espacios de color raros pueden salir mal.

Última actualización:

Llámalo desde el código

Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.

curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
  -F "[email protected]" \
  -F "format=png" \
  -o output.pdf

También está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API

Úsalo desde un agente de IA

Skill

Con esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «Extraer imágenes» por ti: /skills/pdf123-extract-images.md

Todas las skills para agentes

Los archivos se usan solo para este trabajo y se borran automáticamente después.