Extraer imágenes de un PDF
Extraer imágenes saca las imágenes ráster incrustadas de un PDF y las entrega en un ZIP como archivos PNG o JPEG. Los dibujos vectoriales y el texto de la página no son imágenes y no se incluyen.
Arrastra archivos aquí, o haz clic para elegir
Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez
También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.
Extraer imágenes recorre las imágenes XObject de cada página, decodifica flujos Flate/ASCII85/DCT y las empaqueta en un ZIP de `image_N.png` o `image_N.jpeg`. `format` es png (por defecto) o jpeg. Un XObject compartido se extrae una sola vez.
Una imagen con filtro LZW responde error interno (`LZW images unsupported`). Las páginas sin diccionario XObject se saltan. Un archivo sin imágenes extraíbles sigue devolviendo un ZIP, que puede no tener los miembros que esperas.
Esto no es rasterizar cada página a PNG (eso es PDF a imagen) ni OCR. El vector no es un XObject de imagen y no aparece.
Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña.
La subida es temporal. No guardamos tu biblioteca de imágenes.
Funciones
- Imágenes XObject en un ZIP PNG o JPEG
- Deduplicación por id de objeto; LZW no soportado
- No es rasterización de página ni OCR
- API anónima: /api/v1/misc/extract-images
Cuándo usarla
- Sacar fotos de un informe digital
- Con format=jpeg, evitar recodificar un flujo JPEG de foto
- Quedarte con las imágenes sin rasterizar la página entera
¿Cómo extraigo imágenes de un PDF?
- Sube un PDF con fotos o ráster incrustados.
- Deja PNG o cambia a JPEG.
- Pulsa Procesar y descarga `{name}_extracted_images.zip`.
- Si el ZIP no tiene archivos útiles, el PDF no tenía XObject de imagen decodificables.
Límites y casos límite
- No es un renderizador de páginas
- LZW hace fallar el trabajo
- La salida PNG es RGB, así que se pierden la transparencia y las máscaras suaves
- Sin OCR
- Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.
Ejemplos
- Un PDF con tres XObject de foto distintos da image_1 a image_3 en el ZIP
- Una página de logotipo vectorial puede no aportar nada
Privacidad de esta herramienta
Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.
Preguntas frecuentes
- ¿Por qué no hay una imagen por página?
- Solo se extraen XObject de imagen incrustados. Una página de texto más vector puede no aportar ninguna.
- ¿En qué se diferencia de PDF a imagen?
- PDF a imagen renderiza páginas. Extraer imágenes saca los objetos de imagen que ya están en el archivo.
- ¿Y LZW?
- La decodificación LZW no está implementada. La tarea falla en vez de saltar esa imagen.
- ¿Se tratan máscaras y SMask?
- Trata la salida como un export de píxeles a ciegas. Máscaras suaves y espacios de color raros pueden salir mal.
Última actualización:
Llámalo desde el código
Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
-F "[email protected]" \
-F "format=png" \
-o output.pdfTambién está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API
Úsalo desde un agente de IA
SkillCon esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «Extraer imágenes» por ti: /skills/pdf123-extract-images.md
Los archivos se usan solo para este trabajo y se borran automáticamente después.