Cómo funciona Extraer imágenes de PDF
Extraer imágenes de PDF extrae directamente las imágenes rasterizadas integradas originales de un PDF y guarda cada una como un archivo PNG separado. Esto recupera la foto, el logotipo o el escáner real que se colocó en el documento, a la resolución a la que se almacenó, en lugar de renderizar una captura de pantalla del aspecto de la página. La extracción la realiza pdf-lib dentro del navegador y el PDF original nunca viaja por la red.
Esto es diferente de convertir páginas PDF en imágenes. La conversión de páginas renderiza el diseño completo de la página, incluidos texto, bordes y fondo, en una sola imagen rasterizada a un DPI elegido. La extracción de imágenes, en cambio, recorre el grafo de objetos interno del PDF y extrae cada recurso de imagen tal como está, conservando sus dimensiones originales en píxeles y su espacio de color. Si una página se construyó a partir de una sola fotografía a sangre completa, obtienes esa fotografía a su tamaño almacenado, no un renderizado del tamaño de la página. Si un PDF no tiene imágenes rasterizadas integradas (solo gráficos vectoriales o texto), la herramienta no encontrará nada que extraer.