Como o Extrair imagens do PDF funciona
Extrair Imagens do PDF retira as imagens rasterizadas incorporadas originais diretamente de um PDF e salva cada uma como um arquivo PNG separado. Isso recupera a foto, logo ou digitalização real que foi colocada no documento, na resolução em que estava armazenada, em vez de renderizar uma captura de tela de como a página parece. A extração é feita pelo pdf-lib dentro do seu navegador, e o PDF original nunca percorre a rede.
Isso é diferente de converter páginas de PDF em imagens. A conversão de página renderiza o layout completo da página, incluindo texto, bordas e fundo, em uma única imagem rasterizada em um DPI escolhido. A extração de imagens em vez disso percorre o grafo de objetos interno do PDF e extrai cada recurso de imagem como está, preservando suas dimensões de pixel originais e espaço de cor. Se uma página foi construída a partir de uma única fotografia de sangramento total, você obtém essa fotografia de volta no tamanho armazenado, não uma renderização do tamanho da página. Se um PDF não tem imagens rasterizadas incorporadas (apenas gráficos vetoriais ou texto), a ferramenta não encontrará nada para extrair.