Hoe Afbeeldingen uit PDF halen werkt
Afbeeldingen uit PDF extraheren haalt de oorspronkelijk ingesloten rasterafbeeldingen rechtstreeks uit een PDF en slaat elke op als een apart PNG-bestand. Dit herstelt de eigenlijke foto, het logo of de scan die in het document was geplaatst, op de resolutie waarmee hij was opgeslagen, in plaats van een schermafbeelding te renderen van hoe de pagina eruitziet. De extractie wordt gedaan door pdf-lib in je browser, en de originele PDF reist nooit over het netwerk.
Dit verschilt van het omzetten van PDF-pagina's naar afbeeldingen. Paginaconversie rendert de volledige paginalay-out, inclusief tekst, randen en achtergrond, in een enkele rasterafbeelding bij een gekozen DPI. Afbeeldingsextractie doorloopt in plaats daarvan de interne objectgraph van de PDF en haalt elke afbeeldingsresource zo op als hij is, met behoud van de oorspronkelijke pixelafmetingen en kleurruimte. Als een pagina is opgebouwd uit een enkele volledig-vet foto, krijg je die foto terug op zijn opgeslagen formaat, niet een pagina-groot rendering. Als een PDF geen ingesloten rasterafbeeldingen heeft (alleen vectorafbeeldingen of tekst), vindt het hulpmiddel niets te extraheren.