Comment fonctionne Extraire les images d'un PDF
Extraire les images d'un PDF récupère les images matricielles d'origine directement intégrées dans un PDF et enregistre chacune d'elles sous forme de fichier PNG séparé. Cela récupère la vraie photo, le logo ou la numérisation qui avait été placé dans le document, à la résolution à laquelle il était stocké, plutôt que de rendre une capture d'écran de l'aspect de la page. L'extraction est effectuée par pdf-lib dans votre navigateur, et le PDF d'origine ne transite jamais par le réseau.
Cela est différent de la conversion des pages PDF en images. La conversion de page rend la mise en page complète, y compris le texte, les bordures et le fond, en une seule image matricielle à un DPI choisi. L'extraction d'images parcourt plutôt le graphe d'objets interne du PDF et extrait chaque ressource image telle quelle, en préservant ses dimensions en pixels d'origine et son espace colorimétrique. Si une page était composée d'une seule photographie plein cadre, vous obtenez cette photographie à sa taille stockée, pas un rendu de la taille de la page. Si un PDF ne contient pas d'images matricielles intégrées (seulement des graphiques vectoriels ou du texte), l'outil ne trouvera rien à extraire.