Cách Trích xuất hình ảnh từ PDF hoạt động
Trích xuất Hình ảnh từ PDF lấy trực tiếp các hình ảnh raster gốc được nhúng ra khỏi PDF và lưu mỗi ảnh dưới dạng file PNG riêng biệt. Điều này khôi phục ảnh thực tế, logo hoặc bản quét đã được đặt trong tài liệu, ở độ phân giải nó được lưu trữ, thay vì render ảnh chụp màn hình về cách trang trông như thế nào. Việc trích xuất được thực hiện bởi pdf-lib trong trình duyệt của bạn, và PDF gốc không bao giờ đi qua mạng.
Đây khác với việc chuyển đổi trang PDF sang hình ảnh. Chuyển đổi trang render toàn bộ bố cục trang, bao gồm văn bản, viền và nền, thành một hình ảnh raster duy nhất ở DPI được chọn. Trích xuất hình ảnh thay vào đó duyệt qua đồ thị đối tượng nội bộ của PDF và lấy ra từng tài nguyên hình ảnh nguyên trạng, bảo toàn kích thước pixel gốc và không gian màu của nó. Nếu một trang được xây dựng từ một bức ảnh toàn cạnh duy nhất, bạn nhận lại ảnh đó ở kích thước đã lưu trữ, không phải một bản render có kích thước trang. Nếu PDF không có hình ảnh raster nhúng (chỉ có đồ họa vector hoặc văn bản), công cụ sẽ không tìm thấy gì để trích xuất.