Không tải lên, 100% cục bộ, không cần tài khoản

Trích xuất hình ảnh từ PDF

Mỗi hình ảnh XObject nhúng trong PDF được giải mã và xuất dưới dạng PNG. Tệp của bạn không bao giờ rời khỏi thiết bị.

Cách Trích xuất hình ảnh từ PDF hoạt động

Trích xuất Hình ảnh từ PDF lấy trực tiếp các hình ảnh raster gốc được nhúng ra khỏi PDF và lưu mỗi ảnh dưới dạng file PNG riêng biệt. Điều này khôi phục ảnh thực tế, logo hoặc bản quét đã được đặt trong tài liệu, ở độ phân giải nó được lưu trữ, thay vì render ảnh chụp màn hình về cách trang trông như thế nào. Việc trích xuất được thực hiện bởi pdf-lib trong trình duyệt của bạn, và PDF gốc không bao giờ đi qua mạng.

Đây khác với việc chuyển đổi trang PDF sang hình ảnh. Chuyển đổi trang render toàn bộ bố cục trang, bao gồm văn bản, viền và nền, thành một hình ảnh raster duy nhất ở DPI được chọn. Trích xuất hình ảnh thay vào đó duyệt qua đồ thị đối tượng nội bộ của PDF và lấy ra từng tài nguyên hình ảnh nguyên trạng, bảo toàn kích thước pixel gốc và không gian màu của nó. Nếu một trang được xây dựng từ một bức ảnh toàn cạnh duy nhất, bạn nhận lại ảnh đó ở kích thước đã lưu trữ, không phải một bản render có kích thước trang. Nếu PDF không có hình ảnh raster nhúng (chỉ có đồ họa vector hoặc văn bản), công cụ sẽ không tìm thấy gì để trích xuất.

Cách sử dụng Trích xuất hình ảnh từ PDF, từng bước

  1. Tải PDF của bạn vào công cụ trích xuất.
  2. Đợi công cụ quét tài liệu và liệt kê các hình ảnh nhúng nó tìm thấy.
  3. Xem lại danh sách hình ảnh và chọn những hình nào để tải xuống, hoặc dùng tùy chọn tải xuống tất cả.
  4. Lưu các file PNG vào thiết bị của bạn.

Trường hợp sử dụng thường gặp

  • Tài liệu quảng cáo sản phẩm đến dưới dạng PDF và bạn cần ảnh sản phẩm gốc để tái sử dụng trong thuyết trình.
  • Kho lưu trữ đã quét chứa các bức ảnh nhúng cần được trích xuất riêng lẻ để lập danh mục.
  • PDF thiết kế có các file logo nhúng dưới dạng hình ảnh raster và bạn cần khôi phục chúng mà không cần xuất lại từ ứng dụng nguồn.
  • Báo cáo được giao dưới dạng PDF chứa các biểu đồ được lưu dưới dạng hình ảnh; trích xuất chúng để nhúng lại ở độ phân giải cao hơn trong tài liệu mới.

Câu hỏi thường gặp

Điều này khác gì với việc chuyển đổi trang PDF sang hình ảnh?

Chuyển đổi trang render toàn bộ bố cục trang thành bitmap ở DPI được chọn, bao gồm văn bản, nền và tất cả. Trích xuất hình ảnh duyệt qua đồ thị đối tượng PDF và lấy ra các tài nguyên hình ảnh riêng lẻ đã được đặt trong tài liệu, ở độ phân giải chúng được lưu trữ. Bạn nhận được hình ảnh nhúng gốc, không phải ảnh chụp màn hình của trang.

Các hình ảnh được trích xuất được lưu ở định dạng nào?

Hình ảnh được lưu dưới dạng file PNG. PNG không mất dữ liệu, vì vậy hình ảnh được trích xuất giữ nguyên dữ liệu pixel giống như bản gốc được lưu trữ mà không có thêm hiện tượng nén.

Điều gì xảy ra nếu PDF chỉ chứa đồ họa vector hoặc văn bản?

Công cụ chỉ tìm và trích xuất các tài nguyên hình ảnh raster. Nếu một trang được xây dựng hoàn toàn từ đường dẫn vector và văn bản, không có đối tượng hình ảnh nhúng nào để trích xuất và công cụ sẽ báo cáo không tìm thấy gì.

PDF có ở lại trên máy tính của tôi trong quá trình trích xuất không?

Có. Toàn bộ quá trình trích xuất chạy trong tab trình duyệt của bạn sử dụng pdf-lib. PDF được đọc vào bộ nhớ trình duyệt cục bộ, các tài nguyên hình ảnh được xác định và giải mã ở đó, và các file PNG được cung cấp dưới dạng bản tải xuống cục bộ. Tại không có điểm nào file được truyền đi đâu.

Các hình ảnh được trích xuất có độ phân giải bao nhiêu?

Ở độ phân giải được lưu trữ bên trong PDF. Công cụ không phóng to, thu nhỏ hay render lại. Nếu hình ảnh gốc được đặt ở 300 DPI và lưu trữ ở 2480 x 3508 pixel, đó là những gì bạn nhận lại.

Tôi có thể trích xuất hình ảnh từ PDF được bảo vệ bằng mật khẩu không?

Nếu PDF có mật khẩu chủ sở hữu hạn chế việc trích xuất, bạn sẽ cần xóa hạn chế đó trước bằng công cụ Mở khóa PDF. Nếu file có mật khẩu người dùng ngăn mở hoàn toàn, mật khẩu người dùng phải được cung cấp trước khi có thể xử lý bất cứ thứ gì.