Cách HTML sang PDF hoạt động
HTML sang PDF lấy mã đánh dấu HTML bạn dán vào trình soạn thảo, làm sạch nó bằng DOMPurify để loại bỏ các script và thuộc tính không an toàn, kết xuất nó trên canvas ẩn bằng html2canvas, và mã hóa kết quả thành PDF bằng jsPDF. Toàn bộ quy trình chạy trong tab trình duyệt của bạn; không có mã HTML hay đầu ra kết xuất nào được truyền đến bất kỳ máy chủ nào. Điều này khiến nó phù hợp để chuyển đổi các đoạn HTML chứa dữ liệu cá nhân mà bạn không muốn dán vào một dịch vụ trực tuyến.
Hãy hiểu định dạng đầu ra trước khi bạn dựa vào nó. Các trang PDF là hình ảnh raster, không phải văn bản vector. Văn bản trong đầu ra không thể chọn, không thể tìm kiếm, và không thể tái định dạng lại. Các tài nguyên bên ngoài như hình ảnh được tham chiếu bởi URL bị chặn bởi chính sách CORS của trình duyệt và sẽ không tải. Inline style và CSS nhúng hoạt động, nhưng bố cục phức tạp với phông chữ web tùy chỉnh hoặc CSS grid nâng cao có thể không kết xuất chính xác. Để chuyển đổi trung thực với tài liệu của các trang web đầy đủ, trình duyệt headless chạy phía máy chủ là công cụ phù hợp hơn.