Как работает HTML в PDF
HTML в PDF принимает HTML-разметку, вставленную в редактор, очищает её с помощью DOMPurify для удаления скриптов и небезопасных атрибутов, рендерит на скрытом canvas с помощью html2canvas и кодирует результат в PDF с помощью jsPDF. Весь конвейер работает внутри вкладки браузера; ни HTML-код, ни результат рендеринга не передаются на какой-либо сервер. Это делает инструмент подходящим для конвертации HTML-фрагментов, содержащих личные данные, которые не хочется вставлять в онлайн-сервис.
Прежде чем использовать этот инструмент, важно понять формат вывода. Страницы PDF являются растровыми изображениями, а не векторным текстом. Текст в выводе нельзя выделить, найти поиском или переформатировать. Внешние ресурсы, такие как изображения, на которые ссылаются по URL, блокируются политикой CORS браузера и не загрузятся. Встроенные стили и CSS работают, но сложные макеты с нестандартными веб-шрифтами или продвинутым CSS grid могут отображаться некорректно. Для документально-точной конвертации полных веб-страниц более подходящим инструментом является безголовый браузер на стороне сервера.