Så fungerar PDF till text
PDF till text extraherar det befintliga textlagret från en PDF och sparar det som en vanlig .txt-fil. Extraktion utförs av pdf.js inuti din webbläsare, som läser textinnehållsobjekten inbäddade i PDF-filens sidströmmar. Dokumentet lämnar aldrig din enhet; resultatet sätts ihop lokalt och erbjuds som en direkt nedladdning.
Det här verktyget läser ett textlager som redan finns i filen. Om din PDF skapades av ett ordbehandlingsprogram eller ett exportverktyg har den nästan säkert ett textlager och extraktion fungerar bra. Om PDF-filen är en skanning av ett pappersdokument innehåller sidorna bara bilddata och det finns inget textlager att extrahera; i så fall returnerar verktyget tomma eller ofullständiga utdata. Skannade PDF-filer kräver optisk teckenigenkänning (OCR) för att producera text, vilket är en separat process som inte utförs av det här verktyget. Kontrollera om din PDF har markerbar text i en visare innan du använder verktyget.