Cum funcționează PDF în text
PDF to Text extrage stratul de text existent dintr-un PDF și îl salvează ca fișier .txt simplu. Extracția este efectuată de pdf.js în browserul dumneavoastră, citind obiectele de conținut text încorporate în fluxurile de pagină ale PDF-ului. Documentul nu părăsește niciodată dispozitivul dumneavoastră; rezultatul este asamblat local și oferit ca descărcare directă.
Acest instrument citește un strat de text care este deja prezent în fișier. Dacă PDF-ul a fost creat de un procesor de text sau un instrument de export, aproape sigur are un strat de text și extracția va funcționa bine. Dacă PDF-ul este o scanare a unui document pe hârtie, paginile conțin doar date de imagine și nu există niciun strat de text de extras; în acel caz, instrumentul va returna ieșire goală sau incompletă. PDF-urile scanate necesită recunoaștere optică a caracterelor (OCR) pentru a produce text, care este un proces separat neefectuat de acest instrument. Verificați dacă PDF-ul dumneavoastră are text selectabil într-un vizualizator înainte de a folosi acest instrument.