Come funziona PDF in testo
Da PDF a testo estrae il livello testo esistente da un PDF e lo salva come file .txt semplice. L'estrazione è eseguita da pdf.js nel tuo browser, leggendo gli oggetti contenuto testo incorporati nei flussi di pagina del PDF. Il documento non lascia mai il tuo dispositivo; il risultato viene assemblato localmente e offerto come download diretto.
Questo strumento legge un livello testo già presente nel file. Se il tuo PDF è stato creato da un elaboratore testi o uno strumento di esportazione, quasi certamente ha un livello testo e l'estrazione funzionerà bene. Se il PDF è la scansione di un documento cartaceo, le pagine contengono solo dati immagine e non c'è un livello testo da estrarre; in quel caso, questo strumento restituirà output vuoto o incompleto. I PDF scansionati richiedono il riconoscimento ottico dei caratteri (OCR) per produrre testo, un processo separato non eseguito da questo strumento. Verifica che il tuo PDF abbia testo selezionabile in un visualizzatore prima di usare questo strumento.