Ingen upload, 100% lokalt, ingen konto

Artikel

Hvorfor PDF'er er så svære at redigere

At åbne en PDF og forvente at kunne ændre en sætning, som du ville i et tekstbehandlingsprogram, er en almindelig kilde til frustration. Et Word-dokument gemmer afsnit, typografier og ombrydningsregler; en PDF gemmer en færdig side. Her er, hvad der rent faktisk bor inde i en PDF, hvorfor det gør ægte tekstredigering svær, og hvad vores værktøjer kan og ikke kan gøre ved det.

En PDF beskriver en side, ikke et afsnit

Portable Document Format, standardiseret som ISO 32000, blev designet, så en side ser identisk ud på hver enhed og printer: den gemmer en indholdsstrøm af lavniveau-tegneinstruktioner, placer dette glyf ved denne x,y-koordinat, i stedet for afsnit af ombrydelig tekst. Et tekstbehandlingsprograms filformat holder tekst som en strøm af tegn med typografier og layoutregler knyttet til; en PDF holder selve det færdige layout. Det er hele grunden til, at den gengives identisk overalt, og hele grunden til, at det ikke bare er en simpel tekstredigering at flytte en sætning.

Diagram af en PDF-indholdsstrøm: individuelt placerede glyffer på en side, kontrasteret med et tekstbehandlingsprograms flydende afsnit af tegn

Hvorfor en sætning ikke bare flytter sig

I et ombrydeligt dokument skubber en forlænget sætning automatisk resten af afsnittet nedad. En PDF har ingen sådan regel: hver linje tekst er et separat placeret objekt, så at indsætte et ord betyder at genberegne og genplacere hvert glyf efter det, på den linje og ofte på hver linje nedenunder, for at undgå overlappende tekst. Software, der lader dig redigere en PDF som et dokument, genopbygger stille og roligt denne ombrydning bag kulisserne, hvilket er grunden til, at resultaterne kan forskyde mellemrum, skrifttyper eller linjeskift på måder, et rent tekstbehandlingsprogram aldrig ville.

Hvad vores PDF-editor rent faktisk gør

Vores PDF-editor tilføjer tekstbokse, billeder, markeringer og hvidlægningsrektangler oven på den eksisterende side, placeret hvor du end sætter dem; den rører eller ombryder ikke den underliggende indholdsstrøm. Det dækker de almindelige, virkelige tilfælde: at udfylde et blankt felt på en formular, tilføje et stempel eller en note, dække en linje før udskrivning. Det gør ikke en PDF om til et redigerbart afsnit igen, som et tekstbehandlingsprogram ville, fordi det ville kræve genopbygning af dokumentets struktur, ikke bare tegning oven på den.

Side-om-side-diagram: vores PDF-editor lægger nye elementer over den eksisterende side, versus hvad en fuld ombrydnings-rekonstruktion til et redigerbart dokument ville kræve

Når du rent faktisk har brug for teksten, ikke layoutet

Hvis målet er at genbruge ordlyden, så kopiér den ud i stedet for at redigere siden på stedet: vores PDF-til-tekst-værktøj udtrækker de underliggende tegnobjekter, eller kører OCR på en scannet side, der ingen har, til almindelig tekst, du kan indsætte i en hvilken som helst editor og omformatere fra bunden. Det omgår ombrydningsproblemet helt, da du arbejder med ordene, ikke den faste side, de blev tegnet på.

At konvertere en PDF tilbage til et Word-dokument

At gøre en PDF om til en helt redigerbar, ombrydelig Word-fil er et andet, meget sværere problem: det kræver at udlede afsnitsgrænser, typografier og tabelstruktur fra en side, der kun registrerede placerede glyffer, hvilket er præcis den slags tunge, upræcise genopbygning, et server-side-værktøj laver. Det er reelt uden for rammerne for et browser-only-site bygget omkring aldrig at uploade en fil: det er ikke noget, vi gør, og ethvert værktøj, der påstår en perfekt PDF-til-redigerbar-Word-konvertering, laver tabsgivende gætteri et sted.

Værktøjer i denne artikel

Ofte stillede spørgsmål

Kan jeg redigere den faktiske tekst i en PDF gratis uden at uploade den?

Du kan tilføje ny tekst, billeder og dækbokse oven på siden med vores PDF-editor, helt i din browser. At ændre den oprindelige tekst på stedet, sådan som du ville i et tekstbehandlingsprogram, kræver, at dokumentet genopbygges som en ombrydelig fil, hvilket er en anden og meget tungere operation end at lægge elementer over.

Hvorfor giver kopiering af tekst ud af en PDF nogle gange et rodet resultat?

PDF-tekstobjekter er placeret uafhængigt og behøver ikke være gemt i læserækkefølge. En side, der er lagt ud i kolonner, kan for eksempel have sine underliggende objekter ordnet fra top til bund på tværs af hele siden i stedet for kolonne for kolonne, så en direkte kopiér-indsæt kan sammenblande urelaterede linjer.

Er der en reel måde at få en PDF's indhold ind i en redigerbar Word-fil på?

Dedikerede konverteringstjenester forsøger det ved at udlede afsnit og typografier fra sidelayoutet, med blandede resultater afhængigt af, hvor komplekst det oprindelige dokument er. Den genopbygning er ikke noget, et client-side, ingen-upload-værktøj kan gøre tabsfrit, hvilket er grunden til, at det forbliver uden for, hvad dette site tilbyder; at udtrække teksten med PDF til tekst og omformatere den selv er det ærlige alternativ.

Kilder