Ingen uppladdning, 100% lokalt, inget konto

Artikel

Varför PDF:er är så svåra att redigera

Att öppna en PDF och förvänta sig att kunna ändra en mening på samma sätt som i en ordbehandlare är en vanlig källa till frustration. Ett Word-dokument lagrar stycken, stilar och omflytningsregler; en PDF lagrar en färdig sida. Här är vad som faktiskt finns inuti en PDF, varför det gör riktig textredigering svår, och vad våra verktyg kan och inte kan göra åt det.

En PDF beskriver en sida, inte ett stycke

Portable Document Format, standardiserat som ISO 32000, designades så att en sida ser identisk ut på varje enhet och skrivare: den lagrar en innehållsström av lågnivåritinstruktioner, placera det här tecknet på den här x,y-koordinaten, snarare än stycken av omflytande text. En ordbehandlares filformat håller text som ett flöde av tecken med stilar och layoutregler kopplade; en PDF behåller själva den färdiga layouten. Det är hela anledningen till att den ritas identiskt överallt, och hela anledningen till att flytta en mening inte är en enkel textändring.

Diagram över en PDF-innehållsström: individuellt positionerade tecken på en sida, kontrasterat mot en ordbehandlares flytande stycke av tecken.

Varför en mening inte bara flyttar sig

I ett omflytande dokument knuffar en förlängd mening automatiskt ner resten av stycket. En PDF har ingen sådan regel: varje textrad är ett separat positionerat objekt, så att lägga in ett ord innebär att räkna om och omplacera varje tecken efter det, på den raden och ofta på varje rad under den, för att undvika överlappande text. Mjukvara som låter dig redigera en PDF som ett dokument återskapar i tysthet det här flödet i bakgrunden, vilket är varför resultaten kan förskjuta mellanrum, typsnitt eller radbrytningar på sätt en äkta ordbehandlare aldrig skulle.

Vad vår PDF-redigerare faktiskt gör

Vår PDF-redigerare lägger till textrutor, bilder, markeringar och vittäckande rektanglar ovanpå den befintliga sidan, positionerade var du än placerar dem; den rör eller flyttar inte om den ursprungliga innehållsströmmen under. Det täcker de vanliga verkliga fallen: att fylla i ett fält i ett formulär, lägga till en stämpel eller en anteckning, täcka en rad före utskrift. Den gör inte om en PDF till ett redigerbart stycke på det sätt en ordbehandlare skulle, eftersom det skulle kräva att dokumentets struktur byggs om, inte bara ritas över.

Diagram sida vid sida: vår PDF-redigerare lägger nya element ovanpå den befintliga sidan jämfört med vad en fullständig omflytningsrekonstruktion till ett redigerbart dokument skulle kräva.

När du faktiskt behöver texten, inte layouten

Är målet att återanvända ordalydelsen, kopiera ut den i stället för att redigera sidan på plats: vårt verktyg PDF till text extraherar de underliggande teckenobjekten, eller kör OCR på en skannad sida som saknar dem, till ren text du kan klistra in i vilken redigerare som helst och formatera om från grunden. Det kringgår omflytningsproblemet helt, eftersom du arbetar med orden, inte den fasta sidan de ritades på.

Att konvertera en PDF tillbaka till ett Word-dokument

Att göra om en PDF till en fullt redigerbar, omflytande Word-fil är ett annat, mycket svårare problem: det kräver att sluta sig till styckegränser, stilar och tabellstruktur från en sida som bara registrerade positionerade tecken, vilket är precis den sortens tunga, ofullständiga rekonstruktion ett serversidigt verktyg gör. Det ligger genuint utanför räckvidden för en webbläsarbaserad sajt byggd kring att aldrig ladda upp en fil: det är inget vi gör, och varje verktyg som påstår sig göra en perfekt PDF-till-redigerbart-Word-konvertering gissar med förlust någonstans.

Verktyg i den här artikeln

Vanliga frågor

Kan jag redigera den faktiska texten i en PDF gratis utan att ladda upp den?

Du kan lägga till ny text, bilder och övertäckande rutor ovanpå sidan med vår PDF-redigerare, helt i din webbläsare. Att ändra originaltexten på plats, på det sätt du skulle göra i en ordbehandlare, kräver att dokumentet byggs om som en omflytande fil, vilket är en annan och mycket tyngre operation än att lägga element ovanpå.

Varför ger det ibland en rörig röra att kopiera ut text från en PDF?

PDF-textobjekt positioneras oberoende av varandra och behöver inte lagras i läsordning. En sida upplagd i kolumner kan till exempel ha sina underliggande objekt ordnade uppifrån och ner över hela sidan snarare än kolumn för kolumn, så en rak kopiera-klistra kan fläta ihop orelaterade rader.

Finns det ett riktigt sätt att få en PDF:s innehåll in i en redigerbar Word-fil?

Dedikerade konverteringstjänster försöker göra det genom att sluta sig till stycken och stilar från sidlayouten, med varierande resultat beroende på hur komplext originaldokumentet är. Den rekonstruktionen är inget ett klientsidigt verktyg utan uppladdning kan göra utan förlust, vilket är varför det ligger utanför vad den här sajten erbjuder; att extrahera texten med PDF till text och formatera om den själv är det ärliga alternativet.

Källor