Artikel
Varför att svärta över text i en PDF ofta misslyckas
En svart rektangel ritad över ett stycke ser ut som att texten är borta, men i de flesta PDF-redigerare är den inte det. Bokstäverna du täckte lagras fortfarande i filen som markerbara tecken; rutan är bara en ny form som ligger ovanpå dem. Kopiera sidan, sök i den, eller öppna den i en annan läsare, och den "censurerade" meningen kan dyka upp igen. Här är varför det händer, och en censureringsmetod som faktiskt tar bort texten i stället för att dölja den.
En form ovanpå är ingen borttagning
En PDF-sida håller två saker separat: textobjekten, vart och ett ett tecken med en position och ett typsnitt, och ritobjekten placerade på sidan, vilket inkluderar varje rektangel, markering eller anteckning du lägger till. När du ritar en svart ruta i en PDF-läsare lägger du till ett nytt ritobjekt ovanför de befintliga textobjekten. Sidan ser nu censurerad ut eftersom rutan visuellt täcker bokstäverna. Ingenting säger åt filen att ta bort textobjekten under, så de ligger kvar exakt där de var, på samma position, med samma innehåll.

Hur originaltexten dyker upp igen
Eftersom textobjekten aldrig lämnade filen kan fyra vanliga handlingar avslöja dem: att markera och kopiera den "övertäckta" raden, köra en textsökning genom dokumentet, extrahera råtexten med vilket PDF-till-text-verktyg som helst, eller öppna filen i en läsare som ritar textobjekt ovanför ritobjekt i en annan ordning. Ingen av dessa kräver särskild kompetens. Det här har hänt offentligt mer än en gång: PDF:er publicerade med svarta rutor över känsliga stycken visade sig fortfarande innehålla läsbar, kopierbar text under, och misstaget hamnade i nyheterna i stället för att förbli dolt.
Att göra om sidan till en bild först
Lösningen är att ta bort textlagret innan du censurerar, inte efteråt. Konvertera PDF-sidan till en vanlig bild med ett verktyg som PDF till bilder, och rita sedan över det känsliga området på den bilden med Censurera bildregioner. Vid den punkten finns inga textobjekt kvar på sidan, bara pixlar, så rutan ligger inte ovanpå något som går att återskapa. Sätt ihop de censurerade bilderna till en PDF igen med Bilder till PDF och den tidigare känsliga texten existerar helt enkelt inte längre, bara en bild av en sida med en del av den övertäckt.

Vad detta ger upp
Att rastrera en sida gör om riktig, sökbar text till en statisk bild, så att den som läser den censurerade sidan efteråt inte längre kan markera eller söka i den sidans text, censurerad eller inte. Det är en godtagbar avvägning för sidan du skyddar: alternativet, att behålla textlagret intakt och hoppas att ingen kontrollerar, är precis det misstag den här artikeln började med. Bär andra sidor i samma dokument inget känsligt innehåll kan du lämna dem orörda och bara rastrera de sidor som behöver det.
Använd en heltäckande ruta, och kontrollera metadatan också
För text är en helt ogenomskinlig svart eller enfärgad ruta det säkrare valet; ett suddighetsfilter kan ibland räknas baklänges för stor, ren text om suddigheten är lätt, så det passar bättre för ansikten eller foton än för meningar. Att censurera den synliga sidan rör inte heller filens metadata: författarnamn, mjukvaruversion, GPS-koordinater på inbäddade foton eller redigeringshistorik kan läcka separat från sidans innehåll. Spelar det roll för ditt dokument, kontrollera vad din fils egen metadata avslöjar innan du delar den.
Verktyg i den här artikeln
- PDF till bilderKonvertera varje PDF-sida till PNG eller JPG direkt i din webbläsare.
- Censurera bildregionerSudda ut eller svärta känsliga delar av dina bilder innan du delar dem, ingen uppladdning.
- Bilder till PDFKombinera en eller flera bilder (JPG, PNG, WebP) till en enda PDF, direkt i din webbläsare.
Vanliga frågor
Tar det bort texten under att rita en svart rektangel i en PDF-läsare?
Oftast inte. Om inte verktyget har en dedikerad censureringsfunktion som tar bort de underliggande textobjekten, lägger en ritad form bara till ett lager ovanpå sidan. De ursprungliga tecknen finns kvar i filen och kan markeras, sökas eller extraheras med vanliga verktyg.
Är det säkrare att sudda ut känslig text än att täcka den med en ruta?
För text, nej. En lätt suddighet applicerad på stor, ren text kan ibland kastas om tillräckligt bra för att gissa de ursprungliga tecknen, särskilt med korta ord eller siffror. En heltäckande, helt ogenomskinlig ruta, eller att ta bort textlagret helt genom att rastrera först, är det säkrare alternativet för text; suddighet passar bättre för ansikten eller allmänt fotoinnehåll.
Går något viktigt förlorat om man konverterar en PDF till bilder innan man censurerar?
Det tappar möjligheten att markera eller söka text på sidorna du konverterar, eftersom de blir vanliga bilder. För en sida du aktivt censurerar är det poängen: den känsliga texten existerar inte längre som extraherbara tecken. Sidor utan känsligt innehåll kan förbli vanliga PDF-sidor om du bara rastrerar de som behövs.