Ingen opplasting, 100% lokalt, ingen konto

OCR, hent ut tekst fra bilder og PDF-er

Slipp et bilde eller en PDF og få gjenkjent tekst. OCR kjører helt i nettleseren (på enheten, frakoblet etter første lasting), ingenting lastes opp.

Slik fungerer OCR · bilde/PDF til tekst

OCR konverterer et skannet bilde eller en bildebasert PDF til tekst du kan kopiere, søke i og redigere, ved hjelp av tesseract.js som kjører helt inne i nettleseren din. Du velger dokumentspråket fra velgeren, den relevante språkmodellen lastes ned til nettleseren én gang, og all påfølgende gjenkjenning kjøres frakoblet fra den bufrede modellen. De skannede filene dine overføres aldri til noen server under konverteringen.

Gjenkjenningsnøyaktigheten avhenger sterkt av skanningskvaliteten. Rene, høykontrastskannede sider ved 200 DPI eller høyere, med minimal bakgrunnsstøy og rett sidejustering, gir de beste resultatene. Uskarpe, lavoppløselige eller sterkt komprimerte JPEG-er, sider med kolonner eller komplekse oppsett, og håndskrevet tekst reduserer alle nøyaktigheten. Verktøyet gir en ren tekstblokk; for strukturert utdata som bevarte tabeller eller flerkolonneoppsett er etterprosessering nødvendig. Å kjøre PDF Deskew-verktøyet på skjeve skannede sider før OCR forbedrer typisk gjenkjenningsratene.

Slik bruker du OCR · bilde/PDF til tekst, steg for steg

  1. Slipp det skannede bildet ditt (PNG, JPG, TIFF) eller bildebasert PDF på opplastingsfeltet.
  2. Velg dokumentets primære språk fra språkrullegardinmenyen.
  3. Hvis dette er første gang du bruker det språket, vent på at språkmodellen lastes ned (dette skjer én gang).
  4. Klikk trekk ut tekst og vent på at tesseract.js behandler hver side.
  5. Kopier den gjenkjente teksten eller last den ned som en ren tekstfil.

Vanlige bruksområder

  • En skannet kvittering trenger at linjeelementene trekkes ut i et regneark; kjør OCR for å få teksten, og lim deretter inn i regnskapsprogramvaren.
  • Et arkiv med skannede tidsskriftartikler må gjøres tekstsøkbar; konverter hvert til tekst med OCR for indeksering.
  • Et fotografert whiteboard fra et møte inneholder notater som må gjøres om til et redigerbart dokument.
  • Et historisk skannet dokument på tysk trenger teksten sin trukket ut for oversettelse; velg tysk som språk før du kjører OCR.

Ofte stilte spørsmål

Hvorfor må jeg laste ned en språkmodell før OCR fungerer?

tesseract.js bruker trenede nevralnettsdatafiler spesifikke for hvert språk. Disse filene er flere megabyte hver og lastes ned én gang fra dette nettstedet (vi er selv vert for dem, uten tredjeparts-CDN) første gang du velger det språket. Etter den første nedlastingen bufres modellen av nettleseren din, og all videre gjenkjenning for det språket kjøres helt frakoblet.

Hvilke faktorer påvirker OCR-nøyaktigheten mest?

Skanningsoppløsning (minimum 200 DPI, anbefalt 300 DPI), bildeskarphet, kontrast mellom tekst og bakgrunn, og om siden er rett, påvirker alle nøyaktigheten sterkt. Sterkt komprimerte JPEG-skannede sider, svært små skrifter og sider med blandede orienteringer eller komplekse kolonneoppsett er de vanligste kildene til gjenkjenningsfeil.

Kan OCR lese håndskrevet tekst?

tesseract.js er primært trent på trykt tekst. Håndskriftsgjenkjenningsnøyaktighet er generelt lav og upålitelig, spesielt for kursivskrift. For håndskrevne dokumenter gir dedikerte håndskriftsgjenkjenningsverktøy bedre resultater.

Sendes de skannede dokumentene mine noe sted under tekstuttrekking?

Nei. Etter at språkmodellen er bufret, skjer hver gjenkjenningsoppgave helt i nettleseren din ved hjelp av tesseract.js. Skannede dokumenter kan inneholde personlig eller konfidensiell informasjon; denne kun-lokale behandlingen betyr at innholdet aldri når en server.

Bevarer verktøyet oppsettet til det originale skannet?

Utdataene er en ren tekststrøm i leserekkefølge. Tabeller, kolonner, overskrifter og andre oppsettelementer bevares ikke som struktur; verktøyet gir bare tekstinnholdet. For oppsettbevarende utdata er en mer avansert OCR-pipeline med oppsettanalyse nødvendig.

Kan jeg kjøre OCR på en PDF som allerede inneholder valgbar tekst?

Verktøyet kan behandle bildebaserte PDF-er der hver side er et rasterbilde uten innebygd tekst. Hvis PDF-en allerede har et tekstlag (du kan velge og kopiere tekst i en leser), er det unødvendig å kjøre OCR; det eksisterende tekstlaget gir deg samme informasjon uten gjenkjenningssteget.

Kan jeg kjøre OCR på et bilde tatt med telefonen?

Ja, og tesseract.js fungerer i mobilnettlesere, så du kan til og med åpne denne siden på telefonen som tok bildet. Bilder tatt i en vinkel eller med ujevn belysning gjenkjennes dårligere enn en flatbed-skanning; det hjelper å rette opp bildet og beskjære bort bakgrunnen først.

Må jeg opprette en konto eller betale for å bruke OCR?

Nei. Det finnes ingen registrering og ingen avgift. Den eneste nedlastingen som er involvert, er den engangs-språkmodellen tesseract.js trenger, som er en engangsnedlasting av motoren, ikke et abonnement eller en betalingsmur.