Sin subida, 100% local, sin cuenta

OCR, extraer texto de imágenes y PDFs

Suelta una imagen o PDF y obtén el texto reconocido. El OCR se ejecuta completamente en tu navegador (en el dispositivo, sin conexión después de la primera carga), nada se sube.

Cómo funciona OCR · imagen/PDF a texto

OCR convierte una imagen escaneada o un PDF basado en imágenes en texto que puedes copiar, buscar y editar, usando tesseract.js ejecutándose completamente dentro de tu navegador. Eliges el idioma del documento en el selector, el modelo de idioma correspondiente se descarga a tu navegador una vez, y todo el reconocimiento posterior se ejecuta sin conexión desde ese modelo en caché. Tus archivos escaneados nunca se transmiten a ningún servidor durante la conversión.

La precisión del reconocimiento depende fuertemente de la calidad del escaneo. Los escaneos limpios y de alto contraste a 200 DPI o más, con mínimo ruido de fondo y alineación de página recta, producen los mejores resultados. Los JPEG borrosos, de baja resolución o muy comprimidos, las páginas con columnas o diseños complejos, y el texto manuscrito reducen la precisión. La herramienta produce un bloque de texto simple; para una salida estructurada como tablas conservadas o diseño de varias columnas, se necesita postprocesamiento. Ejecutar la herramienta PDF Deskew en escaneos torcidos antes del OCR generalmente mejora las tasas de reconocimiento.

Cómo usar OCR · imagen/PDF a texto, paso a paso

  1. Arrastra tu imagen escaneada (PNG, JPG, TIFF) o PDF basado en imágenes al área de carga.
  2. Selecciona el idioma principal del documento en el menú desplegable de idiomas.
  3. Si es la primera vez que usas ese idioma, espera a que se descargue el modelo de idioma (esto ocurre una vez).
  4. Haz clic en extraer texto y espera a que tesseract.js procese cada página.
  5. Copia el texto reconocido o descárgalo como archivo de texto simple.

Casos de uso comunes

  • Un recibo escaneado necesita que sus elementos de línea se extraigan a una hoja de cálculo; ejecuta OCR para obtener el texto y luego pégalo en tu software de contabilidad.
  • Un archivo de artículos de revista escaneados necesita hacerse buscable por texto; convierte cada uno a texto con OCR para su indexación.
  • Una pizarra fotografiada de una reunión contiene notas que deben convertirse en un documento editable.
  • Un documento histórico escaneado en alemán necesita que su texto se extraiga para su traducción; selecciona alemán como idioma antes de ejecutar OCR.

Preguntas frecuentes

¿Por qué necesito descargar un modelo de idioma antes de que OCR funcione?

tesseract.js usa archivos de datos de redes neuronales entrenados específicos para cada idioma. Estos archivos tienen varios megabytes cada uno y se descargan una vez desde este sitio (los alojamos nosotros mismos, sin ninguna CDN de terceros) la primera vez que seleccionas ese idioma. Tras la descarga inicial, el modelo queda en caché por tu navegador y todo el reconocimiento posterior para ese idioma se ejecuta completamente sin conexión.

¿Qué factores afectan más a la precisión del OCR?

La resolución del escaneo (mínimo 200 DPI, se recomiendan 300 DPI), la nitidez de la imagen, el contraste entre el texto y el fondo, y si la página está recta afectan fuertemente a la precisión. Los escaneos JPEG muy comprimidos, las fuentes muy pequeñas y las páginas con orientaciones mixtas o diseños de columna complejos son las fuentes más comunes de errores de reconocimiento.

¿Puede OCR leer texto manuscrito?

tesseract.js está entrenado principalmente en texto impreso. La precisión del reconocimiento de escritura a mano es generalmente baja y poco fiable, especialmente para la escritura cursiva. Para documentos manuscritos, las herramientas dedicadas al reconocimiento de escritura a mano producen mejores resultados.

¿Mis documentos escaneados se envían a algún lugar durante la extracción de texto?

No. Una vez que el modelo de idioma está en caché, cada tarea de reconocimiento ocurre completamente en tu navegador usando tesseract.js. Los documentos escaneados pueden contener contenido personal o confidencial; este procesamiento exclusivamente local significa que ese contenido nunca llega a un servidor.

¿La herramienta conserva el diseño del escaneo original?

El resultado es un flujo de texto simple en orden de lectura. Las tablas, columnas, cabeceras y otros elementos de diseño no se conservan como estructura; la herramienta produce solo el contenido de texto. Para una salida que conserve el diseño, se requiere un flujo OCR más avanzado con análisis de diseño.

¿Puedo aplicar OCR a un PDF que ya contiene texto seleccionable?

La herramienta puede procesar PDFs basados en imágenes donde cada página es una imagen rasterizada sin texto incrustado. Si tu PDF ya tiene una capa de texto (puedes seleccionar y copiar texto en un visor), ejecutar OCR es innecesario; la capa de texto existente te da la misma información sin el paso de reconocimiento.

¿Puedo ejecutar OCR en una foto tomada con mi teléfono?

Sí, y tesseract.js funciona en navegadores móviles, así que puedes incluso abrir esta página en el mismo teléfono que tomó la foto. Las fotos tomadas en ángulo o con iluminación desigual se reconocen peor que un escaneo plano; enderezar la toma y recortar el fondo primero ayuda.

¿Necesito crear una cuenta o pagar para usar el OCR?

No. No hay registro ni coste. La única descarga implicada es el modelo de idioma que tesseract.js necesita una sola vez, que es una descarga puntual del motor, no una suscripción ni un muro de pago.