Yükleme yok, %100 yerel, hesap yok

OCR, görüntülerden ve PDF'lerden metin çıkar

Bir görüntü veya PDF bırakın ve tanınan metni alın. OCR tamamen tarayıcınızda çalışır (cihaz üzerinde, ilk yüklemeden sonra çevrimdışı), hiçbir şey yüklenmez.

OCR · görüntü/PDF'den metne nasıl çalışır

OCR, taranmış bir görüntüyü ya da görüntü tabanlı PDF'i kopyalayabileceğiniz, arayabileceğiniz ve düzenleyebileceğiniz metne dönüştürür; bunun için tamamen tarayıcınızın içinde çalışan tesseract.js kullanır. Seçiciden belge dilini seçersiniz, ilgili dil modeli tarayıcınıza bir kez indirilir ve sonraki tüm tanıma işlemleri bu önbelleğe alınmış modelden çevrimdışı olarak çalışır. Taranmış dosyalarınız dönüştürme sırasında hiçbir sunucuya iletilmez.

Tanıma doğruluğu, tarama kalitesine güçlü biçimde bağlıdır. 200 DPI ve üzeri temiz, yüksek kontrastlı taramalar, minimal arka plan gürültüsü ve düz sayfa hizalamasıyla en iyi sonuçlar elde edilir. Bulanık, düşük çözünürlüklü ya da aşırı sıkıştırılmış JPEG'ler, sütunlu ya da karmaşık düzeni olan sayfalar ve el yazısı metin doğruluğu düşürür. Araç düz metin bloğu çıktısı verir; tablo korumalı ya da çok sütunlu çıktı gibi yapılandırılmış sonuçlar için işleme sonrası adımlar gereklidir. OCR öncesinde eğri taramalarda PDF Eğikliği Gider aracının çalıştırılması tanıma oranlarını artırır.

OCR · görüntü/PDF'den metne nasıl kullanılır, adım adım

  1. Taranmış görüntünüzü (PNG, JPG, TIFF) ya da görüntü tabanlı PDF'inizi yükleme alanına bırakın.
  2. Dil açılır menüsünden belgenin birincil dilini seçin.
  3. O dili ilk kez kullanıyorsanız dil modelinin indirilmesini bekleyin (bu işlem bir kez gerçekleşir).
  4. Metin çıkar düğmesine tıklayın ve tesseract.js'nin her sayfayı işlemesini bekleyin.
  5. Tanınan metni kopyalayın ya da düz metin dosyası olarak indirin.

Yaygın kullanım örnekleri

  • Taranmış bir fişin kalem kalemleri bir hesap tablosuna çıkarılmak isteniyor; metni elde etmek için OCR çalıştırın, ardından muhasebe yazılımınıza yapıştırın.
  • Taranmış dergi makalelerinden oluşan bir arşivin metin aranabilir hale getirilmesi gerekiyor; dizinleme için her birini OCR ile metne dönüştürün.
  • Toplantıdan fotoğraflanan bir beyaz tahta, düzenlenebilir belgeye dönüştürülmesi gereken notlar içeriyor.
  • Almanca tarihî taranmış belgenin çeviri için metne çıkarılması gerekiyor; OCR çalıştırmadan önce dil olarak Almanca'yı seçin.

Sık sorulan sorular

OCR çalışmadan önce neden dil modeli indirmem gerekiyor?

tesseract.js, her dile özgü eğitilmiş sinir ağı veri dosyaları kullanır. Bu dosyalar birkaç megabayt büyüklüğündedir ve o dili ilk seçtiğinizde bu siteden bir kez indirilir (dosyaları biz kendimiz barındırıyoruz, üçüncü taraf bir CDN kullanılmıyor). İlk indirmenin ardından model tarayıcınız tarafından önbelleğe alınır ve o dil için sonraki tüm tanıma işlemleri tamamen çevrimdışı çalışır.

OCR doğruluğunu en çok etkileyen faktörler nelerdir?

Tarama çözünürlüğü (en az 200 DPI, 300 DPI önerilir), görüntü netliği, metin ile arka plan arasındaki kontrast ve sayfanın düz olup olmadığı doğruluğu en çok etkileyen unsurlardır. Aşırı sıkıştırılmış JPEG taramalar, çok küçük fontlar ve karışık yönlü ya da karmaşık sütun düzeni içeren sayfalar en yaygın tanıma hatası kaynaklarıdır.

OCR el yazısını okuyabilir mi?

tesseract.js ağırlıklı olarak basılı metin üzerine eğitilmiştir. El yazısı tanıma doğruluğu, özellikle el yazısı metin için genellikle düşük ve güvenilmezdir. El yazılı belgeler için özel el yazısı tanıma araçları daha iyi sonuç verir.

Metin çıkarma sırasında taranmış belgelerim herhangi bir yere gönderiliyor mu?

Hayır. Dil modeli önbelleğe alındıktan sonra her tanıma görevi tesseract.js kullanılarak tamamen tarayıcınızda çalışır. Taranmış belgeler kişisel ya da gizli içerik barındırabilir; yalnızca yerel işleme gerçekleşmesi, bu içeriklerin hiçbir sunucuya ulaşmadığı anlamına gelir.

Araç özgün taramanın düzenini koruyor mu?

Çıktı, okuma sırasında düz metin akışıdır. Tablolar, sütunlar, üst bilgiler ve diğer düzen öğeleri yapı olarak korunmaz; araç yalnızca metin içeriğini çıktılar. Düzeni koruyan çıktı için düzey analizi içeren daha gelişmiş OCR ardışık düzenleri gereklidir.

Zaten seçilebilir metin içeren bir PDF'e OCR uygulayabilir miyim?

Araç, her sayfanın gömülü metin içermeyen tarama görüntüsü olduğu görüntü tabanlı PDF'leri işleyebilir. PDF'inizin zaten metin katmanı varsa (görüntüleyicide metin seçip kopyalayabiliyorsanız) OCR çalıştırmak gereksizdir; mevcut metin katmanı, tanıma adımı olmadan aynı bilgiyi verir.

Telefonumla çekilen bir fotoğrafta OCR çalıştırabilir miyim?

Evet, ve tesseract.js mobil tarayıcılarda çalışır, bu yüzden bu sayfayı fotoğrafı çeken telefonda bile açabilirsiniz. Açılı ya da düzensiz aydınlatmayla çekilen fotoğraflar düz bir tarayıcı taramasından daha kötü tanınır; çekimi düzeltmek ve önce arka planı kırpmak yardımcı olur.

OCR kullanmak için hesap oluşturmam ya da ödeme yapmam gerekiyor mu?

Hayır. Kayıt ya da ücret yoktur. Söz konusu olan tek indirme, tesseract.js'nin ihtiyaç duyduğu tek seferlik dil modelidir; bu, bir abonelik ya da ödeme duvarı değil, tek seferlik bir motor indirmesidir.