Yükleme yok, %100 yerel, hesap yok

PDF → Metin çıkarma

PDF'nizden okunabilir tüm metni çıkarın. .txt dosyası olarak indirin. Her şey tarayıcınızda kalır, hiçbir dosya sunucuya gönderilmez.

PDF'den metne nasıl çalışır

PDF'den Metne, bir PDF'de var olan metin katmanını ayıklar ve düz bir .txt dosyası olarak kaydeder. Ayıklama, PDF sayfa akışlarına gömülü metin içerik nesnelerini okuyarak tarayıcınızın içindeki pdf.js tarafından gerçekleştirilir. Belge cihazınızı terk etmez; sonuç yerel olarak derlenir ve doğrudan indirme olarak sunulur.

Bu araç, dosyada zaten var olan metin katmanını okur. PDF'iniz bir kelime işlemci ya da dışa aktarma aracı tarafından oluşturulduysa neredeyse kesinlikle metin katmanına sahiptir ve ayıklama iyi çalışacaktır. PDF bir kağıt belgenin taramasıysa sayfalar yalnızca görüntü verisi içerir ve ayıklanacak metin katmanı yoktur; bu durumda araç boş ya da eksik çıktı döndürür. Taranmış PDF'ler metin üretmek için optik karakter tanıma (OCR) gerektirir; bu ayrı bir işlemdir ve bu araç tarafından gerçekleştirilmez. Bu aracı kullanmadan önce PDF'inizin görüntüleyicideyken seçilebilir metin içerip içermediğini kontrol edin.

PDF'den metne nasıl kullanılır, adım adım

  1. PDF'inizi metin ayıklama aracına yükleyin.
  2. pdf.js'nin tüm sayfalardan metin katmanını okumasını bekleyin.
  3. Ayıklanan metnin önizlemesini inceleyin.
  4. .txt dosyasını kaydetmek için indir düğmesine tıklayın.

Yaygın kullanım örnekleri

  • Bir araştırma makalesi PDF'inden metni, bir not alma uygulamasına yapıştırmak ya da özetleyiciden geçirmek için çıkarın.
  • Tekrar yazmadan düzenleme için bir PDF faturasından içeriği hesap tablosuna aktarın.
  • Görüntüleyicide kopyala-yapıştır işlevinin bozuk olduğu hasarlı ya da düzeni kilitli bir PDF'den metni kurtarın.
  • Bir PDF makalesini bir betik ya da komut satırı aracıyla işlemek üzere düz metne dönüştürün.

Sık sorulan sorular

Bazı PDF'lerde ayıklanan metin neden boş ya da bozuk çıkıyor?

En yaygın neden PDF'in tarama olmasıdır: sayfalar görüntüdür ve metin katmanı içermez. Diğer nedenler arasında metnin anahattı olarak saklandığı ya da pdf.js'nin okunabilir karakterlere eşleyemediği özel font kodlamalarının kullanıldığı PDF'ler yer alır. Taranmış belgeler için metin üretmek amacıyla OCR gereklidir.

Bu araç taranmış PDF'lerde OCR yapıyor mu?

Hayır. Bu araç PDF'den mevcut metin katmanını okur. Optik karakter tanıma yapmaz. Taranmış PDF'ler için, sayfa görüntülerini tarayıcınızdaki yerel bir OCR motorundan geçiren OCR aracını kullanın.

Metin ayıklama sunucuda mı yoksa tarayıcımda mı yapılıyor?

Tarayıcınızda. pdf.js PDF yapısını yerel olarak okur, her sayfa akışından metin içerik nesnelerini ayrıştırır ve çıktıyı tarayıcı belleğinde derlenir. PDF verisi bu süreçte hiçbir noktada cihazınızı terk etmez.

Metin çıktısında biçim ve düzen korunacak mı?

Hayır. Düz metin font, boyut, renk ya da konum bilgisi taşımaz. Çıktı, pdf.js tarafından belirlenen okuma sırasında biçimsiz metindir. Tablolar, çok sütunlu düzenler ve özel biçimlendirme düzleştirilir. Zengin düzen koruması için PDF'den HTML'ye dönüştürücüler daha uygun seçenektir.

Parola korumalı bir PDF'den metin ayıklayabilir miyim?

PDF'in bir kullanıcı açma parolası varsa, dosyanın okunabilmesi için onu girmeniz gerekir. Sahip düzeyindeki ayıklama kısıtlamaları da işlemi engelleyebilir. Önce PDF Kilidi Aç aracıyla bu kısıtlamaları kaldırın, ardından ayıklamayı yeniden deneyin.

PDF'ten metin ayıklamak için hesap oluşturmam gerekiyor mu?

Hayır. Kayıt ya da hesap yoktur. Dosyayı bırakın, ayıklanan önizlemeyi okuyun ve .txt dosyasını indirin.

PDF'ten Metne aracı mobil tarayıcıda çalışıyor mu?

Evet. pdf.js telefon tarayıcısında masaüstündekiyle aynı şekilde çalışır. Ayıklama tamamlandığında ayıklanan metni doğrudan mobil sayfadan kopyalayın ya da indirin.