PDF'den Metne Dönüştürücü

İleri: incele

Bir PDF’deki kelimeleri almanın en hızlı yolu. Bu araç, PDF’de zaten saklı olan metin katmanını sayfa sayfa okur ve size kopyalayabileceğiniz ya da .txt dosyası olarak kaydedebileceğiniz düz metni verir. Her şey tarayıcınızda çalışır, bu yüzden belgeniz asla yüklenmez. Baştan bilmeniz gereken bir şey var: araç dosyada zaten var olan metni okur, dolayısıyla taranmış ya da fotoğraflanmış bir belge (metin katmanı olmayan bir görsel) boş çıkar. Bunun için onun yerine bir OCR aracı kullanın.

Bir PDF'den metin nasıl çıkarılır

  1. 1

    PDF'yi yükleyin

    Sürükleyip bırakın ya da tıklayıp seçin. Dosya cihazınızda kalır ve asla bir sunucuya gönderilmez.

  2. 2

    Metni çıkarın

    Araç her sayfanın metin katmanını okur ve her sayfanın önüne bir işaret koyarak bunları birbirine ekler.

  3. 3

    Sonucu inceleyin

    Çıkarılan metin bir kutuda, sayfa sayfa görünür ve kontrol etmeye hazırdır.

  4. 4

    Kopyalayın ya da indirin

    Panoya kopyalayın ya da başka bir yerde yeniden kullanmak için .txt dosyası olarak kaydedin.

Bu araç neyi okur, neyi okuyamaz

PDF türü Sonuç
Word, Google Docs, bir tarayıcı ya da bir tasarım aracından dışa aktarılmış Tam metin, temiz ve eksiksiz
Düzgün bir metin katmanı olan dijital PDF Metin sayfa sayfa çıkarılır
PDF olarak kaydedilmiş bir tarama ya da fotoğraf (yalnızca görsel) Boş ya da neredeyse boş: okunacak metin yok
Parolayla korunan bir PDF Önce kilidini açmadan okunamaz

Burada OCR yok: taramalar için doğru aracı kullanın

Bu çıkarıcı OCR (optik karakter tanıma) çalıştırmaz. PDF’nin içinde zaten bulunan metni kopyalar, pikselleri okumaz. Dosyanız bir taramaysa ve size hiçbir şey dönmüyorsa, önce bir OCR aracından geçirin; bu araç görseli sonradan çıkarabileceğiniz gerçek bir metin katmanına dönüştürür.

Metin nasıl düzenlenir

Her sayfa bir --- Page N --- işaretiyle ayrılır, böylece bir sayfanın nerede bitip diğerinin nerede başladığını görürsünüz. Metin, PDF’de saklandığı sırayla alınır. Belgelerin çoğu doğal biçimde okunur; olağan dışı çok sütunlu düzene sahip birkaçında sütunlar iç içe geçebilir, çünkü araç bir okuma yolu tahmin etmek yerine PDF’de saklanan sırayı izler.

Yaygın kullanımlar

  • Bir yapay zeka modeline besleme. Dil modelleri PDF değil, düz metin alır. Önce çıkarmak her şeyi daha hızlı ve öngörülebilir kılar.
  • Alıntılama ve arama. PDF görüntüleyicinin seçim özelliğiyle uğraşmadan bir bölümü kopyalayın.
  • İçeriği yeniden kullanma. Metni yeniden yazmadan bir belgeye, bir e-postaya ya da bir nota taşıyın.

Sık Sorulan Sorular

Hayır. Gömülü metin katmanını okur; tarama ise metin katmanı olmayan bir görselden ibarettir, bu yüzden boş döner. Taranmış ya da fotoğraflanmış belgeler için bir OCR aracı kullanın, ardından metni çıkarın.

Hayır. Çıkarma işlemi tamamen tarayıcınızda, kendi cihazınızda gerçekleşir. PDF asla bir sunucuya gönderilmez ve hiçbir şey saklanmaz.

Birkaç PDF, özellikle çok sütunlu düzenler, metnini okuduğunuz sıradan farklı bir sırayla saklar. Araç PDF’de saklanan sırayı izlediği için sütunlar iç içe geçebilir. Kelime işlemcilerden dışa aktarılan belgeler neredeyse her zaman doğru çıkar.

Kilitli oldukları sürece açamaz. Önce bir PDF kilit açma aracıyla parolayı kaldırın, ardından metni çıkarın.

İlgili Araçlar

Araç diğer dillerde mevcuttur