PDF OCR

Taranmış bir PDF seçin

Yalnızca PDF · 20 MB · 40 sayfa

veya bir PDF’yi buraya bırakın

Bir PDF seçilebilir metin yerine taranmış sayfa görüntüleri içeriyorsa bu aracı kullanın. Araç sayfaları tarayıcınızda işler, optik karakter tanıma (OCR) uygular ve tanınan düz metni incelemeniz, kopyalamanız veya .txt dosyası olarak kaydetmeniz için gösterir. Kaynak PDF cihazınızda kalır. Araç aranabilir PDF oluşturmaz, sayfa düzenini korumaz ve OCR çıktısında hatalar bulunabilir.

Taranmış bir PDF’den metin çıkarma

  1. 1

    Belgenin dilini seçin

    Basılı metnin ana dilini seçin. Bu seçim, tarayıcının kullanacağı OCR modelini belirler.

  2. 2

    PDF’yi açın

    En fazla 20 MB ve 40 sayfa olan bir PDF seçin. Kaynak dosya tarayıcınızda kalır ve sunucumuza gönderilmez.

  3. 3

    Tanımanın bitmesini bekleyin

    Tarayıcı her sayfayı işler ve seçilen OCR modeliyle okur. Tanıma başlamadan önce model dosyalarının indirilmesi gerekebilir.

  4. 4

    Sonucu kontrol edin

    Adları, sayıları ve önemli bölümleri özgün sayfalarla karşılaştırın. OCR bir yardımcıdır; kritik kullanım için güvenilir bir yazıya dökme yöntemi değildir.

  5. 5

    Metni kopyalayın veya indirin

    Kopyalama ve TXT’yi yerel olarak indirme sonucu tarayıcıda tutar. Yalnızca isteğe bağlı indirme sayfası, türetilmiş metin dosyasını korumalı bir bağlantıya yükler.

Bu araç ne üretir?

Çıktı, her sayfadan tanınan metnin önünde bir sayfa işareti bulunan düz metindir. Araç:

  • PDF’ye gizli bir metin katmanı eklemez
  • sütunları, tabloları, formları veya özgün tipografiyi yeniden oluşturmaz
  • sayfanın görsel düzenini korumaz
  • belgeyi çevirmez
  • tanınan metnin doğru olduğunu doğrulamaz

Taranmış sayfaları koruyup arkalarına aranabilir metin eklemeniz gerekiyorsa özel bir aranabilir PDF uygulaması veya masaüstü OCR programı kullanın.

En iyi çalışan belgeler

OCR basılı metin için tasarlanmıştır. Düz, net ve okunaklı kontrasta sahip bir tarama; bulanık bir fotoğraf, solmuş bir faks veya hasarlı bir sayfadan daha kolay tanınır. Dekoratif yazı tipleri, el yazısı, matematiksel gösterimler, birbirine yakın sütunlar ve karmaşık tablolar eksik ya da sırası bozuk metin üretebilir.

Araç en fazla 20 MB ve 40 sayfa olan PDF’leri kabul eder. Tanıma sayfa sayfa yapılır ve özellikle büyük veya yüksek çözünürlüklü sayfalarda önemli miktarda bellek kullanabilir. Tarayıcının belleği yetersiz kalırsa PDF’yi daha küçük dosyalara bölüp ayrı ayrı işleyin.

Desteklenen OCR dilleri

İngilizce, İspanyolca, Fransızca, Almanca, İtalyanca, Portekizce, Felemenkçe, Rusça, Japonca, basitleştirilmiş Çince, Korece veya Arapça seçebilirsiniz.

Dosyayı açmadan önce belgenin ana dilini seçin. Birden fazla dil veya yazı sistemi içeren bir sayfanın ayrı ayrı işlenmesi gerekebilir; buna rağmen birbirine benzeyen karakterler karıştırılabilir.

Tanınan metni inceleyin

Sonuca güvenmeden önce her zaman özgün PDF ile karşılaştırın. Özellikle şunları kontrol edin:

  • adlar, adresler ve kimlik numaraları
  • tarihler, tutarlar, ondalık ayırıcılar ve eksi işaretleri
  • hukuki, tıbbi, mali veya güvenlikle ilgili talimatlar
  • çok sütunlu belgelerde sayfa sonları ve okuma sırası

OCR çıktısını önemli bir belgenin yetkili kopyası olarak kabul etmeyin.

Dosya işleme ve indirmeler

Kaynak PDF tarayıcınızda yerel olarak okunur. Huni URL’sine eklenmez ve sunucumuza gönderilmez. Tarayıcı, PDF işleme ve OCR kitaplıklarıyla seçilen dil modelini yapılandırılmış kitaplık sağlayıcısından indirebilir.

Kopyalama, tanınan metni tarayıcıda tutar ve panoya yazar. TXT’yi yerel olarak indir seçeneği .txt dosyasını yüklemeden oluşturup kaydeder. Yalnızca İndirme sayfası oluştur seçeneğini kullanırsanız türetilmiş TXT, korumalı bir bağlantı oluşturmak üzere yüklenir ve en fazla 7 gün saklanabilir. Bu isteğe bağlı yükleme başarısız olursa yerel indirme kullanılmaya devam eder.

Sık Sorulan Sorular

Hayır. Sayfalar işlenip tanınırken kaynak PDF tarayıcıda kalır. Tarayıcı gerekli kitaplıkları ve seçilen dil modelini indirebilir. Yerel indirme de metni yüklemez; yalnızca isteğe bağlı indirme sayfası türetilmiş TXT’yi yükler.

Hayır. Sonuç, sayfalara göre gruplanmış düz metindir. Araç özgün PDF’yi değiştirmez, gizli metin katmanı eklemez ve düzenini korumaz.

Özgün sayfalarla karşılaştırmalısınız. OCR karakterleri karıştırabilir, metni atlayabilir ve okuma sırasını değiştirebilir. Çıktıyı hukuki, tıbbi, mali, güvenlikle ilgili veya başka bir kritik işte kullanmadan önce her ayrıntıyı kontrol edin.

Basılı metin için tasarlanmıştır. El yazısı, denklemler ve dekoratif yazı tipleri güvenilir biçimde tanınmayabilir. Tablodaki karakterler tanınabilir ancak satır ve sütun yapısı düz metinde korunmaz.

İngilizce, İspanyolca, Fransızca, Almanca, İtalyanca, Portekizce, Felemenkçe, Rusça, Japonca, basitleştirilmiş Çince, Korece ve Arapça. PDF’yi açmadan önce ana dili seçin.

PDF en fazla 20 MB ve 40 sayfa olabilir. Büyük veya ayrıntılı sayfalar yine de tarayıcının kullanılabilir belleğini aşabilir; bu durumda belgeyi daha küçük dosyalara bölün.

TXT’yi yerel olarak indir seçeneği .txt dosyasını oluşturur ve yüklemeden doğrudan cihazınıza kaydeder. Bir indirme sayfası oluşturursanız yalnızca bu türetilmiş TXT korumalı bir bağlantıya yüklenir ve en fazla 7 gün saklanabilir.

İlgili Araçlar