Görüntüden Excel'e

Görüntüyü sunucumuza göndermeden basılı tablo metnini düzenlenebilir bir elektronik tabloya aktarın. Tesseract.js sözcükleri tarayıcıda tanır; araç da sözcükleri dikey konumlarına göre satırlarda gruplar ve geniş yatay boşluklarda sütunları ayırır. Önizlemeyi kontrol edip XLSX veya CSV indirin.

Bir görüntüyü Excel'e nasıl dönüştürürsünüz

  1. 1

    Bir tablo görüntüsü yükleyin

    Net bir ekran görüntüsü, tarama veya fotoğraf en iyi sonucu verir. Düz, iyi aydınlatılmış tablolar en doğru okunur.

  2. 2

    Yerel OCR çalıştırın

    Tesseract.js görüntüyü yüklemeden, seçilen OCR dilindeki basılı sözcükleri tanır.

  3. 3

    Tahmini satır ve sütunları kontrol edin

    Yakın yükseklikteki sözcükler bir satır oluşturur, geniş yatay boşluk ise yeni sütun başlatır. Bu sezgisel bir tahmindir, tam tablo yapısı algılama değildir.

  4. 4

    XLSX veya CSV indirin

    İki biçimden birini Excel, Google Sheets ya da LibreOffice'te açıp olası tanıma veya sütun hatalarını düzeltin.

İyi bir kaynak görüntüyü ne yapar

Faktör Doğruluk için en iyisi Doğruluğa zarar verir
Keskinlik Net, odakta Bulanık veya düşük çözünürlük
Aydınlatma Eşit, parlama yok Gölgeler, yansımalar
Açı Tam karşıdan, düz Eğik veya çarpık fotoğraflar
Sütun aralığı Sütunlar arasında belirgin boşluk Sıkışık, birleştirilmiş veya iç içe hücreler
Metin Basılı, net yazı tipi El yazısı, dekoratif yazı tipleri

Kesin sınırlar, diller ve gizlilik

Kaynak gerçek bir PNG, JPG/JPEG veya WebP dosyası olmalı; 20 MB, kenar başına 8192 piksel ve toplam 24 megapiksel sınırlarını aşmamalıdır. OCR; İngilizce, İspanyolca, Fransızca, Almanca, İtalyanca, Portekizce ve Hollandaca basılı metni destekler. Sayfa dili görüntüdeki dili otomatik olarak değiştirmez, bu yüzden uygun OCR dilini seçin.

Görüntü bu tarayıcıdan hiç çıkmaz. Tek sayfalı tam görünümde yalnızca bellekte kalır. Üç adımlı görünümde görüntü ve tanınan satırlar, sayfalar arasında taşınabilmeleri için bu sitenin IndexedDB alanında en fazla 30 dakika tutulur. İndirme veya Yeniden başla işlemi daha erken silinmelerini ister. Tarayıcı seçilen Tesseract dil modelini indirebilir, ancak bu isteğe kaynak görüntüyü eklemez.

Çıktılar, OCR adlı tek çalışma sayfası içeren bir XLSX çalışma kitabı ve UTF-8 kodlu bir CSV dosyasıdır. Araç formülleri, birleştirilmiş hücreleri, biçimlendirmeyi, kenarlıkları veya anlamlı başlıkları yeniden oluşturmaz.

Bunun gerçekten zaman kazandırdığı yerler

  • Yalnızca kâğıt üzerinde aldığınız taranmış raporlar.
  • Kopyalayamadığınız panoların veya tabloların ekran görüntüleri.
  • Toplamanız gereken fiş, fatura veya hesap özeti fotoğrafları.
  • Hiçbir yerde dijital orijinali olmayan eski çıktılar.

Sonucu her zaman kontrol edin

Optik karakter tanıma iyidir, kusursuz değildir. 0/O ve 1/l gibi sayılar yanlış okunabilir ve birleştirilmiş ya da alışılmadık hücreler kayabilir. Ona güvenmeden önce elektronik tabloyu görüntüye karşı hızlıca tarayın, birkaç hücreyi düzeltmek tüm tabloyu yazmaktan çok daha hızlıdır.

Daha temiz çıkarma için ipuçları

  • Yüklemeden önce görüntüyü yalnızca tabloya kadar kırpın.
  • Satırlar yatay olsun diye eğik bir fotoğrafı düzleştirin.
  • Soluk veya solmuş çıktılarda kontrastı artırın.

Sık Sorulan Sorular

Genellikle çoğu, ancak optik karakter tanıma kusursuz değildir. Birbirine benzeyen karakterler ve alışılmadık hücre düzenleri kayabilir. Elektronik tabloyu her zaman orijinal görüntüyle karşılaştırın ve yanlış değerleri düzeltin.

Görünür ızgara çizgileri olan basılı bir tablonun net, eşit aydınlatılmış, tam karşıdan çekilmiş bir görüntüsü. Bulanık, eğik veya el yazısı tablolar doğru okunması çok daha zor olanlardır.

El yazısı güvenilir değildir. Araç basılı veya ekran metni için yapılmıştır. Düzgün büyük matbaa harfleri çalışabilir, ancak daha fazla hücre düzeltmeyi bekleyin.

Bir XLSX çalışma kitabı veya UTF-8 kodlu CSV dosyası indirebilirsiniz. İkisi de önizlemedeki tahmini satır ve sütunları içerir ve Excel, Google Sheets ya da LibreOffice Calc ile açılır.

İlgili Araçlar