PDF aracı / 11

Taranmış PDF'den Metne (OCR)

Seçilebilir metin içermeyen taranmış PDF'deki metni sayfa sayfa, tamamen tarayıcınızda okuyun.

Taranmış PDF'den Metne (OCR): TOEA her sayfayı bir görsele dönüştürür, her sayfada optik karakter tanıma çalıştırır ve metni sayfalara göre etiketler; böylece her bölümün kaynağını görebilirsiniz. Sunucuya hiçbir dosya yüklenmeden tarayıcınızda %100 yerel olarak çalışır.

Çalıştırma sayısı
Tarayıcınızda
Maliyet
Ücretsiz · kayıt gerekmez
Kullanılabilirlik
Kullanıma hazır
Taranmış PDF → metin çalışma alanıYerel işleme

Tamamen tarayıcınızda çalışır

↥
Taranmış bir PDF seçin

PDF · en fazla 30 MB, hiçbir zaman yüklenmez

Daha temiz bir okuma elde etmek

Her sayfa okunmadan önce 200 DPI ile işlenir; bu nedenle sınırı taramanın kendisi belirler. 300 DPI ile taranan gövde metni iyi okunur; açılı çekilmiş bir sayfa telefon fotoğrafı veya küçük yazı içeren faks kalitesinde bir tarama, tahminlere yol açar. Yan duran veya baş aşağı sayfalar çok kötü okunur; bu nedenle tanımayı çalıştırmadan önce PDF'yi döndür ile sayfaları dik konuma getirin.

Belgenin yazıldığı dili seçin; çünkü her dil ayrı bir modeldir. Çince için Basitleştirilmiş ve Geleneksel modeller bulunur; yanlış olanı seçmek doğruluğu ciddi ölçüde düşürür. İki dili karıştıran bir belge, metnin çoğunda kullanılan dil seçildiğinde en iyi şekilde okunur.

Çıktıyı kontrol etmek

Güven puanı tüm sayfaların ortalamasıdır; bu nedenle tek bir kötü sayfa, iyi bir puanın içinde gizlenebilir. Yaklaşık 90 veya üzeri puan genellikle yalnızca ara sıra hatalar olduğu anlamına gelir; 75'in altında ise çoğu paragrafta hata bekleyin. En sık karıştırılanlar 0 ve O, 1, l ve I, m olarak okunan rn ile S olarak okunan 5tir. Bu durum özellikle tutarlar, tarihler ve referans numaralarında önemlidir; bu nedenle her rakamı sayfayla karşılaştırarak kontrol edin.

Düzyazı için, her yazdırılmış satırın sonunda bölünen cümleleri birleştiren Satırları paragraflara birleştir seçeneğini açık bırakın. Satır sonlarının anlam taşıdığı adresler, listeler ve tablolar için kapatın.

Nasıl kullanılır?

  1. Taranmış bir PDF seçin.
  2. Metnin dilini seçin.
  3. Sonucu okuyup kopyalayın veya indirin.

Gizlilik ve sınırlamalar

Dosyanız hiçbir zaman yüklenmez. Tanıma motoru ve dil modeli bir kez — yaklaşık 10 MB — indirilip tarayıcınız tarafından önbelleğe alınır; ardından her şey kendi cihazınızda çalışır. Barındırılan OCR hizmetleri bunun tersine çalışır: belgeyi isterler. Her sayfa önce görsele dönüştürülüp ardından sırayla okunduğu için uzun bir belgenin işlenmesi zaman alır.

İlgili araçlar

Sık sorulan sorular

PDF'den Metne yerine buna ne zaman ihtiyacım olur?

Önce PDF'den Metne aracını kullanın; belgede gerçek metin varsa bu araç anında ve tam sonuç verir. Bu araç, PDF'den Metne hiçbir sonuç döndürmediğinde kullanılır; bu da sayfaların fotoğraf olduğu anlamına gelir.

Neden yavaş?

Her sayfa bir görsele dönüştürülür ve ardından karakter karakter okunur. Birkaç sayfa hızlı işlenir; yüz sayfalık bir tarama gerçekten zaman alır ve sekmenin açık kalması gerekir.

Düzeni korur mu?

Hayır. Sütunlar, tablolar ve başlıklar okuma sırasına göre düz satırlar olarak çıkar; bu nedenle karmaşık sayfaların düzenlenmesi gerekir.

PDF'yi aranabilir hâle getirebilir mi?

Burada değil — bunun için dosyaya görünmez bir metin katmanı yazılması gerekir. Bu araç, başka yerlerde kullanmanız için metni sağlar.

Ücretsiz araç · tarayıcınızda kez çalıştırma · hesap gerekmez