Taranmış PDF dosyasını Word’e dönüştürün

Taramayı çevrimiçi OCR ile düzenlenebilir bir Word belgesine çevirin

Sonucu gönder:

Taranmış bir PDF dosyasını OCR ile düzenlenebilir bir Word belgesine çevirin

Tarama, bir sayfanın fotoğrafıdır. Çoğu araç onu öyle bırakır: kelimeleri tanır ve resmin altındaki görünmez bir katmana saklar; böylece dosyada arama yapılabilir ama hiçbir şey değiştirilemez. Bu uygulama ise belgeyi yeniden kurar. Kelimeler ve konumları metin tanımadan gelir, sayfanın yapısı — başlıklar, sütunlar, tablolar, resim altı yazıları — ayrıca çıkarılır ve sayfa gerçek metin, gerçek tablo ve gerçek görsellerle bir Word (.docx) dosyasına yeniden yazılır.

Yapı, metin yerleştirilmeden önce bulunduğu için taramadaki tablo dağınık satırlar yığını olarak değil, kendi sütunlarıyla bir tablo olarak döner. Form, etiketleri ve değerleriyle, basıldığı gibi ikişerli hizalanmış olarak döner. Başlıklar başlık kalır ve taramanın her sayfası belgenin bir sayfası olarak kalır.

Belgenin dili sayfaların kendisinden çıkarılır; Almanca ya da İtalyanca bir tarama için elle ayar yapmanız gerekmez. Tanımanın emin olmadığı kelimeler tahmin edilmek yerine taramadan yeniden okunur; sayılar ve kimlik numaraları hiçbir zaman yeniden yazılmaz. Dosya hazır olduğunda tek bir satır kaç sayfanın yeniden kurulduğunu, kaç kelimenin düzeltildiğini ve kaç kelimenin şüpheli bırakıldığını söyler.

Sonuçta Word, Google Docs veya Pages’te açılan ve her belge gibi düzenlenen bir .docx alırsınız. Taramadaki görseller alternatif metniyle aktarılır, başlıklar başlık olarak işaretlenir; böylece ekran okuyucu belgeyi takip edebilir — görünmez metin katmanlı bir taramanın asla izin vermediği şey.

Bilinmesi gereken sınırlar var. Metin tek bir standart yazı tipiyle yeniden yazılır, bu yüzden kurulan sayfa taramayla harfi harfine örtüşmez: düzen korunur, tipografi korunmaz. El yazısı, metin tanımanın yapıldığı şey değildir; el yazısı notlar bozuk kelimeler olarak dönebilir. Soluk, eğri ya da düşük çözünürlüklü bir tarama her adımda doğruluktan götürür. Sonuca güvenmeden önce kontrol edin ve aslını saklayın.

Hiçbir şeyi düzenlemeniz gerekmiyorsa ve sayfanın piksel piksel aynı görünmesini istiyorsanız doğru araç «Aranabilir PDF yapma»dır: resmi korur ve üzerine görünmez bir metin katmanı koyar. Bu araç ise birebir görünümü, değiştirebileceğiniz bir belgeyle takas eder.

Her şey tarayıcıda, sunucularımızda çalışır: kurulum yok, kayıt yok, CAPTCHA yok. Aynı anda 10 dosyaya kadar, her biri 10 MB. Yüklenen dosyalar ve indirme bağlantıları 24 saat sonra silinir.

Taranmış bir PDF çevrimiçi olarak Word’e nasıl dönüştürülür

Optik karakter tanıma (OCR), kelimeleri ve nerede durduklarını okur; sayfa yapısı ayrıca çıkarılır ve belge gerçek metin, tablo ve görsellerle bir .docx dosyasına yeniden yazılır.

  1. Taranmış PDF dosyasını yükleyin — yükleme alanına sürükleyin ya da alana tıklayıp bilgisayarınızdan seçin.
  2. Sayfaların düz ve okunaklı olduğunu kontrol edin: eğri, soluk ya da düşük çözünürlüklü bir tarama sonraki her adımda doğruluktan götürür.
  3. DÖNÜŞTÜR’e basın. Her sayfa tanınır, yapısı çıkarılır ve şüpheli kelimeler taramadan yeniden okunur.
  4. Özet satırını okuyun: kaç sayfa yeniden kuruldu, kaç kelime düzeltildi, kaç kelime şüpheli kaldı.
  5. .docx dosyasını indirin ve şüpheli kalan kelimeleri gözden geçirerek Word, Google Docs veya Pages’te düzenleyin.

Dosyalar 24 saat sonra sunucularımızdan silinir ve indirme bağlantıları çalışmayı bırakır.

SSS