Převod naskenovaného PDF do Wordu

Proměňte sken online v upravitelný dokument Word pomocí OCR

Pošlete výsledek na adresu:

Proměňte naskenovaný PDF pomocí OCR v upravitelný dokument Word

Sken je fotografie stránky. Většina nástrojů ji tak nechá: rozpozná slova a schová je do neviditelné vrstvy pod obrázkem, takže v souboru lze hledat, ale nic v něm změnit. Tato aplikace dokument místo toho sestaví znovu. Slova a jejich pozice pocházejí z rozpoznávání, struktura stránky — nadpisy, sloupce, tabulky, popisky — se určuje zvlášť a stránka se znovu zapíše jako skutečný text, skutečné tabulky a skutečné obrázky do souboru Word (.docx).

Protože se struktura najde dřív, než se rozmístí text, tabulka ze skenu se vrátí jako tabulka s vlastními sloupci, ne jako zeď volných řádků. Formulář se vrátí s popisky a hodnotami zarovnanými po dvojicích tak, jak byly vytištěny. Nadpisy zůstanou nadpisy a každá stránka skenu zůstane stránkou dokumentu.

Jazyk dokumentu se odvodí ze samotných stránek, takže německý nebo italský sken nepotřebuje žádné ruční nastavení. Slova, kterými si rozpoznávání není jisté, se znovu přečtou ze skenu místo hádání a čísla ani identifikátory se nikdy nepřepisují. Když je soubor hotový, jeden řádek řekne, kolik stránek bylo sestaveno, kolik slov opraveno a kolik zůstalo nejistých.

Výsledkem je .docx, který se otevře ve Wordu, Google Docs nebo Pages a upravuje se jako každý jiný dokument. Obrázky ze skenu přecházejí s alternativním textem a nadpisy jsou označené jako nadpisy, takže čtečka obrazovky dokument projde — což sken s neviditelnou textovou vrstvou nikdy neumožní.

Jsou tu meze, které je dobré znát. Text se přepíše jedním standardním písmem, takže sestavená stránka nebude se skenem souhlasit písmeno po písmenu: rozvržení zůstává, typografie ne. Rukopis není to, pro co je rozpoznávání stavěné, a ručně psané poznámky se mohou vrátit jako zkomolená slova. Bledý, pootočený nebo málo rozlišený sken stojí přesnost v každém kroku. Než se na výsledek spolehnete, zkontrolujte ho a originál si nechte.

Pokud nepotřebujete nic upravovat a chcete, aby stránka vypadala stejně na pixel, správný nástroj je «Prohledávatelné PDF»: obrázek zachová a položí přes něj neviditelnou textovou vrstvu. Tento nástroj mění přesný vzhled za dokument, který lze změnit.

Vše běží v prohlížeči, na našich serverech: bez instalace, bez registrace, bez CAPTCHA. Až 10 souborů najednou, každý 10 MB. Nahrané soubory a odkazy ke stažení se po 24 hodinách mažou.

Jak online převést naskenovaný PDF do Wordu

Rozpoznávání textu (OCR) přečte slova a jejich místa, struktura stránky se určí zvlášť a dokument se znovu zapíše jako skutečný text, tabulky a obrázky do souboru .docx.

  1. Nahrajte naskenovaný PDF — přetáhněte ho do pole pro nahrání nebo do něj klikněte a vyberte soubor v počítači.
  2. Zkontrolujte, že jsou stránky rovně a čitelné: pootočený, bledý nebo málo rozlišený sken stojí přesnost ve všech dalších krocích.
  3. Klikněte na PŘEVÉST. Každá stránka se rozpozná, určí se její struktura a pochybná slova se znovu přečtou ze skenu.
  4. Přečtěte si souhrnný řádek: kolik stránek bylo sestaveno, kolik slov opraveno a kolik zůstalo nejistých.
  5. Stáhněte .docx a upravte ho ve Wordu, Google Docs nebo Pages; projděte přitom slova, která zůstala nejistá.

Soubory se po 24 hodinách z našich serverů mažou a odkazy ke stažení pak přestanou fungovat.

Otázky a odpovědi