Pošlete výsledek na adresu:
Sken je fotografie stránky. Většina nástrojů ji tak nechá: rozpozná slova a schová je do neviditelné vrstvy pod obrázkem, takže v souboru lze hledat, ale nic v něm změnit. Tato aplikace dokument místo toho sestaví znovu. Slova a jejich pozice pocházejí z rozpoznávání, struktura stránky — nadpisy, sloupce, tabulky, popisky — se určuje zvlášť a stránka se znovu zapíše jako skutečný text, skutečné tabulky a skutečné obrázky do souboru Word (.docx).
Protože se struktura najde dřív, než se rozmístí text, tabulka ze skenu se vrátí jako tabulka s vlastními sloupci, ne jako zeď volných řádků. Formulář se vrátí s popisky a hodnotami zarovnanými po dvojicích tak, jak byly vytištěny. Nadpisy zůstanou nadpisy a každá stránka skenu zůstane stránkou dokumentu.
Jazyk dokumentu se odvodí ze samotných stránek, takže německý nebo italský sken nepotřebuje žádné ruční nastavení. Slova, kterými si rozpoznávání není jisté, se znovu přečtou ze skenu místo hádání a čísla ani identifikátory se nikdy nepřepisují. Když je soubor hotový, jeden řádek řekne, kolik stránek bylo sestaveno, kolik slov opraveno a kolik zůstalo nejistých.
Výsledkem je .docx, který se otevře ve Wordu, Google Docs nebo Pages a upravuje se jako každý jiný dokument. Obrázky ze skenu přecházejí s alternativním textem a nadpisy jsou označené jako nadpisy, takže čtečka obrazovky dokument projde — což sken s neviditelnou textovou vrstvou nikdy neumožní.
Jsou tu meze, které je dobré znát. Text se přepíše jedním standardním písmem, takže sestavená stránka nebude se skenem souhlasit písmeno po písmenu: rozvržení zůstává, typografie ne. Rukopis není to, pro co je rozpoznávání stavěné, a ručně psané poznámky se mohou vrátit jako zkomolená slova. Bledý, pootočený nebo málo rozlišený sken stojí přesnost v každém kroku. Než se na výsledek spolehnete, zkontrolujte ho a originál si nechte.
Pokud nepotřebujete nic upravovat a chcete, aby stránka vypadala stejně na pixel, správný nástroj je «Prohledávatelné PDF»: obrázek zachová a položí přes něj neviditelnou textovou vrstvu. Tento nástroj mění přesný vzhled za dokument, který lze změnit.
Vše běží v prohlížeči, na našich serverech: bez instalace, bez registrace, bez CAPTCHA. Až 10 souborů najednou, každý 10 MB. Nahrané soubory a odkazy ke stažení se po 24 hodinách mažou.
Rozpoznávání textu (OCR) přečte slova a jejich místa, struktura stránky se určí zvlášť a dokument se znovu zapíše jako skutečný text, tabulky a obrázky do souboru .docx.
Soubory se po 24 hodinách z našich serverů mažou a odkazy ke stažení pak přestanou fungovat.
Přetáhněte naskenovaný PDF do bílé plochy nebo do ní klikněte a vyberte soubor, pak stiskněte PŘEVÉST. Až budou stránky sestavené, stáhněte .docx. Až 10 souborů najednou, každý 10 MB.
Rozvržení zůstane — nadpisy, sloupce, tabulky i obrázky zůstanou tam, kde byly — ale text se přepíše jedním standardním písmem, takže se skenem nebude souhlasit písmeno po písmenu. Pokud potřebujete stránku stejnou na pixel, použijte «Prohledávatelné PDF»: obrázek zachová a přidá neviditelnou textovou vrstvu.
OCR je stavěné pro tištěný text. Ručně psané poznámky a podpisy se mohou vrátit jako zkomolená slova, takže si je před spolehnutím na dokument zkontrolujte.
Dokument Word (.docx) ke každému nahranému souboru, s textem, tabulkami a obrázky skenu sestavenými jako skutečné objekty.
Soubory se po 24 hodinách z našich serverů mažou a odkazy ke stažení přestanou fungovat. Nikdo jiný k nim nemá přístup.
Ano. Vše se zpracovává na našich serverech, takže stačí jakýkoli moderní prohlížeč — Chrome, Firefox, Safari nebo Opera, na jakémkoli systému.