Konverzija skeniranog PDF u Word

Pretvorite skeniranje onlajn u Word dokument koji se može menjati uz OCR

Pošalji rezultat na:

Pretvorite skenirani PDF uz OCR u Word dokument koji se može menjati

Skeniranje je fotografija stranice. Većina alata je takvom i ostavlja: prepozna reči i sakrije ih u nevidljivi sloj ispod slike, pa se po datoteci može pretraživati, ali se ništa ne može promeniti. Ova aplikacija umesto toga iznova gradi dokument. Reči i njihova mesta dolaze iz prepoznavanja, struktura stranice — naslovi, kolone, tabele, potpisi — utvrđuje se posebno, a stranica se ponovo ispisuje kao pravi tekst, prave tabele i prave slike u Word (.docx) datoteku.

Pošto se struktura nalazi pre nego što se tekst rasporedi, tabela sa skeniranja vraća se kao tabela sa sopstvenim kolonama, a ne kao zid razbacanih redova. Obrazac se vraća sa svojim oznakama i vrednostima poravnatim u parove, onako kako je bio odštampan. Naslovi ostaju naslovi, a svaka stranica skeniranja ostaje stranica dokumenta.

Jezik dokumenta utvrđuje se iz samih stranica, pa nemačko ili italijansko skeniranje ne traži nikakvo ručno podešavanje. Reči u koje prepoznavanje nije sigurno ponovo se čitaju sa skeniranja umesto da se pogađaju, a brojevi i identifikatori nikada se ne prepisuju. Kada je datoteka gotova, jedan red kaže koliko je stranica obnovljeno, koliko je reči ispravljeno i koliko ih je ostalo nesigurno.

Ono što dobijate jeste .docx koji se otvara u Word-u, Google Docs-u ili Pages-u i uređuje kao bilo koji drugi dokument. Slike sa skeniranja prelaze sa alternativnim tekstom, a naslovi su označeni kao naslovi, pa čitač ekrana može da prati dokument — što skeniranje sa nevidljivim slojem teksta nikada ne dopušta.

Postoje ograničenja koja vredi znati. Tekst se ispisuje jednim standardnim pismom, pa obnovljena stranica neće odgovarati skeniranju slovo po slovo: prelom se čuva, tipografija ne. Rukopis nije ono za šta je prepoznavanje napravljeno, i rukom pisane beleške mogu se vratiti kao izobličene reči. Bledo, iskrivljeno ili nisko rezolucijsko skeniranje košta tačnosti na svakom koraku. Proverite rezultat pre nego što se na njega oslonite i sačuvajte original.

Ako ne treba ništa da menjate, a želite da stranica izgleda isto do piksela, pravi alat je «Pretraživi PDF»: čuva sliku i preko nje postavlja nevidljivi sloj teksta. Ovaj menja tačan izgled za dokument koji možete izmeniti.

Sve radi u pregledaču, na našim serverima: bez instalacije, bez registracije, bez CAPTCHA. Do 10 datoteka odjednom, svaka po 10 MB. Otpremljene datoteke i veze za preuzimanje uklanjaju se posle 24 sata.

Kako skenirani PDF konvertovati u Word onlajn

Prepoznavanje teksta (OCR) čita reči i njihova mesta, struktura stranice se utvrđuje posebno, a dokument se ponovo ispisuje kao pravi tekst, tabele i slike u .docx datoteku.

  1. Otpremite skenirani PDF — prevucite ga u polje za otpremanje ili kliknite na njega i izaberite datoteku na računaru.
  2. Proverite da li su stranice uspravne i čitljive: iskrivljeno, bledo ili nisko rezolucijsko skeniranje košta tačnosti u svim narednim koracima.
  3. Kliknite KONVERTUJ. Svaka stranica se prepoznaje, utvrđuje joj se struktura, a sumnjive reči se ponovo čitaju sa skeniranja.
  4. Pročitajte red sa rezimeom: koliko je stranica obnovljeno, koliko reči ispravljeno i koliko ih je ostalo nesigurno.
  5. Preuzmite .docx i uredite ga u Word-u, Google Docs-u ili Pages-u, uz proveru reči koje su ostale nesigurne.

Datoteke se brišu sa naših servera posle 24 sata, a veze za preuzimanje tada prestaju da rade.

ČPP