Сканований PDF у Word

Перетворіть скан на редагований документ Word онлайн за допомогою OCR

Відправити результат до:

Перетворіть сканований PDF на редагований документ Word за допомогою OCR

Скан — це фотографія сторінки. Більшість інструментів так її і лишають: розпізнають слова й ховають їх у невидимий шар під картинкою, тож у файлі можна шукати, але не можна нічого змінити. Цей застосунок натомість відтворює документ. Слова та їхні позиції беруться з розпізнавання, структура сторінки — заголовки, колонки, таблиці, підписи — визначається окремо, і сторінка записується заново справжнім текстом, справжніми таблицями та справжніми зображеннями у файл Word (.docx).

Оскільки структуру знаходять до того, як розставляють текст, таблиця зі скана повертається таблицею з власними стовпцями, а не стіною розрізнених рядків. Форма повертається підписами та значеннями, вирівняними парами, як їх було надруковано. Заголовки лишаються заголовками, а кожна сторінка скана лишається сторінкою документа.

Мову документа визначають із самих сторінок, тож німецький чи італійський скан не потребує ручних налаштувань. Слова, у яких розпізнавання не впевнене, перечитуються зі скана, а не вгадуються; числа й ідентифікатори ніколи не переписуються. Коли файл готовий, один рядок каже, скільки сторінок відтворено, скільки слів виправлено й скільки лишилося під питанням.

На виході ви отримуєте .docx, який відкривається у Word, Google Docs чи Pages і редагується як будь-який інший документ. Зображення зі скана переносяться з alt-текстом, а заголовки розмічені заголовками, тож зчитувач екрана може пройти документом — чого скан із невидимим шаром тексту не дозволяє ніколи.

Є обмеження, про які варто знати. Текст записується одним стандартним шрифтом, тож відтворена сторінка не збігатиметься зі сканом літера в літеру: верстка зберігається, типографіка — ні. Рукописний текст — не те, для чого зроблено розпізнавання, і рукописні нотатки можуть повернутися спотвореними словами. Блідий, перекошений або низької роздільності скан коштує точності на кожному кроці. Перевірте результат, перш ніж на нього покладатися, і збережіть оригінал.

Якщо редагувати нічого не треба, а сторінка має виглядати однаково до пікселя, потрібний інструмент — «PDF з пошуком за текстом»: він лишає картинку й кладе поверх невидимий шар тексту. Цей же змінює точний вигляд на документ, який можна змінити.

Усе працює в браузері, на наших серверах: без встановлення, без реєстрації, без CAPTCHA. До 10 файлів за раз, по 10 МБ кожен. Завантажені файли та посилання на скачування видаляються через 24 години.

Як конвертувати сканований PDF у Word онлайн

Розпізнавання тексту (OCR) читає слова та їхні місця, структура сторінки визначається окремо, і документ записується заново справжнім текстом, таблицями та зображеннями у файл .docx.

  1. Завантажте сканований PDF — перетягніть його в область завантаження або натисніть на неї та виберіть файл на комп’ютері.
  2. Перевірте, що сторінки рівні й читабельні: перекошений, блідий або низької роздільності скан коштує точності на всіх наступних кроках.
  3. Натисніть КОНВЕРТУВАТИ. Кожна сторінка розпізнається, її структура визначається, а сумнівні слова перечитуються зі скана.
  4. Прочитайте рядок підсумку: скільки сторінок відтворено, скільки слів виправлено й скільки лишилося під питанням.
  5. Завантажте .docx і редагуйте його у Word, Google Docs чи Pages, перевіривши слова, що лишилися під питанням.

Файли видаляються з наших серверів через 24 години, після цього посилання на скачування перестають працювати.

Поширені запитання