Відправити результат до:
Скан — це фотографія сторінки. Більшість інструментів так її і лишають: розпізнають слова й ховають їх у невидимий шар під картинкою, тож у файлі можна шукати, але не можна нічого змінити. Цей застосунок натомість відтворює документ. Слова та їхні позиції беруться з розпізнавання, структура сторінки — заголовки, колонки, таблиці, підписи — визначається окремо, і сторінка записується заново справжнім текстом, справжніми таблицями та справжніми зображеннями у файл Word (.docx).
Оскільки структуру знаходять до того, як розставляють текст, таблиця зі скана повертається таблицею з власними стовпцями, а не стіною розрізнених рядків. Форма повертається підписами та значеннями, вирівняними парами, як їх було надруковано. Заголовки лишаються заголовками, а кожна сторінка скана лишається сторінкою документа.
Мову документа визначають із самих сторінок, тож німецький чи італійський скан не потребує ручних налаштувань. Слова, у яких розпізнавання не впевнене, перечитуються зі скана, а не вгадуються; числа й ідентифікатори ніколи не переписуються. Коли файл готовий, один рядок каже, скільки сторінок відтворено, скільки слів виправлено й скільки лишилося під питанням.
На виході ви отримуєте .docx, який відкривається у Word, Google Docs чи Pages і редагується як будь-який інший документ. Зображення зі скана переносяться з alt-текстом, а заголовки розмічені заголовками, тож зчитувач екрана може пройти документом — чого скан із невидимим шаром тексту не дозволяє ніколи.
Є обмеження, про які варто знати. Текст записується одним стандартним шрифтом, тож відтворена сторінка не збігатиметься зі сканом літера в літеру: верстка зберігається, типографіка — ні. Рукописний текст — не те, для чого зроблено розпізнавання, і рукописні нотатки можуть повернутися спотвореними словами. Блідий, перекошений або низької роздільності скан коштує точності на кожному кроці. Перевірте результат, перш ніж на нього покладатися, і збережіть оригінал.
Якщо редагувати нічого не треба, а сторінка має виглядати однаково до пікселя, потрібний інструмент — «PDF з пошуком за текстом»: він лишає картинку й кладе поверх невидимий шар тексту. Цей же змінює точний вигляд на документ, який можна змінити.
Усе працює в браузері, на наших серверах: без встановлення, без реєстрації, без CAPTCHA. До 10 файлів за раз, по 10 МБ кожен. Завантажені файли та посилання на скачування видаляються через 24 години.
Розпізнавання тексту (OCR) читає слова та їхні місця, структура сторінки визначається окремо, і документ записується заново справжнім текстом, таблицями та зображеннями у файл .docx.
Файли видаляються з наших серверів через 24 години, після цього посилання на скачування перестають працювати.
Перетягніть сканований PDF у білу область або натисніть на неї та виберіть файл, потім натисніть КОНВЕРТУВАТИ. Коли сторінки відтворено, завантажте .docx. До 10 файлів за раз, по 10 МБ кожен.
Верстка зберігається — заголовки, колонки, таблиці та зображення лишаються на місцях, — але текст записується одним стандартним шрифтом, тож літера в літеру зі сканом він не збігатиметься. Якщо потрібен вигляд до пікселя, візьміть «PDF з пошуком за текстом»: там картинка лишається, а текст лягає невидимим шаром.
OCR розраховане на друкований текст. Рукописні нотатки й підписи можуть повернутися спотвореними словами, тож перевірте їх, перш ніж покладатися на документ.
Документ Word (.docx) на кожен завантажений файл: текст, таблиці та зображення скана відтворені справжніми об’єктами.
Файли видаляються з наших серверів через 24 години, після цього посилання на скачування не працюють. Доступу до них більше ні в кого немає.
Так. Усе обробляється на наших серверах, тож підійде будь-який сучасний браузер — Chrome, Firefox, Safari чи Opera, на будь-якій операційній системі.