Відправити результат до:
У зображенні сторінки — фото з телефона, скриншоті, файлі зі сканера — немає тексту, лише пікселі. Вставте його у Word, і отримаєте те саме зображення всередині документа: у ньому нічого не можна ні виділити, ні виправити, ні скопіювати. Цей застосунок відтворює сторінку заново. Слова та їхні позиції беруться з розпізнавання, структура сторінки — заголовки, колонки, таблиці, підписи — визначається окремо, і сторінка записується заново справжнім текстом, справжніми таблицями та справжніми зображеннями у файл Word (.docx).
Застосунок приймає формати, в яких зазвичай надходять зображення сторінок: JPG і JPEG, PNG, BMP, WEBP і TIFF. Багатосторінковий TIFF, який зберігають сканери документів, читається кадр за кадром. Завантажте кілька зображень одразу, і вони стануть сторінками одного документа в тому порядку, в якому ви їх додали: договір, знятий посторінково, повернеться одним договором, а не купою файлів.
Зображення не має власного розміру паперу, тож аркуш обираєте ви. На A4 або Letter кожне зображення кладеться цілком у середину сторінки, а аркуш повертається книжково чи альбомно під нього; «Як на зображенні» зберігає власні пропорції зображення. Фото повертаються правильним боком за орієнтацією, яку записала камера, тож сторінка, знята боком, боком не повернеться.
Структура знаходиться до того, як розставляється текст, тому таблиця на зображенні приходить таблицею зі своїми стовпцями, а не стіною розрізнених рядків, а форма — підписами та значеннями, вирівняними парами. Мова визначається за самою сторінкою. Слова, в яких розпізнавання не впевнене, перечитуються з самого зображення, а не вгадуються; числа та ідентифікатори ніколи не переписуються. Коли файл готовий, один рядок каже, скільки сторінок відтворено, скільки слів виправлено і скільки лишилося під питанням.
Є обмеження, про які варто знати. Текст переписується одним стандартним шрифтом, тож сторінка не збігатиметься із зображенням літера в літеру: верстка зберігається, типографіка — ні. Рукописний текст — не те, для чого створене розпізнавання. Розмите, темне чи низької роздільності зображення, як і сторінка, знята під сильним кутом, коштує точності на кожному кроці. Перевірте результат, перш ніж на нього покладатися, і збережіть оригінал.
Нічого не треба встановлювати: робота йде на наших серверах, без реєстрації та без CAPTCHA. До 10 файлів за раз, по 10 МБ кожен. Завантажені файли й посилання на завантаження видаляються через 24 години.
Розпізнавання тексту (OCR) читає слова на зображенні та їхні місця, структура сторінки визначається окремо, і сторінка записується заново справжнім текстом, таблицями та зображеннями у файл .docx.
Файли видаляються з наших серверів через 24 години, після цього посилання на скачування перестають працювати.
Перетягніть зображення у білу область або натисніть на неї та виберіть файли, виберіть розмір сторінки й натисніть КОНВЕРТУВАТИ. Коли сторінки відтворено, завантажте .docx. До 10 файлів за раз, по 10 МБ кожен.
JPG і JPEG, PNG, BMP, WEBP і TIFF. Багатосторінковий TIFF — такий зберігають сканери документів — читається кадр за кадром, і кожен кадр стає сторінкою документа.
Ні, один. Зображення стають сторінками одного документа в тому порядку, в якому ви їх завантажили, тож договір, знятий посторінково, повертається одним договором.
Верстка зберігається — заголовки, колонки, таблиці та зображення лишаються на місцях, — але текст переписується одним стандартним шрифтом, тож літера в літеру із зображенням він не збігатиметься. На виході документ, а не копія зображення.
Файли видаляються з наших серверів через 24 години, після цього посилання на скачування не працюють. Доступу до них більше ні в кого немає.
Так. Усе обробляється на наших серверах, тож підійде будь-який сучасний браузер — Chrome, Firefox, Safari або Opera, на Android, iOS, Windows, macOS або Linux.
OCR розраховане на друкований текст. Рукописні нотатки й підписи можуть повернутися спотвореними словами, тож перевірте їх, перш ніж покладатися на документ.