Отправить результат в:
В картинке страницы — фото с телефона, скриншоте, файле со сканера — нет текста, только пиксели. Вставьте её в Word, и получите ту же картинку внутри документа: в ней ничего нельзя ни выделить, ни исправить, ни скопировать. Это приложение пересобирает страницу заново. Слова и их позиции берутся из распознавания, структура страницы — заголовки, колонки, таблицы, подписи — определяется отдельно, и страница пишется заново настоящим текстом, настоящими таблицами и настоящими картинками в файл Word (.docx).
Приложение принимает форматы, в которых обычно приходят картинки страниц: JPG и JPEG, PNG, BMP, WEBP и TIFF. Многостраничный TIFF, какой сохраняют сканеры документов, читается кадр за кадром. Загрузите несколько картинок сразу, и они станут страницами одного документа в том порядке, в каком вы их добавили: договор, снятый постранично, вернётся одним договором, а не россыпью файлов.
У картинки нет своего размера бумаги, поэтому лист выбираете вы. На A4 или Letter каждая картинка кладётся целиком в середину страницы, а лист поворачивается книжно или альбомно под неё; «Как на изображении» сохраняет собственные пропорции картинки. Фотографии поворачиваются правильной стороной по ориентации, которую записала камера, поэтому страница, снятая боком, боком не вернётся.
Структура находится до того, как расставляется текст, поэтому таблица на картинке приходит таблицей со своими столбцами, а не стеной разрозненных строк, а форма — подписями и значениями, выровненными парами. Язык определяется по самой странице. Слова, в которых распознавание не уверено, перечитываются с самой картинки, а не угадываются; числа и идентификаторы не переписываются никогда. Когда файл готов, одна строка говорит, сколько страниц пересобрано, сколько слов исправлено и сколько осталось под вопросом.
Есть ограничения, о которых стоит знать. Текст переписывается одним стандартным шрифтом, поэтому страница не совпадёт с картинкой буква в букву: вёрстка сохраняется, типографика — нет. Рукописный текст — не то, для чего сделано распознавание. Размытая, тёмная или низкого разрешения картинка, как и страница, снятая под сильным углом, стоит точности на каждом шаге. Проверьте результат, прежде чем на него полагаться, и сохраните оригинал.
Ничего не нужно устанавливать: работа идёт на наших серверах, без регистрации и без CAPTCHA. До 10 файлов за раз, по 10 МБ каждый. Загруженные файлы и ссылки на скачивание удаляются через 24 часа.
Распознавание текста (OCR) читает слова на картинке и их места, структура страницы определяется отдельно, и страница пишется заново настоящим текстом, таблицами и картинками в файл .docx.
Файлы удаляются с наших серверов через 24 часа, после этого ссылки на скачивание перестают работать.
Перетащите картинки в белую область или нажмите на неё и выберите файлы, выберите размер страницы и нажмите «КОНВЕРТИРОВАТЬ». Когда страницы будут пересобраны, скачайте .docx. До 10 файлов за раз, по 10 МБ каждый.
JPG и JPEG, PNG, BMP, WEBP и TIFF. Многостраничный TIFF — такой сохраняют сканеры документов — читается кадр за кадром, и каждый кадр становится страницей документа.
Нет, один. Картинки становятся страницами одного документа в том порядке, в каком вы их загрузили, поэтому договор, снятый постранично, возвращается одним договором.
Вёрстка сохраняется — заголовки, колонки, таблицы и картинки остаются на местах, — но текст переписывается одним стандартным шрифтом, поэтому буква в букву с картинкой он не совпадёт. На выходе документ, а не копия изображения.
Файлы удаляются с наших серверов через 24 часа, после этого ссылки на скачивание перестают работать. Доступа к ним ни у кого больше нет.
Да. Всё обрабатывается на наших серверах, поэтому подойдёт любой современный браузер — Chrome, Firefox, Safari или Opera, на Android, iOS, Windows, macOS или Linux.
OCR рассчитано на печатный текст. Рукописные пометки и подписи могут вернуться искажёнными словами, поэтому проверьте их, прежде чем полагаться на документ.