Gửi kết quả đến:
Ảnh của một trang - ảnh chụp từ điện thoại, ảnh màn hình, tệp từ máy quét - không chứa văn bản, chỉ có điểm ảnh. Dán nó vào Word, bạn chỉ có cùng bức ảnh nằm trong tài liệu: không thể chọn, sửa hay sao chép gì trong đó. Ứng dụng này dựng lại trang. Các từ và vị trí của chúng đến từ nhận dạng, cấu trúc trang - tiêu đề, cột, bảng, chú thích - được xác định riêng, rồi trang được viết lại bằng văn bản thật, bảng thật và hình ảnh thật trong tệp Word (.docx).
Ứng dụng nhận các định dạng mà ảnh trang thường có: JPG và JPEG, PNG, BMP, WEBP và TIFF. TIFF nhiều trang, như cách máy quét tài liệu lưu, được đọc từng khung. Tải nhiều ảnh cùng lúc, chúng sẽ thành các trang của một tài liệu theo thứ tự bạn thêm vào: một hợp đồng chụp từng trang sẽ trở về thành một hợp đồng, không phải một đống tệp.
Ảnh không có khổ giấy riêng, nên bạn chọn khổ giấy. Với A4 hoặc Letter, mỗi ảnh được đặt trọn vào giữa trang, tờ giấy xoay dọc hoặc ngang theo ảnh; “Như trong ảnh” giữ tỷ lệ của chính ảnh. Ảnh chụp được xoay đúng chiều theo hướng mà máy ảnh đã ghi lại, nên trang chụp nghiêng sẽ không trở về nghiêng.
Vì cấu trúc được tìm ra trước khi đặt văn bản, bảng trong ảnh trở về thành bảng với các cột riêng, không phải một mảng dòng rời rạc, còn biểu mẫu trở về thành các cặp nhãn và giá trị. Ngôn ngữ được xác định từ chính trang. Những từ mà nhận dạng không chắc được đọc lại từ ảnh thay vì đoán, và số cùng mã định danh không bao giờ bị viết lại. Khi tệp sẵn sàng, một dòng cho biết bao nhiêu trang đã được dựng lại, bao nhiêu từ đã được sửa và bao nhiêu từ còn đáng ngờ.
Có những giới hạn cần biết. Văn bản được viết lại bằng một phông chữ chuẩn, nên trang sẽ không khớp với ảnh từng chữ một: bố cục được giữ, kiểu chữ thì không. Chữ viết tay không phải thứ mà nhận dạng được làm ra để đọc. Ảnh mờ, tối hoặc độ phân giải thấp, hay trang chụp ở góc nghiêng nhiều, làm giảm độ chính xác ở mọi bước. Hãy đọc kết quả trước khi dựa vào nó, và giữ lại bản gốc.
Không cần cài đặt: công việc được làm trên máy chủ của chúng tôi, không đăng ký và không CAPTCHA. Tối đa 10 tệp mỗi lần, mỗi tệp 10 MB. Tệp đã tải lên và liên kết tải về bị xóa sau 24 giờ.
OCR đọc các từ trong ảnh và vị trí của chúng, cấu trúc trang được xác định riêng, rồi trang được viết lại bằng văn bản, bảng và hình ảnh thật trong tệp .docx.
Tệp bị xóa khỏi máy chủ của chúng tôi sau 24 giờ, và sau đó liên kết tải xuống ngừng hoạt động.
Kéo ảnh vào vùng trắng, hoặc bấm vào đó để chọn, chọn khổ trang rồi nhấn CHUYỂN ĐỔI. Khi các trang được dựng lại, hãy tải tệp .docx về. Tối đa 10 tệp mỗi lần, mỗi tệp 10 MB.
JPG và JPEG, PNG, BMP, WEBP và TIFF. TIFF nhiều trang, loại mà máy quét tài liệu lưu, được đọc từng khung, và mỗi khung thành một trang của tài liệu.
Không, chỉ một. Các ảnh thành các trang của một tài liệu theo thứ tự bạn tải lên, nên một hợp đồng chụp từng trang sẽ trở về thành một hợp đồng.
Bố cục được giữ - tiêu đề, cột, bảng và hình ảnh ở nguyên chỗ - nhưng văn bản được viết lại bằng một phông chữ chuẩn, nên sẽ không khớp với ảnh từng chữ một. Thứ bạn nhận được là tài liệu, không phải bản sao của ảnh.
Tệp bị xóa khỏi máy chủ của chúng tôi sau 24 giờ và liên kết tải xuống ngừng hoạt động. Không ai khác truy cập được.
Có. Mọi thứ chạy trên máy chủ của chúng tôi, nên trình duyệt hiện đại nào cũng dùng được - Chrome, Firefox, Safari hoặc Opera, trên Android, iOS, Windows, macOS hoặc Linux.
OCR được tạo ra cho chữ in. Ghi chú viết tay và chữ ký có thể trở lại thành những từ méo mó, nên hãy kiểm tra trước khi tin dùng tài liệu.