發送結果:
頁面的圖片——手機拍的照片、螢幕截圖、掃描器產生的檔案——裡面沒有文字,只有像素。把它貼進 Word,得到的只是文件裡的同一張圖片:裡面什麼都不能選取、修改或複製。這個應用程式會重建頁面。文字及其位置來自辨識,頁面結構——標題、分欄、表格、圖說——另外求出,然後頁面被重新寫成 Word 檔案(.docx)中真正的文字、真正的表格和真正的圖片。
它支援頁面圖片通常使用的格式:JPG 和 JPEG、PNG、BMP、WEBP 和 TIFF。文件掃描器儲存的多頁 TIFF 會逐格讀取。一次上傳多張圖片,它們會依你加入的順序成為同一份文件的各頁:逐頁拍下的合約會作為一份合約傳回,而不是一堆檔案。
圖片沒有自己的紙張尺寸,所以紙張由你選擇。選 A4 或 Letter 時,每張圖片完整放在頁面中央,紙張依圖片方向設為直向或橫向;「與圖片相同」保留圖片本身的比例。照片會依相機記錄的方向轉正,所以側著拍的頁面不會側著傳回。
因為結構在放置文字之前就已找到,圖片中的表格會還原為帶有自己欄位的表格,而不是一堆零散的行,表單會還原為成對的標籤和值。語言根據頁面本身判斷。辨識沒有把握的字詞會回到圖片上重讀,而不是用猜的,數字和編號從不改寫。檔案完成後,一行提示會告訴你重建了多少頁、修正了多少字詞、還有多少字詞存疑。
有些限制值得了解。文字會用一種標準字型重寫,所以頁面不會與圖片逐字吻合:版面保留,字體排印不保留。手寫字不是辨識所針對的對象。模糊、昏暗或解析度低的圖片,或是以很大角度拍攝的頁面,在每一步都會降低準確度。依賴結果之前請先讀一遍,並保留原件。
無需安裝:處理在我們的伺服器上完成,無需註冊,也沒有 CAPTCHA。每次最多 10 個檔案,每個 10 MB。上傳的檔案和下載連結會在 24 小時後刪除。
OCR 讀取圖片上的文字及其位置,頁面結構另外求出,然後把頁面重新寫成 .docx 中真正的文字、表格和圖片。
檔案會在 24 小時後從我們的伺服器刪除,之後下載連結將失效。
把圖片拖到白色區域,或點一下該區域選擇,選好頁面尺寸,然後按「轉換」。頁面重建完成後下載 .docx。每次最多 10 個檔案,每個 10 MB。
JPG 和 JPEG、PNG、BMP、WEBP 和 TIFF。文件掃描器儲存的那種多頁 TIFF 會逐格讀取,每一格成為文件的一頁。
不會,只有一個。圖片會依上傳順序成為同一份文件的各頁,所以逐頁拍下的合約會作為一份合約傳回。
版面會保留——標題、分欄、表格和圖片都留在原處——但文字會用一種標準字型重寫,所以不會與圖片逐字吻合。你得到的是文件,而不是圖片的副本。
檔案會在 24 小時後從我們的伺服器刪除,下載連結也會失效。其他任何人都無法存取。
可以。所有處理都在我們的伺服器上進行,所以任何現代瀏覽器都行——Android、iOS、Windows、macOS 或 Linux 上的 Chrome、Firefox、Safari 或 Opera。
OCR 是為印刷文字做的。手寫註記與簽名可能變成亂掉的字詞,依賴這份文件之前請先核對。