将结果发送到:
JPG 是手机相机保存的格式,而如今大多数纸质文件都是以照片的形式进入电脑的:餐桌上的合同、收据、课本的一页、银行寄来的信。照片里没有文字,只有像素。把它贴进 Word,它仍然是一张图片:里面什么都不能选中、修改或复制。这个应用会重建文档。文字及其位置来自识别,页面结构——标题、分栏、表格、图注——单独求出,然后页面被重新写成 Word 文件(.docx)中真正的文字、真正的表格和真正的图片。
照片直接来自手机,原样上传即可。每张照片都会按相机记录的方向摆正,所以侧着拍的页面不会侧着返回。一次上传多张照片,它们会按你添加的顺序成为同一个文档的各页:逐页拍下的合同会作为一份合同返回。
照片没有纸张尺寸,所以纸张由你选择。选 A4 或 Letter 时,每张照片完整放在页面中央,纸张按照片方向设为纵向或横向;“与图片相同”保留照片本身的比例。
因为结构在放置文字之前就已找到,照片中的表格会还原为带有自己列的表格,表单会还原为成对的标签和值。语言根据页面本身判断。识别没有把握的词会回到照片上重读,而不是去猜,数字和编号从不改写。文件完成后,一行提示会告诉你重建了多少页、修正了多少词、还有多少词存疑。
结果的好坏取决于照片本身。把页面平放,在均匀的光线下从正上方拍,并让页面占满画面。模糊、阴影、反光、角度过大或纸张卷曲,在每一步都会降低准确度。文字会用一种标准字体重写,所以页面不会与照片逐字吻合,手写字也不是识别所针对的对象。依赖结果之前请先读一遍,并保留原件。
无需安装:在任何浏览器中打开本页即可,手机也行,无需注册,也没有 CAPTCHA。每次最多 10 个文件,每个 10 MB。上传的文件和下载链接会在 24 小时后删除。
OCR 读取照片上的文字及其位置,页面结构单独求出,然后把页面重新写成 .docx 中真正的文字、表格和图片。
文件会在 24 小时后从我们的服务器删除,之后下载链接将失效。
把 JPG 文件拖到白色区域,或点击该区域选择,选好页面尺寸,然后按“转换”。页面重建完成后下载 .docx。每次最多 10 个文件,每个 10 MB。
把页面平放,从正上方拍,让页面边缘与画面边框平行;在均匀的光线下拍,避免阴影和反光,并让页面占满画面。模糊、角度过大或纸张卷曲都会在每一步降低准确度,低质量保存的 JPG 也一样:压缩会让小字糊掉。
会。一起上传的所有照片会按上传顺序成为同一个文档的各页。按页码顺序上传,文档就会按页码顺序返回。
它看起来像文档,而不是照片。版式会保留——标题、分栏、表格和图片都留在原处——但文字会用一种标准字体重写,桌面、阴影和页面周围的纸张都不会带进来。
文件会在 24 小时后从我们的服务器删除,下载链接也会失效。其他任何人都无法访问。
可以。在手机浏览器中打开本页,从相册中选择照片即可。所有处理都在我们的服务器上进行,所以任何现代浏览器都行——Android、iOS、Windows、macOS 或 Linux 均可。
OCR 是为印刷文字做的。手写批注和签名可能变成乱掉的词,依赖这份文档之前请先核对。