스캔한 PDF를 Word로 변환

온라인 OCR로 스캔본을 편집할 수 있는 Word 문서로 바꿉니다

결과 보내기 :

스캔한 PDF를 OCR로 편집할 수 있는 Word 문서로 바꾸세요

스캔본은 한 쪽을 찍은 사진입니다. 대부분의 도구는 그대로 둡니다. 글자를 인식해 이미지 아래 보이지 않는 층에 숨기므로 검색은 되지만 아무것도 고칠 수 없습니다. 이 앱은 대신 문서를 다시 만듭니다. 낱말과 그 위치는 문자 인식에서 가져오고, 쪽의 구조 — 제목, 단, 표, 그림 설명 — 는 따로 알아내며, 쪽은 실제 글, 실제 표, 실제 그림으로 Word 파일(.docx)에 다시 쓰입니다.

글을 놓기 전에 구조를 먼저 찾기 때문에, 스캔본의 표는 흩어진 줄의 벽이 아니라 자기 열을 가진 표로 돌아옵니다. 서식은 인쇄되어 있던 대로 항목 이름과 값이 짝을 이뤄 정렬된 채 돌아옵니다. 제목은 제목으로 남고, 스캔본의 각 쪽은 문서의 각 쪽으로 남습니다.

문서의 언어는 쪽 자체에서 알아내므로 독일어나 이탈리아어 스캔본도 수동 설정이 필요 없습니다. 인식이 확신하지 못한 낱말은 추측하지 않고 스캔본에서 다시 읽으며, 숫자와 식별 번호는 절대 고쳐 쓰지 않습니다. 파일이 준비되면 한 줄로 몇 쪽을 다시 만들었는지, 몇 낱말을 고쳤는지, 몇 낱말이 확실하지 않은 채 남았는지 알려 줍니다.

결과물은 Word, Google 문서, Pages에서 열리고 다른 문서처럼 편집되는 .docx입니다. 스캔본의 그림은 대체 텍스트와 함께 옮겨지고 제목은 제목으로 표시되므로 화면 낭독기가 문서를 따라갈 수 있습니다. 보이지 않는 텍스트 층을 덮은 스캔본은 결코 허용하지 않는 일입니다.

알아 둘 한계도 있습니다. 글은 하나의 표준 글꼴로 다시 쓰이므로 다시 만든 쪽이 스캔본과 글자 하나하나까지 같지는 않습니다. 배치는 지키지만 서체는 지키지 않습니다. 손글씨는 문자 인식이 겨냥한 대상이 아니며, 손으로 쓴 메모는 뭉개진 낱말로 돌아올 수 있습니다. 흐리거나 기울었거나 해상도가 낮은 스캔본은 모든 단계에서 정확도를 떨어뜨립니다. 결과를 믿기 전에 확인하고 원본은 남겨 두세요.

편집할 것이 없고 쪽 모양이 픽셀까지 같아야 한다면 알맞은 도구는 «검색 가능 PDF»입니다. 이미지를 그대로 두고 그 위에 보이지 않는 텍스트 층을 올립니다. 이 도구는 정확한 겉모습 대신 고칠 수 있는 문서를 줍니다.

모든 처리는 브라우저에서, 저희 서버에서 이뤄집니다. 설치도 가입도 CAPTCHA도 없습니다. 한 번에 10개 파일까지, 파일당 10 MB. 올린 파일과 내려받기 링크는 24시간 뒤에 삭제됩니다.

스캔한 PDF를 온라인에서 Word로 변환하는 방법

OCR(광학 문자 인식)이 낱말과 그 위치를 읽고, 쪽의 구조는 따로 알아내며, 문서는 실제 글과 표, 그림으로 .docx 파일에 다시 쓰입니다.

  1. 스캔한 PDF를 올리세요. 업로드 영역으로 끌어다 놓거나 영역을 눌러 컴퓨터에서 파일을 고르면 됩니다.
  2. 쪽이 똑바르고 읽을 만한지 확인하세요. 기울었거나 흐리거나 해상도가 낮은 스캔본은 이후 모든 단계에서 정확도를 떨어뜨립니다.
  3. 변환을 누르세요. 각 쪽을 인식하고 구조를 알아내며, 의심스러운 낱말은 스캔본에서 다시 읽습니다.
  4. 요약 줄을 읽으세요. 몇 쪽을 다시 만들었고, 몇 낱말을 고쳤으며, 몇 낱말이 확실하지 않은지 나옵니다.
  5. .docx를 내려받아 Word, Google 문서, Pages에서 편집하면서 확실하지 않다고 표시된 낱말을 확인하세요.

파일은 24시간 뒤 저희 서버에서 삭제되며, 그 뒤로는 내려받기 링크가 작동하지 않습니다.

자주하는 질문