일감

PDF 텍스트 추출

PDF 안에 든 글자를 텍스트로 꺼냅니다.

파일이 서버에 올라가지 않습니다. 선택한 파일은 이 기기를 벗어나지 않고 브라우저 안에서 처리됩니다. 페이지를 닫으면 사라지며, 저장되거나 전송되는 기록이 없습니다.

도구를 불러오는 중입니다.

사용 방법

  1. PDF 파일 하나를 선택합니다.
  2. 쪽 구분을 유지할지 고릅니다.
  3. 추출을 누르면 텍스트가 나오고, 복사하거나 txt로 저장할 수 있습니다.

자주 묻는 질문

글자가 하나도 안 나옵니다.
스캔한 이미지 PDF일 가능성이 큽니다. 종이를 찍은 사진이 들어 있을 뿐 문자 정보가 없는 파일이라, 문자 인식(OCR)을 거쳐야 텍스트를 얻을 수 있습니다.
줄바꿈이 이상하게 됩니다.
PDF는 글자의 위치 좌표만 갖고 있어서 문단 구조를 정확히 복원하기 어렵습니다. 특히 표나 다단 편집 문서는 읽는 순서가 원본과 달라질 수 있습니다.
한글이 깨져 나옵니다.
PDF를 만들 때 글꼴을 특수한 방식으로 넣으면 글자 정보가 유실되는 경우가 있습니다. 원본 문서가 있다면 그쪽에서 복사하는 편이 정확합니다.