PDF 다루기
합치고 나누고 꺼내는 일의 원리.
도구
엑셀을 PDF로
엑셀 표를 그대로 PDF 문서로 인쇄하듯 만듭니다.
PDF 합치기
여러 PDF를 순서대로 이어 붙입니다. 파일은 서버로 가지 않습니다.
PDF 쪽 삭제
필요 없는 쪽을 빼거나 필요한 쪽만 남깁니다.
PDF 암호 해제
아는 암호를 없앱니다.
PDF 쪽 번호
제출 서류에 번호를 찍습니다.
PDF 순서 바꾸기
쪽 순서를 다시 짭니다.
PDF 회전
옆으로 누운 쪽을 바로 세웁니다.
PDF 이미지 변환
PDF의 각 페이지를 JPG나 PNG 이미지로 바꿉니다.
PDF 텍스트 추출
PDF 안에 든 글자를 텍스트로 꺼냅니다.
PDF를 워드로
PDF 안의 글자를 뽑아 워드에서 바로 편집할 수 있는 파일로 만듭니다.
PDF 나누기
PDF에서 원하는 쪽만 뽑거나 낱장으로 나눕니다.
텍스트를 PDF로
쓰거나 붙여넣은 글을 한글이 안 깨지는 PDF로 만듭니다.
워드를 PDF로
워드 문서를 제목·본문 서식이 살아있는 PDF로 바꿉니다.
읽을거리
PDF 암호는 두 가지입니다
PDF 암호는 여는 암호와 권한 암호 두 가지입니다. 아는 암호는 없앨 수 있지만, 없앤 파일은 누구나 열립니다.
글꼴이 포함되지 않은 PDF가 열리는 과정
PDF에 글꼴이 포함되지 않으면 여는 컴퓨터의 글꼴로 대체됩니다. 내 화면에서는 멀쩡한데 받는 쪽에서 깨지는 이유입니다.
PDF 를 손보는 순서
쪽을 빼고, 순서를 바꾸고, 방향을 돌리고, 번호를 넣는 순서입니다. 순서를 잘못 잡으면 다시 해야 합니다.
복사가 안 되는 세 경우
스캔한 문서라 글자 정보가 없거나, 복사를 막아둔 것입니다. 각각 방법이 다릅니다.
PDF 로 바꿀 때
워드, 엑셀, 텍스트, 이미지를 PDF로 만들 때 각각 살아남는 것이 다릅니다. 변환 전에 알아야 낭패를 안 봅니다.
무엇으로 꺼낼까
텍스트 추출, 워드 변환, 이미지 변환은 각각 다른 상황을 위한 것입니다. 무엇을 하려는지에 따라 답이 달라집니다.
세 갈래로 나뉩니다
PDF끼리 — 합치기, 나누기. 페이지를 그대로 복사해 옮기므로 화질 손실이 없습니다.
PDF로 만들기 — 워드·엑셀·텍스트를 PDF로. 내용을 다시 조판하므로 쪽 나눔 위치가 원본과 달라질 수 있습니다.
PDF에서 꺼내기 — 여기가 가장 헷갈립니다.
꺼낼 때 고르는 기준
글자가 필요한가?
├─ 아니오 → 이미지 변환 원본과 100% 동일, 검색 불가
└─ 예
├─ 편집해서 다시 문서로? → 워드 변환
└─ 복사해서 쓰기만? → 텍스트 추출
PDF에서 원래 형식으로 되돌리는 것은 근본적으로 어렵습니다. PDF를 만드는 순간 "어떤 문단인지"가 아니라 "어디에 그릴지"만 남기 때문입니다. 원본 파일이 있다면 그쪽을 쓰는 게 언제나 낫습니다.
아무것도 안 나올 때
스캔한 이미지 PDF일 가능성이 큽니다. 겉보기엔 문서지만 속은 사진 한 장이라 문자 정보가 없습니다.
구분하는 법은 간단합니다. 뷰어에서 글자를 드래그해보세요. 선택 영역이 잡히면 텍스트, 안 잡히면 이미지입니다.
줄바꿈이 뒤엉킬 때
PDF는 글자의 좌표만 갖고 있고 문단 순서 정보가 없습니다. 그래서 추출 도구가 좌표를 보고 순서를 추측합니다. 2단 편집된 논문이나 표가 많은 문서에서 특히 어긋납니다.
한글이 깨지는 PDF
PDF 표준 기본 글꼴에는 한글이 없습니다. 만들 때 글꼴을 파일에 넣지 않으면 다른 컴퓨터에서 네모나 물음표로 나옵니다.
만든 컴퓨터에서는 드러나지 않으니, 다른 기기에서 한 번 열어보는 것이 유일한 확인 방법입니다.