스캔 PDF와 검색 가능한 PDF를 1분 안에 구분하는 방법
글자를 선택할 수 없는 PDF를 변환 오류로 오해하지 않고 이미지형 문서와 텍스트형 문서를 구분하는 기준입니다.
한 단어 선택과 검색으로 문서 유형을 확인하세요
본문의 분명한 단어 하나를 마우스로 드래그해 선택해 봅니다. 글자 단위로 선택되고 복사한 내용을 텍스트 편집기에 붙여 넣을 수 있다면 텍스트 층이 있는 PDF입니다. 페이지 전체가 하나의 사각형 이미지처럼 선택되거나 아무것도 선택되지 않으면 스캔 이미지일 가능성이 큽니다.
같은 단어를 PDF 검색 기능으로 찾아봅니다. 눈에는 보이지만 검색 결과가 없다면 텍스트 층이 없거나 OCR 인식이 잘못된 것입니다. 파일이 열리고 페이지가 보인다면 이 현상만으로 손상 파일이라고 판단할 수는 없습니다.
- 단어 한 개를 글자 단위로 선택
- 복사해 텍스트 편집기에 붙여넣기
- 같은 단어로 문서 검색
스캔 PDF는 페이지 작업과 내용 인식을 나눠 생각하세요
스캔 PDF도 페이지 합치기, 추출, 회전은 할 수 있습니다. 이 작업은 페이지를 구성하는 이미지 자체를 다루기 때문입니다. 그러나 글자 검색, 복사, 문장 수정에는 OCR로 이미지 속 문자를 인식해 텍스트 층을 만들어야 합니다.
이 PDF 도구는 페이지 구성 작업을 제공하며 OCR 정확도를 보장하지 않습니다. 문자인식이 필요하면 별도의 OCR 도구에서 처리한 뒤 사람 이름, 금액, 날짜, 표의 열을 원본 이미지와 대조해야 합니다.
- 페이지 구성 작업인지 내용 인식 작업인지 구분
- OCR 결과를 원본 이미지와 대조
- 금액·날짜·고유명사를 우선 검수
제출 목적에 따라 OCR을 하지 않는 선택도 가능합니다
상대 기관이 원본 스캔 사본을 요구한다면 OCR로 문서를 다시 만들 필요가 없을 수 있습니다. 검색 편의 때문에 OCR을 추가했더라도 화면에 보이는 원본 이미지는 유지하고, 인식 오류가 법적·행정적 의미를 바꾸지 않는지 확인해야 합니다.
민감한 문서는 온라인 OCR 서비스에 올리기 전에 처리 위치와 보관 정책을 확인합니다. 로컬 처리가 필요하다면 인터넷 연결 없이 실행되는 도구나 기관이 승인한 프로그램을 사용하고, 결과 파일에 숨은 텍스트로 개인정보가 더 쉽게 검색되지는 않는지도 검토합니다.
- 제출기관이 스캔 원본을 요구하는지 확인
- OCR 처리 위치와 보관 정책 확인
- 숨은 텍스트의 개인정보 노출 점검
이 방법으로 해결되지 않는 경우
- 이 사이트의 PDF 페이지 도구는 OCR 서비스를 대신하지 않습니다.
- 선택·검색 시험만으로 전자서명과 문서 진위를 판단할 수 없습니다.
- 손글씨와 복잡한 표는 OCR 후에도 사람 검수가 필요합니다.
바로 실행하기
PDF 페이지 추출 열기 →PDF 회전 열기 →JPG·PNG를 PDF로 열기 →근거 자료
형식과 기능 설명은 아래 공식 문서와 표준을 우선 확인했습니다.