PDF OCR: 스캔본을 검색·복사 가능하게 만들기
FreePDF 팀 작성 ·
스캔한 PDF는 사실 페이지를 찍은 사진을 .pdf 확장자로 저장한 것에 지나지 않습니다. 검색도 안 되고, 한 문장을 골라 복사할 수도 없고, 화면 낭독기도 읽지 못하죠. OCR(광학 문자 인식)이 이걸 해결합니다. 이미지 속 글자를 읽어서 눈에 안 보이게 다시 심어 주는 방식입니다.
OCR이 실제로 바꾸는 것
스캔 자체는 그대로입니다. 레이아웃도, 손글씨도, 혹시 있다면 커피 자국 까지 똑같죠. 더해지는 건 이미지 속 글자 바로 뒤에 정확히 겹쳐 놓인, 선택 가능한 진짜 글자 층입니다. 덕분에 페이지는 똑같아 보이면서도 이제 일반 문서처럼 동작합니다.
OCR 돌리기
- PDF OCR 도구를 열고 스캔한 파일을 올리세요.
- 각 페이지의 글자를 인식해 그 아래에 검색 가능한 층으로 더합니다.
- 검색 가능한 PDF를 다운로드하세요.
이게 정말 필요한 순간
- 긴 스캔 계약서나 보고서에서 조항 하나를 찾을 때, 모든 페이지를 읽는 대신 검색으로 끝내고 싶을 때.
- 스캔본에서 한 문단을 손으로 다시 치는 대신 복사해 올 때.
- 오래된 스캔 문서를 화면 낭독기가 읽을 수 있게 만들 때.
- 이후 변환을 준비할 때. 표나 텍스트 추출은 읽어 낼 진짜 글자가 있어야 비로소 작동하니까요.
정확한 결과를 얻는 법
OCR 정확도는 스캔 품질을 그대로 따라갑니다.
- 선명하고 반듯하며 빛이 고른 스캔본은 거의 완벽하게 읽힙니다.
- 저해상도 사진, 심하게 기운 페이지, 손글씨는 안정적으로 인식하기가 더 어렵습니다. 첫 결과가 영 이상하면 평평하고 밝게 다시 스캔하세요.
- 영어 글자에 최적화돼 있어, 다른 언어는 오류가 더 많을 수 있습니다.
자주 묻는 질문
작업 후 페이지가 달라 보이나요?
아니요. 원본 이미지는 있던 그대로 둡니다. OCR은 그 뒤에 보이지 않는 텍스트 층을 더할 뿐, 페이지를 다시 그리거나 갈아 끼우지 않습니다.
그다음 파일을 Word나 Excel로 변환할 수 있나요?
네, 오히려 그게 목적인 경우가 많습니다. 먼저 OCR을 돌려 아래에 진짜 글자나 표 데이터를 만든 뒤, 평소처럼 Word, Excel, 순수 텍스트로 변환하세요.