스캔 PDF 텍스트 인식(OCR) — 검색·복사 되는 문서로 만들기
스캔한 PDF에서 검색도 복사도 안 되나요? OCR로 보이지 않는 텍스트 층을 입히면 검색·복사·선택이 모두 됩니다. 한국어 지원, 무료.

스캔한 계약서에서 특정 조항을 찾으려고 Ctrl+F를 눌렀는데 아무것도 검색되지 않았던 경험, 있으실 겁니다. 스캐너나 휴대폰 카메라가 만든 PDF는 컴퓨터 입장에서 그냥 사진이기 때문입니다. 페이지에 글자가 보여도, 컴퓨터에게는 픽셀 덩어리일 뿐입니다. OCR(광학 문자 인식)이 바로 이 문제를 해결합니다.
OCR은 어떻게 작동하나요
OCR 엔진이 스캔 이미지 속 글자 모양을 분석해 실제 텍스트로 변환한 뒤, 그 텍스트를 원본 이미지 위에 보이지 않는 층으로 정확히 같은 위치에 깔아 줍니다. 결과물은 원본과 겉모습이 완전히 동일하지만, 이제 검색하면 찾아지고, 드래그하면 선택되고, 복사하면 붙여넣어집니다. 저희는 업계 표준 오픈소스 엔진인 Tesseract를 사용합니다 — Google이 오랫동안 발전시켜 온, 전 세계에서 가장 널리 쓰이는 OCR 엔진입니다.
단계별 따라 하기
OCR 도구 열기
pdfty.com/tools/ocr 로 이동하세요. 가입 없이, 20 MB까지 무료입니다.
스캔 PDF 끌어다 놓기
스캔본이나 사진으로 만든 PDF를 업로드 영역에 끌어다 놓으세요. HTTPS로 안전하게 전송됩니다.
문서 언어 선택
한국어를 선택하세요. 한글과 영어가 섞인 문서라면 두 언어를 함께 지정하면 인식률이 올라갑니다.
인식 기다리기
Tesseract 엔진이 페이지별로 글자를 인식합니다. 페이지 수에 따라 수 초에서 수십 초가 걸립니다.
내려받기 — 완료
겉모습은 그대로, 검색·복사는 되는 PDF가 완성됩니다. 파일은 1시간 이내에 서버에서 삭제됩니다.
인식률을 높이는 팁
- 해상도가 좋을수록 정확합니다. 300 DPI 이상으로 스캔된 문서가 이상적입니다.
- 똑바로 스캔하세요. 기울어지거나 구겨진 페이지는 인식률이 떨어집니다.
- 손글씨는 기대하지 마세요. 무료 OCR 엔진은 인쇄된 활자에 최적화되어 있어 손글씨 인식률이 낮습니다. 손글씨 메모가 많은 문서라면 결과를 반드시 검토하세요.
- OCR 후 용량이 커졌다면 PDF 압축으로 줄이세요. 텍스트 층은 그대로 유지됩니다.
자주 묻는 질문
OCR 후에 문서 모양이 바뀌나요?
아니요. 원본 스캔 이미지는 한 픽셀도 바뀌지 않습니다. 텍스트 층은 이미지 뒤에 투명하게 깔릴 뿐이라 인쇄해도, 화면으로 봐도 원본과 완전히 동일합니다.
손글씨도 인식되나요?
잘 안 됩니다. Tesseract를 비롯한 무료 엔진은 인쇄된 활자 전용에 가깝습니다. 또박또박 쓴 글씨 일부는 인식될 수 있지만, 흘림체는 대부분 실패합니다. 손글씨 문서는 결과를 직접 확인하셔야 합니다.
한글과 영어가 섞인 문서도 되나요?
네. 언어를 여러 개 지정할 수 있어 한·영 혼용 문서도 문제없습니다. 계약서나 논문처럼 영어 용어가 섞인 한국어 문서에서 특히 유용합니다.
pdfty 팀은 개인정보를 중시하는 온라인 PDF 도구(압축, 변환, OCR, 서명, 보호)를 만듭니다. 파일은 1시간 이내에 삭제됩니다. 회사 소개 →
