스캔 PDF 합치고 글자 검색되게

스캔 PDF·서류 사진을 하나로 합치고, 보이지 않는 글자층을 넣어 검색·복사되는 PDF로 만들어요.

이 레시피: PDF 하나로 모으기 → 스캔 글자 인식 · 다른 레시피 보기·직접 만들기

도구를 불러오는 중이에요...

광고 (tool-below)

스캔 PDF는 왜 검색이 안 될까요

복합기로 스캔하거나 사진으로 만든 PDF는 쪽마다 그림 한 장이 들어 있을 뿐이라, Ctrl+F로 찾거나 글자를 복사할 수 없어요. 이 레시피는 여러 스캔 파일을 먼저 하나로 합친 다음, 쪽마다 글자를 인식해 그 위치에 보이지 않는 글자층을 겹쳐 넣어요. 보기에는 원본과 똑같지만 PDF 뷰어에서 낱말을 검색하고 드래그해서 복사할 수 있게 돼요.

인식은 이 브라우저 안에서 해요

글자 인식은 tesseract.js(Apache-2.0)로 이 기기 안에서 이루어지고, 파일은 서버로 올라가지 않아요. 처음 한 번은 인식 데이터(한국어+영어 약 6MB)를 내려받아요. 한 쪽에 보통 1~3초쯤 걸리고, 300dpi 정밀 모드는 더 오래 걸려요. 이미 글자가 들어 있는 쪽은 자동으로 건너뛰어요.

정확도와 한계

또렷하게 인쇄된 문서는 잘 인식되지만 손글씨, 흐리거나 기울어진 스캔, 아주 작은 글씨는 틀리거나 빠질 수 있어요. 한글은 낱말이 음절 단위로 띄어 인식될 때가 있어서 PDF 뷰어에 따라 긴 구절 검색이 안 맞을 수 있어요. 결과 PDF는 한글 글꼴이 들어가서 원본보다 2MB쯤 커져요. 크기가 걱정되면 "단계 더하기"로 용량 줄이기(보통)를 글자 인식 뒤에 붙이세요. "강하게"는 글자층을 지우므로 글자 인식 앞에만 둘 수 있어요.

사용 방법

  1. 위 단계와 설정을 확인해요. 필요하면 단계를 더하거나 순서를 바꿔요.
  2. PDF·사진 파일을 끌어다 놓거나 골라요. 순서는 파일 목록에서 바꿀 수 있어요.
  3. "한 번에 실행"을 누르면 단계가 차례로 실행되고 단계별 결과가 표시돼요.
  4. 완성된 PDF를 미리 보고 내려받아요. 자주 쓰는 조합은 "내 레시피로 저장"으로 남겨요.

알아 두세요

자주 묻는 질문

원본 화면이 바뀌나요?

아니요. 원래 쪽 그림은 그대로 두고, 그 위에 보이지 않는 글자층만 겹쳐 넣어요.

얼마나 걸리나요?

보통 해상도(200dpi)에서 한 쪽에 1~3초 정도예요. 처음 한 번은 인식 데이터를 내려받는 시간이 더 걸려요.

손글씨도 인식되나요?

손글씨는 거의 인식되지 않아요. 인쇄된 글자에 맞춰진 방식이에요.

파일이 왜 커졌나요?

한글을 검색·복사할 수 있게 한글 글꼴이 PDF 안에 들어가서 2MB쯤 커져요. 용량 줄이기 단계를 뒤에 붙이면 사진 부분을 줄일 수 있어요.

다른 작업 레시피

함께 쓰면 좋은 도구

🗂️ 서류 제출할 때 파일 준비 순서 전체 보기 →