OCR로 검색 가능한 PDF 만들기
스캔본과 이미지 전용 PDF를 검색·선택 가능한 PDF로 변환 — 10개 언어 지원
서버의 FFmpeg가 모든 형식을 처리합니다 — 브라우저가 재생하지 못하는 HEVC/H.265도 지원. 파일은 30분 안에 서버에서 삭제됩니다.
⚠️ 완료될 때까지 이 페이지를 닫거나 새로고침하지 마세요. 결과가 사라질 수 있습니다.
💡 큰 파일은 사용자의 연결 속도에 맞춰 전송됩니다. 업로드는 자동으로 계속되고 안전하게 이어 올릴 수 있으므로, 느린 회선은 시간에만 영향을 줄 뿐 크레딧에는 영향을 주지 않습니다.
자주 묻는 질문
일반 OCR 도구와 무엇이 다른가요?
일반 OCR 도구는 인식된 텍스트를 .txt 파일로 제공합니다. 이 도구는 원본 페이지 이미지를 그대로 유지하면서 그 아래에 보이지 않는 텍스트 레이어를 추가합니다 — 결과물은 여전히 원본처럼 보이는 PDF이지만, 이제 텍스트를 선택, 복사, 검색할 수 있습니다.
페이지 모양이 달라지나요?
아니요 — 보이는 페이지 이미지는 그대로입니다. 그 아래에 보이지 않는 검색 가능한 텍스트 레이어만 추가됩니다.
어떤 언어를 지원하고, 몇 페이지까지 가능한가요?
중국어 간체·번체, 영어, 일본어, 한국어, 프랑스어, 스페인어, 독일어, 러시아어, 포르투갈어를 지원하며, 파일당 최대 20페이지입니다. 다국어 문서에는 “中文 + English”와 같은 조합 옵션을 선택하세요.
OCR을 실행하면 스캔 이미지 모양이 바뀌나요?
아니요 — 이미지 레이어는 바이트 단위로 그대로 유지됩니다. 추가되는 것은 숨겨진 텍스트 레이어뿐이며, 리더는 이를 색인할 뿐 화면에는 표시하지 않습니다.
OCR 파이프라인 세부 사항
인식 엔진은 Tesseract이며 100개 이상 언어를 지원하고 페이지별로 문자 체계를 감지합니다:
- 레이어 배치 — 인식된 단어가 해당 픽셀 위에 정확히 놓여 선택 영역이 눈에 보이는 텍스트와 일치합니다.
- 혼합 언어 — 기본 언어에 영어 폴백을 함께 지정할 수 있고, 이중 언어 스캔도 페이지 단위로 처리됩니다.
- 텍스트 있으면 건너뛰기 — 실제 텍스트가 이미 있는 페이지는 이중 처리되지 않고 그대로 통과합니다.
이용 방법
- 1
스캔한 PDF나 문서 사진/스크린샷을 업로드하세요.
- 2
문서의 언어를 선택하세요(영어와의 혼합도 지원).
- 3
검색 가능한 PDF를 다운로드하세요 — 이제 텍스트를 선택, 복사하고 Ctrl+F로 찾을 수 있습니다.
실제 문서처럼 동작하는 스캔본
이미지 페이지 아래에 보이지 않는 검색 가능한 텍스트 레이어가 추가됩니다 — 화면은 그대로 유지되면서 복사-붙여넣기와 Ctrl+F가 동작합니다.
스캔이 검색 가능하게
스캔한 페이지는 PDF 안에 그림으로 저장됩니다. 이 도구는 그 위에 검색 가능한 텍스트 레이어를 더해서, 파일을 디지털 문서처럼 검색할 수 있게 합니다.
보이지 않는 텍스트 레이어
텍스트는 각 페이지 아래에 보이지 않게 자리하며 Ctrl+F, 선택, 복사-붙여넣기를 지원합니다. 보이는 스캔 부분은 스캔된 그대로 유지됩니다.
원본 모습 유지
한 번의 작업으로 최대 20페이지의 이미지나 PDF를 처리하며, 출력은 문서를 다시 흐르게 하지 않고 원래 레이아웃을 유지합니다.
관련 도구
검색 가능한 PDF란 무엇인가요?
검색 가능한 PDF는 외관은 스캔과 똑같지만, 페이지 이미지 아래에 보이지 않는 텍스트 레이어를 갖습니다. 그래서 문서 전체가 어떤 PDF 리더에서든 검색, 선택, 복사가 가능해지고, 보이는 페이지는 원본 스캔과 완전히 동일합니다. 이 도구는 서버 측 OCR로 그 레이어를 만듭니다. 스캔 이미지나 이미지만 있는 PDF를 업로드하고 10개 언어 중에서 고르면, Tesseract가 페이지를 읽고 인식된 텍스트를 원본 페이지 이미지 아래에 보이지 않게 심은 새 PDF를 작성합니다. 그다음에는 계약서에서 키워드를 검색하고, 문장을 선택하고, 문단을 복사하고, 문서 소프트웨어가 파일을 색인하게 할 수 있습니다. 종이 기록을 디지털화하는 기록관리자, 계약서를 스캔하는 변호사와 회계사, 그리고 '예쁘지만 검색할 수 없는 PDF'를 가진 모든 사람을 위한 도구입니다. 계정이 필요하고 크레딧을 소비합니다.
이 도구로 할 수 있는 일
- 스캔이나 이미지만 있는 PDF에 보이지 않지만 선택 가능한 텍스트 레이어를 추가한다
- 간체·번체 중국어부터 영어, 일본어, 한국어, 프랑스어, 스페인어, 독일어, 러시아어, 포르투갈어까지 10개 언어를 인식한다
- 원본 페이지 이미지를 스캔 그대로 유지한다. 시각적으로 바뀌는 것이 없다
- 여러 페이지 문서를 한 번에 처리해 하나의 검색 가능한 PDF로 출력한다
- 어떤 PDF 리더에서든 텍스트를 선택하고 복사할 수 있다
- 완성된 검색 가능한 PDF를 페이지에서 바로 다운로드한다
이런 때 사용하세요
- 스캔한 계약서를 키워드로 검색할 수 있게 만들고 싶을 때
- 종이 문서와 영수증으로 검색 가능한 전자 아카이브를 만들고 싶을 때
- 스캔한 강의 노트를 인용할 수 있는 문서로 바꾸고 싶을 때
- 검색과 인용을 위해 스캔한 양식이나 증거 자료를 준비할 때
- 클라이언트에게 스캔을 눈으로 쫓는 대신 텍스트를 선택할 수 있는 PDF를 보내고 싶을 때
개인정보와 제한: OCR은 사이트의 VPS에서 실행됩니다. 스캔은 처리를 위해 업로드되고 작업이 끝나면 삭제됩니다. 계정이 필요하고 크레딧을 소비합니다. 인식 품질은 원본 자료와 같습니다. 깨끗하고 반듯하며 대비가 높은 스캔은 거의 완벽한 텍스트 레이어를 만들지만, 저품질이나 손글씨 페이지는 숨은 텍스트에 오류가 있을 수 있습니다. 중요한 문서는 변환 후 반드시 확인하세요.
마지막 업데이트 · 2026-09-01