사진을 검색 가능한 PDF로 만드는 방법
- 이미지 추가하기. JPG, PNG, WebP 사진을 도구에 끌어다 놓거나 탭해서 선택합니다. 각 페이지는 카드로 표시되며, 손잡이를 드래그해 순서를 바꾸거나 원하지 않는 페이지는 제거할 수 있습니다.
- 언어 선택하기. 문서에 쓰인 언어를 선택합니다. 해당 언어의 인식 데이터는 한 번만 내려받으며(선택 목록 옆에 용량이 표시됩니다), 이미지는 여전히 기기 밖으로 나가지 않습니다.
- 인식하기. ‘텍스트 인식’을 누르면 각 페이지 카드가 대기 상태에서 완료 상태로 바뀌며 실시간 단어 수가 표시됩니다. 진행 중에도 취소할 수 있으며, 취소하면 아무것도 남지 않습니다.
- 확인하고 다운로드하기. 인식된 텍스트가 페이지별로 표시되므로 신뢰하기 전에 확인할 수 있습니다. 출력 파일 이름을 정한 뒤 검색 가능한 PDF를 다운로드하거나, 일반 .txt 파일을 받거나, 전체 텍스트를 클립보드로 복사하세요.
무엇을 하는 도구인가요
- 브라우저 안에서 실행되는 실제 OCR — 파일이 어디로도 업로드되지 않음
- 여러 장의 사진을 원하는 순서대로 하나의 다중 페이지 PDF로 변환
- 보이지 않는 텍스트 레이어: PDF는 사진처럼 보이지만 검색하고 복사할 수 있음
- 필요할 때 내려받는 15개 인식 언어
- 인식된 텍스트를 .txt 파일로도 내보냄
검색 가능한 PDF란 실제로 무엇인가
영수증 사진은 그저 픽셀 덩어리일 뿐입니다. 검색할 수도, 합계 금액을 선택할 수도, 가맹점 이름을 복사할 수도 없습니다. 검색 가능한 PDF는 이미지 위에 보이지 않는 두 번째 레이어를 더합니다. 바로 사진 속 위치에 배치된 인식된 텍스트입니다. 페이지는 여전히 사진 그대로 보이지만, 이제 미리보기, Adobe Reader, Spotlight를 비롯한 모든 문서 시스템이 그 내용을 읽을 수 있습니다.
이 도구는 이 파일을 브라우저 안에서 만듭니다. 이미지를 디코딩하고, WebAssembly로 컴파일된 오픈소스 Tesseract 인식 엔진을 실행하며, pdf-lib로 PDF를 조립합니다. 이 모든 과정이 지금 보고 있는 페이지 안에서 이루어집니다. 아무것도 전송되지 않습니다. 이것이 핵심입니다. 영수증, 계약서, 진료 편지, 신분증은 무료 OCR을 얻기 위해 임의의 변환 사이트에 넘겨서는 안 되는 바로 그런 파일이기 때문입니다.
언제 사용하면 좋은가
- 나중에 찾을 수 있도록 남기고 싶은 종이 문서 사진 — 영수증, 보증서, 편지, 서식.
- 스캐너로 만든 단순 이미지 형태의 스캔본.
- 낯선 웹사이트에 붙여넣고 싶지 않은 모든 것.
텍스트 레이어에서 위치가 중요한 이유
인식된 단어는 파일에 그냥 덧붙는 것이 아니라, 사진 속에 나타난 좌표에 맞춰 보이지 않게 배치됩니다. 그래서 선택이 자연스럽게 느껴집니다. 이미지를 가로질러 드래그하면 강조 표시가 인쇄된 줄을 따라가고, 단어를 검색하면 뷰어가 페이지의 정확한 위치로 이동합니다. 위치는 대략적인데, 이는 사무용 스캐너가 만드는 파일에서도 마찬가지이며 찾고 복사하는 데는 문제가 없습니다.
솔직한 한계
기기 안에서 처리하는 OCR은 서버 팜보다 느리며, 인쇄물은 읽지만 손글씨는 읽지 못합니다. 매우 작거나 흐릿한 글자는 잘못 인식될 수 있어, .txt로 내보내면 쉽게 확인할 수 있습니다. 인식 속도를 위해 이미지는 긴 변 기준 약 2,500 px로 축소되지만, PDF에 삽입되는 페이지 이미지는 최대 4,000 px를 유지해 레터 크기로 인쇄해도 깔끔합니다.
이 작업을 자주 한다면
이 도구는 한 번 쓰고 마는 변환기입니다. 카메라 롤이 문서가 사라지는 곳이 되고 있다면, 그것이 바로 Paperlock이 존재하는 이유입니다. 아이폰에서 문서를 스캔하고 읽고 정리해 주며, 암호화되지 않은 상태로 기기를 벗어나지 않는다는 같은 원칙을 지킵니다.