PDF 텍스트 추출(OCR)
스캔한 PDF에 실제 텍스트 레이어를 추가해 텍스트를 검색하고, 선택하고, 복사할 수 있게 만드세요. 인식은 전적으로 사용자의 기기에서 실행되며 문서는 그것을 떠나지 않습니다.
- 업로드 없음
- 로컬 실행
- 가입 없이
이번 세션에 업로드된 파일 데이터: 0 B
파일은 브라우저에서 로컬로 처리됩니다. 아무것도 업로드되지 않습니다.
PDF를 OCR 처리하는 방법
- 스캔한 PDF를 업로드 영역으로 드래그하거나 클릭해서 찾아보세요(최대 100 MB).
- 인식 품질을 선택하세요. 표준(200 DPI)이 대부분의 문서에 적합합니다. 잔글씨(300 DPI)는 작은 글자에 도움이 되고, 빠름(150 DPI)이 가장 빠릅니다.
- "OCR PDF"를 클릭하세요. 처음 한 번은 인식 엔진을 다운로드하고, 이후에는 즉시 시작됩니다.
- 검색 가능한 PDF를 다운로드하세요. 같은 페이지에 이제 실제 텍스트 레이어가 있습니다. 추출된 텍스트만 받을 수도 있습니다.
기밀 스캔본을 어디에도 보내지 않고 OCR 처리하세요
스캔 문서는 종종 민감한 종류입니다. 서명된 계약서, 의료 기록, 신분증 사본, 오래된 편지가 그렇습니다. 대부분의 온라인 OCR 서비스는 먼저 업로드를 요구합니다. NoriPDF는 대신 브라우저 탭 안에서 Tesseract — WebAssembly로 컴파일된 인식 엔진 — 을 실행합니다. 문서는 사용자 자신의 컴퓨터에서 읽히고 처리되며 단 하나의 바이트도 네트워크를 거치지 않습니다. 작동하는 동안 브라우저의 네트워크 패널에서 직접 확인할 수 있습니다. 작업을 하는 서버가 없으므로 페이지 할당량이나 일일 상한도 없습니다. 유일한 한도는 사용자의 기기가 정합니다.
자주 묻는 질문
어떤 언어를 인식할 수 있나요?
한국어와 영어를 함께 인식합니다. 두 언어의 학습 데이터가 모두 내장되어 있어 별도의 설정 없이 바로 사용할 수 있습니다.
이미 텍스트가 있는 PDF에서도 작동하나요?
이 도구는 텍스트 레이어가 없는 스캔본과 이미지를 위한 것입니다. PDF에 이미 선택 가능한 텍스트가 있다면 OCR이 필요 없습니다. PDF를 Markdown으로 도구가 텍스트를 직접 추출할 수 있습니다.
첫 실행이 더 오래 걸리는 이유는 무엇인가요?
첫 인식 시 OCR 엔진과 언어 데이터(약 7 MB)를 다운로드합니다. 둘 다 이후에는 기기에 캐시되므로 나중 실행은 즉시 시작되며 오프라인에서도 작동합니다.
OCR을 위해 문서가 업로드되나요?
아니요. 인식은 전적으로 브라우저에서 사용자 자신의 프로세서로 실행됩니다. 어떤 서버로도 전송되지 않습니다. 작동하는 동안 위의 업로드 데이터 카운터는 0으로 유지됩니다.
사용량 제한이 있나요?
아니요. 모든 도구는 무제한으로 무료입니다. 일일 상한도, 할당량도, 가입도 없습니다. 작업은 사용자의 기기가 하므로 전가할 서버 비용이 없습니다. 브라우저 안정성을 위해 도구마다 넉넉한 파일당 크기 제한(도구에 따라 50~150 MB)이 있지만, 일상적인 문서에는 훨씬 넉넉합니다.
NoriPDF는 브라우저 기반 무료 PDF 도구 모음입니다. 기존의 온라인 PDF 도구와 달리 NoriPDF는 WebAssembly를 사용해 모든 파일을 사용자의 기기에서 로컬로 처리하므로 파일이 어떤 서버에도 업로드되지 않습니다. 도구는 계정, 이메일, 가입이 필요 없으며, 사용량 제한 없이 완전 무료입니다. 이런 특징 덕분에 NoriPDF는 계약서, 의료 기록, 재무 명세서와 같은 기밀 문서에 적합합니다.