PDFora
Pricing 모든 도구
👁️

OCR PDF

스캔한 문서와 이미지 속 텍스트를 브라우저에서 바로 인식합니다.

🔒 파일은 브라우저 안에서 로컬로 처리되며 절대 업로드되지 않습니다.
1

업로드

파일을 선택하거나 끌어다 놓으세요.

2

설정

원하는 옵션을 선택하세요 — 모든 작업이 브라우저 안에서 처리됩니다.

3

다운로드

완성된 파일을 즉시 저장하세요. 워터마크가 없습니다.

스캔한 PDF는 사실 사진을 쌓아 놓은 것에 불과합니다. 검색할 수도, 문단을 복사할 수도, 참조 번호 하나 붙여 넣을 수도 없죠. PDFora의 OCR 도구는 실무 문서 처리에서 널리 쓰이는 오픈소스 엔진 Tesseract로 페이지 이미지 속 글자를 읽어 내고, 인식된 텍스트를 검색하고 편집하고 재사용할 수 있는 깔끔한 .txt 파일로 돌려 줍니다.

이 OCR이 다른 점은 이것입니다. 전부 브라우저 안에서 실행된다는 것이죠. 거의 모든 온라인 OCR 서비스는 스캔본을 서버로 올려 처리합니다. 저희는 그러지 않습니다. 인식이 사용자 기기에서 이뤄지므로 스캔한 여권, 서명한 임대차 계약서, 검사 결과지가 어디로도 전송되지 않습니다. 이런 문서라면 이 점은 부가 혜택이 아니라 핵심입니다.

현재 영어, 힌디어, 스페인어, 프랑스어를 인식하며, 스캔을 실행하기 전에 언어를 직접 고르면 됩니다. 무료이고 가입도, 워터마크도, 페이지 할당량도 없습니다. 실제 연산을 사용자 프로세서가 담당하므로 인식 속도는 기기에 따라 달라지지만, 최신 노트북이라면 보통 한 페이지에 몇 초면 끝납니다.

온라인에서 PDF에 OCR 적용하는 방법

  1. 최신 브라우저에서 PDFora의 OCR PDF 도구를 엽니다.
  2. 스캔한 PDF를 드롭 영역에 끌어다 놓거나, 클릭해서 기기에서 선택합니다.
  3. 문서의 언어를 고릅니다. 영어, 힌디어, 스페인어, 프랑스어 중에서 선택하며, 맞는 언어를 고르면 정확도가 크게 올라갑니다.
  4. 텍스트 인식을 누르고 Tesseract가 브라우저 안에서 각 페이지를 로컬로 처리하도록 둡니다.
  5. 페이지가 끝날 때마다 진행 상황을 확인합니다. 문서가 길수록 시간이 조금 더 걸립니다.
  6. 추출된 텍스트를 .txt 파일로 내려받아 자유롭게 검색하고 편집하고 복사합니다.

When to use this tool

  • 60페이지짜리 스캔 판결문에서 텍스트를 뽑아, 모든 페이지를 읽는 대신 특정 조항을 검색해 찾기
  • 촬영한 교재 페이지에서 인용문을 추출해, 손으로 다시 타이핑하지 않고 연구 논문에 쓰기
  • 종이 청구서 뭉치를 디지털화해 금액과 청구서 번호를 검색 가능한 기록으로 만들기
  • 스캔한 힌디어 정부 공문을 편집 가능한 텍스트로 바꿔 번역하거나 요약하기
  • 인쇄본만 남은 문서를 스캔한 뒤 OCR을 돌려 본문 텍스트 되살리기
  • 회의 유인물이나 인쇄 보고서를 화면 캡처 대신 텍스트로 뽑아 이메일에 인용할 수 있게 만들기

Tips for the best results

  • 가지고 있는 스캔본 중 가장 깨끗한 것을 넣으세요. 300DPI, 충분한 조명, 밝은 배경 위의 진한 글자가 어두운 휴대폰 사진보다 훨씬 좋은 인식률을 냅니다.
  • 먼저 스캔본을 반듯하게 펴세요. 기울어진 페이지는 문자 인식을 방해하므로 기울어진 문서는 OCR 전에 PDFora의 기울기 보정 도구를 거치게 하세요.
  • 언어 설정을 문서에 맞추세요. 스페인어 편지를 영어 모델로 돌리면 결과가 엉망이 되고, 반대도 마찬가지입니다.
  • 휴대폰이나 오래된 노트북에서는 더 느립니다. 엔진이 기기의 프로세서를 쓰기 때문에 100페이지 스캔본은 5년 된 태블릿이 아니라 데스크톱에서 처리할 일입니다.
  • 숫자는 꼭 검토하세요. OCR은 매우 뛰어나지만 완벽하지는 않으므로, 계좌번호나 합계 같은 숫자는 그대로 신뢰하기 전에 눈으로 한 번 확인하는 게 좋습니다.

자주 묻는 질문

스캔한 문서가 처리를 위해 업로드되나요?

아니요, 그리고 이는 온라인 OCR 도구 중에서는 드문 방식입니다. Tesseract 엔진이 브라우저 안에서 실행되므로 모든 페이지가 사용자 기기에서 인식됩니다. 어떤 단계에서도 서버로 전송되지 않기 때문에 신분증, 계약서, 진료 기록에도 안전합니다.

결과물로는 무엇을 받게 되나요?

이 도구는 인식된 텍스트를 추출해 내려받을 수 있는 .txt 파일로 제공합니다. 이후에는 검색하거나 문서에 붙여 넣거나, 일반 텍스트가 필요한 다른 작업 흐름에 넣어 쓸 수 있습니다.

어떤 언어를 지원하나요?

현재 영어, 힌디어, 스페인어, 프랑스어를 사용할 수 있습니다. 인식을 실행하기 전에 문서와 맞는 언어를 고르세요. 엔진이 언어별 모델을 불러오기 때문에 정확도가 올바른 선택에 달려 있습니다.

텍스트 인식은 얼마나 정확한가요?

인쇄된 글자를 밝고 깨끗하게 스캔한 경우라면 정확도가 대체로 매우 높습니다. 흐릿한 사진, 특이한 글꼴, 손글씨, 심한 기울어짐이 있으면 품질이 떨어집니다. 입력 품질이 가장 큰 변수이므로 상태가 나쁜 페이지는 엔진을 탓하기 전에 다시 스캔하거나 기울기를 보정하세요.

왜 제 기기에서는 동료보다 OCR이 느린가요?

처리가 로컬에서 이뤄지므로 속도가 하드웨어에 좌우되기 때문입니다. 최신 노트북은 페이지당 몇 초 만에 처리하지만 오래된 휴대폰은 눈에 띄게 오래 걸립니다. 그 로컬 처리의 대가로 얻는 것이 완전한 프라이버시입니다.

페이지나 파일 수 제한이 있고, 비용이 드나요?

비용도, 계정도, 워터마크도, 페이지 할당량도 없습니다. 원한다면 스캔본 아카이브 전체에 OCR을 돌려도 됩니다. 유일한 현실적 제약은 시간인데, 긴 문서는 사용자 기기에서 처리하는 데 더 오래 걸리기 때문입니다.