PDFora
Pricing 모든 도구
🔎

텍스트별 분할

지정한 키워드가 들어 있는 페이지마다 새 PDF를 시작합니다. 명세서나 청구서를 나눌 때 딱 좋습니다.

🔒 파일은 브라우저 안에서 로컬로 처리되며 절대 업로드되지 않습니다.
1

업로드

파일을 선택하거나 끌어다 놓으세요.

2

설정

원하는 옵션을 선택하세요 — 모든 작업이 브라우저 안에서 처리됩니다.

3

다운로드

완성된 파일을 즉시 저장하세요. 워터마크가 없습니다.

일괄 스캔은 효율적입니다. 그 문서들을 다시 나눠야 하기 전까지는요. 청구서 40장을 스캐너에 넣으면 이음매가 어디인지 알 수 없는 긴 PDF 하나가 나옵니다. PDFora의 텍스트 기준 분할 도구가 그 이음매를 대신 찾아 줍니다. "청구서" 같은 키워드를 지정하면 그 단어가 들어 있는 페이지마다 새 파일의 첫 페이지가 됩니다. 한 번만 돌리면 묶음이 다시 40개의 개별 문서로 돌아갑니다.

텍스트 검색이 브라우저에서 로컬로 실행되므로, 나누려는 청구서나 급여명세서, 고객 명세서가 어디로도 업로드되지 않습니다. 처리하는 동안 재무 문서가 남의 컴퓨터에 놓이는 서버 기반 분할기와는 확실히 다른 점이죠. PDFora는 무료이고 가입도 필요 없으며 워터마크도 붙지 않고 파일 수나 분할 횟수에 제한도 없습니다.

대소문자 무시 옵션을 켜면 "INVOICE", "Invoice", "invoice"가 모두 같은 분할을 일으킵니다. 서식이 제각각인 여러 거래처의 문서를 다룰 때 유용합니다. 각 문서의 첫 페이지에 반드시 나오고 거기에만 나오는 단어를 고르세요.

온라인에서 키워드 기준으로 PDF 나누는 방법

  1. getpdfora.com에서 텍스트 기준 분할 도구를 엽니다. 파일은 전부 브라우저에서 처리됩니다.
  2. 합쳐진 PDF를 추가합니다. 예를 들어 청구서나 명세서를 일괄 스캔한 파일이면 됩니다.
  3. 각 문서의 시작을 알리는 키워드를 입력합니다. "Invoice"나 "거래명세서" 같은 것이 좋습니다.
  4. 문서마다 대소문자 표기가 다르다면 대소문자 무시 옵션을 켭니다.
  5. 분할을 클릭합니다. 키워드가 나오는 모든 페이지에서 새 파일이 시작됩니다.
  6. 생성된 파일 수가 예상한 문서 수와 맞는지 확인한 뒤 내려받습니다.

When to use this tool

  • "Invoice"라는 단어를 구분자로 삼아, 일괄 스캔한 공급업체 청구서 묶음을 청구서별 파일로 나누기.
  • "사번"을 기준으로 급여 처리분을 개별 급여명세서로 분리해, 각자 자기 페이지만 받게 하기.
  • 대출 신청을 위해 1년 치 통합 거래내역서를 "거래 기간"이라는 문구로 나누기.
  • 하나의 PDF로 내보낸 발주서 묶음을 "발주번호" 텍스트를 기준으로 분할하기.
  • "증권번호"로 보험 문서 묶음을 나눠 고객별 증서를 따로 보관하기.
  • 라벨을 개별 인쇄하기 전에 "Tracking"을 기준으로 배송 라벨 통합 파일 자르기.

Tips for the best results

  • 키워드는 검색 가능한 텍스트로 존재해야 합니다. PDF가 OCR 레이어 없는 순수 이미지 스캔본이라면 먼저 OCR을 돌리세요. 그러지 않으면 검색 결과가 없습니다.
  • 첫 페이지에만 나오는 문구를 고르세요. "Invoice"는 각 문서의 제목으로만 쓰일 때 유효합니다. 바닥글에도 나온다면 "Invoice Number:" 같은 표현으로 나누세요.
  • 단어 하나보다 구(句)가 대개 더 안전합니다. "Tax"보다 "Tax Invoice"가 잘못된 분할을 줄여 줍니다.
  • 500페이지 묶음을 통째로 돌리기 전에 작은 샘플로 시험하고, 결과 파일 수를 스캔한 문서 수와 비교해 보세요.
  • 파일이 하나 더 나왔다면 키워드가 맨 첫 페이지에도 있었을 가능성이 큽니다. 이건 정상입니다. 그보다 더 많이 나왔다면 키워드가 문서 중간 페이지에도 걸리고 있는 것입니다.

자주 묻는 질문

텍스트 기준 PDF 분할은 어떻게 동작하나요?

도구가 모든 페이지의 텍스트 레이어를 읽고, 키워드가 들어 있는 페이지가 나올 때마다 새 결과 파일을 시작합니다. 일치하는 페이지 사이의 페이지들은 함께 묶이므로, 각 결과 파일은 키워드가 있는 페이지부터 다음 일치 직전 페이지까지의 완전한 문서 하나를 담습니다.

왜 키워드를 못 찾나요?

열에 아홉은 PDF가 선택 가능한 텍스트가 없는 스캔 이미지이기 때문입니다. PDF 뷰어에서 텍스트를 선택해 보세요. 단어가 표시되지 않는다면 먼저 파일에 OCR을 돌린 뒤 나누세요.

대소문자 무시 옵션이 중요한가요?

네, 대개 그렇습니다. 거래처마다 서식의 대소문자 표기가 달라서, 한 문서는 "INVOICE", 다른 문서는 "Invoice"라면 분할이 들쭉날쭉해집니다. 정확한 대소문자 일치가 꼭 필요한 경우가 아니라면 켜 두세요.

이 도구로 재무 문서를 다뤄도 안전한가요?

네. 문서가 기기를 벗어나지 않기 때문입니다. 검색과 분할 모두 브라우저에서 로컬로 실행되며 업로드도, 서버 저장도, 파일에 연결된 계정도 없습니다.

여러 단어로 된 문구로 나눌 수 있나요?

네. "Statement of Account" 같은 문구도 되고 보통 단어 하나보다 정확합니다. 길고 구체적인 문구일수록 그 단어가 스쳐 지나가듯 언급된 페이지에서 잘못 나뉠 가능성이 줄어듭니다.

파일 크기나 분할 횟수에 제한이 있나요?

없습니다. PDFora는 가입 없이 무료이고 워터마크를 붙이지 않으며 페이지 수, 결과 파일 수, 처리할 묶음 수에 상한을 두지 않습니다. 아주 큰 파일은 사용자 컴퓨터가 일하는 만큼 시간이 더 걸릴 뿐입니다.