PDF에서 텍스트 비공개로 추출 — 전부 브라우저 안에서 실행

PDF를 선택하면 각 페이지의 텍스트 레이어가 브라우저 안에서 로컬로 추출되어 내려받을 수 있는 텍스트 파일로 제공됩니다 — 업로드 없음.

Quick answer

What it does
PDF를 선택하면 각 페이지의 텍스트 레이어가 브라우저 안에서 로컬로 추출되어 내려받을 수 있는 텍스트 파일로 제공됩니다 — 업로드 없음.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
고정 레이아웃 PDF에서 계약 조항을 텍스트 편집기로 복사하여 검토하거나 비교하기.
Good to know
이 도구는 PDF에 텍스트 레이어로 내장된 텍스트만 추출할 수 있습니다. 스캔된 PDF와 이미지 전용 PDF에는 텍스트 레이어가 없으므로 추출되는 텍스트가 없습니다.

How it works

  1. 파일 선택 창에서 기기에 있는 PDF 파일을 선택합니다.
  2. 파일은 브라우저 메모리에 읽어 들입니다 — 데이터는 브라우저 밖으로 나가지 않습니다.
  3. pdf.js가 Web Worker에서 문서를 불러와 각 페이지마다 getTextContent()를 호출해 내장된 텍스트 레이어를 가져옵니다.
  4. 모든 페이지에서 추출한 텍스트를 순서대로 합쳐 내려받을 수 있는 .txt 파일로 제공합니다.
  5. 내려받기가 끝나면 임시 데이터는 모두 메모리에서 해제됩니다.

When to use this tool

  • 고정 레이아웃 PDF에서 계약 조항을 텍스트 편집기로 복사하여 검토하거나 비교하기.
  • 연구 논문 PDF의 본문 텍스트를 번역 또는 요약 도구에 붙여넣기 위해 추출하기.
  • 스프레드시트로 가져오기 전 첫 단계로 PDF에서 청구서 항목 데이터 스크래핑하기.
  • 참고: 텍스트 레이어가 임베드된 PDF에서만 작동합니다. 스캔된 PDF나 이미지 전용 PDF에는 추출할 텍스트가 없습니다.

Frequently asked questions

다른 온라인 PDF 도구와 무엇이 다른가요?
대부분의 온라인 PDF 도구는 처리를 위해 파일을 원격 서버로 전송합니다. 이 도구는 클라이언트 측 JavaScript를 사용해 모든 작업을 브라우저 안에서 로컬로 처리합니다. 파일이 어떤 서버로도 전송되지 않으므로 문서 내용이 온전히 사용자의 통제 아래에 남습니다.
제 PDF 파일이 업로드되나요?
아니요. 파일은 브라우저가 직접 읽습니다. 파일은 네트워크로 전송되지 않습니다. 이 도구는 사용자가 열어 둔 브라우저 탭 안에서만 동작합니다.
파일이 업로드되지 않는다는 것을 확인할 수 있나요?
예. 브라우저 개발자 도구(F12)를 열고 네트워크 탭으로 이동한 뒤, 도구를 사용하는 동안 외부로 나가는 요청이 있는지 지켜보세요. 파일 데이터가 브라우저 밖으로 나가지 않는 것을 확인할 수 있습니다. 사이트는 익명 페이지 조회 수를 기록할 수 있으며, 이는 파일을 포함하지 않고 비활성화할 수 있습니다.
이 도구는 오프라인에서도 작동하나요?
예. 페이지가 한 번 로드되면 도구는 파일을 브라우저 안에서 전부 처리하며, 도구 기능에는 네트워크 연결이 필요 없습니다. 인터넷 연결을 끊은 상태에서도 계속 사용할 수 있습니다.
페이지를 새로고침하면 어떻게 되나요?
서버에 저장되는 것이 없기 때문에 페이지를 새로고침하면 현재 세션이 초기화됩니다. 선택해 두었던 파일은 다시 선택해야 합니다.
이 도구가 제 파일을 저장하나요?
아니요. 파일은 페이지가 열려 있는 동안에만 브라우저 메모리에 보관됩니다. 페이지를 닫거나 새로고침하면 사라집니다. 이 도구는 디스크에 아무것도 기록하지 않으며, 서버로도 아무것도 전송하지 않습니다.
이 도구로 비밀번호가 걸린 PDF를 해제할 수 있나요?
아니요. 이 도구는 PDF의 비밀번호 보호를 제거하거나 우회하려 시도하지 않습니다. 비밀번호를 알고 있다면 이 사이트의 PDF 잠금 해제 도구로 로컬에서 비밀번호를 제거한 뒤, 이 도구로 해당 파일을 처리할 수 있습니다.
이 도구는 어떤 기술을 사용하나요?
이 도구는 Web Worker에서 pdf.js(Mozilla의 클라이언트 측 PDF 엔진)를 사용해 브라우저 안에서 각 PDF 페이지의 내장 텍스트 레이어를 읽습니다. 파일이 브라우저 밖으로 나가지 않습니다.
이 도구는 WebAssembly를 사용하나요?
아니요. pdf.js는 순수 JavaScript 라이브러리로 WebAssembly를 사용하지 않습니다. 모든 PDF 텍스트 추출은 브라우저 안의 클라이언트 측 JavaScript에서 이루어집니다.
PDF에서 텍스트를 어떻게 추출하나요?
파일 선택 창에서 PDF를 고른 다음 추출 버튼을 누르세요. 각 페이지의 텍스트가 브라우저 안에서 로컬로 읽혀 미리보기 상자에 표시되며, .txt 파일로 저장할 수 있습니다.
제 스캔된 PDF는 왜 텍스트 없이 돌아왔나요?
이 도구는 PDF에 저장된 내장 텍스트 레이어를 읽는데, 스캔되거나 이미지로만 된 문서에는 그런 레이어가 없어 아무것도 꺼낼 수 없습니다. 그럴 때는 알림이 표시되고 텍스트 파일이 제공되지 않는데, OCR 없이는 복원할 문자 데이터가 없기 때문입니다.
추출된 텍스트가 왜 페이지의 시각적 레이아웃과 일치하지 않나요?
이 도구는 pdf.js가 각 페이지에 대해 보고하는 텍스트 항목을 따라가며 줄바꿈을 유지하지만, 단을 다시 흐름에 맞추지는 않으므로 여러 단으로 된 페이지, 표, 복잡한 레이아웃은 화면에 보이는 것과 맞지 않을 수 있습니다. 페이지는 빈 줄로 이어지며, 특이하거나 사용자 지정 글꼴 인코딩을 쓴 PDF는 페이지가 멀쩡해 보여도 깨진 문자를 낼 수 있습니다.
Extract Text from PDF는 유료인가요?
Extract Text from PDF는 완전히 무료입니다 — 계정도 필요 없고, 회원 가입도 필요 없으며, 처리하는 PDF 수에 제한도 없습니다. 앞으로도 항상 무료입니다. 브라우저가 pdf.js를 사용하여 PDF를 직접 읽어 페이지별로 내장된 텍스트 레이어를 추출하고 일반 .txt 파일로 제공합니다. 파일 자체는 처음부터 끝까지 브라우저 메모리에만 존재하며 어디로도 전송되지 않습니다.

Related tools

  • PDF를 이미지로
  • PDF 분할
  • 페이지 정리
  • 이미지를 PDF로
  • 올인원 PDF 편집기
  • 홈
  • 올인원 PDF 편집기
  • PDF 병합
  • PDF 분할
  • PDF 회전
  • 워터마크 추가
  • 이미지를 PDF로
  • PDF를 이미지로
  • 페이지 번호
  • PDF 압축
  • 텍스트 추출
  • 메타데이터 편집
  • 페이지 정리
  • 빈 페이지 삽입
  • 페이지 추출
  • N-up (장당 페이지 수)
  • PDF 회색조 변환
  • PDF 자르기
  • 페이지 순서 뒤집기
  • 크기 조정 (A4/Letter)
  • 머리글 및 바닥글 추가
  • 양식 평면화
  • N페이지마다 분할
  • PDF 정보 및 메타데이터
  • 이미지/서명 스탬프
  • 페이지 제거
  • 타일 워터마크
  • 소책자
  • 페이지 복제
  • 파일 첨부
  • 비율로 크기 조정
  • 빈 페이지 제거
  • 교차 병합
  • 페이지 테두리 추가
  • 홀수/짝수 페이지 추출
  • PDF를 긴 이미지로
  • 페이지 절반으로 분할
  • 여백 추가
  • PDF 서명
  • PDF 비교
  • 포스터 분할
  • 단어 수 세기
  • PDF 복구
  • PDF 양식 작성
  • 북마크 기준 분할
  • 검색 및 강조 표시
  • 이미지 추출
  • PDF 검열
  • OCR (스캔본을 텍스트로)
  • PDF 보호
  • PDF 잠금 해제
  • 소개
  • 개인정보처리방침
  • 문의
  • 작동 방식
  • 로컬 vs 온라인 PDF 도구
  • 온라인 PDF 도구는 안전할까?