콘텐츠로 건너뛰기
100% 로컬 · 업로드 0 KBPDF 압축

PDF를 텍스트로

PDF에서 텍스트를 추출합니다. 파일은 기기를 떠나지 않습니다 — 모든 처리가 브라우저에서 로컬로 이루어집니다.

설계부터 개인정보 보호
파일은 기기에서 떠나지 않습니다. 모든 처리는 브라우저에서 로컬로 이루어집니다 — 업로드 없음, 서버 없음.

PDF를 여기에 놓으세요

또는 클릭하여 파일 선택

파일은 기기에서 떠나지 않습니다.

Extracts the text content stream of each page. Scanned (image-only) PDFs have no text layer — the result will be empty for those files.

PDF를 텍스트로 변환은 PDF.js를 Web Worker에서 사용하여 각 페이지의 텍스트 콘텐츠 스트림을 추출합니다. 결과는 페이지 내 미리보기에 표시되고 .txt 다운로드로 제공되며, 다른 앱에 붙여넣기 위한 클립보드 복사 버튼이 있습니다. 추출은 브라우저 내에서 완전히 실행되며, 파일이 업로드되지 않습니다. 스캔된(이미지 전용) PDF는 텍스트 레이어가 없어 빈 결과를 반환합니다. 도구는 OCR을 위장하지 않고 이를 정직하게 알립니다.

작동 방식

PDF를 텍스트로 사용 방법

  1. 1
    PDF 놓기. PDF 파일을 드롭 존에 끌어다 놓거나, 클릭하여 기기에서 파일을 선택합니다.
  2. 2
    페이지 범위 설정(선택). 1,3,5-7과 같이 페이지를 입력하여 해당 페이지에서만 텍스트를 추출합니다. 모든 페이지는 비워둡니다.
  3. 3
    PDF를 텍스트로 실행. PDF.js를 사용하여 Web Worker에서 기기 내에서 각 페이지의 텍스트 콘텐츠 스트림을 읽습니다.
  4. 4
    미리보기, 복사 또는 다운로드. 추출된 텍스트가 미리보기 영역에 표시됩니다. 클립보드에 복사하거나 .txt 파일로 다운로드하세요.

기능

이 도구가 하는 일

  • 모든 페이지 또는 선택한 페이지에서 텍스트 추출
  • 선택적 레이아웃 보존(페이지 레이아웃에 따라 줄바꿈 삽입)
  • 페이지별 분해와 함께 페이지 내 미리보기
  • 클립보드 복사 또는 .txt로 다운로드
  • 업로드 불필요 — 브라우저 내에서 완전히 동작

제한 사항

알아두어야 할 점

  • 스캔된(이미지 전용) PDF는 텍스트 레이어가 없습니다 — 결과가 비습니다(OCR 수행 안 함; OCR 가이드 참조)
  • 레이아웃 재구성은 최선의 노력입니다; 복잡한 다중 단 레이아웃은 시각적 읽기 순서와 일치하지 않을 수 있습니다
  • ToUnicode 매핑이 깨진 임베디드 글꼴은 깨진 텍스트를 생성할 수 있습니다
  • 이미지 내 텍스트는 추출되지 않습니다(실제 텍스트 콘텐츠 스트림만 읽음)

FAQ

자주 묻는 질문

결과가 비어 있는 이유는?

PDF가 스캔되었거나(이미지 전용) 텍스트가 이미지에 구워졌을 가능성이 높습니다. 추출할 텍스트가 콘텐츠 스트림에 없습니다. 해결책은 OCR입니다 — 신뢰할 수 있는 로컬 OCR 도구는 PDF를 검색 가능하게 만드는 방법을 참조하세요. IXPDF는 브라우저에서 OCR을 위장하지 않습니다(정확도가 출시할 만큼 신뢰할 수 없음).

암호화된 PDF에서 작동하나요?

아니요. PDF가 비밀번호로 보호된 경우 도구는 "암호화됨" 오류를 표시합니다. 먼저 파일을 복호화한 후 텍스트를 추출하세요.

"레이아웃 보존"은 무엇인가요?

선택하면 도구가 페이지의 텍스트 항목 y 위치에 따라 줄바꿈을 삽입하여 시각적 레이아웃에 더 가까운 텍스트를 생성합니다. 선택하지 않으면 텍스트 항목이 공백으로 연결되어 전문 검색 및 복사-붙여넣기에 더 적합합니다.

추출된 텍스트가 정확한가요?

실제 텍스트 레이어가 있는 PDF(스캔되지 않음)의 경우 추출된 텍스트가 보이는 것과 일치합니다. 글꼴 인코딩이 깨진 PDF(ToUnicode 매핑 누락)는 깨진 문자를 생성할 수 있습니다 — 이는 도구의 버그가 아니라 파일의 속성입니다.

특정 페이지에서만 텍스트를 추출할 수 있나요?

네. 페이지 범위 필드에 1,3,5-7과 같이 입력하세요. 나열된 순서대로 해당 페이지만 추출됩니다.

파일이 어디에 업로드되나요?

아니요. 텍스트 추출은 Web Worker를 사용하여 브라우저 내에서 완전히 수행됩니다. 파일과 추출된 텍스트가 기기를 떠나지 않습니다.