PDF 도구

PDF에서 텍스트(글자) 추출하기

글자가 있는 PDF에서 텍스트를 복사하고 txt 파일로 저장하세요. 스캔 사진만 있는 PDF는 OCR이 필요합니다.

텍스트 레이어가 있는 PDF를 이 기기에서 엽니다. 이미지로만 된 스캔본은 별도 OCR이 필요합니다.

  • 브라우저에서 처리
  • 업로드 없음
  • 즉시
  • 무료

사용 방법

  1. 이 기기에서 PDF를 선택하세요.
  2. 페이지를 구분하려면 페이지 나누기를 유지하거나, 빈 줄을 줄이려면 건너뛰기를 선택하세요.
  3. 글자 추출을 누르면 브라우저에서 작업이 이뤄집니다.
  4. 결과를 복사하거나 txt 파일로 저장하세요.

NEXNARA를 쓰는 이유

  • 비공개

    데이터는 브라우저에만 머뭅니다.

  • 즉시

    결과가 바로 나타납니다.

  • 업로드 없음

    NEXNARA 서버로 아무것도 보내지 않습니다.

  • 어디서나

    설치가 필요 없습니다.

자세히 알아보기

PDF에서 글자 추출이란?

이미 글자 레이어가 있는 PDF에서 텍스트를 페이지 순서대로 복사합니다. 스캔 사진만 있는 PDF는 OCR이 아니므로 글자를 읽지 않습니다.

제한

PDF 글자는 보이는 순서와 다르게 저장될 수 있어, 여러 단이나 표는 읽기 순서와 다를 수 있습니다. 이미지로만 된 스캔본에는 꺼낼 글자가 거의 없습니다. 암호가 걸린 PDF는 열리지 않습니다. 80MB 또는 400페이지를 넘는 파일은 받지 않습니다.

개인정보

PDF는 브라우저에 남으며 NEXNARA 서버로 올라가지 않습니다.

자주 묻는 질문

스캔한 PDF에서도 되나요?

대개는 안 됩니다. 페이지가 사진이면 복사할 글자 레이어가 없습니다. 그 경우는 이미지 OCR을 사용하세요.

글자 순서가 다른 이유는 무엇인가요?

PDF는 글자를 객체로 저장해서, 항상 읽는 순서와 같지 않습니다. 여러 단이나 표는 순서가 바뀔 수 있습니다.

PDF가 업로드되나요?

아니요. 추출은 브라우저에서 이뤄지며 파일은 NEXNARA로 가지 않습니다.

텍스트를 파일로 받을 수 있나요?

예. 추출한 뒤 복사하거나 txt로 저장하세요.