CanDoYa
KO

PDF 텍스트 변환

브라우저에서 바로 실행됩니다. 업로드도, 회원가입도 없습니다.

선택 가능한 텍스트가 있는 디지털 PDF를 선택하세요.

이 도구 공유하기

PDF를 텍스트로 어떻게 변환하나요?

이 PDF 텍스트 변환 도구로 디지털 PDF 안에 이미 저장된 선택 가능한 텍스트를 추출한 다음, 복사하거나 TXT 파일로 내려받으면 됩니다. 처리는 브라우저 안에서만 실행되므로 문서는 업로드되지 않습니다. 스캔한 이미지형 PDF는 OCR이 필요하지만, 이 도구는 OCR을 하지 않습니다.

사용 방법

  1. 1디지털 PDF 선택. 도구에 PDF 한 개를 끌어다 놓거나 기기에서 선택하세요. 가장 좋은 결과를 원하면 평소 PDF 뷰어에서 단어를 선택할 수 있는지 먼저 확인하세요.
  2. 2텍스트 레이어 추출. 텍스트 추출을 누르세요. PDF.js가 파일을 로컬에서 읽고, 서버로 보내지 않은 채 진행 상태를 보여 줍니다.
  3. 3일반 텍스트 확인. 문단, 열, 표, 기호를 원본과 비교해 보세요. PDF의 읽는 순서는 화면에 보이는 순서와 다를 수 있습니다.
  4. 4복사하거나 내려받기. 필요하면 결과를 수정한 뒤 클립보드로 복사하거나 UTF-8 TXT 파일로 저장하세요.

이런 분께 추천

이 변환기는 Mozilla PDF.js로 기기에서 각 페이지의 기존 텍스트 레이어를 읽습니다. 페이지 순서와 감지된 줄바꿈을 유지한 뒤, 편집할 수 있는 하나의 일반 텍스트 결과로 보여 줍니다. TXT 출력에서는 이미지, 글꼴, 열, 표, 시각적 서식은 보존되지 않습니다.

중요한 경계가 하나 있습니다. 디지털 PDF는 소프트웨어가 선택하고 검색할 수 있는 문자를 저장합니다. 스캔본은 페이지의 사진만 담고 있을 수 있습니다. 앞의 경우를 추출하는 것은 텍스트 파싱이고, 뒤의 경우를 읽으려면 OCR, 즉 광학 문자 인식이 필요합니다. 이 도구는 첫 번째 작업만 합니다.

자주 묻는 질문

PDF 파일이 서버로 업로드되나요?

아니요. 브라우저가 PDF.js로 선택한 PDF를 로컬에서 읽을 뿐이며, 파일은 CanDoYa로 전송되지 않습니다. PDF 엔진 코드는 처음 사용할 때 다운로드될 수 있지만, 문서 자체는 그 요청에 포함되지 않습니다.

이 PDF 텍스트 변환은 무료인가요?

네. 계정 없이, 워터마크 없이, 결제 없이 텍스트를 추출하고 편집하고 복사하고 내려받을 수 있습니다. 작업은 기기에서 실행되므로 서버 변환 대기열도 없고, 나중에 다시 받아야 할 업로드 파일도 없습니다.

PDF 용량과 페이지 제한은 어떻게 되나요?

이 도구는 100 MB 이하, 2,000페이지 이하의 PDF 한 개를 받습니다. 사용 가능한 메모리와 기기 속도에 따라 실제 한도는 더 낮을 수 있으며, 특히 휴대폰에서 그렇습니다. 브라우저가 끝내지 못하면 아주 큰 문서는 더 작은 PDF로 나누세요.

스캔한 PDF도 텍스트를 추출할 수 있나요?

페이지 이미지밖에 없는 스캔본은 불가능합니다. 이 변환기는 이미 선택 가능한 텍스트만 읽고 OCR은 하지 않습니다. 스캔한 PDF는 픽셀에서 문자를 인식하는 OCR 도구가 필요합니다. 일부 혼합 PDF는 특정 페이지에는 텍스트가 있고 다른 페이지에는 없을 수 있으며, 결과는 텍스트가 없는 페이지를 표시합니다.

추출된 텍스트 순서가 왜 이상한가요?

PDF 페이지는 텍스트 조각을 좌표로 배치하고, 문단이나 열의 명확한 순서를 저장하지 않을 수 있습니다. PDF.js는 문서의 텍스트 항목과 줄바꿈을 따르므로, 여러 열 레이아웃, 표, 머리글, 복잡한 양식에서는 화면의 읽기 순서와 다를 수 있습니다.

PDF 텍스트 변환은 서식과 이미지를 보존하나요?

아니요. TXT 파일은 일반 문자만 담으므로 글꼴, 색상, 이미지, 링크, 열, 표 테두리는 보존되지 않습니다. 줄바꿈은 PDF 텍스트 레이어에서 가져오며, 추출 후 수정이 필요할 수 있습니다.

비밀번호로 보호된 PDF가 왜 거부되나요?

브라우저는 비밀번호 없이는 암호화된 문서를 읽을 수 없습니다. 신뢰할 수 있는 뷰어에서 PDF를 열고 비밀번호를 입력한 뒤, 권한이 있다면 잠금이 풀린 사본으로 저장하세요. 그런 다음 그 사본을 변환기에 추가하면 됩니다.

PDF에서 어떤 언어를 추출할 수 있나요?

파서는 한 언어에 묶여 있지 않습니다. PDF에 올바른 문자 맵과 선택 가능한 텍스트가 있으면 어떤 문자 체계든 Unicode 텍스트로 돌려줄 수 있습니다. 문서가 글꼴 매핑을 누락했거나 사용자 정의로 쓰였다면 복사된 문자가 일부 비어 있거나 잘못될 수도 있습니다.