PDF 안에 들어 있는 글자를 뽑아 텍스트 상자에 보여주고, 복사하거나 .txt 파일로 저장할 수 있습니다. 문서에 실제로 담긴 문자를 읽는 방식이라 스캔본이나 이미지로만 이루어진 PDF에서는 아무것도 나오지 않으며(OCR이 아닙니다), 파일은 브라우저에서만 읽히고 업로드되지 않습니다.
PDF 파일을 여기에 놓거나 클릭해서 선택
파일은 기기 밖으로 나가지 않습니다 — 브라우저에서 바로 처리됩니다.
PDF 텍스트 추출이란 무엇인가요?
PDF 안에 들어 있는 글자를 뽑아내어 편집·검색·복사할 수 있는 일반 텍스트로 바꾸는 것입니다. 문서 내용을 다른 곳에 옮겨 쓰거나 인용할 때, 또는 내용을 TXT로 보관하거나 검색하고 싶을 때 유용합니다.
PDF에서 텍스트를 추출하는 방법
- 파일 선택 — 텍스트를 뽑을 PDF를 끌어다 놓거나 클릭해서 엽니다.
- 텍스트 추출 — ‘텍스트 추출’을 누르면 각 페이지의 글자가 아래에 표시됩니다.
- 복사 또는 저장 — ‘복사’로 클립보드에 담거나 ‘TXT 저장’으로 파일로 내려받습니다.
스캔한 PDF에서도 텍스트가 나오나요?
아니요. 스캔본이나 사진처럼 페이지가 이미지로만 되어 있으면 뽑아낼 텍스트 정보가 없습니다. 이 경우에는 이미지 속 글자를 인식하는 OCR이 필요하며, 이 도구는 문서에 실제로 포함된 텍스트 레이어만 읽어 옵니다.
추출한 텍스트를 저장할 수 있나요?
네. 추출된 텍스트는 화면에 바로 표시되며, 복사 버튼으로 클립보드에 담거나 TXT 저장 버튼으로 텍스트 파일(.txt)로 내려받을 수 있습니다. 필요한 부분만 골라 복사해도 됩니다.
표나 단 나눔이 그대로 유지되나요?
글자 자체는 정확히 추출되지만, 표·여러 단(칼럼)·복잡한 배치는 원래 모양 그대로 재현되지 않을 수 있습니다. 추출한 뒤 순서나 줄바꿈을 약간 다듬어야 할 수 있으니 참고하세요.
파일이 서버에 업로드되나요?
아니요. 텍스트 추출은 전적으로 브라우저 안에서 이뤄지므로 PDF는 서버로 전송되거나 저장되지 않습니다. 민감한 문서도 안심하고 처리할 수 있습니다. 처리 라이브러리는 첫 추출 때만 한 번 내려받고 이후에는 캐시됩니다.
관련 도구