PDF 텍스트 추출
PDF에서 텍스트를 온라인으로 추출하세요. 줄과 문단을 유지한 채 페이지별로 복사하거나 .txt 파일로 다운로드할 수 있습니다. 무료이며 안전하고, 아무것도 업로드되지 않습니다.
무엇을 하나
이 도구는 PDF의 텍스트를 읽어 복사, 편집하거나 .txt 파일로 저장할 수 있는 일반 텍스트로 돌려줍니다. 줄과 문단은 페이지 위 단어의 위치를 바탕으로 다시 구성되며, 각 페이지가 시작되는 곳을 표시할 수도 있습니다. 워드 프로세서에서 내보낸 문서처럼 실제 텍스트가 들어 있는 PDF라면 모두 사용할 수 있습니다. 스캔한 페이지는 이미지이므로 추출할 텍스트가 없습니다.
사용 방법
- PDF를 선택하세요.
- '텍스트 추출'을 누르세요. 긴 문서는 몇 초 걸립니다.
- 텍스트를 복사하거나 .txt 파일로 다운로드하세요.
자주 묻는 질문
왜 내 PDF에서 텍스트를 찾지 못하나요?
스캔한 문서나 PDF로 저장한 사진처럼 페이지가 이미지이기 때문입니다. 이 경우 PDF 안에는 텍스트가 없고 픽셀만 있으므로, 읽으려면 문자 인식(OCR)이 필요합니다.
레이아웃이 유지되나요?
텍스트의 줄과 문단은 유지되지만 글꼴, 단, 이미지는 유지되지 않습니다. 2단 문서에서는 한 줄의 텍스트에 두 단이 섞일 수 있으며, 표는 셀 사이에 공백이 있는 텍스트 줄이 됩니다.
내 문서는 안전한가요?
네. PDF는 브라우저가 읽으며 서버로 전송되지 않으므로 개인 문서에도 사용할 수 있습니다.
어떤 언어에서도 작동하나요?
네, PDF에 실제 텍스트가 들어 있고 글꼴이 문자를 올바르게 대응시킨다면 작동합니다. 오래되었거나 잘못 만들어진 일부 PDF는 화면에는 텍스트가 올바르게 보여도 추출하면 깨진 문자가 나옵니다. 이는 파일의 문제이며 OCR로만 복구할 수 있습니다.