이미지 텍스트 변환 (OCR)

무료 온라인 OCR: 이미지, 스크린샷, 사진, 스캔한 PDF에서 24개 언어의 텍스트를 추출하세요. 브라우저에서 실행되며 파일은 업로드되지 않습니다.

파일을 여기로 끌어다 놓거나 Ctrl+V(Mac에서는 ⌘+V)로 스크린샷을 붙여 넣을 수도 있습니다. 텍스트 인식은 브라우저에서 이루어집니다. 파일은 어디로도 전송되지 않으며 업로드나 저장도 없습니다.
각 언어는 한 번만 다운로드되며(1~3 MB) 이후 브라우저에 저장됩니다. 텍스트에 로마자 단어가 섞여 있으면 두 번째 언어로 영어를 추가하세요.

무엇을 하나


이 도구는 OCR(광학 문자 인식)을 사용해 그림 속 글자를 복사·편집·검색할 수 있는 텍스트로 바꿉니다. 스크린샷, 문서 사진, 스캔한 페이지, 이미지로만 된 PDF에서 작동합니다. 인식은 오픈 소스 OCR 엔진인 Tesseract가 사용자의 브라우저에서 직접 수행하므로 파일이 기기 밖으로 나가지 않습니다. 작은 글자는 읽기 전에 자동으로 확대되어 오류가 눈에 띄게 줄어듭니다.

사용 방법


  1. 이미지 하나 이상 또는 PDF를 선택하거나, 여기로 끌어다 놓거나, 스크린샷을 붙여 넣으세요.
  2. 텍스트 언어를 확인하세요. 읽기는 자동으로 시작되며, 언어를 바꾸면 텍스트 추출을 다시 누르세요.
  3. 결과를 검토하고 잘못 읽힌 부분을 고친 다음, 복사하거나 .txt 파일로 다운로드하세요.

자주 묻는 질문


이미지가 업로드되나요?
아니요. 인식 엔진과 언어 데이터가 브라우저로 다운로드되고, 이미지와 PDF는 그곳에서 처리됩니다. 서버로 아무것도 전송되지 않으므로 개인 문서에도 안심하고 사용할 수 있습니다.

정확도는 어느 정도인가요?
선명한 인쇄 텍스트라면 로마자로 쓰는 언어는 보통 99% 이상의 문자를 정확히 인식하고, 다른 문자 체계는 대체로 93%에서 99% 사이입니다. 흐린 사진, 낮은 대비, 휘어진 페이지, 장식용 글꼴, 손글씨에서는 정확도가 떨어집니다. 최상의 결과를 얻으려면 선명하고 밝으며 반듯한 이미지를 사용하고 올바른 언어를 선택하세요.

어떤 언어를 지원하나요?
24개 언어: 영어, 포르투갈어, 스페인어, 프랑스어, 독일어, 이탈리아어, 스웨덴어, 아프리칸스어, 튀르키예어, 인도네시아어, 말레이어, 필리핀어, 베트남어, 러시아어, 아랍어, 우르두어, 힌디어, 타밀어, 태국어, 크메르어, 일본어, 한국어, 중국어 간체 및 번체. 텍스트에 두 언어가 섞여 있으면 두 언어를 함께 선택할 수 있습니다.

손글씨도 읽을 수 있나요?
잘 읽지 못합니다. 엔진이 인쇄된 텍스트로 학습되어 또박또박 쓴 대문자는 가끔 인식되지만, 이어 쓴 필기체는 대개 틀리게 나옵니다.

스캔한 PDF에서도 작동하나요?
네. 각 페이지를 고해상도로 렌더링해 차례로 읽으며, 페이지가 시작되는 위치를 표시할 수도 있습니다. PDF에 이미 선택 가능한 텍스트가 있다면 PDF 텍스트 추출 도구가 더 빠르고 정확합니다.

Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)