이미지 글자 추출(OCR)란?
이미지 글자 추출(OCR)은 사진이나 스캔한 문서에 찍힌 글자를 컴퓨터가 읽어 텍스트로 바꿔 주는 도구입니다. 종이 문서를 다시 타이핑하거나, 캡처 이미지 속 문장을 복사하고 싶을 때 이미지를 올리기만 하면 됩니다.
오픈소스 OCR 엔진 Tesseract를 브라우저 안에서 실행하므로 이미지가 외부 서버로 전송되지 않습니다. 처음 사용할 때만 인식 엔진과 언어 데이터(언어당 1~3MB)를 내려받고, 이후에는 브라우저에 저장된 데이터를 다시 씁니다.
사용 방법
- 이미지 선택을 눌러 사진이나 스캔 이미지를 고르거나, 캡처한 화면을 Ctrl+V로 붙여 넣으세요.
- 인식할 언어를 고르세요. 기본은 한국어+영어이며, 문서에 들어 있는 언어만 고를수록 정확하고 빠릅니다.
- 진행률이 100%가 되면 아래 칸에 인식된 텍스트가 나타납니다. 틀린 글자는 칸에서 바로 고칠 수 있습니다.
- 텍스트 복사나 .txt 저장으로 결과를 가져가세요.
인식률을 높이는 방법
- 정면에서 밝게 찍으세요. 기울어지거나 그림자가 진 사진은 인식률이 크게 떨어집니다.
- 글자 높이가 20픽셀 이상이면 잘 읽힙니다. 작은 글자는 필요한 부분만 확대해 캡처하세요(작은 이미지는 자동으로 확대해서 인식합니다).
- 색 배경이나 흐린 사진은 흑백·대비 보정을 켜 두세요.
- 문서에 쓰인 언어만 고르세요. 쓰지 않는 언어를 함께 고르면 비슷한 모양의 다른 글자로 잘못 읽을 수 있습니다.
- 표, 손글씨, 세로쓰기, 장식이 많은 글꼴은 정확도가 낮을 수 있습니다.
언어별 데이터 크기
| 언어 | 내려받는 크기 |
|---|---|
| 인식 엔진(공통, 1회) | 약 1.4MB |
| 한국어 | 약 1.6MB |
| 영어 | 약 3.0MB |
| 일본어 | 약 2.0MB |
| 중국어(번체) | 약 1.7MB |
| 독일어·프랑스어·스페인어·포르투갈어·이탈리아어 | 각 0.7~2.1MB |
한 번 받은 데이터는 브라우저 저장소에 남아 다음 방문 때는 바로 인식을 시작합니다. 모바일 데이터 사용이 걱정된다면 와이파이에서 처음 사용하세요.
자주 묻는 질문
이미지가 서버에 올라가나요?
아니요. 글자 인식은 모두 내 기기의 브라우저 안에서 처리됩니다. 인터넷으로 내려받는 것은 인식 엔진과 언어 데이터뿐이며 이미지와 결과 텍스트는 어디에도 전송되지 않습니다.
손글씨도 인식되나요?
또박또박 쓴 글씨는 어느 정도 읽지만, 이 엔진은 인쇄된 글자에 맞춰져 있어 손글씨 정확도는 낮습니다.
PDF에서 글자를 추출할 수 있나요?
이미지 파일만 지원합니다. 스캔 PDF라면 PDF 이미지 변환 도구로 페이지를 JPG로 바꾼 뒤 올리세요. 글자를 선택할 수 있는 일반 PDF는 PDF 뷰어에서 바로 복사하는 편이 정확합니다.
처음 인식이 오래 걸려요.
첫 사용 때 인식 엔진과 언어 데이터를 내려받기 때문입니다. 두 번째부터는 저장된 데이터를 써서 몇 초 안에 끝납니다. 큰 사진은 인식 시간이 더 걸릴 수 있습니다.
일본어·중국어 세로쓰기도 되나요?
가로쓰기 문서에 맞춰져 있어 세로쓰기는 정확도가 낮습니다. 세로쓰기 이미지는 90도 회전해도 글자 방향이 맞지 않으므로 가로쓰기 부분만 쓰는 것을 권장합니다.