이미지 글자 추출(OCR)

사진, 스캔본, 화면 캡처 속 글자를 인식해 복사·편집할 수 있는 텍스트로 바꿔 줍니다. 한국어·영어·일본어 등 9개 언어를 지원하며 이미지는 서버로 전송되지 않습니다.

🔒 파일·입력값은 내 기기 안에서만 처리돼요
이미지 선택 사진·스캔·캡처 이미지를 끌어 놓거나 Ctrl+V로 붙여 넣어도 돼요 · 이미지는 서버로 전송되지 않아요

인식할 언어

Scanner - 문서 스캔 PDF종이 문서를 아이폰으로 스캔해 깔끔한 PDF로 저장하세요.
아이폰 앱 받기

이미지 글자 추출(OCR)란?

이미지 글자 추출(OCR)은 사진이나 스캔한 문서에 찍힌 글자를 컴퓨터가 읽어 텍스트로 바꿔 주는 도구입니다. 종이 문서를 다시 타이핑하거나, 캡처 이미지 속 문장을 복사하고 싶을 때 이미지를 올리기만 하면 됩니다.

오픈소스 OCR 엔진 Tesseract를 브라우저 안에서 실행하므로 이미지가 외부 서버로 전송되지 않습니다. 처음 사용할 때만 인식 엔진과 언어 데이터(언어당 1~3MB)를 내려받고, 이후에는 브라우저에 저장된 데이터를 다시 씁니다.

사용 방법

  1. 이미지 선택을 눌러 사진이나 스캔 이미지를 고르거나, 캡처한 화면을 Ctrl+V로 붙여 넣으세요.
  2. 인식할 언어를 고르세요. 기본은 한국어+영어이며, 문서에 들어 있는 언어만 고를수록 정확하고 빠릅니다.
  3. 진행률이 100%가 되면 아래 칸에 인식된 텍스트가 나타납니다. 틀린 글자는 칸에서 바로 고칠 수 있습니다.
  4. 텍스트 복사나 .txt 저장으로 결과를 가져가세요.

인식률을 높이는 방법

  • 정면에서 밝게 찍으세요. 기울어지거나 그림자가 진 사진은 인식률이 크게 떨어집니다.
  • 글자 높이가 20픽셀 이상이면 잘 읽힙니다. 작은 글자는 필요한 부분만 확대해 캡처하세요(작은 이미지는 자동으로 확대해서 인식합니다).
  • 색 배경이나 흐린 사진은 흑백·대비 보정을 켜 두세요.
  • 문서에 쓰인 언어만 고르세요. 쓰지 않는 언어를 함께 고르면 비슷한 모양의 다른 글자로 잘못 읽을 수 있습니다.
  • 표, 손글씨, 세로쓰기, 장식이 많은 글꼴은 정확도가 낮을 수 있습니다.

언어별 데이터 크기

언어내려받는 크기
인식 엔진(공통, 1회)약 1.4MB
한국어약 1.6MB
영어약 3.0MB
일본어약 2.0MB
중국어(번체)약 1.7MB
독일어·프랑스어·스페인어·포르투갈어·이탈리아어각 0.7~2.1MB

한 번 받은 데이터는 브라우저 저장소에 남아 다음 방문 때는 바로 인식을 시작합니다. 모바일 데이터 사용이 걱정된다면 와이파이에서 처음 사용하세요.

자주 묻는 질문

이미지가 서버에 올라가나요?

아니요. 글자 인식은 모두 내 기기의 브라우저 안에서 처리됩니다. 인터넷으로 내려받는 것은 인식 엔진과 언어 데이터뿐이며 이미지와 결과 텍스트는 어디에도 전송되지 않습니다.

손글씨도 인식되나요?

또박또박 쓴 글씨는 어느 정도 읽지만, 이 엔진은 인쇄된 글자에 맞춰져 있어 손글씨 정확도는 낮습니다.

PDF에서 글자를 추출할 수 있나요?

이미지 파일만 지원합니다. 스캔 PDF라면 PDF 이미지 변환 도구로 페이지를 JPG로 바꾼 뒤 올리세요. 글자를 선택할 수 있는 일반 PDF는 PDF 뷰어에서 바로 복사하는 편이 정확합니다.

처음 인식이 오래 걸려요.

첫 사용 때 인식 엔진과 언어 데이터를 내려받기 때문입니다. 두 번째부터는 저장된 데이터를 써서 몇 초 안에 끝납니다. 큰 사진은 인식 시간이 더 걸릴 수 있습니다.

일본어·중국어 세로쓰기도 되나요?

가로쓰기 문서에 맞춰져 있어 세로쓰기는 정확도가 낮습니다. 세로쓰기 이미지는 90도 회전해도 글자 방향이 맞지 않으므로 가로쓰기 부분만 쓰는 것을 권장합니다.