이미지 텍스트 추출 (온라인 OCR 문자인식)

이미지 텍스트 추출 (온라인 OCR 문자인식)

'이미지 텍스트 추출' 은 이미지·사진·스크린샷 속 글자를 복사하고 편집할 수 있는 텍스트로 바꿔 주는 무료 온라인 OCR 도구입니다. 인식은 전부 내 브라우저 안에서 이루어지며, 이미지는 어떤 서버로도 전송되지 않습니다.

이미지 텍스트 추출 · OCR

이미지를 끌어다 놓거나 클릭해서 선택하세요 JPG, PNG, WebP, GIF, BMP 지원. 스크린샷은 Ctrl + V 로 바로 붙여넣을 수 있습니다.
인식할 이미지 미리보기

TXT

0 자
0%

이미지는 내 브라우저에서만 처리되며 서버로 전송되지 않습니다. 신분증, 영수증, 계약서 같은 문서도 안심하고 사용하세요.

변환하려는 게 PDF 파일인가요?'PDF 텍스트 추출' 을 쓰면 텍스트 레이어가 있는 PDF는 즉시 추출되고, 스캔본은 자동으로 OCR 처리됩니다. 페이지마다 캡처할 필요가 없습니다.

사용 방법

  1. 이미지 넣기 — 영역을 클릭해 파일을 고르거나, 이미지를 끌어다 놓거나, 캡처한 뒤 Ctrl + V 로 붙여넣으세요.
  2. 이미지 속 언어 선택 — 언어를 정확히 고를수록 결과가 좋아집니다.
  3. 「텍스트 추출」 클릭 — 끝나면 오른쪽에 텍스트가 나타납니다. 그대로 수정하거나 복사하고, .txt 파일로 내려받을 수도 있습니다.

인식이 끝나면 이미지 위에 읽어 낸 각 줄이 초록색 상자로 표시됩니다. 어떤 문단에 상자가 없다면 그 부분은 인식에 실패한 것이며, 대개 기울어짐·너무 작은 글자·복잡한 배경이 원인입니다.

지원 형식과 언어

항목 지원 범위
이미지 형식 JPG, PNG, WebP, GIF, BMP
파일 크기 장당 최대 12 MB
언어 한국어, 영어, 일본어, 중국어 간체·번체

특정 언어를 처음 선택하면 브라우저가 해당 언어 파일을 내려받습니다(한국어 약 5–10 MB). 그래서 첫 인식은 조금 느리지만, 같은 세션에서 다시 인식할 때는 훨씬 빨라집니다.

정확도를 높이는 다섯 가지 요령

  1. 똑바로 찍기 — OCR은 기울어진 글자에 매우 취약합니다. 카메라를 종이와 평행하게 두는 것이 어떤 후보정보다 효과적입니다.
  2. 고른 조명 — 그림자, 반사, 플래시 얼룩을 피하세요. 한글 인식이 실패하는 가장 흔한 원인입니다.
  3. 글자는 클수록 정확 — 이미지 안에서 글자 높이가 20픽셀 이상이면 좋습니다. 작다면 「작은 글자 자동 확대」를 켜세요. 먼저 확대한 뒤 인식합니다.
  4. 배경은 단순하게 — 무늬 배경, 워터마크, 표 선은 오인식을 부릅니다. 필요 없는 부분은 미리 잘라내세요.
  5. 언어를 욕심내지 않기 — 실제로 쓰인 언어만 고르세요. 한국어와 중국어를 동시에 고르면 양쪽 다 나빠집니다.

이미지는 이 기기를 벗어나지 않습니다

이 도구는 오픈소스 Tesseract.js 엔진을 사용하며, 인식 전 과정이 내 브라우저 안에서 실행됩니다. 이미지와 추출된 텍스트는 어떤 서버로도 전송되지 않으며, 저희도 무엇을 처리했는지 알 수 없습니다.

그래서 주민등록증, 은행 거래내역서, 영수증, 진료 기록, 계약서처럼 민감한 문서를 다뤄도 자료가 제3자에게 넘어갈 걱정이 없습니다. (덤으로, 언어 파일을 한 번 내려받으면 오프라인에서도 쓸 수 있습니다.)

OCR이란 무엇인가요?

OCR은 Optical Character Recognition의 약자로, 우리말로는 광학 문자 인식이라고 합니다. 쉽게 말해 이미지 안에 '그려져' 있는 글자 모양을, 컴퓨터가 실제로 읽고 복사할 수 있는 문자로 되돌리는 기술입니다.

컴퓨터에게는 문서를 찍은 사진이나 풍경 사진이나 똑같은 픽셀 덩어리일 뿐입니다. OCR은 그 픽셀을 다시 문자로 바꿔 줍니다. 책의 한 페이지, 화이트보드에 적은 메모, PDF 캡처, 영수증, 메뉴판 — 예전에는 직접 다시 입력해야 했던 것들을 클릭 한 번으로 꺼낼 수 있습니다.

다만 OCR은 기본적으로 인쇄체를 위해 만들어졌습니다. 손글씨는 정확도가 크게 떨어지며, 흘려 쓴 글씨는 거의 인식하지 못합니다.

자주 묻는 질문

이미지 텍스트 추출은 유료인가요? 가입이 필요한가요?

완전히 무료이며 가입도, 횟수 제한도 없습니다. 인식이 내 브라우저에서 이루어지므로 서버 비용이 들지 않아 계속 무료로 제공할 수 있습니다.

제 이미지가 업로드되거나 다른 사람에게 보이나요?

아닙니다. 이 도구는 Tesseract.js를 사용하며 모든 처리가 내 브라우저에서 실행됩니다. 이미지와 인식 결과 모두 어떤 서버로도 전송되지 않습니다.

PDF도 지원하나요?

이 도구는 이미지만 처리합니다. 다만 PDF 전용으로 'PDF 텍스트 추출' 도구가 따로 있습니다. 텍스트 레이어가 있는 PDF는 즉시 추출되고, 스캔본은 자동으로 OCR 처리되므로 페이지마다 캡처할 필요가 없습니다.

결과가 정확하지 않으면 어떻게 하나요?

먼저 「작은 글자 자동 확대」를 켜고, 이미지에 실제로 쓰인 언어만 선택해 보세요. 그래도 나아지지 않는다면 대개 이미지가 기울었거나, 어둡거나, 글자가 너무 작은 경우입니다. 정면에서 고른 조명으로 다시 찍으면 눈에 띄게 좋아집니다.

손글씨도 인식되나요?

시도해 볼 수는 있지만 정확도 편차가 큽니다. 이런 OCR 엔진은 주로 인쇄체로 학습되어 있어, 또박또박 쓴 정자체는 일부 읽어 내지만 흘려 쓴 글씨는 거의 인식하지 못합니다.

첫 인식이 왜 이렇게 오래 걸리나요?

처음에는 언어 파일(한국어 약 5–10 MB)과 인식 엔진을 내려받아야 하기 때문입니다. 한 번 받고 나면 같은 세션 안에서는 훨씬 빠르게 동작합니다.

함께 쓰면 좋은 도구