'이미지 텍스트 추출' 은 이미지·사진·스크린샷 속 글자를 복사하고 편집할 수 있는 텍스트로 바꿔 주는 무료 온라인 OCR 도구입니다. 인식은 전부 내 브라우저 안에서 이루어지며, 이미지는 어떤 서버로도 전송되지 않습니다.
이미지 텍스트 추출 · OCR
TXT
0 자이미지는 내 브라우저에서만 처리되며 서버로 전송되지 않습니다. 신분증, 영수증, 계약서 같은 문서도 안심하고 사용하세요.
Ctrl + V 로 붙여넣으세요.인식이 끝나면 이미지 위에 읽어 낸 각 줄이 초록색 상자로 표시됩니다. 어떤 문단에 상자가 없다면 그 부분은 인식에 실패한 것이며, 대개 기울어짐·너무 작은 글자·복잡한 배경이 원인입니다.
| 항목 | 지원 범위 |
|---|---|
| 이미지 형식 | JPG, PNG, WebP, GIF, BMP |
| 파일 크기 | 장당 최대 12 MB |
| 언어 | 한국어, 영어, 일본어, 중국어 간체·번체 |
특정 언어를 처음 선택하면 브라우저가 해당 언어 파일을 내려받습니다(한국어 약 5–10 MB). 그래서 첫 인식은 조금 느리지만, 같은 세션에서 다시 인식할 때는 훨씬 빨라집니다.
이 도구는 오픈소스 Tesseract.js 엔진을 사용하며, 인식 전 과정이 내 브라우저 안에서 실행됩니다. 이미지와 추출된 텍스트는 어떤 서버로도 전송되지 않으며, 저희도 무엇을 처리했는지 알 수 없습니다.
그래서 주민등록증, 은행 거래내역서, 영수증, 진료 기록, 계약서처럼 민감한 문서를 다뤄도 자료가 제3자에게 넘어갈 걱정이 없습니다. (덤으로, 언어 파일을 한 번 내려받으면 오프라인에서도 쓸 수 있습니다.)
OCR은 Optical Character Recognition의 약자로, 우리말로는 광학 문자 인식이라고 합니다. 쉽게 말해 이미지 안에 '그려져' 있는 글자 모양을, 컴퓨터가 실제로 읽고 복사할 수 있는 문자로 되돌리는 기술입니다.
컴퓨터에게는 문서를 찍은 사진이나 풍경 사진이나 똑같은 픽셀 덩어리일 뿐입니다. OCR은 그 픽셀을 다시 문자로 바꿔 줍니다. 책의 한 페이지, 화이트보드에 적은 메모, PDF 캡처, 영수증, 메뉴판 — 예전에는 직접 다시 입력해야 했던 것들을 클릭 한 번으로 꺼낼 수 있습니다.
다만 OCR은 기본적으로 인쇄체를 위해 만들어졌습니다. 손글씨는 정확도가 크게 떨어지며, 흘려 쓴 글씨는 거의 인식하지 못합니다.
완전히 무료이며 가입도, 횟수 제한도 없습니다. 인식이 내 브라우저에서 이루어지므로 서버 비용이 들지 않아 계속 무료로 제공할 수 있습니다.
아닙니다. 이 도구는 Tesseract.js를 사용하며 모든 처리가 내 브라우저에서 실행됩니다. 이미지와 인식 결과 모두 어떤 서버로도 전송되지 않습니다.
이 도구는 이미지만 처리합니다. 다만 PDF 전용으로 'PDF 텍스트 추출' 도구가 따로 있습니다. 텍스트 레이어가 있는 PDF는 즉시 추출되고, 스캔본은 자동으로 OCR 처리되므로 페이지마다 캡처할 필요가 없습니다.
먼저 「작은 글자 자동 확대」를 켜고, 이미지에 실제로 쓰인 언어만 선택해 보세요. 그래도 나아지지 않는다면 대개 이미지가 기울었거나, 어둡거나, 글자가 너무 작은 경우입니다. 정면에서 고른 조명으로 다시 찍으면 눈에 띄게 좋아집니다.
시도해 볼 수는 있지만 정확도 편차가 큽니다. 이런 OCR 엔진은 주로 인쇄체로 학습되어 있어, 또박또박 쓴 정자체는 일부 읽어 내지만 흘려 쓴 글씨는 거의 인식하지 못합니다.
처음에는 언어 파일(한국어 약 5–10 MB)과 인식 엔진을 내려받아야 하기 때문입니다. 한 번 받고 나면 같은 세션 안에서는 훨씬 빠르게 동작합니다.