OCR은 "Optical Character Recognition"의 약자로, 우리말로는 광학 문자 인식이라고 부릅니다. 쉽게 말하면 사진이나 스캔본처럼 픽셀로 이루어진 이미지 속에서 사람이 읽을 수 있는 글자를 찾아내, 컴퓨터가 다룰 수 있는 텍스트 데이터로 바꿔주는 기술입니다.

이미지와 텍스트는 근본적으로 다른 데이터입니다

사진 속 문서를 사람은 눈으로 읽지만, 컴퓨터에게 이미지는 단지 색깔을 가진 점(픽셀)들의 모음일 뿐입니다. "이 픽셀 덩어리가 '가'라는 글자를 나타낸다"는 사실을 컴퓨터가 스스로 알아내는 과정이 바로 문자 인식입니다. 이 과정을 거쳐야만 이미지 속 문장을 검색하거나, 복사해서 다른 문서에 붙여넣거나, 번역기에 넣을 수 있게 됩니다.

대략적인 인식 과정

일반적인 OCR 엔진은 몇 단계를 거쳐 동작합니다. 먼저 이미지에서 글자가 있을 법한 영역을 찾아내고(텍스트 영역 탐지), 그 영역을 한 글자 또는 한 단어 단위로 잘라냅니다. 그다음 각 글자의 모양을 미리 학습된 수많은 글자 패턴과 비교해 가장 가까운 글자를 찾아냅니다. 이렇게 찾아낸 글자들을 원래 순서대로 이어 붙이면 우리가 보는 텍스트 결과물이 완성됩니다.

왜 어떤 이미지는 인식이 잘 안 될까

이 과정에서 이미지가 흐릿하거나, 글자가 기울어져 있거나, 배경과 글자의 명암 차이가 적으면 컴퓨터가 글자의 경계를 제대로 찾지 못합니다. 앞선 가이드들에서 다룬 "밝은 곳에서, 정면으로, 흔들리지 않게" 촬영하라는 조언들이 바로 이 인식 과정을 방해하지 않기 위한 것입니다.

JPG2TEXT는 어떻게 동작하나요

JPG2TEXT는 오픈소스 OCR 엔진을 웹 브라우저에서 직접 실행하는 방식으로 동작합니다. 이미지를 서버로 전송해 처리하는 대신, 사용자의 브라우저 안에서 곧바로 인식 과정을 수행하기 때문에 이미지가 외부로 나가지 않는다는 장점이 있습니다. 지금 바로 사용해보며 그 과정을 직접 확인해보세요.

원리를 이해했다면, 이제 직접 이미지를 올려 텍스트로 바꿔보세요.

이미지 변환하러 가기

다음 가이드 → 온라인 OCR 도구 고를 때 확인해야 할 3가지