JPG2TEXT는 사진이나 스캔본 속 텍스트를 매번 손으로 옮겨 적는 번거로움을 줄이기 위해 만든 무료 웹 도구입니다. 회의록을 촬영한 사진, 책의 한 페이지, 화면 캡처 속 문장을 다시 타이핑하는 데 시간을 쓰는 대신, 이미지를 올리는 것만으로 바로 텍스트를 얻을 수 있도록 만들었습니다.
JPG2TEXT는 별도의 서버를 거치지 않고, 업로드한 이미지를 사용자의 브라우저 안에서 직접 분석합니다. 오픈소스 광학 문자 인식(OCR) 엔진인 Tesseract를 웹 환경에 맞게 이식한 라이브러리를 사용하며, 이미지 파일은 어떤 외부 서버로도 전송되지 않습니다. 페이지를 새로고침하면 업로드했던 이미지와 결과는 즉시 사라집니다.
현재는 인쇄체 문서 인식에 최적화되어 있어 손글씨나 흐릿한 이미지에서는 정확도가 떨어질 수 있습니다. PDF 파일을 직접 업로드하는 기능과 다국어 인식 정확도 개선을 다음 업데이트로 준비하고 있습니다.
JPG2TEXT는 개인이 운영하는 무료 서비스입니다. 서비스 이용에 대한 의견이나 오류 제보는 문의 페이지를 통해 보내주시면 확인 후 반영하겠습니다.