OCR은 이미지나 스캔 문서의 글자를 기계가 처리할 수 있는 텍스트로 변환하는 기술입니다. 결과 품질은 언어, 글꼴, 해상도, 기울기, 촬영환경, 표 구조와 서비스 설정에 따라 크게 달라집니다.
OCR의 일반적인 처리 과정
| 과정 | 설명 |
|---|---|
| 입력·전처리 | 회전·기울기·명암·노이즈를 보정합니다. |
| 텍스트 영역 검출 | 문서에서 글자가 있는 위치를 찾습니다. |
| 문자 인식 | 검출한 영역을 글자·단어·문장으로 변환합니다. |
| 후처리 | 언어모델·사전·문서 규칙으로 결과를 보정하고 구조화합니다. |
제품에 따라 검출과 인식이 통합되거나 단계가 더 세분될 수 있으므로 이를 모든 OCR의 고정된 4단계 표준으로 보지는 않습니다.
서비스 정확도는 같은 자료로 직접 시험해야 합니다
서로 다른 OCR 서비스에 고정된 정확도 순위를 부여하는 공식 공통 비교표는 없습니다. 특정 정확도나 처리시간을 모든 문서에 보장되는 수치처럼 제시하면 안 됩니다.
- 실제 업무 문서에서 개인정보를 제거한 대표 표본을 준비합니다.
- 문자 오류율(CER), 단어 오류율(WER), 필드별 정확도 등 목적에 맞는 지표를 정합니다.
- 같은 이미지와 후처리 조건으로 후보 서비스를 시험합니다.
- 표·손글씨·다국어·저화질 문서를 별도 그룹으로 나눠 평가합니다.
- 정확도뿐 아니라 보안, 데이터 저장정책, 장애 대응, 가격을 함께 비교합니다.
요금은 공식 페이지에서 사용량 기준으로 계산하세요
Google Cloud Vision은 현재 월 첫 1,000단위가 무료이고, 이후 5백만 단위까지 텍스트 감지와 문서 텍스트 감지가 1,000단위당 미화 1.50달러입니다. 환율과 추가 저장·네트워크 비용에 따라 원화 금액은 달라집니다.
CLOVA OCR은 요금제와 호출 유형, 템플릿 영역 수, 배치 기능에 따라 과금방식이 달라집니다. ‘월 1만 페이지 약 1만5천원’처럼 하나의 금액으로 고정하지 말고 도입 시점의 공식 요금표로 계산하세요.
도입 전 체크리스트
- 문서 유형별 실제 표본으로 시험했는가
- 오류를 사람이 검수해야 하는 필드를 정했는가
- 개인정보·민감정보의 전송·저장 위치와 보관기간을 확인했는가
- 호출 단위와 무료구간, 환율, 저장비용을 포함해 계산했는가
- 서비스 장애 시 원본과 결과를 재처리할 방법이 있는가
공식 출처
- Google Cloud – Vision OCR 공식 문서
- Google Cloud Vision 공식 요금
- NAVER Cloud – CLOVA OCR 사양·요금 안내
- Tesseract OCR 공식 저장소
이 글은 2026년 9월 1일 기준으로 공식 문서와 원문 자료를 확인해 수정했습니다. 제도·요금·서비스 상태는 바뀔 수 있으므로 실제 이용 전 연결된 공식 페이지를 다시 확인하세요.