2026년 최고의 OCR 모델: 스캔 PDF, 표, API 비용
스캔 문서를 위한 Mistral OCR, Google Document AI, PaddleOCR를 비교합니다. 문자 인식, 레이아웃 복원, 사용 가능한 페이지의 비용을 구분하세요.

송장에서 모든 숫자를 정확히 추출해도 가격이 엉뚱한 상품에 연결될 수 있습니다. 광학 문자 인식(OCR)은 이미지에서 글자를 읽습니다. 페이지의 순서와 관계를 복원하는 일은 별도의 요구 사항이며, 결과의 사용 가능성을 결정하는 경우가 많습니다.
호스팅형 문서 파싱 시험에는 Mistral OCR 4.1, 텍스트 인식 기준선에는 Google Enterprise Document OCR, 로컬 처리를 직접 운영해야 한다면 PaddleOCR부터 시작하겠습니다. 문서 구조가 중요하면 Google Layout Parser를 추가하세요. 기존 작업 환경에서는 더 저렴한 Mistral OCR 3도 비교 후보입니다. 이는 필요한 출력에 따라 만든 후보 목록이며 독립적으로 측정한 정확도 순위가 아닙니다.
출처와 가격은 2026년 9월 7일에 확인했습니다. OCR 모델과 이를 제공하는 서비스를 비교하며, 이름이 붙은 선택지가 다운로드 가능한 모델이 아니라 프로세서나 도구 모음인 경우도 구분합니다. PDF 채팅 앱과 이미 읽을 수 있는 텍스트에서 정보를 추출하는 작업은 범위 밖입니다.
모델보다 먼저 출력 형태 선택하기
| 후보 | 평가할 내용 | 주요 결정 |
|---|---|---|
| Mistral OCR 4.1 | 블록 정보가 포함된 문서 파싱 | 필요한 관계가 결과에 보존되는가? |
| Mistral OCR 3 | 계속 제공되는 저비용 OCR 엔드포인트 | 새 출력이 기존 연동을 바꿀 가치가 있는가? |
| Google Enterprise Document OCR | 관리형 텍스트 인식 프로세서 | 인식된 텍스트만으로 충분한가? |
| 같은 요금 페이지의 Google Layout Parser | 구조 추출과 초기 분할 | 제목과 표의 관계가 보존되는가? |
| PaddleOCR | 로컬에 배포할 수 있는 OCR·파싱 도구 모음 | 선택한 파이프라인을 운영하고 평가할 수 있는가? |
Mistral의 OCR 프로세서 안내서는 OCR 4 이상에서 블록을 추출하는 방법을 설명합니다. 기록에는 정확한 모델 ID를 남기세요. 바뀌는 latest 별칭은 탐색에는 편리하지만 예전 시험의 재현성을 낮춥니다.
PaddleOCR는 하나의 점수로 나타낼 수 있는 단일 모델이 아닙니다. 저장소는 PaddleOCR-VL을 포함한 인식·문서 파싱 구성 요소를 제공합니다. 배포할 버전과 구성을 고정하세요. 다운로드 가능한 소프트웨어를 쓰면 호스팅 서비스의 페이지당 청구는 없어지지만 컴퓨팅, 설치, 업그레이드, 검토 비용까지 사라지는 것은 아닙니다.
PDF에 이미 정확한 텍스트 레이어가 있다면 페이지를 다시 인식하는 데 비용을 쓰기 전에 그 레이어부터 확인하세요. 스캔 문서는 실제 스캔 품질을 표본으로 뽑아야 합니다. 깨끗한 디지털 내보내기 파일과 기울어진 휴대전화 사진을 같은 정확도 수치로 뭉뚱그리면 안 됩니다.
10,000페이지 처리 비용
다음은 세금, 저장 공간, 재시도, 선택 기능, 협상 할인을 적용하기 전 처리 페이지 10,000장의 USD 사용 비용 예시입니다. Google OCR 행은 단위를 분명히 보여 주기 위해 무료 허용량 적용 전 유료 요율을 표시합니다.
| 서비스와 처리 방식 | 1,000페이지당 표시 요율 | 사용 비용 예시 |
|---|---|---|
| Google Enterprise Document OCR, 표준 유료 구간 | $1.50 | 허용량 적용 전 $15 |
| Mistral OCR 3, OCR 전용 | $2 | $20 |
| Mistral OCR 4.1, OCR 전용 | $4 | $40 |
| Mistral OCR 4.1, 주석 페이지 | $5 | $50 |
| Google Layout Parser | $10 | $100 |
| PaddleOCR, 자체 호스팅 | 자체 인프라 비용 | 배포한 파이프라인에서 측정 |
현재 Google 표준 OCR 요금에는 첫 1,000페이지의 무료 처리량이 포함됩니다. 이를 모두 사용할 수 있다면 해당 프로세서로 10,000페이지를 처리하는 비용은 $13.50입니다. Layout Parser와 OCR 부가 기능은 별도로 과금됩니다. $1.50 요율로 모든 Document AI 기능을 이용하는 것은 아닙니다.
마찬가지로 Mistral의 OCR 전용 요율과 주석 페이지 요율은 다릅니다. 비용을 비교하기 전에 사용할 출력을 정하세요. 서로 다른 출력을 처리하는 서비스의 달러 차이는 효율성 결과가 아닙니다.
표에는 정확한 문자 이상의 정보가 필요합니다
작은 가상 구매 주문서로 승인 기준을 정합니다.
| 품목 | 수량 | 단가 | 행 합계 |
|---|---|---|---|
| 파란색 폴더 | 12 | $2.50 | $30.00 |
| 흰색 폴더 | 8 | $3.00 | $24.00 |
직접 시험 문서를 인쇄하거나 렌더링한 뒤 스캔 이미지와 기울어진 사진을 평가에 포함하세요. 예상 소계는 $54.00입니다. 숫자 여섯 개를 모두 반환했어도 단가를 서로 바꿔 연결했다면 표를 올바르게 복원하지 못한 것입니다.
최소 세 가지를 따로 확인하세요. 텍스트 자체, 각 값이 속한 행과 열, 제목·주석·합계 주변의 읽기 순서입니다. 원본의 셀이 비어 있다면 값을 지어낸 것은 오류입니다. 배송비 포함 여부를 각주가 바꾸는 경우 그 내용을 잃는 일은 사소한 간격 차이보다 중요할 수 있습니다.
점수를 매기기 전에 두 번째 모델로 OCR 결과를 조용히 수정하지 마세요. 그러면 OCR과 수정 모델을 합친 작업 절차를 평가하게 됩니다. 그런 절차가 유용할 수는 있지만 추가 사용량과 데이터가 발명될 가능성을 드러내야 합니다.
대표 표본에는 일반 문서뿐 아니라 흐린 스캔, 병합된 표 셀, 다단 문서, 회전된 텍스트, 손글씨 추가처럼 실제 작업에서 어려운 사례도 포함하세요. 문서 유형별로 결과를 기록합니다. 쉬운 페이지가 대부분인 높은 평균 점수는 여전히 수동 처리가 필요한 범주를 감출 수 있습니다.
벤치마크로 후보를 찾고 실제 페이지를 점검하기
OmniDocBench는 텍스트, 표, 수식, 읽기 순서 같은 요소별 문서 파싱 데이터와 평가를 제공합니다. 이 글에서는 과제를 분리한다는 점이 유용합니다. 점수를 인용하기 전에 벤치마크 릴리스, 시험한 체크포인트, 평가 구성을 확인하세요.
이 글에서는 해당 벤치마크를 다시 실행하거나 구매 주문서 예시로 현재의 모든 엔드포인트를 시험하지 않았습니다. 공개 데이터셋에서 얻은 모델 결과는 살펴볼 이유가 될 뿐, 특정 공급자의 문서 양식을 처리한다는 보장이 아닙니다. 공급자가 보고한 결과는 공급자 근거라는 표시를 유지해야 합니다.
운영 단계에서는 검사를 통과한 일괄 작업의 비용을 비교하세요. 가상의 서비스가 10,000페이지 처리에 $40을 청구한다고 가정합니다. 그중 200페이지를 각각 2분씩 수정하고 인건비를 시간당 $30로 잡으면 검토 비용이 $200 추가되어 총비용은 $240입니다. 이 오류율과 인건비 가정은 어떤 서비스에서도 측정한 값이 아닙니다.
이 예시는 작은 페이지 요금 절감보다 반복되는 표 오류 하나가 더 중요할 수 있는 이유를 보여 줍니다. 처리 페이지와 함께 수정 시간을 기록하고, 실패한 페이지도 비용 계산에 포함하세요.
텍스트와 레이아웃을 신뢰할 수 있게 된 뒤 별도의 정보 추출 모델로 공급자, 금액, 배송일 같은 필드에 결과를 매핑할 수 있습니다. 검증을 위해 원본 페이지를 남겨 두세요. 의심스러운 값을 문서의 실제 내용까지 추적할 수 있을 때만 구조화 레코드가 유용합니다.
참고 자료
- Mistral OCR 4.1과 OCR 3: 정확한 엔드포인트, 제공 상태, 페이지 요율입니다.
- Mistral OCR 프로세서 안내서: 문서 입력과 블록 추출을 설명합니다.
- Google Document AI 요금: 프로세서별 요율과 허용량을 안내합니다.
- PaddleOCR 저장소: 배포 가능한 인식·파싱 구성 요소를 제공합니다.
- OmniDocBench: 문서 파싱 평가와 데이터셋 범위를 설명합니다.







