본문 바로가기
카테고리 없음

클라우드 OCR 서비스 비교: PDF·영수증·표 데이터 추출 기능 차이

by danie 2026. 10. 1.
반응형

클라우드 OCR 서비스 비교: PDF·영수증·표 데이터 추출 기능 차이

OCR 서비스는 모두 같은 일을 하는 것처럼 보여도, 실제로는 글자만 읽는 OCR부터 표·키값·문서 구조까지 추출하는 클라우드 문서 인식 서비스까지 기능 범위가 다릅니다. 비교할 때는 가격보다 먼저 내 문서에서 무엇을 추출해야 하는지를 보는 것이 좋습니다.

아래 순서대로 보면 일반 사무용으로도 선택이 쉬워집니다.

1) 먼저, 내가 필요한 건 ‘글자만’인지 ‘구조까지’인지 나누기

먼저 볼 것은 서비스가 단순 OCR인지, 아니면 문서 구조까지 읽는지입니다.

  • 단순 OCR: 이미지나 PDF에서 글자 내용을 읽는 방식입니다.
  • 구조화 문서 인식: 글자뿐 아니라 표, 항목과 값의 짝, 문서 안의 구조까지 함께 다룹니다.

비교 기준으로 보면 다음처럼 정리할 수 있습니다.

  • Google Cloud Document AI의 Form Parser는 key-value pairs, tables, selection marks, generic fields를 추출합니다. [1]
  • Microsoft Azure AI Document Intelligence의 Read는 텍스트 줄, 단어, 위치를 추출하는 OCR용 기능이고, Layout과 General Documents는 구조적 통찰과 key-values/entities를 제공합니다. [2]
  • Amazon Textract는 text, forms, tables, query responses, signatures를 추출합니다. [3]

즉, 단순히 글자만 읽으면 되는지, 아니면 표나 항목 묶음까지 필요한지에 따라 후보가 달라집니다.

이런 경우에 특히 확인하세요

  • 영수증이나 송장처럼 항목명과 금액이 짝으로 나오는 문서를 다루는 경우
  • 표 안의 값을 그대로 옮겨야 하는 경우
  • 체크박스나 서명 같은 요소도 함께 봐야 하는 경우

2) 어떤 문서에 쓰려는지 보면 후보가 더 빨리 좁혀진다

같은 OCR이라도 공식 문서에서 강조하는 문서 유형이 다릅니다.

  • Azure AI Document Intelligence Invoice 모델은 invoices, utility bills, purchase orders에서 key fields와 line items를 추출하고, 결과를 structured JSON으로 반환합니다. [4]
  • Amazon Textract는 문서 이미지를 입력해 텍스트를 검출하거나 분석하는 방식으로 동작합니다. [5]
  • Google Cloud Document AI는 processor 문서에서 Enterprise Document OCR의 언어 지원을 따로 안내합니다. [6]

이 단계에서는 “내 문서가 어떤 종류인지”를 먼저 적어두면 좋습니다. 예를 들어:

  • 송장
  • 영수증
  • 구매 주문서
  • 일반 PDF
  • 스캔 이미지

문서 종류가 명확하면, 특정 모델이 있는지와 범용 OCR로 충분한지를 비교하기 쉬워집니다.

3) PDF·이미지·오피스 문서 중 무엇을 넣을지 확인하기

입력 파일 형식도 비교할 때 중요합니다. 같은 서비스라도 지원하는 파일이 다릅니다.

  • Google Cloud Document AI는 PDF, GIF, TIFF, JPEG, PNG, BMP, WebP를 포함해, 일부 기능에서는 HTML, DOCX, PPTX, XLSX도 지원합니다. [7]
  • Amazon Textract는 JPEG, PNG, PDF, TIFF를 지원하며, XFA PDF는 지원하지 않고, PDF는 password protected가 아니어야 합니다. [8]

따라서 파일이 이미 정해져 있다면, 먼저 그 형식을 지원하는지부터 확인하는 것이 좋습니다.

예를 들어:

  • 스캔 PDF가 많다 → PDF 지원을 먼저 확인
  • 사진으로 받은 문서가 많다 → JPEG/PNG 지원을 확인
  • 엑셀이나 워드 문서를 그대로 넣고 싶다 → 해당 형식을 공식 지원하는지 확인

4) 문서 모양과 품질 조건도 비교 기준이 된다

문서가 흐리거나 비스듬하면 결과가 달라질 수 있어서, 공식 문서가 품질이나 레이아웃을 어떻게 설명하는지도 봐야 합니다.

  • Google Cloud Document AI는 OCR로 텍스트와 레이아웃을 다루며, image quality detection과 deskewing 같은 보조 기능을 안내합니다. [9]
  • Google Cloud Document AI는 스캔 품질에 대해 최소 200 dpi, 300 dpi 이상 권장을 안내합니다. [10]
  • Amazon Textract FAQ는 테이블이 주변 요소와 시각적으로 분리되어 있고, 텍스트가 upright일 때 더 잘 작동한다고 안내합니다. [11]
  • Azure AI Document Intelligence의 Layout 문서는 tables extracted와 table analysis를 지원한다고 설명합니다. [12]

이 부분은 “내 문서가 표 중심인지”, “스캔본 품질이 일정한지”를 먼저 떠올리면 이해하기 쉽습니다.

5) 언어 지원은 모델별로 따로 봐야 한다

한글 문서가 많다면 언어 지원도 꼭 비교해야 합니다.

  • Google Cloud Document AI의 Enterprise Document OCR은 200개 이상 언어를 지원한다고 문서에 명시합니다. [6]
  • Azure AI Document Intelligence의 OCR language support 문서는 Read/Layout의 언어·로케일 지원이 모델별로 다르다고 안내하며, 자동 언어 감지를 언급합니다. [13]
  • Amazon Textract FAQ는 현재 지원 언어로 English, Spanish, Italian, Portuguese, French, German을 언급합니다. [11]

즉, 언어 지원은 서비스 전체에 똑같이 붙는 기능이 아니라, 모델별로 확인해야 하는 항목입니다.

6) 업무용 OCR 서비스를 비교할 때 보는 순서

비교 글을 쓸 때는 다음 순서가 읽기 쉽습니다.

1. 글자만 읽는 OCR인지, 표·키값까지 읽는지

2. 송장, 영수증, 일반 문서 중 무엇을 공식 지원하는지

3. PDF·이미지·오피스 문서 입력이 가능한지

4. 언어와 레이아웃 제약이 있는지

이 순서대로 보면 “무엇이 최고냐”보다 “내 문서에 맞느냐”를 빠르게 판단할 수 있습니다.

한눈에 정리

  • 표·키-값·서명·질의응답까지 필요하면 구조화 문서 인식을 본다. [1][2][3]
  • 송장·영수증·구매 주문서처럼 문서 종류가 정해져 있으면 전용 모델 지원을 본다. [4]
  • PDF, 이미지, 오피스 파일을 넣을 계획이면 입력 형식을 먼저 확인한다. [7][8]
  • 한글이나 다국어 문서라면 언어 지원을 모델별로 확인한다. [6][11][13]
  • 스캔 품질이나 표 배치가 중요하면 품질·레이아웃 안내를 함께 본다. [9][10][11][12]

출처

[1] Google Cloud Document AI, Extracting overview — https://docs.cloud.google.com/document-ai/docs/extracting-overview

[2] Microsoft Azure AI Document Intelligence, Transparency note — https://learn.microsoft.com/en-us/azure/foundry/responsible-ai/document-intelligence/transparency-note

[3] Amazon Textract, How it works: Analyzing documents — https://docs.aws.amazon.com/textract/latest/dg/how-it-works-analyzing.html

[4] Microsoft Azure AI Document Intelligence, Invoice model — https://learn.microsoft.com/en-us/azure/ai-services/document-intelligence/prebuilt/invoice?view=doc-intel-4.0.0

[5] Amazon Textract, API Reference — https://docs.aws.amazon.com/textract/latest/APIReference

[6] Google Cloud Document AI, Processors list — https://docs.cloud.google.com/document-ai/docs/processors-list

[7] Google Cloud Document AI, File types — https://docs.cloud.google.com/document-ai/docs/file-types?hl=en

[8] Amazon Textract, Document limits — https://docs.aws.amazon.com/textract/latest/dg/limits-document.html

[9] Google Cloud Document AI, Document AI overview — https://docs.cloud.google.com/document-ai/docs/overview?hl=en

[10] Google Cloud Document AI, File types — https://docs.cloud.google.com/document-ai/docs/file-types?hl=en

[11] Amazon Textract FAQs — https://aws.amazon.com/textract/faqs

[12] Microsoft Azure AI Document Intelligence, Layout model — https://learn.microsoft.com/en-us/azure/ai-services/document-intelligence/prebuilt/layout?view=doc-intel-4.0.0

[13] Microsoft Azure AI Document Intelligence, OCR language support — https://learn.microsoft.com/en-us/azure/ai-services/document-intelligence/language-support/ocr?view=doc-intel-4.0.0

반응형