Home / Work / OCR 파이프라인

Anchor case · AI · 데이터

문서 등록 자동화 — OCR 파싱 파이프라인

다양한 양식의 문서를 담당자가 수기로 시스템에 등록하던 업무를, 수신→인식→검증→등록을 잇는 자동 파이프라인으로 전환했습니다. 규칙 기반을 핵심 경로로 두고 머신러닝으로 필드 판별을 보조하되, 전 건 사람 최종 검증을 유지해 품질을 담보했습니다.

역할
기획 · 구현 · 운영 (단독)
기간
약 1년+ (운영 지속)
핵심 성과
건당 30분 → 2분
대외 인정
그룹 어워드 (상위권)

문제

거래 문서는 발신처마다 양식·레이아웃이 제각각이었습니다. 담당자는 문서를 열어 필요한 항목을 눈으로 찾아 시스템에 하나씩 수기 입력했고, 이 과정에서 세 가지 비용이 발생했습니다.

접근

“전부 AI로 읽는다”가 아니라, 규칙 기반을 뼈대로 두고 ML은 애매한 필드 판별을 보조하는 하이브리드로 설계했습니다. 정형 구간은 규칙으로 정확하고 예측 가능하게, 비정형·변동 구간만 학습 모델이 거들게 해 안정성과 유지보수성을 확보했습니다. 그리고 자동 등록 뒤에 사람 최종 검증 단계를 남겨, 자동화가 판단을 대체하지 않고 담당자의 30분 수작업을 2분 검증으로 축소하도록 했습니다.

동작 방식

수신 · 수집

들어온 문서를 파이프라인 입력으로 표준화.

전처리

OpenCV로 기울기 보정·노이즈 제거 등 인식 품질을 끌어올림.

텍스트 인식 (OCR)

문자 블록을 추출.

구조 파악

networkx로 텍스트 블록의 공간 위치관계를 그래프화해 “어떤 값이 어떤 항목인지”의 레이아웃 맥락을 잡음.

필드 판별 (ML 보조)

앙상블(RandomForest·XGBoost·LightGBM)로 필드 후보를 분류.

후처리 · 검증

CRF와 규칙 파서로 값 정합성을 보정·검증.

등록 · 사람 검증

시스템에 자동 등록하되 전 건 사람 최종 확인으로 품질 확정.

설계 원칙 — 핵심 경로는 규칙(예측 가능), ML은 보조(변동 흡수), 최종 판단은 사람. 세 층으로 “빠르되 틀리지 않는” 자동화를 만들었습니다.

구조 한눈에

Pipeline — 수신부터 등록까지

수신 · 표준화문서 입력
전처리 · OCR보정 → 텍스트 추출
공간 그래프블록 위치관계 파악
필드 판별ML 앙상블 보조
정합성 검증규칙 보정·검사
등록 + 사람 검증전 건 최종 확인

3 Layers — 역할 분리

규칙 기반핵심 경로 — 예측 가능
ML 앙상블보조 — 변동 흡수
사람최종 판단 — 품질 확정

※ 익명화·단순화한 개념도입니다. 상세 구성은 대화 시 설명 가능합니다.

기술

OpenCVOCRnetworkx RandomForestXGBoostLightGBM CRFRule-based parserPython

※ 규칙 기반이 핵심 경로이고 ML은 필드 판별 보조입니다.

성과

30분 → 2분
건당 처리시간(사람 역할이 입력→검증으로 축소)
월 약 70시간
해당 업무 절감(자체 산정)
그룹 어워드
글로벌 엔지니어링 어워드 (상위권)

수치는 자체 산정 기준이며 산정 근거·상세는 대화 시 검증 가능합니다.

배운 점

← 전체 프로젝트 다음: 전사 RPA 자동화 →