Vision-Language Model for OCR Error Detection in Industrial Handwritten Documents based on Visual Noise and Contextual Information
이공학학술연구기반구축(R&D) · 석사과정생연구장려금지원
2026년
2340066090
교육부
한국연구재단
경상국립대학교
한지우
1명
2026.09.01 ~ 2027.08.31
2026.09.01 ~ 2027.08.31
1,200만원
1,200만원
기초연구
대학
경상남도 진주시
정보/통신 > 정보이론 > 인공지능
... 생생한 경험 지식과 장비의 유지보수 이력 등을 포함하는 핵심적인 정보 자산임. 이러한 비정형 데이터를 체계적인 지식 베이스로 전환하기 위해 OCR(Optical Character Recognition) 기술을 활용한 문서 디지털화가 활발히 수행되고 있음. 그러나 실제 산업현장에서는 흙탕물 튀김, 기름 얼룩, 문서의 구겨짐 및 찢어짐 등 예측 불가능한 시각적 간섭이 ...
[1. 산업현장 문서 데이터셋 및 Ground Truth 구축] 실제 산업현장에서 수집된 일일장비점검표 등 수기 작성 문서를 기반으로 실증적 연구를 수행함. 모델이 현장의 물리적 환경을 효과적으로 학습할 수 있도록, 원본 문서에 기름 얼룩, 흙탕물 튀김, 심한 구겨짐 및 찢어짐 등 다양한 시각적 간섭 요소들을 인위적으로 합성하여 대규모 학습 데이터를 증강함...
... 통해 개발되는 VLM 기반 OCR 오류 탐지 프레임워크는 다양한 산업 분야의 비정형 문서 디지털화 파이프라인에 핵심 요소 기술로 즉각 활용될 수 있음. 첫째, 현재 수작업 및 텍스트 중심 ... 시간 소모를 최소화함. 이는 궁극적으로 산업현장의 문서 전산화 비용을 대폭 절감하고, 고신뢰성 지식 데이터 기반의 성공적인 디지털 전환을 가속하는 강력한 경제적 파급효과를 창출함.