Fundamental Research on Vision-Language-Action Models for Human-Collaborative Physical AI Agents
집단연구지원(R&D) · 기초연구실 심화형
2026년
2710110449
과학기술정보통신부
한국연구재단
한국과학기술원
성영철
37명
2026.07.01 ~ 2027.06.30
2026.07.01 ~ 2029.06.30
5억원
5억원
기초연구
대학
대전광역시 유성구
정보/통신 > 정보이론 > 인공지능
[연구 개요]본 연구의 최종 목표는 인간과 협업하는 피지컬 인공지능 에이전트 구현을 위한 '고효율·실시간 반응형 시각-언어-행동(VLA) 통합 모델' 기술 개발이다. 인간과 로봇이 협업하는 일반적인 환경에서 드러나는 기존 VLA 모델의 주요 한계인 장기 계획 수립의 부재, 물리적 안전성 결여, 과도한 연산 비용 문제를 해결하기 위해, 인간의 언어적 지시와 ...
본 과제는 '인식-계획-제어-검증'의 로보틱스 전주기 체계를 기반으로 각 구성요소에 해당하는 4개 연구실의 다학제적 협력을 통해 '비전 및 환경 지각-능동적 협업 의사 결정-안전한 반응형 행동 제어-로봇 하드웨어'의 VLA 모델 기술을 개발한다. 과제 수행의 1차 연도에는 다중 모달 지각 기반 인간 의도 이해와 협업 계획 구조 확립, 2차 연도에는 외부 ...
... 등의 고난도 협업 작업을 수행하는 산업용 로봇, 사용자의 모호한 명령에도 맥락을 읽고 안전하게 가사 노동이나 간병 보조를 수행하는 개인용 비서 로봇 등 산업 환경으로 확장 가능하다. 모델 경량화 및 실증을 통해 클라우드 의존성 없는 엣지 인공지능 기술을 확보하여 로봇 운용 비용을 절감하고, 고부가가치 휴머노이드 로봇 시장에서의 글로벌 기술경쟁력을 선점한다.