Brain-in-the-loop RL: Human-AI Strategic Alignment via EEG-based Belief Prediction Error
이공학학술연구기반구축(R&D) · 석사과정생연구장려금지원
2026년
2340066274
교육부
한국연구재단
한국과학기술원
정경윤
1명
2026.09.01 ~ 2027.08.31
2026.09.01 ~ 2027.08.31
1,200만원
1,200만원
개발연구
대학
대전광역시 유성구
뇌과학 > 뇌공학 > 뇌-기계 인터페이스
인간의 뇌파(EEG)에서 발생하는 믿음 예측 오류(Belief Prediction Error) 신호를 실시간으로 디코딩하여, AI 에이전트의 전략과 궤적을 인간의 의도에 맞게 조정하는 '신경 가치 정렬(Neural Value Alignment, NVA)' 프레임워크를 개발하는 것이 목표입니다. 이를 통해 AI 에이전트가 단순히 누적 보상만을 기계적으로 극대...
본 연구의 목적은 인간의 뇌파(EEG)에서 발생하는 예측 오류(PE) 신호를 실시간으로 디코딩하고, 이를 인공지능 모델의 강화학습 과정에 이식하여 인간과 AI가 전략적으로 동기화되는 '신경 가치 정렬(Neural Value Alignment)' 시스템을 구축하는 것입니다. 구체적인 연구 내용은 다음과 같은 두 단계로 구성됩니다.1. EEG 기반의 Belief ...
1. 활용 계획본 연구에서 개발된 증거 기반 학습(Evidential Learning) 뇌파 디코더 및 베이지안 최적화 기반의 전략 정렬 프레임워크 소스 코드를 GitHub를 통해 오픈소스로 배포할 예정입니다. 이를 통해 관련 분야 연구자들이 본 모델을 손쉽게 재현하고 발전시킬 수 있으리라 기대합니다.또한, Overcooked 환경에서 수집된 실시간 EEG...