Research on Structure-Guided Emotion-Aware 3D Talking Head Synthesis and Cross-Lingual Generalization
이공학학술연구기반구축(R&D) · 기본연구B(포용형)
2026년
2340064523
교육부
한국연구재단
숭실대학교산학협력단
소재현
1명
2026.09.01 ~ 2027.02.28
2026.09.01 ~ 2029.08.31
3,000만원
3,000만원
기초연구
대학
서울특별시 동작구
정보/통신 > 정보이론 > 인공지능
... 단방향 감정 주입에 머물렀던 기존의 한계를 넘어 검증 루프가 생성 결과의 감정 불일치를 능동적으로 교정하도록 설계한다. 궁극적으로 이 통합 프레임워크를 통해 언어 장벽을 허물고 다문화 가정이나 고령층 등 정보 소외 계층과 정서적으로 깊이 교감할 수 있는 차세대 포용형(Inclusive) 디지털 휴먼 원천 기술을 확보하여 실질적인 사회적 포용 가치를 실현한다.
본 연구는 4단계의 연차별 목표를 통해 다국어 일반화 및 감정 인지형 3D 토킹 헤드 프레임워크를 완성한다. 1차년도에는 사전 학습된 3D 얼굴 정렬 모델의 랜드마크를 3D 가우시안 스플래팅(3DGS)의 위상학적 고정 앵커로 주입하는 구조적 특징 융합(SGF) 메커니즘을 설계하여 기하학적 붕괴를 차단하고, 다국어 입력 시 발생하는 품질 열화(OOD)를 정량...
본 연구의 성과는 학술적 패러다임 전환과 산업적 서비스 확산, 그리고 기술 생태계 조성을 위해 다각도로 활용된다. 우선 기존의 단방향 조건부 생성 방식을 넘어 '생성-검증-피드백'으로 ... 붕괴와 다국어 입력 시의 품질 열화를 구조적 제약과 검증 루프로 해결함으로써 감성 인지형 디지털 휴먼 기술의 신뢰성을 확보한다. 경제·산업적 측면에서는 단일 모델의 다국어 처리 능력을 통해 ...