Sold
Available
IBL-26-1249

표정 피드백을 이용하는 딥강화학습 기반 협력로봇 및 딥강화학습 방법

등록일
2026-09-01
로봇관련 기술 휴머노이드 제어/AI/SW
표정 피드백을 보상에 반영하는 딥강화학습 협력로봇

본 기술은 인간형 로봇의 비전 정보를 활용하여 사용자가 파지한 물체(테이블)의 기울기를 상태 이미지로부터 추정하고, 강화학습(DQN) 모델을 통해 최적의 균형 맞춤 동작을 결정 및 수행합니다. 이때, 사용자 얼굴 표정을 실시간으로 분석하여 얻은 감성 기반 표정 피드백 값을 환경 보상 값과 함께 강화학습 모델에 반영함으로써 학습 효율을 높이는 메커니즘을 가집니다.

기존의 리워드 쉐이핑 방식은 사람이 별도의 입력 장치를 통해 수동으로 피드백을 제공해야 하는 번거로움이 있고, 피드백 유형이 제한적이며, 에이전트 모델링 과정에서 고도의 전문 공학 지식이 요구되어 자연스러운 로봇 학습 환경 구현에 한계가 있습니다.

본 기술은 사용자의 얼굴 이미지를 촬영하여 표정 평가 모델을 통해 감성을 2차원 감성 공간에 매핑하고, 이를 기반으로 자동화된 표정 피드백 값을 생성합니다. 이 피드백 값을 사전 설정된 가중치를 거쳐 환경 보상 값과 합산한 후, DQN 모델의 Q 함수 오차를 최소화하도록 파라미터를 업데이트하는 인터액티브 딥강화학습 구조를 제안합니다.

Key Features:
  • 파지한 테이블의 상태 이미지와 사용자의 평가적 얼굴 이미지를 함께 촬영하는 카메라
  • 동작 결정 모델에 상태 이미지를 입력해 균형 맞춤 동작을 결정하고 얼굴 이미지 기반 표정 피드백 값을 반영해 강화학습시키는 협력로봇 제어 모듈
  • 결정된 균형 맞춤 동작에 따라 협력로봇을 실제로 구동시키는 협력로봇 구동 모듈
  • 평가적 얼굴 이미지에서 사용자의 감성을 추정하고 대응하는 표정 피드백 값을 출력하는 표정 피드백 출력부

경북대학교
강보영 | 전해인 | 강정훈
문서
출원일:
2022-10-13
|
특허등록번호:
10-2776109
산업
로봇•자동화
기술
로보틱스
인공지능
국가
Korea
패밀리 특허

N/A

제시 가격
가격협의
뉴스레터를 구독하시면 최신 특허 정보를 가장 빠르게 받아보실 수 있습니다.
← 목록으로 돌아가기