KAIST와 마이크로소프트연구소 아시아 공동연구진이 사람의 뇌파를 피드백으로 활용해 AI의 목표와 행동을 조정하는 신경 가치 정렬(NVA) 을 제안함 같은 행동에도 여러 목적이 있을 수 있다는 한계에 주목해, 겉으로 드러난 행동뿐 아니라 예상과 다른 결과나 상황을 마주했을 때 나타나는 뇌 반응을 활용함 보상 예측 오차(RPE)는 AI가 추정한 목표를 수정하는 데, 상태 예측 오차(SPE)는 목표에 도달하는 행동 방식을 수정하는 데 사용함 뇌파 실험에서는 두 오류 신호와 이들이 동시에 발생한 경우를 구별할 수 있음을 확인했으며, 시뮬레이션에서는 두 신호를 함께 사용할 때 사람의 목표 변화에 더 빠르게 적응함 말이나 몸짓으로 매번 교정하지 않아도 AI에 피드백을 전달하는 방법을 제시한 연구로, 피지컬 AI와 의료/재활 로봇 등으로의 활용 가능성을 제시함. 실제 현장에서의 효과까지 입증한 결과는 아님 행동만으로 알기 어려운 사람의 목표 사람이 컵을 집는 행동만으로는 직접 물을 마시려는지, 다른 사람에게 건네려는지 구분하기 어려움 반대로 같은 목표를 이루는 행동도 여러 가지일 수 있어, 행동을 관찰하는 것만으로 AI가 사람의 의도를 정확히 파악하기에는 한계가 있음 신경 가치 정렬(Neural Value Alignment, NVA) 은 사람이 예상과 다른 상황을 접했을 때 발생하는 뇌의 ‘예측 오차’를 추가 피드백으로 활용함 목표를 다시 찾을지, 방법을 바꿀지 구분 기존 피드백을 단순한 ‘맞음/틀림’으로 처리하는 대신, 두 종류의 예측 오차를 서로 다른 수정에 연결함 보상 예측 오차(RPE): 기대한 결과와 실제 결과의 차이를 반영하며, AI가 사용자의 목표를 다시 추정하는 데 활용 상태 예측 오차(SPE): 예상한 상황 변화와 실제 변화의 차이를 반영하며, AI의 행동 방식을 조정하는 데 활용 이를 통해 목표 자체를 잘못 이해한 경우와 목표로 향하는 과정이 기대와 다른 경우에 서로 다르게 대응하도록 함 뇌파 실험과 시뮬레이션에서 확인한 것 두 예측 오차를 분리해 관찰할 수 있도록 설계한 과제에서 뇌파(EEG) 를 기록하고, 각 신호와 두 신호가 동시에 나타난 경우를 구별할 수 있음을 확인함 딥러닝으로 뇌파 신호를 구분하고, 이를 AI의 목표 추정과 행동 수정에 연결하는 알고리듬을 제안함 시뮬레이션에서는 두 신호를 함께 활용한 방식이 한 종류의 신호만 쓰거나 관찰된 행동에만 의존하는 방식보다 목표 변화에 빠르게 적응함 ...
KAIST-MS, 뇌파로 ‘그게 아닌데’를 감지해 AI의 목표와 행동을 교정하는 연구 발표
3 weeks ago
20
Related
Strands Decider 2B - 소형 오픈소스 의사결정 모델
53 minutes ago
0
Tell HN: GitHub이 한 달이 지나도 제 소프트웨어의 크랙 복제본 삭제를 거부합니다
56 minutes ago
2
Penguin Mail - AI를 탑재한 Linux용 오픈소스 Rust 이메일 클라이언트
1 hour ago
3
Show GN: 이메일 피싱 모의훈련을 전화로 옮겼습니다. 예고 없는 전화
2 hours ago
3
토론토 기반 VPN 업체, 적법 접근 법안으로 캐나다 떠날 계획
3 hours ago
3
Claude Code의 메시지 제안 기능: 진짜 고객은 모델이라는 생각
3 hours ago
3
Show GN: 추천링크·UTM으로 오프라인 소개의 성과를 추적하는 구조
5 hours ago
3
Tips
click
Popular
프로들도 줄지어 샷 점검… KLPGA 스타 사랑방 된 더헤븐CC 연습장
2 weeks ago
73
iOS 27, iPadOS 27, macOS 27
3 weeks ago
69
손흥민 선제골 발판·골대 불운…LAFC, 7경기 만에 승리
3 weeks ago
65
영림원소프트랩, 나람 통합 ERP 구축…사료 제조·물류·회계 데이터 하나로
2 weeks ago
62
'이 악문' 김영범, 자유형 50m '대회 신기록' 금메달
2 weeks ago
55
© Clint IT 2026. All rights are reserved









English (US) ·