AI 안전 다이제스트

2025-03-07 · 1건

전문가와 협력하는 방법 학습 (2025.3.7)

공공 · 인간 호환 AI 센터(CHAI)

연구진은 자율적으로 행동할 때와 전문가의 도움을 요청할 때를 판단하는 전략을 학습하는 ‘통제 양보 및 요청 학습(YRC)’이라는 조정 문제를 제시했다. 다양한 분야를 아우르는 오픈소스 벤치마크와 새로운 검증 방법을 개발하고, 여러 환경에서 다양한 학습 방법의 성능을 조사해 향후 연구 방향을 제시했다.