🇺🇸 공동 헌법형 AI: 공공 입력을 통한 언어 모델 행동 지침 (2023.10.17)
앤서픽과 공동 지능 프로젝트는 약 1,000명의 미국인을 대상으로 공공 입력 프로세스를 진행하여 AI 시스템을 위한 헌법을 작성하는 실험을 진행했습니다. 이는 민주적 과정이 AI 개발에 어떻게 영향을 미칠 수 있는지 탐구하기 위함이었습니다. 실험 결과, 참가자들은 앤서픽 내부 헌법과 일부 일치하는 부분과 다른 선호도를 보인 부분이 있었습니다. 이 글에서는 공개적으로 수집된 헌법과 이를 기반으로 훈련된 새로운 AI 모델의 성능에 대한 내용을 공유합니다.
주요 내용 요약: - 앤서픽은 공공 참여 프로세스를 통해 AI 모델의 행동 지침을 민주적으로 설정하는 방법을 연구했습니다. - 약 1,000명의 참가자가 참여하여 1,127개의 진술과 38,252개의 투표를 통해 헌법을 작성했습니다. - 공개 헌법은 앤서픽 내부 헌법과 대략 50%의 개념과 가치를 공유하지만, 객관성, 접근성, 그리고 바람직한 행동을 촉진하는 데 더 중점을 두었습니다. - 공개 헌법을 기반으로 훈련된 모델은 기존 모델과 유사한 성능을 보였지만, 사회적 편향성이 감소하는 경향을 보였습니다. - 연구는 투명성을 높이기 위해 주관적인 판단 과정을 공개하였습니다.