AI 안전 다이제스트

2022-02-15 · 1건

대형 생성 모델의 예측 가능성과 예측 불가능성: 정책적 함의 (2022.2.15)

기업 · Anthropic Research

대형 생성 모델은 일반적으로 유용한 기능을 예측 가능하게 보여주지만, 구체적인 입력과 출력은 예측하기 어려워 모델 배포의 결과를 예측하기 힘들게 만든다. 이 연구는 이러한 모델의 예측 가능성과 예측 불가능성의 조합이 사회적으로 해로운 행동을 초래할 수 있음을 예시와 실험을 통해 설명하며, 개발자들이 모델을 배포하는 동기와 그 과정에서 직면하는 도전들을 분석한다. 또한 AI 커뮤니티가 이러한 모델의 긍정적인 영향을 증대시키기 위한 개입 방안을 제시한다.