AI 안전 다이제스트

2023-03-08 · 1건

🇺🇸 Anthropic의 AI 안전성 핵심 견해: 시기, 이유, 내용, 방법 (2023.3.8)

기업 · Anthropic

Anthropic는 AI의 영향이 산업 및 과학 혁명과 맞먹을 수 있으나, 긍정적인 결과가 보장되지 않는다고 믿습니다. 가까운 미래, 특히 이번 십 년 내에 이러한 수준의 영향이 시작될 가능성이 높다고 보고 있습니다.

AI 안전성 연구의 긴급성과 다양한 이해관계자들의 지원 필요성을 강조하며, 그들은 안전한 AI 시스템 구축을 위한 다차원적이고 경험적 기반 접근법에 가장 낙관적입니다. 특히 스케일링 슈퍼비전, 메커니즘 해석력, 프로세스 지향 학습, 그리고 AI 시스템의 학습 및 일반화 방식 이해에 집중하고 있습니다.

AI 발전이 예측 가능한 이유는 훈련 데이터, 계산 능력, 그리고 개선된 알고리즘 때문입니다. 최근의 스케일링 법칙은 더 많은 계산을 통해 AI 성능이 예측 가능하게 향상된다는 것을 보여주며, 이는 AI 시스템이 인간 수준의 성능을 달성할 가능성을 시사합니다. 그러나 이러한 발전은 사회적 혼란을 초래하고 경쟁적인 활동을 유발할 수 있어 안전성이 중요한 이슈로 떠오릅니다.

AI 안전 위험은 두 가지 주요 이유로 우려됩니다: 고도화된 AI 시스템이 설계자보다 더 지능적이고 자기 인식이 높아질 경우 안전하고 제어 가능한 시스템 구축이 어려울 수 있으며, 빠른 AI 발전은 경제적, 사회적 혼란을 일으켜 안전한 AI 개발을 더욱 어렵게 만들 수 있습니다.

Anthropic는 경험적 근거를 기반으로 한 AI 안전성 연구를 추진하며, 특히 고도화된 모델에 대한 안전성 연구의 중요성을 강조하고 있습니다. 이 접근법은 예측 가능한 문제와 예측 불가능한 문제 모두에 대비하기 위한 것입니다.