AI 안전 다이제스트

2023-09-26 · 3건

🇺🇸 METR, Responsible Scaling Policies (RSPs) 소개 및 중요성 (2023.9.26)

공공 · METR

RSPs는 AI 개발자가 현재의 보호 조치로 안전하게 다룰 수 있는 AI 능력 수준을 명시하고, 보호 조치가 개선될 때까지 AI 시스템 배포를 중단해야 하는 조건을 설정하는 정책입니다. 이 정책은 위험을 크게 줄일 수 있으며, AI 위험에 대한 우려가 큰 집단과 그렇지 않은 집단 모두에게 호소력이 있습니다. RSPs는 구체적인 평가와 경험적 관찰을 기반으로 AI 개발의 게이트를 설정함으로써 위험을 관리하고, 필요한 경우 개발을 일시 중지하여 위험을 억제하는 데 중점을 둡니다. 이는 향후 평가 기반 규칙과 규범을 위한 시험대 역할도 합니다.

🇺🇸 METR의 책임 있는 확장 정책(RSP) 소개 (2023.9.26)

공공 · METR

METR은 책임 있는 확장 정책(RSP)의 개념과 중요성을 설명하며, 이러한 정책이 인공지능(AI) 개발 과정에서 안전성을 강화하는 데 어떻게 기여할 수 있는지 논의하고 있습니다. RSP는 AI 시스템의 위험한 기능이 나타나는 시점을 명확히 하여 확장을 중단하거나 보호 조치를 강화하는 기준을 제공합니다. 특히, AI의 위험한 기능이 정보 보안 강화와 거부 기능 구현 등 구체적인 보호 조치 없이는 안전하지 않다는 점을 강조하고 있습니다. 또한, RSP는 다양한 관점에서 이해되는 '책임 있는 확장'의 의미를 명확히 하며, AI 개발의 지속 가능성과 안전성 사이의 균형을 추구합니다. 이 정책은 극단적인 위험을 초래할 수 있는 AI 기능의 개발을 일시적으로 중단하거나 제한하는 데까지 이르며, 이는 AI 안전성 향상을 위한 중요한 단계로 여겨집니다.

🇺🇸 负责任扩展政策(RSP) - METR 연구: AI 개발의 안전한 확장 방안 탐색 (2023.9.26)

공공 · METR

본 문서는 책임 있는 확장 정책(RSP)의 개념과 필요성을 설명하며, 이를 통해 AI 개발 과정에서 발생할 수 있는 위험을 관리하고 평가하는 방법을 제시한다. RSP는 AI 시스템의 능력 확장에 대한 구체적인 한계와 필수적인 보호 조치를 명시하고, 위험 능력이 감지될 때의 적절한 반응 방안을 포함한다. 핵심 요소로는 위험 능력 한계 설정, 필요한 보호 조치 명시, 적시 위험 평가 프로세스, 위험 초과 시 개발 중단 의지, 그리고 책임성 확보 방안이 포함된다. 이러한 접근법은 AI 개발의 안전성을 높이고, 사회적으로 기반한 평가 규칙과 규범의 축적에 기여할 수 있다. 그러나 초기 평가 지표의 신뢰성과 의사소통의 명확성 유지가 중요한 과제로 남아 있다.