AI 안전 다이제스트

2025-05-02 · 2건

🇬🇧 메커니즘 해석가능성(MI)에서 ‘좋은 설명’을 평가·개선하기 위한 설명의 덕목(Explanatory Virtues) 프레임워크 제안 (**2025.05.02**)

공공 · AISI-UK · 🔬🧪

MI는 신경망을 인과적(causal) 설명으로 이해하는 것을 목표로 하며, 설명 생성 방법은 많지만 설명을 평가하는 보편적 기준이 부족하다는 문제를 제기한다. 이를 해결하기 위해 과학철학의 네 관점(Bayesian, Kuhnian, Deutschian, Nomological)을 바탕으로 ‘설명의 덕목 프레임워크’를 제안하고, 설명을 체계적으로 평가·개선하는 방법을 제시한다. 연구에서는 Compact Proofs가 여러 설명 덕목을 폭넓게 다룬다는 점에서 유망하다고 결론내리며, 설명의 단순성 정의, 설명의 통합, 신경망에 대한 보편 원칙 도출 등을 후속 연구 방향으로 제시한다.

🇪🇺 EU 회원국의 인공지능 규제 샌드박스 접근 방식 개요 (2025.5.2)

공공 · EU 인공지능법 · ⚖️📋

EU 인공지능법에 따라 각 회원국은 2026년 8월 2일까지 최소 하나의 인공지능 규제 샌드박스를 설치해야 하며, 회원국별로 중앙집중형·분산형 등 다양한 방식이 추진되고 있다. 샌드박스는 출시 전 인공지능 시스템을 규제기관의 guidance 아래 개발·시험하는 환경으로, 참여 기업은 준수 입증 자료를 확보하고 지침을 성실히 따르면 행정벌금 면제 혜택을 받을 수 있지만 실험으로 인한 제3자 피해 책임은 유지된다. EU는 EUSAiR, Testing and Experimentation Facilities(TEFs), European Digital Innovation Hubs(EDIHs) 등을 통해 특히 중소기업과 스타트업의 기술·법률 지원 및 시장 진입을 돕고 있다.