AI 안전 다이제스트

2025-03-24 · 1건

🇬🇧 Adversarial machine learning: 공격·완화 개념을 분류하고 용어를 정리(2025.3.24)

공공 · AISI-UK · 📜🔬

AI의 adversarial machine learning(AML) 분야에 대해 NIST Trustworthy and Responsible AI 보고서 형식으로 개념 분류 체계(attack 단계, 공격자 목표·역량·지식 등)와 용어를 정리한 글이다. ML 방법의 주요 유형과 AI 시스템 생애주기 전반에서의 공격 시나리오를 계층 구조로 제시하고, 공격의 결과를 줄이기 위한 완화·관리 방법과 함께 현재의 도전 과제도 다룬다. 보고서의 용어는 AML 관련 기존 문헌과 일치하며, AI 시스템 보안 관련 주요 용어 글로서리를 포함해 공통 언어를 제공하는 것을 목표로 한다.