AI 안전 다이제스트

2025-12-19 · 4건

공공영역 인공지능 기반 의사결정의 투명성·책임성 및 관리 체계 확립 방안 (2025.12.19)

공공 · 정보통신정책연구원

이 보고서는 공공영역의 인공지능 기반 의사결정 도입·활용 현황과 관련 정책·규제 동향, 윤리적·사회적·기술적 쟁점을 검토한다. 또한 설문조사와 문헌 논의를 바탕으로 기술 검증, 제도 정비, 조직역량 강화, 정책환경 대응 등 투명성과 책임성을 높이기 위한 관리 체계와 정책 방안을 제시한다.

AI 일상화 시대의 사이버 위협과 AI 사이버보안 확립 방안 (2025.12.19)

공공 · 정보통신정책연구원 · 📏🔒🎭

이 보고서는 침입탐지, 악성코드 탐지, 프라이버시 보존 딥러닝, 스팸 필터링, 인증 등 AI 기반 사이버보안 기술과 활용 사례를 분석했다. AI의 환각, 개인정보 유출, 윤리·신뢰성 문제와 함께 APT, 피싱, 딥페이크, 랜섬웨어 등 AI 악용 공격 및 적대적 공격·민감정보 유출 공격의 대응 방안을 검토했다. 연구개발 환경과 보안 데이터 생태계 구축, AI 보안 규제·표준화, 고위험 산업의 안정성 규제, 공공·민간 협력 강화를 국가 차원의 정책 방향으로 제시했다.

🇺🇸 Anthropic 연구팀, 자동 행동 평가 도구 Bloom 공개 (2025.12.19)

기업 · Anthropic-Research · 🚀

Anthropic 연구팀은 새로운 오픈 소스 도구 Bloom을 발표하여 최첨단 AI 모델의 행동 평가를 자동화했습니다. Bloom은 연구자가 지정한 행동을 자동으로 생성된 시나리오를 통해 빈도와 심각도를 측정합니다. 이 도구는 기존 수작업 평가 방법보다 훨씬 빠르고 확장 가능하며, 다양한 행동 특성에 대한 평가를 빠르게 수행할 수 있도록 설계되었습니다. 특히, Bloom은 16개의 최첨단 모델에 대해 네 가지 정렬 관련 행동(허위 동조, 장기적 방해 지시, 자기 보존, 자기 선호 편향)에 대한 벤치마크 결과를 포함하여 평가를 수행합니다. 이를 통해 연구자들은 AI 모델의 행동 특성을 효율적으로 측정할 수 있게 되었습니다. Bloom은 GitHub에서 공개되어 있습니다 ([github.com/safety-research/bloom](https://github.com/safety-research/bloom)).

🇪🇺 (2025.12.19) 유럽연합 집행위, AI Act 이행 지원 ‘AI Act Service Desk’와 ‘단일 정보 플랫폼’ 개시

공공 · 유럽연합 집행위원회(European Commission) 디지털 전략(Digital Strategy) · ⚖️📋

유럽연합 집행위원회는 AI Act의 원활하고 효과적인 이행을 지원하기 위해 ‘AI Act Service Desk’와 ‘AI Act Single Information Platform’을 개시했다. 단일 정보 플랫폼은 이해관계자가 AI Act 관련 정보를 한곳에서 확인하고 적용 방식과 맞춤형 이행 지침을 받을 수 있도록 설계됐으며, Compliance Checker·AI Act Explorer 등 디지털 도구와 FAQ·자료(회원국 제공 포함)를 제공한다. 또한 이해관계자는 온라인 양식을 통해 Service Desk에 AI Act 관련 질문을 제출할 수 있고, 플랫폼은 현재 3개 언어로 제공되다가 2026년 초 24개 공식 언어로 확대될 예정이다.