AI 안전 다이제스트

2026-02-18 · 6건

🇪🇺 OECD, EU AI 협력 계획 이행 현황 분석 (2026.2.18)

K-AISI 주간동향 · OECD · ⚖️

OECD는 EU 회원국들이 'AI 협력 계획'을 어떻게 이행하고 있는지 분석한 보고서 발간. AI 투자 확대, 데이터 공유 생태계 조성, 중소기업의 AI 도입 지원, 관련 기술 인력 양성 등 정책적 진전 사항을 다루며, 특히 신뢰할 수 있는 AI 환경 구축을 위한 규제 샌드박스 운영과 공공 부문의 AI 활용 사례를 공유하고, 유럽 내 AI 혁신과 안전성 사이의 균형을 맞추기 위한 국가 간 협력 방안을 제시.

UN 사무총장, 개발도상국 AI 지원을 위한 30억 달러 펀드 조성 촉구 (2026.2.18)

K-AISI 주간동향 · UN · 📜

안토니오 구테흐스 UN 사무총장은 인도 AI 임팩트 서밋에서 개발도상국의 AI 기술 및 컴퓨팅 접근성을 높이기 위해 30억 달러 규모의 펀드 조성을 제안. AI 혜택이 일부 소수 국가나 억만장자에게 독점되는 것을 방지하고, 모두를 위한 기술 발전과 데이터 생태계의 포용적 성장을 지원해야 한다고 강조.

🇬🇧 영국 AISI·ElevenLabs, 음성 AI 안전 연구를 위한 파트너십 체결 (2026.2.18)

K-AISI 주간동향 · ElevenLabs · 🤖

영국 AI 보안 연구소(AISI)는 ElevenLabs와 대규모 음성 AI 기술이 사회와 안보에 미치는 영향을 연구하기 위한 3년 파트너십을 체결. 대중이 AI 에이전트와 인간의 목소리를 얼마나 잘 구별하는지, 그리고 상대가 AI임을 인지했을 때 행동이 어떻게 변하는지 분석하여 안전 기준을 마련할 예정.

🇫🇷🇯🇵 제미나이, 음악 생성 기능으로 새로운 자기표현 지원 (2026.2.18)

기업 · 구글 딥마인드 · 🚀

구글 딥마인드는 생성형 음악 모델 Lyria 3를 제미나이 앱에 베타로 출시해 사용자가 텍스트나 사진·영상을 바탕으로 가사와 악기 연주가 포함된 30초 음악을 만들 수 있도록 했다. 생성된 음악에는 구글 AI 콘텐츠 식별을 위한 보이지 않는 워터마크 SynthID가 삽입되며, 사용자는 파일을 업로드해 SynthID 기반 AI 생성 여부를 확인할 수 있다. 이 기능은 18세 이상 사용자를 대상으로 영어·독일어·스페인어·프랑스어·힌디어·일본어·한국어·포르투갈어로 데스크톱에서 제공되고, 모바일 앱에는 며칠 내 순차 적용되며 구독자는 더 높은 사용 한도를 이용할 수 있다.

EVMbench로 스마트컨트랙트 취약점 관리 평가(2026.2.18)

DB · AI-Risk-Explorer · 🔒

본문 내용 확인 필요: OpenAI가 EVMbench를 통해 어떤 지표·절차로 스마트컨트랙트 취약점 관리(탐지/대응/완화 등)를 평가하는지, 적용 범위와 사용 방법은 본문 확인이 필요합니다. 또한 기존 도구 대비 차별점과 실험 결과(있다면)도 페이지 본문을 확인해야 정확히 요약할 수 있습니다.

(2026.2.18) 실사용 AI 에이전트 자율성 측정: Claude Code는 더 오래 실행되고, 숙련자는 더 자주 자동승인하지만 더 자주 중단도 함

DB · 앤트로픽(Anthropic) · 🤖🚀

앤트로픽은 Claude Code와 공개 API에서 수백만 건의 인간-에이전트 상호작용을 분석해 사람들이 에이전트에 어느 정도 자율성을 부여하는지, 경험이 쌓일수록 어떻게 바뀌는지, 어떤 도메인에서 위험한 행동이 나타나는지 살폈다. 그 결과 Claude Code는 중단되기 전 실행 시간이 3개월 사이 최장 구간에서 거의 2배로 늘었고(99.9퍼센타일이 25분 미만→45분 초과), 모델 릴리스에 따라 급격히 튀기보다는 완만하게 증가하는 양상이었다. 또한 숙련 사용자는 자동승인 비율이 20%대에서 40%대로 상승하는 반면, 실행 중 사용자가 개입(인터럽트)하는 비율도 5%→약 9%로 증가해 감독 방식이 ‘사전 승인’에서 ‘필요 시 중단’으로 이동하는 것으로 해석했다.