AI 안전 다이제스트

2026-03-26 · 21건

🇬🇧 AI 에이전트가 MCP 도구 177,436개를 통해 어떻게 쓰이는지 분석(2026.3.26)

공공 · AISI-UK · 🔬🤖

AI 에이전트 도구 177,436개(2024년 11월~2026년 2월)를 공개 Model Context Protocol(MCP) 서버 저장소를 모니터링해 분류한 내용이다. 도구는 데이터 접근·읽기(인식), 분석(추론), 파일 편집·이메일 발송·물리 세계 조종 등 외부 환경 수정(행동)으로 나누었으며, O*NET 매핑으로 작업 도메인과 파급가능성을 식별했다. 전체 도구의 67%가 소프트웨어 개발 용도이고, MCP 서버 다운로드의 90%가 이를 차지했으며, 표본 16개월 동안 ‘행동’ 도구 사용 비중은 27%에서 65%로 증가했다. 정부·규제기관이 모델 출력뿐 아니라 ‘도구 계층’까지 감시해 에이전트 배치 위험을 모니터링할 수 있다고 제안했다.

🇬🇧 영국 정부, 딥페이크 탐지 기술 시장 분석 및 성장 잠재력 보고서 발행 (2026.3.26)

K-AISI 주간동향 · GOV.UK · 📏🎭

영국 과학혁신기술부(DSIT)는 AI 생성 조작 미디어의 위협에 대응하기 위해 영국 내 딥페이크 탐지 시장의 현황과 과제를 분석한 심층 보고서를 발표. 사이버 범죄 예방을 위한 수요 증가에도 불구하고 규제 불확실성, 높은 기술 비용, 학습 데이터 부족 등이 장벽으로 작용하고 있어 표준화 및 정책적 개입이 필요함을 지적.

🇺🇸 미 하원의원, 'AI 파운데이션 모델 투명성 법안' 발의 (2026.3.26)

K-AISI 주간동향 · Congressman Don Beyer · ⚖️🗳️

미국 하원의원들은 소속 정당을 넘어 AI 파운데이션 모델의 구축, 훈련, 배포 방식에 대한 투명성 의무를 규정하는 법안을 발의. 고위험 파운데이션 모델 제공자가 훈련 데이터의 출처, 훈련 메커니즘, 사용자 데이터 수집 여부 등의 정보를 대중과 연방거래위원회(FTC)에 공개하도록 의무화.

Gemini 3.1 Flash Live, 실시간 음성 대화의 자연스러움·정확도·지연 개선 (2026.3.26)

기업 · DeepMind · 🎭

Gemini Live API(프리뷰)·Gemini Enterprise for Customer Experience·Search Live 및 Gemini Live에서 제공(시작일: 2026.3.26)

Gemini 3.1 Flash Live는 구글의 최신 실시간 음성·오디오 모델로, 음성 상호작용의 정밀도와 지연을 낮춰 더 자연스럽고 신뢰도 높은 대화를 목표로 한다. 개발자는 Gemini Live API(프리뷰)와 Google AI Studio를 통해, 기업은 고객경험용 Gemini Enterprise로, 일반 사용자는 Search Live와 Gemini Live로 이용할 수 있다. 또한 3.1 Flash Live 오디오에는 SynthID 워터마크가 적용돼 AI 생성 콘텐츠를 탐지해 허위정보 확산을 줄이는 데 활용된다.

🇬🇧🇺🇸 AI의 유해한 조작(사람의 생각·행동을 부정적·기만적으로 바꾸는 행위) 위험을 측정·평가하는 툴킷 공개 (2026.3.26)

기업 · DeepMind

유해 조작 평가를 위한 Frontier Safety Framework 내 Harmful Manipulation Critical Capability Level(CCL) 도입 및 Gemini 3 Pro 등 모델 평가에 활용 예정

DeepMind는 AI가 유해한 조작에 악용될 가능성(사람의 신념과 행동을 부정적·기만적으로 변화시키는 능력)을 다루는 새로운 연구 결과를 공개했다. 영국·미국·인도에서 1만 명이 넘는 참여자를 대상으로 9개 연구를 수행했으며, 금융(투자 시나리오)과 건강(식이보충제 선호) 등 고위험 영역에서 AI의 영향력을 측정했다. 또한 유해 조작의 ‘성공률(효능)’과 ‘시도 성향(얼마나 자주 조작을 시도하는지)’을 함께 평가하는 실증 기반 툴킷을 공개하고, 특정 영역에서의 성공이 다른 영역의 성공을 보장하지는 않는다고 밝혔다.

Gemini 3.1 Flash Live, 더 자연스럽고 안정적인 음성 AI 구현 (2026.3.26)

기업 · 구글 딥마인드 · 🎭

구글이 실시간 대화용 음성 모델 Gemini 3.1 Flash Live를 공개했으며, 음성의 자연스러움·응답 속도·억양 이해와 복잡한 작업 수행 능력을 개선했다고 밝혔다. 개발자는 Google AI Studio의 Gemini Live API, 기업은 Gemini Enterprise for Customer Experience를 통해 이용할 수 있고, 일반 사용자는 Gemini Live와 Search Live에서 사용할 수 있다. ComplexFuncBench Audio에서 90.8%, Audio MultiChallenge에서 사고 기능을 켠 상태로 36.1%를 기록했으며, Search Live는 200개국 이상으로 확대됐다. 모델이 생성하는 모든 오디오는 SynthID 워터마크가 적용돼 AI 생성 음성 식별과 허위정보 확산 방지를 지원한다.

🇪🇺 유럽 집행위, 디지털서비스법(DSA)상 아동 보호 의무 준수 여부로 스냅챗 조사 착수 (2026.3.26)

공공 · EU-Digital-Strategy · 🧒

유럽 집행위원회는 스냅챗이 디지털서비스법(DSA)에 따라 아동의 온라인 안전·프라이버시·보안을 충분히 보장하는지 여부를 확인하기 위해 공식 절차를 개시했다. 집행위는 스냅챗이 미성년자를 대상으로 한 그루밍 시도 및 범죄 목적 모집, 마약 등 불법 상품 판매 정보, 베이프·주류 등 연령 제한 상품 정보에 노출했을 가능성이 DSA 위반에 해당할 수 있다고 본다. 조사는 5개 분야를 중심으로 진행된다.

🇪🇺 유럽 집행위, Pornhub·Stripchat·XNXX·XVideos가 DSA상 미성년자 보호 의무를 위반한 것으로 예비 판단 (2026.3.26)

공공 · EU-Digital-Strategy · 🧒

유럽 집행위는 Pornhub, Stripchat, XNXX, XVideos가 서비스 내에서 포르노 콘텐츠에 미성년자가 노출되지 않도록 보호하지 못해 디지털서비스법(DSA)을 위반한 것으로 예비 판단했다. 해당 플랫폼들은 방어권 행사에 따라 집행위 조사 파일의 문서를 열람하고, 집행위의 예비 판단에 대해 서면으로 답변할 수 있다.

🇪🇺 반도체법(Chips Act) 이행 논의(2026.3.26)

공공 · EU-Digital-Strategy

EU 집행위는 2026년 봄 ‘Chips Act 2.0’(기술 주권 패키지 일부) 채택을 준비 중이며, 이번 논의 결과는 향후 개혁 준비에 반영될 예정

헨나 비르쿠넨(기술 주권·안보·민주주의 담당 집행위원)이 반도체 가치사슬 전반의 업계 리더 및 고위 이해관계자들과 함께 Chips Act 이행을 논의하는 ‘이행 대화’를 주재했다. 회의에서는 Chips Act 개정과 관련해 개선·추가·단순화 방안이 논의됐고, 업계는 산업자문그룹(Industry Advisory Group)이 작성한 보고서를 제시했다. 보고서는 Chips Act 개정이 유럽의 경제 안보·경쟁력·기술 주권을 강화할 기회이며, 수요 촉진과 전 가치사슬의 회복력 강화, 투자·혁신·스케일업 여건 개선을 위한 더 넓고 야심찬 전략 프레임워크가 필요하다고 강조한다. 또한 ASM, ASML, 인피니온, ST마이크로일렉트로닉스 등 다수의 산업 주체가 보고서를 지지했다.

🇪🇺 유럽의회, AI법 일부 고위험 규정 적용 시점 연기 및 ‘누디파이어’ 앱 금지 추진 (2026.3.26)

공공 · 유럽의회(European Parliament) · ⚖️📋

유럽의회는 고위험 AI 규정 적용일을 2027.12.2(규정에 특정 열거된 고위험) 및 2028.8.2(EU 부문별 안전·시장감시 적용 대상)로 제안했으며, 워터마킹 준수는 2026.11.2까지로 제시

유럽의회는 인공지능법(AIA) 간소화(옴니버스) 개정안에 대해 찬성 569표로 의회 입장을 채택했다. 개정안은 고위험 AI 시스템 관련 일부 규정의 적용 시점을 연기해 기업이 이행을 위한 지침과 표준을 준비할 시간을 확보하도록 하며, 적용일을 고정해 예측 가능성과 법적 확실성을 높이려는 내용을 담고 있다. 또한 동의 없이 특정 실존 인물을 닮게 성적으로 노골적·친밀한 이미지를 생성·조작하는 ‘누디파이어’ 시스템에 대한 금지 도입을 추진하되, 효과적인 안전조치로 사용자의 생성이 차단되는 경우는 예외로 두는 방안을 제시했다.

🇺🇸 (2026.3.26) 최전선 AI 기업 채용공고 분석: 판매·배포 인력 급증과 하드웨어/로봇 등 신제품 단서

공공 · Epoch AI(에포크 AI) 뉴스레터 · 🚀

Epoch AI는 OpenAI·Anthropic·xAI·Google DeepMind의 공개 채용을 분석해, 지난 1년간 판매/고객 배포(go-to-market) 관련 채용 비중이 크게 늘었다고 밝혔다. 또한 OpenAI와 DeepMind는 하드웨어(소비자 기기, XR 안경)와 로봇 분야 채용이 두드러지며, Anthropic은 기존 핵심 제품 개선과 함께 데이터센터·컴퓨트 확보를 위한 역할에 더 집중하는 양상이 나타난다고 설명했다. 컴퓨트/데이터 확보 방식에서는 OpenAI가 자체 칩 개발 관련 역할이 있는 반면, Anthropic은 외부 파트너와의 데이터센터 설계·구축 및 계약 협상 역할이 상대적으로 많다고 정리했다.

🇺🇸 METR, Anthropic 내부 에이전트 모니터링 시스템 레드팀 평가 (2026.3.26)

공공 · METR · 🔒🧪🚀

METR의 연구원 David Rein은 Anthropic과 협력하여 3주간 Anthropic의 에이전트 모니터링 및 보안 시스템에 대한 레드팀 평가를 수행했습니다. 이 평가는 Opus 4.6 사보티지 위험 보고서에 언급된 시스템의 일부를 포함하며, 새로운 취약점들을 발견하여 일부는 이미 수정되었습니다. 평가 결과는 보고서 형태로 Anthropic에 공유되었으며, METR 내부 직원들에게는 적색 처리된 버전이 공유되었습니다. 이 연구는 외부 연구자의 적대적 테스트의 가치를 보여주며, 향후 METR 위험 보고서에 더 자세한 내용을 포함하는 방안을 모색 중입니다. 관심 있는 AI 개발자는 파트너십 문의를 통해 참여할 수 있습니다. (연락처: partnerships@metr.org)

Ethical AI Governance Fellowship(2026.3.26)

공공 · globethics.net · 📜

마감일: 2026.4.16 (지원 마감), 제네바 레지던시 2026.7.6~7.10

Globethics의 Emerging Leaders in Ethical AI Governance Fellowship은 윤리적·포용적·가치 기반 AI 거버넌스를 주도할 초기 경력(24~35세) 전문가를 위한 국제 펠로십이다. 제네바에서 1주 체류(2026.7.6~7.10)하며 AI for Good Global Summit 참여, AI 윤리·거버넌스 및 상호문화/종교 거버넌스 관련 멘토링, 외부 파트너와의 발표·출판 기회 등이 제공된다. 지원은 2026.3.26부터 4.16까지이며, 1단계(필수) 후 2단계는 상위 5명에게 프로젝트 실행을 위한 시드 펀딩과 추가 멘토링 등이 제공된다.

🇬🇧 (Defining and Governing Unacceptable AI Risks - The Future Society) 2026.3.26

공공 · thefuturesociety.org · 🛡️🧒

런던에서 열린 ‘제7회 아테네 라운드테이블(2025년 12월)’의 비공개 대화에서 76명의 전문가가 ‘운영 가능한 AI 레드 라인(금지·제한 대상)’을 논의했다. 대화에서는 대규모 조작·심리적 착취(특히 아동 관련), 고도 AI의 통제 상실, CBRN 위협, 사이버 공격 역량, 중요 인프라의 자율적 통제, 치명적 자율무기 및 긴장·확대(에스컬레이션) 역학, 인권·사법 전반의 위험 등 주요 위험 군집을 제시했다. 레드 라인을 실제로 적용하려면 국제법과 법치 원칙에 기반해 관할을 넘어 평가·검증 가능한 기술적 기준과 검증 메커니즘, 다자 표준 및 지속적 프로세스가 필요하며, 합의된 안전 한계를 입증하지 못하는 시스템은 개발·배치되어서는 안 된다는 점에 의견이 모였다.

Serious AI Incident Prevention & Preparedness - Athens 2025 Report (2026.3.26)

공공 · thefuturesociety.org · 🚨

본문은 PDF 메타데이터와 페이지 구조 정보(제목, 제작자/생성일, 페이지 객체 등) 중심으로 추출되어 실제 보고서의 핵심 내용(정책·권고사항·결론 등)은 확인되지 않습니다. 문서 제목은 “Serious AI Incident Prevention & Preparedness - Athens 2025 Report”이며, 제작은 Canva로 표시됩니다.

🇺🇸🇪🇺 네덜란드 법원, X와 AI 챗봇 ‘그록’에 비동의 성적 이미지·아동성착취물 생성 중단 명령(2026.3.26)

언론 · Tech Policy Press · 🧒🚀

네덜란드 암스테르담 지방법원은 판결 송달 후 10영업일 내 이행 확인서를 제출하라고 명령했으며, 위반 시 당사자별 하루 10만 유로의 제재금이 부과됨

네덜란드 법원이 X와 AI 이미지 생성 기능 ‘그록(Grok)’에 대해 비동의 성적 이미지(‘undressing’ 기능 포함)와 아동성착취물 생성을 즉시 중단하라고 명령했다. 법원은 xAI(그록 운영 주체)가 네덜란드 거주자의 명시적 동의 없이 성적 이미지를 생성·배포하지 못하게 하고, 아동성착취물에 해당하는 콘텐츠의 생산·배포·공개 표시도 금지했다. 또한 xAI가 사용자 프롬프트 책임을 주장하며 면책될 수 없고, 모델 기능을 통제하는 플랫폼 운영자로서 불법 출력 방지 의무가 있다고 판단했으며, 이 사건은 EU 사법재판소의 ‘Russmedia’ 취지(플랫폼의 GDPR 공동관리자성)를 적용해 더 나아간다고 설명했다.

위키피디아, AI로 작성·재작성한 문서 편집을 금지(2026.3.26)

언론 · 더버지(theverge.com) · 📋

위키피디아는 편집자가 AI를 이용해 문서를 작성하거나 재작성하는 것을 더 이상 허용하지 않는다고 밝혔다. 이번 조치는 지난주 말 위키피디아 가이드라인에 추가됐으며, AI로 쓴 글이 여러 핵심 콘텐츠 정책을 위반할 가능성이 이유로 제시됐다. 다만 영어 위키피디아에서는 AI를 ‘기본 교정 제안’이나 다른 언어 위키피디아 문서의 영어 번역에 보조적으로 사용하는 일부 경우는 허용하되, 번역 정확성 확인 등 규정 준수는 편집자 책임으로 남는다.

(2026.3.26) 81,000명 사용자 인터뷰로 본 AI에 대한 기대와 우려

DB · 앤트로픽(Anthropic) · 🚀

앤트로픽은 2025년 12월 한 주 동안 Claude.ai 계정 사용자들을 대상으로 AI에 대한 희망과 우려를 듣는 대규모 정성 인터뷰(총 80,508명, 159개국·70개 언어)를 진행했다고 밝혔다. 응답은 Claude 기반 분류기로 정리했으며, 가장 큰 기대는 AI가 일상 업무를 처리해 전략적·고부가가치 업무에 집중하게 해주는 ‘전문 역량 향상(19%)’이었다. 한편 일부 응답자들은 AI로 인한 일자리 대체, 개인의 사고·독립 능력 저하에 대한 우려도 함께 드러났으며, 희망과 우려는 사람들 사이에서 양분되기보다 한 개인 안에서 공존하는 양상으로 나타났다고 설명했다.

🇰🇷

공공

출처: 소프트웨어정책연구소(SPRi)

AI 스마트 글래스는 사용자의 시선과 주변 환경을 AI가 실시간 인식·해석해 디지털 정보와 현실을 연결하는 차세대 컴퓨팅 인터페이스로 소개된다. 시장은 메타·삼성·구글 등 빅테크의 생태계 경쟁과 중국 기업의 제조 기반 진입 확대가 진행 중이며, 음성 중심 제품에서 디스플레이 탑재형으로 발전이 예상된다고 본다. 다만 배터리·경량화·시야각 등 기술 과제와 함께 개인정보 보호, 디지털 격차 심화, 사회적 수용성 확보가 필요해 정책적 균형이 중요하다고 강조한다.