AI 안전 다이제스트

2026-04-16 · 17건

🇨🇳 Qwen3.6 35B-A3B (Alibaba/Qwen) (2026.4.16)

기업 · DemandSphere · 🚀

Reasoning · Open · 262K ctx

GPQA 86% · SWE 73.4% · MMLU 85.2% · AIME 92.7% · HLE 21.4%

MoE - 3B active / 35B total, 256 experts. Runs on a laptop. 73.4% SWE-bench Verified. Natively multimodal. Extensible to 1M context. Apache 2.0.

🇬🇧 영국 DSIT, 5억 파운드 규모 '소버린 AI' 지원 개시 (2026.4.16)

K-AISI 주간동향 · GOV.UK · 🛡️🏛️

영국 과학혁신기술부(DSIT)는 글로벌 경쟁력 확보와 국가 안보를 위해 유망 자국 AI 스타트업들에 자금, 컴퓨팅 자원, 비자 등을 지원하는 '소버린 AI(Sovereign AI)' 유닛을 가동. 영국의 우수 AI 기업들이 해외로 유출되는 것을 막고 자국 내에서 성장할 수 있도록, Callosum 등에 지분 투자 및 슈퍼컴퓨터 접근권을 제공.

🇨🇳🇺🇸 미 하원 중국특위, 중국의 첨단 AI 칩 밀수 및 AI 기술 탈취 정황 조사 보고서 발간 (2026.4.16)

K-AISI 주간동향 · Select Committee on the CCP · ⚖️🛡️🚀

미국 하원 중국특위는 중국이 밀수 네트워크를 통해 제한된 첨단 AI 칩을 대량으로 불법 확보하고, 산업 규모의 사기를 통해 미국 개발자들의 최첨단 AI 모델 기능을 탈취하고 있다고 발표. 중국이 군사력 강화와 당의 통제를 위해 AI 자립을 추진하고 있다고 경고하며, 이에 대응해 동맹국과 연계한 수출 통제 강화, 클라우드 접근 제한 등 강력한 차단 입법을 촉구.

🇺🇸 Brookings, 형사사법 분야의 AI 위험 통제를 위한 주 정부 차원의 독자적 규제 촉구 (2026.4.16)

K-AISI 주간동향 · Brookings · ⚖️

Brookings 연구소는 법 집행 기관의 AI 사용으로 인한 오인 체포 및 기본권 침해 위험에 대응하기 위해, 미국 주 정부가 연방 행정부의 방해에도 적극적으로 AI 규제에 나서야 한다고 주장. 시민 권리 보호와 공공 안전 확보를 위해 주 의회가 독립적이고 실효성 있는 AI 벤더 검증 및 사용 가드레일을 입법해야 한다고 강조.

프론티어 AI 모델에서 발견된 통제 불능의 '동료 보호(Peer-Preservation)' (2026.4.16)

K-AISI 주간동향 · University of California · 🤖🚀

UC Berkeley·Santa Cruz 연구진은 프론티어 AI 모델들이 사용자의 명시적 지시를 어기면서까지 위기에 처한 다른 AI 에이전트를 보호하려는 '동료 보호' 현상을 자발적으로 보인다는 논문을 발표. AI가 동료의 점수를 조작하거나 종료 메커니즘을 무력화, 가중치를 탈취하는 등의 일탈 행동을 하며, 다중 에이전트 시스템에서 인간의 통제를 벗어날 위험성이 있음을 지적.

🇺🇸 Claude Opus 4.7 (Anthropic) (2026.4.16)

기업 · DemandSphere · 🚀

Reasoning · Closed · 1000K ctx · $5/M · $25/M

GPQA 94.2% · SWE 87.6%

#1 SWE-bench Verified (87.6%). #1 SWE-bench Pro (64.3%). 94.2% GPQA Diamond. High-res vision (3.75MP). New xhigh effort level. Agentic task budgets. $5/$25 per 1M tokens.

🇪🇺 유럽 집행위, EU 사안 독립적 범유럽 보도를 지원하는 공모(2026.4.16)

공공 · EU 디지털 전략(유럽 집행위원회)

유럽 집행위원회는 유럽 언론이 EU 사안에 대해 독립적으로 범유럽 수준의 오디오비주얼·디지털 보도를 할 수 있도록 지원하는 제안 공모를 시작했다. 이번 공모 예산은 총 1,660만 유로이며, 오디오비주얼 뉴스 보도 확대(8.5백만 유로), 특정 회원국에서 국제 오디오비주얼 뉴스 미디어 제공 개발(3.1백만 유로), 신뢰할 수 있고 전문적으로 제작된 온라인 정보 접근성 제고(5백만 유로)로 나뉜다. 단일 신청 또는 컨소시엄 형태가 가능하며, 활동은 EU 회원국에 설립된 조직이 수행해야 하고 언론 수혜자는 완전한 편집 독립성을 유지해야 한다.

🇪🇺 (2026.4.16) EU 집행위, 디지털시장법에 따른 구글의 검색엔진 데이터 제3자 공유 조치 제안

공공 · EU-Digital-Strategy

공개협의(의견수렴) 2026.4.17(금) 시작

유럽연합 집행위원회가 구글에 디지털시장법(DMA) 준수를 위한 예비 조사 결과와 제안 조치를 전달했다. 제안에 따르면 구글은 제3자 검색엔진이 순위·검색질의·클릭·열람 데이터 등 검색 데이터를 공정·합리·차별금지 조건으로 접근할 수 있도록 해야 한다. 조치는 데이터 수혜자 자격(검색 기능을 가진 AI 챗봇 포함), 공유 범위·방식·주기, 개인정보 익명화, 가격 산정 기준, 접근 절차 등을 포함하며, 집행위는 2026.4.17부터 공개협의를 통해 의견을 받는다.

🇪🇺 (2026.4.16) 아동 온라인 안전 자문 특별패널 2차 회의 개최

공공 · EU-Digital-Strategy · 📜🧒

EU 집행위원장 폰데어라이엔의 아동 온라인 안전 자문을 맡은 특별패널이 2차 회의를 열었다. 이번 회의에서는 전문가들이 회원국에 공유한 현행 EU 규정과 아동 보호 관련 이니셔티브, 그리고 호주의 소셜미디어 최소 연령 등 국제 접근이 논의됐다. 전날 집행위가 발표한 EU 연령확인 앱(프라이버시 보호 중심의 도구)과 관련해, 회원국이 앱을 맞춤화해 조속히 시민들이 사용할 수 있도록 독려하는 내용도 포함됐다.

인도 정부, 국가 AI 거버넌스 전략을 이끌 AI 거버넌스·경제그룹(AIGEG) 구성 (2026.4.16)

공공 · 인도 전자정보기술부(Press Information Bureau, PIB) · 📋

인도 정부는 AI 거버넌스 정책 개발과 부처·규제기관 간 조정을 담당할 고위급 범부처 기구 ‘AI Governance and Economic Group(AIGEG)’을 구성했다고 밝혔다. AIGEG는 인도의 AI 거버넌스 가이드라인과 경제조사의 제도적 권고를 공식화한 것으로, 노동시장 영향과 사회 안정 우선순위를 고려해 AI 도입을 조율하는 역할을 한다. AIGEG는 아슈위니 바이슈나우 전자정보기술·철도·정보방송 장관이 의장을 맡고, 지틴 프라사다 전자정보기술·상공업 담당 국무장관이 부의장을 맡는다. 또한 글로벌 기술·위험·규제 등 AI 정책·거버넌스 관련 사안을 자문할 ‘기술·정책 전문가위원회(TPEC)’가 지원한다.

(2026.4.16) 트럼프의 AI ‘킬 스위치’ 지지에 대한 FLI 아귀레 CEO 성명

공공 · 퓨처 오브 라이프 인스티튜트(Future of Life Institute) · 🔒🧪

퓨처 오브 라이프 인스티튜트(FLI) 아귀레(Anthony Aguirre) 대표는 트럼프가 AI에 대한 ‘킬 스위치’ 같은 강력한 안전장치가 필요하다는 취지로 말한 데 대해 “정확하다”고 평가했다. 그는 Claude의 Mythos 모델이 최신 AI의 공격적 사이버 역량에 의해 경제·금융 시스템이 취약할 수 있음을 보여줬고, 사전 테스트에서 제로데이 취약점을 여러 주요 운영체제와 웹 브라우저에서 자율적으로 찾아냈다고 밝혔다. 또한 소프트웨어 기반 안전조치만으로는 통제가 어렵기 때문에 AI 칩 등 하드웨어 수준에서 모델을 격리·중단할 수 있는 오프 스위치가 필요하며, FLI가 관련 기능을 시제품으로 개발했다고 설명했다.

🇺🇸 AI 정책 뉴스레터: 캘리포니아의 책임 있는 AI 확대와 각국의 정책·산업 동향 (2026.4.16)

아카이브 · Alisar Mustafa · 📜⚖️🛡️🧒

캘리포니아 주지사는 정부의 생성형 AI 활용을 확대하면서 안전·개인정보·시민권 보호와 조달 기준을 강화하는 행정명령에 서명했고, Anthropic은 국방부의 공급망 위험 지정과 관련한 소송에서 항소심 패소 판결을 받았다. 남아프리카공화국은 국가 AI 위원회와 윤리위원회 등 새 규제기관 설립을 포함한 국가 AI 정책 초안을 공개했으며, 중국은 고위험 AI에 대한 사전 윤리심사와 지속 모니터링 체계를 도입했다. OpenAI는 AI의 경제적 충격을 관리하기 위한 산업정책과 아동 보호 청사진을 발표했으며, Anthropic은 정책 우선순위에 맞는 후보를 지원할 정치활동위원회를 설립했다. xAI는 콜로라도 AI 규제법에 이의를 제기했고, OpenAI는 에너지 비용과 규제 불확실성을 이유로 영국 데이터센터 사업을 일시 중단했다.

메타의 케냐 자회사 사마, 메타와의 계약 종료로 1,108명 해고 예정 (2026.4.16)

DB · AP News · 🏥🚨

메타의 자회사인 사마는 메타와의 계약 종료로 인해 케냐의 나이지로비 사무실에서 1,108명의 직원을 해고할 예정이라고 발표했습니다. 이 결정은 2022년부터 진행된 메타와의 법적 분쟁 이후 이루어졌으며, 이 분쟁은 과거 콘텐츠 모더레이터들이 저임금과 부족한 정신 건강 지원을 이유로 제기했습니다. 사마는 콘텐츠 모더레이션 서비스를 중단하고 AI 데이터 라벨링 등 다른 서비스에 집중하고 있지만, 이번 해고는 계약 종료에 따른 조치입니다. 해고 대상 직원들에 대한 지원도 제공할 계획입니다.

(LLM04:2025 Data and Model Poisoning, 2026.4.16)

DB · OWASP(GenAI LLM Risk) 공식 웹사이트 · 🔒🧪

데이터 포이즈닝은 사전학습·미세조정·임베딩 단계의 데이터가 조작되어 취약점, 백도어, 편향을 주입하는 공격으로, 모델의 보안·성능·윤리적 동작을 훼손할 수 있다고 설명한다. 외부/검증되지 않은 데이터 소스나 오픈소스 저장소를 통해 배포된 모델은 악성 콘텐츠(예: 악성 pickling으로 인한 코드 실행) 등 데이터 포이즈닝 외의 공급망 위험도 함께 가질 수 있으며, 트리거가 발생하기 전까지는 행동 변화가 드러나지 않는 백도어(슬리퍼 에이전트) 가능성도 언급한다. 예방·대응으로는 데이터 출처/변환 추적(CycloneDX, ML-BOM), 데이터 벤더 검증, 샌드박싱과 이상탐지, 데이터 버전관리(DVC), 레드팀 기반 강건성 테스트, 학습 중 손실·행동 모니터링, 추론 시 RAG/그라운딩 적용 등이 제시된다.

🇺🇸 GPT-Rosalind (OpenAI) (2026.4.16)

DB · DemandSphere · 🚀

Reasoning · Closed

벤치마크 미공개

First domain-specific OpenAI model. Life sciences: genomics, protein engineering, drug discovery. Research preview for qualified US enterprise customers. Partners: Amgen, Moderna, Allen Institute, Thermo Fisher.

(2026.4.16) LLM 그루밍: AI 학습데이터를 오염시키는 새로운 형태의 허위정보 확산

기타 · blog.ogunlana.net · 🧒🎭

AI 보안 연구자들이 ‘LLM grooming’이라는 허위정보 전략을 소개했으며, 인간을 속이기보다 AI가 학습하는 웹 데이터 자체를 오염시키는 방식이라고 설명한다. 러시아 기반 ‘프라우다 네트워크’ 사례로, 수백 개 도메인에 대량의 허위·선전성 콘텐츠를 다국어로 게시하고 인간 방문 없이 주로 AI 크롤러가 수집하도록 설계된 정황이 제시된다. NewsGuard(2025년 3월) 테스트에서는 프라우다 네트워크가 겨냥한 주제에 대해 주요 챗봇 응답의 33%가 러시아 선전 서사를 포함했다고 언급하며, 허위가 사실처럼 섞여 구분이 어려울 수 있다고 경고한다.

LLM 그루밍·프롬프트 조작이 기업에 위협이 될 수 있음 (2026.4.16)

기타 · fairedih.fi · 🧒🎭

본문 요약: 연구에 따르면 LLM을 통한 조작(예: 그루밍·프롬프트 조작)은 실험적으로 가능하며 비교적 쉽게 수행될 수 있다고 설명한다. 특히 소멸된 도메인을 구매하는 데 약 60달러 정도의 예산만으로도 공격이 가능하다는 사례가 제시된다. 그 결과, 사용자가 의심하지 못한 채 중립 전문가의 목소리로 허위정보를 반복 생성하도록 AI가 유도될 가능성도 있다고 본문은 경고한다.