AI 안전 다이제스트

2026-07-03 · 5건

신뢰로 여는 인공지능(AI) 혁신, 달라지는 개인정보 체계로 이끈다 (2026.7.3)

공공 · 개인정보보호위원회

개인정보보호위원회는 인공지능 확산과 대규모 개인정보 유출에 대응하기 위한 「제3차 개인정보 보호 기본계획(2027~2029)」을 발표했다. 계획은 위험 비례 규율, 예방 중심 보호, 범정부 협력, 국민 권리구제를 4대 전략으로 삼고 맞춤형 혁신 지원, 데이터 국외이전 관리, 사이버 위협 대응 등을 추진한다. 신고부터 분쟁조정·손해배상까지 연계하는 원스톱 권리구제와 취약계층 보호도 강화한다.

🇬🇧 영국, AI 아동 성착취물 제작 우려로 부모들에게 자녀 사진의 온라인 게시 주의 권고 (2026.7.3)

K-AISI 주간동향 · The Guardian · 📋🧒

영국 국가범죄수사국(NCA)과 인터넷감시재단(IWF)은 AI가 생성한 아동 성착취물 범죄가 증가함에 따라 부모들에게 사진 게시 주의 가이드라인을 발표. 범죄자들이 평범한 사진을 수집해 AI로 성착취물을 제작하거나 협박하는 사례가 급증함에 따라, 소셜 계정을 비공개로 전환하거나 사진 동의 규정을 재검토할 것을 권고.

🇯🇵 AI 정보 통신: 2026.7.2 15시의 주요 AI 안전·산업 소식(2026.7.3)

아카이브 · Japan AISI · 🔬

Anthropic은 Claude Fable 5를 다시 배치(redeploy)하면서 공격/위험 시나리오에서의 대응을 강화하고, 안전 관련 업데이트를 공개했다. OpenAI는 GeneBench-Pro를 소개하며 유전체 관련 10개 영역 과제에서 129개 데이터/벤치마크로 성능과 탐지·구분 능력을 평가할 수 있다고 설명했다. 또한 UN 독립 국제 과학 패널의 ‘AI에 관한 독립 국제 과학 패널 예비 보고서’와 Microsoft Security Blog의 ‘AI agents가 reading에서 acting으로 전환될 때의 보안’ 등 국제·민간의 안전/거버넌스 이슈도 함께 정리했다.

🇺🇸 Altman, AI 안전 글로벌 표준을 위한 ‘미국 주도’ 국제 포럼 제안(2026.7.3)

DB · AI-Risk-Explorer · 🚀

사마 알트만(OpenAI CEO)이 미국이 주도하는 국제 포럼을 만들어 글로벌 AI 안전 기준을 마련하자고 제안했다. 포럼은 정부, 독립 기술전문가, 이해관계자를 함께 참여시켜 AI 역량·위험에 대한 공정한 평가와 합의된 규칙 준수 조건 하에서 첨단 AI 기술의 제공을 논의하는 방식이라고 설명했다. 다만 frontier AI는 폐쇄적 데이터센터에서 개발돼 독립적 검증과 집행(enforcement)이 어렵다는 점이 주요 과제로 언급됐으며, G7 및 UN 등 국제 논의 흐름과 함께 기존 국제 거버넌스(IAEA, 항공 안전, 금융 표준) 사례를 참고할 수 있다고 밝혔다.

VIBE: Voice-Induced open-ended Bias Evaluation for Large Audio-Language Models via Real-World Speech (2026.7.3)

연구

VIBE는 실제 사람이 녹음한 음성을 사용해 LALM의 생성 편향을 open-ended 과제로 평가하는 프레임워크를 제안한다. 합성 음성과 MCQ 기반이 제공하는 단편적 공정성 관점의 한계를 넘어, 개인화 추천 같은 과업에서 고정된 선택지 없이도 고정관념적 연상이 자연스럽게 드러나도록 설계했다. 12개 SOTA LALM 평가 결과, gender와 accent 관련 단서가 분포 수준에서 statistically significant한 shifts를 유발했으며 bias magnitude는 task에 따라 크게 달라졌다.