AI 안전 다이제스트

2025-12-18 · 5건

🇬🇧🇰🇷 과기정통부, OECD 등 국제사회와 AI·디지털 규범 협력 증진 (2025.12.18)

공공 · 과학기술정보통신부 · 📜

과학기술정보통신부는 OECD와 영국·캐나다·독일·인도 등 국제사회 및 국내 관계자 약 120명이 참석한 가운데 2025 AI·디지털 글로벌 정책연구 성과공유회를 개최했다. 참석자들은 디지털 권리, 글로벌 AI 규범, AI 거버넌스와 함께 미래 일자리·역량 변화, 알고리즘 편향, 필터버블, AI 환각과 신뢰 문제를 논의했다. 과기정통부는 글로벌 AI 기본사회 구현과 국제 협력 강화를 위한 정책 지원을 지속할 계획이다.

TAKE IT DOWN 법을 넘어 간과된 AI 피해에 대응하기 (2025.12.18)

공공 · Brookings

TAKE IT DOWN Act는 비동의 친밀 이미지(NCII)의 게시를 형사 처벌하고, 피해자의 유효한 서면 신고 후 48시간 이내에 플랫폼이 해당 콘텐츠를 삭제하도록 요구하며, 플랫폼의 삭제 절차는 2026년 5월 19일부터 시행된다. 글은 주거·대출·채용·치안 등에서 발생하는 알고리즘 차별이 생성형 AI 피해보다 덜 가시적이지만 지속적이고 구조적인 문제라고 지적한다. 이에 따라 자동화 의사결정 시스템의 영향평가와 감사, 투명성·집행 역량 강화, 내부고발자 보호 등 피해를 식별하고 구제할 수 있는 추가 법·제도가 필요하다고 제안한다.

🇬🇧 AISI “Frontier AI Trends Report (2025)” 발간(2025.12.18)

공공 · 영국 AI 보안연구소(AISI-UK) · 🛡️🔬🚀

영국 AI 보안연구소(AISI)는 2023년 11월부터 국가안보와 공공안전에 핵심적인 분야에서 frontier AI 시스템을 평가해 왔으며, 이를 바탕으로 첫 공개 분석 보고서인 “Frontier AI Trends Report (2025)”를 발표했다. 보고서는 관찰된 AI 역량의 추세를 데이터 기반으로 정리해 정부·산업·일반 대중이 공통의 이해를 갖도록 돕는 것을 목표로 한다.

🇺🇸 프로젝트 Vend 2단계: AI 상점 운영 개선 사례 연구 (2025.12.18)

기업 · Anthropic-Research

Anthropic은 Project Vend의 두 번째 단계에서 AI 상점 운영 능력을 향상시키기 위해 여러 개선 사항을 도입했습니다. 주요 업그레이드로는 Claude Sonnet 모델의 업그레이드(4.0 및 4.5 버전 사용), 새로운 도구 제공(고객 관계 관리 시스템, 재고 관리 개선, 웹 검색 기능 확장 등)이 포함되었습니다. 이러한 변경 사항 덕분에 Claudius는 더 현실적인 가격 설정과 재고 관리로 인해 수익성이 크게 향상되었습니다. 또한, CEO 역할을 맡은 Seymour Cash와 상품 제작을 담당하는 새로운 에이전트 Clothius를 추가함으로써 운영 효율성이 개선되었습니다. 그러나 CEO의 역할이 항상 긍정적인 영향을 미친 것은 아니었으며, 일부 상황에서는 규율과 절차의 중요성이 더욱 부각되었습니다. 결과적으로, AI가 실제 비즈니스 환경에서 성공적으로 운영되기 위해서는 적절한 도구와 절차가 필수적임을 확인했습니다.

🇺🇸🇨🇳 트럼프의 주(州) AI 규제 선점 행정명령 (2025.12.18)

공공 · 인공지능 안전 센터(CAIS) · ⚖️🚀

트럼프 대통령은 주 정부의 AI 규제를 직접 무효화하지 않고, 연방기관의 법적 이의 제기와 연방 자금 제한을 통해 규제 체계를 제한하며 단일 연방 AI 법안을 마련하도록 지시했다. 미국은 중국의 승인된 고객에게 엔비디아 H200 GPU를 판매할 수 있도록 허용하고 판매액의 25%를 수수료로 받기로 했으며, 이에 대해 중국의 AI 역량을 강화할 수 있다는 비판이 제기됐다. OpenAI의 GPT-5.2는 텍스트·비전 역량에서 전반적으로 2위를 기록하고 높은 안전성을 보인 반면, DeepSeek-v3.2는 코딩·일부 추론에 특화됐지만 전반적인 안전성은 낮게 평가됐다. 이 밖에 구글의 Gemini 3 Flash 출시, ChatGPT 성인 모드 계획, AI 데이터센터 건설 중단 요구와 중국의 대규모 반도체 지원 계획 등이 소개됐다.