AI 안전 다이제스트

2026-08-21 · 33건

안전한 인공지능 개발을 위한 개인정보 활용 특례 신설 개인정보 보호법 개정안 국회 본회의 통과 (2026.8.21)

공공 · 개인정보보호위원회 · ⚖️

개인정보보호위원회는 공익·사회적 필요성이 있고 가명정보나 익명정보만으로 인공지능 개발이 어려운 경우, 강화된 안전조치와 위원회 심의·의결을 거쳐 적법하게 수집한 개인정보를 활용할 수 있도록 하는 개인정보 보호법 개정안이 국회 본회의를 통과했다고 밝혔다. 민감정보나 고유식별정보 등을 활용할 때는 사전 위험요인 평가와 개선방안 마련, 관련 내용 공개가 의무화된다. 개정안은 국무회의 의결과 공포 후 6개월이 지나면 시행되며, 개인정보보호위원회는 시행 전 운영방안과 하위법령을 마련할 계획이다.

🇺🇸 첨단 AI 보안을 위한 네 가지 거버넌스 접근법 (2026.8.21)

공공 · RAND

RAND 연구진은 첨단 AI 개발자의 보안 강화를 위해 정부 강제 보안 기준, 연방정부 사용을 조건으로 한 개발자 인증, 업계 주도 보안 인증, 정부·업계 협력 기반의 자율규제 등 네 가지 접근법을 제시했다. 효과적인 보안·준수 체계에는 권한과 전문성을 갖춘 기관, 보안 요구사항, 준수 여부 검증, 집행 수단이 필요하며, 위험과 기업 역량에 비례한 기준과 투명한 이해관계자 참여가 중요하다고 분석했다. 세부 모델로는 고위험 개발자를 대상으로 한 SAFE-AI, 연방 사용 승인을 부여하는 SecureAI Authorization, 업계 컨소시엄 기반의 FASSO 인증이 제안됐으며, 위반 시 시정조치·감사·사용 중지·인증 취소 등의 제재가 적용된다.

아타리에서 EVE 온라인까지: 15년간 이어진 게임 AI 연구의 발전 (2026.8.21)

기업 · 구글 딥마인드 · 🤖🚀

구글 딥마인드는 Atari, Go, 체스, StarCraft II 등을 통해 발전시킨 AI 연구가 AlphaFold의 단백질 구조 예측 등 다른 분야에도 기여했다고 설명했다. 자연어 지시와 키보드·마우스 조작으로 게임을 수행하는 범용 에이전트 SIMA 2를 개발해 복잡한 3D 게임에서의 실시간 추론과 상호작용을 연구하고 있다. Fenris Creations와의 협력에서는 EVE Online·EVE Vanguard·EVE Frontier를 활용해 지속 학습, 장기 계획, 기억, 다중 에이전트 상호작용을 연구하며, 우선 오프라인 EVE Online 환경에서 안전하게 검증한 뒤 역량이 성숙하면 실제 게임에 적용할 계획이다.

AI 거버넌스 채용공고와 실제 업무 사이의 간극 (2026.8.21)

기업 · AI Career Pro

AI 거버넌스 채용공고는 존재하기 어려운 경력 연수와 지나치게 넓은 전문성·자격 요건을 요구하고, 수행 활동만 나열해 역할의 목적과 기대 성과를 명확히 제시하지 못하는 경우가 많다. 실제 업무는 정책 작성이나 위원회 운영 같은 활동 자체가 아니라, 권한 있는 거버넌스 기능 구축, AI 자산 파악, 적정 기준 정의, 위험 감소, 규제·계약 의무의 입증 가능한 이행, 수명주기 내 거버넌스 통합, 배포 후 지속 관리, 독립적 검증이라는 8개 목표를 달성하는 데 있다. 글은 활동을 완료하는 것과 조직의 의사결정과 위험 관리가 실제로 개선되는 것은 다르므로, 채용공고도 업무 목록보다 기대 결과를 중심으로 작성해야 한다고 설명한다.

🇺🇸 제프리 웽거, RAND ‘AI·노동자·경제’ 특별석좌로 임명 (2026.8.21)

공공 · RAND

RAND의 선임 경제학자 제프리 웽거가 인공지능이 노동자·노동시장·공공재정·경제 전반에 미치는 영향을 연구하는 2년 임기의 특별석좌로 임명됐다. 그는 RAND의 중산층 경로 센터와 정책분석 석사과정을 이끌고 있으며, 경제적 기회와 노동시장에 관한 연구를 수행해 왔다. 이번 직책은 Diller–von Furstenberg Family Foundation과 Lowy Family Foundation의 지원을 받는다.

데이터센터는 상징이다 (2026.8.21)

언론 · TransformerNews · 🗳️

이 글은 데이터센터의 물·에너지 사용량에 관한 과장되거나 사실과 다른 비판이 확산되고 있지만, 그 이면에는 AI가 인간의 삶과 환경을 크게 바꿀 수 있다는 불안이 있다고 설명한다. 데이터센터는 AI의 추상적인 영향이 물리적 공간과 시설로 드러나는 대표적 상징이며, 최근 여론조사에서 거주지 인근 건설 반대가 1년 만에 33%포인트 증가해 75%에 이르렀다고 전한다. 글은 데이터센터에 대한 우려를 허위 주장과 동일시하기보다 AI의 위험과 확장에 대한 정당한 문제의식으로 받아들여야 하며, 건설 지연이 AI의 무제한 확장을 늦추는 역할을 할 수 있다고 주장한다.

🇯🇵 AI 정보통: 8월 20일 15시 정보 (2026.8.21)

아카이브 · 일본 AI 안전성 연구소 공식 발표 · 🔒🔬

일본 AI 안전성 연구소는 Varonis가 Microsoft Copilot Personal의 CoSnitch 취약점을 공개했으며, 공격자가 만든 링크를 열면 사용자의 확인 없이 명령이 실행되고 연결된 앱의 정보가 외부로 전송될 가능성이 있었다고 전했다. Microsoft는 2026년 8월 18일 수정 사항을 적용했으며, 공개 시점까지 실제 악용 사례는 확인되지 않았다. Rapid7은 취약점 공개부터 공격자 악용까지의 기간이 짧아지고 있어 심각도뿐 아니라 실제 악용 가능성과 중요 시스템에 미칠 영향을 함께 고려해야 한다고 분석했다. 이 밖에 OpenAI의 Zero Data Retention 및 Private Safety Processing, Bitdefender의 중앙아시아 대상 사이버 스파이 활동, OpenAI의 사이버 역량 관련 모델 개발 속도 조절 소식도 소개됐다.

🇬🇧 영국 영화관, 불법 촬영 우려로 카메라 탑재 AI 안경 착용 제한 (2026.8.21)

언론 · 조선일보

영국 영화관 운영사들이 영화 불법 촬영과 사생활 침해 우려로 메타의 AI 안경 등 카메라 탑재 스마트안경을 금지하거나 사용을 제한하고 있다. 영국 전체에 일률적인 규정이 적용되는 것은 아니며, 영화관별로 자체 정책을 시행한다. 잉글랜드·웨일스 법원과 독일에서도 촬영 및 개인정보 보호 문제로 관련 제한과 법적 대응이 이어지고 있다. 다만 영국영화관협회는 접근성 지원을 위한 스마트안경의 활용 가능성을 고려해 과도하지 않은 대응을 강조했다.

🇺🇸🇰🇷 미국이 만든 AI기구에만 참여하라? 트럼프의 협박과 한국의 대응 방법 (2026.8.21)

언론 · 딴지일보 · 🛡️

기사에 따르면 미국 주도의 팍스 실리카는 AI 공급망·경제안보 협력망에 가깝고, 중국 주도의 WAICO는 AI 거버넌스·국제 규칙·기술협력을 다루는 정부 간 국제기구로 성격과 기능이 다르다. 미국은 두 체제에 동시에 참여하는 것을 문제 삼기 시작했지만, 한국에 중국과의 AI 협력을 끊으라는 최후통첩을 한 단계는 아니며 한국은 현재 팍스 실리카 회원국이고 WAICO에는 가입하지 않았다. 글은 양 기구의 의무가 실제로 충돌하는 분야만 제한하고, 민감한 공급망 정보와 군사·첨단 기술을 분리하는 방식으로 미국과 중국에 동일한 원칙을 적용해야 한다고 제안한다.

🇰🇷 한국의 투트랙 AI 전략: 공공은 연결하고, 산업은 전문화하자 (2026.8.21)

언론 · 동아일보 · 📏🔒🤖

한국의 AI 전략은 공공 부문과 산업 부문을 나눠 추진해야 한다는 제안이다. 공공 부문에서는 개인정보 보호와 접근 권한을 전제로 데이터 형식·인증·프로토콜을 표준화해 AI 에이전트 간 상호운용성을 높이고, 산업 부문에서는 제조업 현장 데이터와 전문 노하우를 결합한 산업특화 AI 시스템에 집중해야 한다고 설명한다. 국가 경쟁력은 거대 범용 모델 하나보다 국민생활에서 연결되는 공공 AI와 산업별 경쟁력을 높이는 전문화된 AI에서 나온다고 강조한다.

🇯🇵 AI 이미지 베끼면 저작권 침해?…일본서 2억원 손해배상 소송 (2026.8.21)

언론 · 뉴시스 · ⚖️

일본 콘텐츠 제작사 사이(Sai)가 자사의 AI 모델 이미지 240점을 무단 사용했다며 지바현의 미용실 업체를 상대로 2400만 엔의 손해배상을 청구했다. 사이 측은 이미지 제작 과정에서 성별·구도·배경 등을 지시하고 결과물을 선택·수정했다고 주장했으며, 미용실 측이 일부 이미지를 변형해 사용했다고 밝혔다. 이번 소송에서는 사람이 AI 제작에 관여한 정도에 따라 생성 이미지가 저작물로 인정될 수 있는지와 무단 사용에 대한 배상 책임이 쟁점이 될 전망이다.

애피어, 리스크 인지 의사결정 프레임워크로 에이전틱 AI 신뢰성 강화 (2026.8.21)

언론 · 서울신문 · 🤖

애피어가 LLM과 에이전틱 AI의 의사결정 신뢰성을 평가하는 ‘리스크 인지 의사결정 프레임워크’를 공개했다. 이 framework는 정답 보상, 오답 페널티, 답변 거부 비용 등을 반영해 모델이 답변·거부·추측 중 어떤 선택을 할지 정량적으로 평가한다. 애피어는 과업 실행, 확신도 추정, 기대 가치 추론의 3단계 스킬 분해 접근법을 통해 고위험 상황에서 과도한 추측을 줄이고 기업용 AI의 안정성을 높일 수 있다고 설명했다.

한권 의원, ‘AI 민주주의’ 조례 제정 위한 전문가 좌담회 개최 (2026.8.21)

언론 · 여성신문

제주도의회 한권 의원이 공공서비스와 정책 결정 과정의 AI 활용에 따른 기술 독점, 알고리즘 편향, 디지털 취약계층의 접근성 문제를 점검하기 위한 전문가 좌담회를 열었다. 조례안에는 AI 민주주의 위원회, 전략계획, 플랫폼, AI인권영향평가, 도민 참여 제도와 윤리·교육 방안 등이 담길 예정이다. 한 의원은 전문가 의견을 반영해 조례안을 보완한 뒤 9월 발의할 계획이다.

AI가 조작한 문자로 체포된 여성, 법 개혁을 위해 싸우다 (2026.8.21)

DB · AIID · 🚨

플로리다의 간호사 멜리사 심스는 전 남자친구가 AI 문자 생성기로 조작한 증거를 사용해 접근금지 명령 위반 혐의로 신고하면서 체포됐다고 주장했다. 이후 통신 기록에서 문자가 실제로 발송·수신되지 않은 사실이 드러났지만, 사건이 수개월간 이어지며 간호사 면허와 30만 달러 이상을 잃었고, 접근금지 혐의는 기각됐으며 기존 가정폭력 혐의에서도 무죄를 선고받았다. 심스는 디지털 증거의 메타데이터 검증을 의무화하고 AI 합성 증거 조작에 처벌을 부과하는 ‘멜리사의 법’을 추진하고 있다.

오우라, 수면 추적 정확도를 소비자에게 오인시켰다는 소송 직면 (2026.8.21)

DB · AIID · ⚖️🚨

집단소송 제안서에서 오우라의 스마트 링이 수면 단계와 수면의 질을 직접 측정하지 못하면서도 임상 수준의 정확도를 제공하는 것처럼 광고했다고 주장했다. 원고 측은 오우라가 79% 및 최근 95%의 수면 단계 정확도를 내세웠지만 실제로는 AI 기반 추정에 의존하며, 허위 광고 중단과 소비자 배상을 요구했다. 오우라는 심박수·심박변이도·움직임·호흡·체온 등 여러 생리 신호를 사용하고 관련 독립 연구가 정확성을 뒷받침한다며 혐의를 부인하고 법적 대응을 예고했다.

🇰🇷 브라질 하원 위원회, 브라질 인공지능 개발 지원 정책 승인 (2026.8.21)

DB · 브라질 하원 · ⚖️

브라질 하원 과학·기술·혁신위원회가 브라질 인공지능 국가진흥정책(Pontaria)을 마련하는 법안을 승인했다. 법안은 국가과학기술개발기금(FNDCT) 재원의 최소 10%를 관련 기업에 배정하고, 인증된 브라질산 AI 개발비의 최대 20% 공제와 국내 연구·개발·시험 비용의 30% 세액공제를 предусматри한다. 브라질산 AI는 국내 데이터·인프라·기술·인력을 활용하고 브라질 법률을 준수해야 하며, 법안은 재정·조세위원회와 헌법·사법·시민권위원회의 심사를 거친 뒤 하원과 상원 의결을 거쳐야 한다.

🇨🇳 중국·인도네시아, AI 협력 및 기술 이전 실무그룹 설립 (2026.8.21)

DB · 주인도네시아 중국대사관

중국과 인도네시아 외교장관은 자카르타에서 포괄적 전략대화 메커니즘의 첫 회의를 열고 양국 협력과 공동 발전 방안을 논의했다. 양측은 2027~2031년 5개년 행동계획 수립을 시작하고, 인공지능 등 신산업·에너지·광물·농업기술·보건·교육 분야 협력을 확대하기로 했다. 또한 어업 협력을 재개하고 남중국해 행동선언을 이행하며, 내년 중국에서 제2차 회의를 개최하기로 합의했다.

태국 디지털경제부 장관, TH-AI Passport 데이터 보안 모델이 일반 AI 플랫폼보다 안전하다고 주장 (2026.8.21)

DB · GlobalAIRegTracker

태국의 TH-AI Passport 사전 등록자가 출시 이틀 만에 103만3,635명에 도달했으며, 서비스는 2026년 8월 31일 공식 출시될 예정이다. 디지털경제사회부 장관은 계약상 사업자가 이용자 데이터를 보관하거나 AI 모델 훈련·개발에 재사용할 수 없고, 정부 시스템을 통해 신원 확인과 등록이 진행돼 일반 AI 서비스보다 강력한 보호 장치를 갖췄다고 설명했다. 이 사업은 최대 500만 명을 대상으로 하며, 실제 이용자 기준으로 월 1인당 24.70바트를 지급하는 Pay Per Active User 방식으로 운영된다.

경영 교육에서 AI 거버넌스 가르치기: 불확실성 속 책임 있는 의사결정을 위한 시뮬레이션 게임 (2026.8.21)

연구

이 연구는 학생들이 AI 도입 과정의 조직적 판단과 책임 있는 의사결정을 연습할 수 있도록 카드 기반 시뮬레이션 게임을 제시한다. 학부생 2개 집단 67명을 대상으로 사전·사후검사와 수업 평가를 실시하고, 15개 팀이 작성한 Model Cards에서 의사결정 근거를 분석했다. 학생들의 지식·윤리·거버넌스 자신감은 즉시 향상됐으며 효과크기(dz)는 0.44~1.00이었지만, 퀴즈 점수 향상은 작고 통계적으로 유의하지 않았다. Model Card 분석에서는 검토 가능한 거버넌스 판단이 나타났으나, 인과적 학습 효과·기억 유지·전이는 확인되지 않았다.

🇺🇸 실제 사건 131건을 통한 세 가지 에이전트 AI 위험 분류체계의 포괄성과 상호보완성 (2026.8.21)

연구 · 📏🤖🚨

에이전트 AI에서 발생한 실제 실패 사례를 세 가지 위험 분류체계로 비교해 각 체계가 현실의 사건을 얼마나 포착하는지 검증했다. AI Incident Database 등을 통해 2014~2026년의 에이전트 관련 사건 131건을 수집하고 OWASP-ASI, MSFT-AIRT, NIST AI RMF에 각각 독립적으로 분류했다. 세 체계의 공동 포괄률은 96.9%였으며, 개별 포괄률은 OWASP-ASI 79.4%, MSFT-AIRT 93.1%, NIST AI RMF 96.2%였다. OWASP-ASI에서 분류되지 않은 사건은 27건(20.6%)으로, 자문 역할에서의 hallucination, 인간의 AI 오용, 사회기술적 결합 실패에 집중됐고, OWASP-ASI는 관찰 가능한 결과를 통합하는 반면 MSFT-AIRT는 작동 메커니즘을 세분화하며 NIST AI RMF는 수명주기 관점의 보완적 틀로 나타났다.

피부과에서 오픈 웨이트 언어 모델의 로컬 배포: 개인정보 보호, 형평성 및 실제 구현에 관한 관점 (2026.8.21)

연구 · 🔓

이 글은 임상 사진과 피부경 이미지처럼 민감한 정보를 다루는 피부과에서 로컬 오픈 웨이트 LLM 배포의 조건과 구현 방안을 설명한다. 로컬·클라우드 배포를 비교하고, LLM을 CNN, vision transformer, vision-language model, PanDerm, MedGemma 같은 시각 모델과 결합하는 전략을 검토했다. knowledge distillation, structured pruning, low-bit quantization, mixture-of-experts를 활용하면 7~33 billion-parameter 모델을 소비자용 워크스테이션에서 실행할 수 있으며, 14~33 billion-parameter 모델을 구동하는 하드웨어 비용은 enterprise cloud-AI 구독 1~2년분 정도로 제시됐다. 로컬 배포에는 기관의 임상 이미지 통제, vendor model deprecation 회피, skin of color 성능 격차를 위한 감사·fine-tuning이라는 장점이 있지만, 모델 이질성·model drift·quantization에 따른 정확도 저하를 CONSORT-AI, SPIRIT-AI, DECIDE-AI, TRIPOD+AI와 retrieval-augmented generation 및 federated learning으로 관리해야 한다.

블랙박스를 넘어—논리 시스템 비교 분석을 통한 설명 가능한 AI의 새로운 방향 (2026.8.21)

연구

이 리뷰는 AI의 판단 과정을 사후에 추정하는 대신 논리 시스템으로 결정 과정을 투명하고 재현 가능하게 만드는 방법을 다룬다. SHAP와 LIME의 한계를 검토하고, 명제논리·의무논리·1차 논리와 현대적 solver를 표현력과 보장 수준에 따라 비교했다. 비교 분류 결과, 자연어 입력·형식적 검증 가능성·재현성을 동시에 제공하는 기존 논리 시스템 계열은 없었다. neuro-symbolic 사례인 Causal Logic Engine(CLE)은 언어모델이 텍스트를 읽고 투명한 논리 계층이 결정을 내리며 사람이 이를 확인하는 전 과정을 제시했다.

AI 기반 금융 리스크 분석: 사우디아라비아의 내부감사와 기업 거버넌스 재편 (2026.8.21)

연구 · 📋🔒

사우디아라비아 기업에서 AI가 금융 리스크 관리와 내부감사의 핵심 도구로 활용되는 현상을 다룬다. 사우디의 FMCG, QSR 프랜차이즈, 산업 유통, 에너지, 부동산 대기업 사례를 바탕으로 기대신용손실 추정, fraud·anomaly detection, 운전자본 예측, 지속적 통제 모니터링을 검토한다. SAP S/4HANA, Microsoft Copilot, Google Gemini Enterprise, TeamMate+와 TeamMate Analytics 등의 활용을 사우디의 PDPL, 생성형 AI 지침, Essential Cybersecurity Controls 및 국제 AI 거버넌스 지침과 대조한다. 내부감사가 model risk, algorithmic bias, explainability gaps를 점검할 수 있도록 AI assurance model과 사우디 인재의 AI 기반 감사 역할 육성 방안을 제안한다.

CLEAR: 유용성을 보존하는 연속 잠재 어댑터 라우팅 기반 LLM safety alignment (2026.8.21)

연구 · 🧪🚀

이 연구는 유해한 응답은 줄이면서 무해한 요청에 대한 언어모델의 성능 저하를 최소화하는 조건부 safety adaptation 방법을 제안한다. CLEAR는 hidden-state gate로 safety low-rank adapter의 활성화 강도를 연속적으로 조절하고, Llama-3-8B-Instruct를 safety·utility 벤치마크에서 평가했다. HarmBench ASR은 전역 SFT나 LoRA 적용 시 32.3%에서 CLEAR 적용 후 0.5%로 낮아졌으며, GSM8K 정확도는 전역 SFT 또는 LoRA보다 최대 7.1%포인트 높았다.