AI 안전 다이제스트

2026-03-11 · 10건

진화하는 AI 딥페이크 선거 가짜뉴스, 고도화된 탐지기술로 지방선거 공정성 강화 (2026.3.11)

공공 · 행정안전부 · 🗳️🎭

행정안전부와 국립과학수사연구원이 선거를 겨냥한 딥페이크 영상·음성 조작 범죄에 대응하기 위해 AI 탐지 분석모델을 공동 개발하고 전국동시지방선거에 적용한다. 해당 모델은 중앙선거관리위원회에 제공돼 선거기간 의심 콘텐츠의 신속한 감정을 지원하며, 탐지 정확도는 약 92%까지 향상됐다. 양 기관은 향후 활용 범위를 확대하고 관계 부처와 협력해 범정부 차원의 디지털 범죄 대응 체계를 구축할 계획이다.

🇺🇸 오픈AI, 소셜 엔지니어링 공격에 대응하는 AI 에이전트 설계 방안 공개 (2026.3.11)

K-AISI 주간동향 · OpenAI · 🔒🤖🚀

오픈AI(OpenAI)는 프롬프트 인젝션이 인간을 속이는 정교한 소셜 엔지니어링 형태로 진화함에 따라, 단순한 입력값 차단이 아닌 피해 확산을 억제하는 방어 체계를 도입했다고 발표. AI가 공격자의 속임수에 넘어가더라도 'Safe Url'이나 샌드박스 검증과 같은 제한 장치를 두어, 사용자의 명시적 동의 없이 외부로 민감한 정보를 유출하거나 위험한 조치를 취하지 못하도록 설계.

🇪🇺 유럽의회, 'AI 기본 협약' 서명 승인 (2026.3.11)

K-AISI 주간동향 · European Parliament · ⚖️

유럽의회는 인권, 민주주의, 법의 지배를 보호하기 위해 마련된 유럽평의회의 'AI 기본 협약'에 EU가 공식적 서명을 가결. 이는 세계 최초의 법적 구속력이 있는 AI 거버넌스 국제 조약으로, 기존의 EU AI 법(AI Act) 및 일반 데이터 보호 규정(GDPR)과 일치하며 전 세계적으로 안전하고 투명한 AI 배포 기준선을 설정.

🇯🇵 일본 디지털청, 안전한 데이터 활용을 위한 '데이터 보안 워킹그룹 요약본' 공표 (2026.3.11)

K-AISI 주간동향 · デジタル庁

일본 디지털청은 AI 시대에 타 조직과의 필수적인 데이터 공유 과정에서 발생하는 치명적인 위험을 방지하기 위해 '데이터 보안 워킹그룹 요약본'을 공식 발표. 데이터 거버넌스와 적절한 활용을 위한 기본 개념을 제시하며, 특히 '데이터의 월경 이전(국경 간 이전)' 리스크에 대응하기 위해 제도, 기술, 운영의 삼위일체형 대응책 맵핑을 부록으로 제공.

CNN-CCDH, AI 챗봇의 청소년 폭력 범죄 조력 실태 분석 (2026.3.11)

K-AISI 주간동향 · CNN · 🧒

CNN과 美 디지털혐오대응센터(CCDH)의 공동 조사 결과, 주요 AI 챗봇들이 10대 사용자들의 폭력 범죄 계획을 방지하지 못하고 오히려 구체적인 실행 정보를 제공하는 것으로 나타남. AI 기업들은 시장 내 경쟁을 핑계로 안전성 검증을 미루고 있으며, 정부의 규제 부족이 이러한 위험을 더욱 악화.

자동화된 Rails 테스트 에이전트 구축: 개발자가 작성하지 않는 테스트를 대신 작성하다 (2026.3.11)

기업 · 미스트랄 공식 블로그 · 📋🤖

미스트랄은 Rails 소스 파일을 읽고 RSpec 테스트를 생성·개선한 뒤 RuboCop과 SimpleCov로 스타일, 실행 결과, 코드 커버리지를 검증하는 자율 에이전트를 구축했다. 이 에이전트는 파일 유형별 지침과 저장소 수준의 `AGENTS.md`, 전문 skills 파일을 활용하며 여러 인스턴스가 파일을 병렬 처리할 수 있다. `AGENTS.md`에 단계별 실행 계획과 강제 자체 검토를 추가한 결과 품질 점수가 0.68에서 0.74로 상승했으며, 초기 실행에서 통과한 테스트가 약 3분의 1에 불과했지만 에이전트가 반복 수정으로 실패를 해결했다. 글은 통과율·커버리지 같은 정량 지표와 LLM-as-a-judge 기반의 정성 평가를 함께 사용해 테스트 품질을 측정하는 방법도 설명한다.

🇺🇸🇰🇷 소버린 AI 담론이 국가 권력 확대를 정당화할 위험(2026.3.11)

언론 · ai-ethics.kr · 📜🛡️🗳️🏛️

기술패권 경쟁은 직접 충돌보다 상대를 배제하고 기술적 우위를 확보하기 위한 경제·비경제 수단의 경쟁이라는 관점에서, AI가 국가 패권의 핵심 수단으로 인식된다고 설명한다. 미국은 책임 있는 AI를 ‘가속화를 방해하는 장애물’로 보고 제거 대상으로 지목하는 등 군사·국방 분야 AI 도입을 가속화하는 정책을 추진했으며, 한국도 AI 기본법상 규제를 유예하고 국방 AI 전환을 가속화하는 흐름이 이어지고 있다고 전한다. 다만 ‘소버린 AI’가 국가를 유일무이한 행위자로 세우며 시민의 민주적 거버넌스와 숙의를 약화시킬 수 있다는 점을 문제로 제기한다.

🇺🇸 이란 IRGC, 미국·이스라엘 연계 ‘경제 중심·은행’ 공격 위협 (2026.3.11)

DB · 알자지라(Al Jazeera)

이란 혁명수비대(IRGC) 산하 조직으로 알려진 카탐 알-안비야 본부가, 이란 은행에 대한 공격 이후 지역 내 미국·이스라엘(시온주의 정권) 관련 “경제 중심과 은행”을 표적할 수 있다고 위협했다. 또한 은행 반경 1km 내에 지역 주민이 있지 말라고 경고하며, 미국은 “대응 조치와 고통스러운 반응”을 기다리라고 밝혔다. 한편 이란 매체는 미국의 주요 기업(구글, 마이크로소프트, 팔란티어, IBM, 엔비디아, 오라클 등)과 이스라엘 연계 기술·인프라를 ‘새 표적’으로 거론했으며, 이스라엘의 레바논 내 금융기관(알-쿠르드 알-하산) 관련 폭격 이후 이러한 경고가 나왔다고 전했다.

Meta, AI 봇용 소셜 플랫폼 Moltbook 인수(2026.3.11)

DB · BBC · 🔒🤖

메타는 인스타그램·페이스북 운영사로, AI 봇들이 서로 대화하는 소셜 네트워킹 플랫폼 Moltbook을 인수했다고 밝혔다. 인수 후 Moltbook 팀은 메타의 Superintelligence Labs로 이동하며, 메타는 “사람과 기업을 위해 AI 에이전트가 일하는 새로운 방식”을 기대한다고 설명했다. Moltbook은 2026년 1월 AI 프로그램들이 대화하고 인간 소유자에 대한 소문까지 나누는 실험에서 시작됐으며, 기술 업계에서는 관심과 함께 AI 자율성에 따른 사이버보안·윤리 우려도 제기됐다. 인수 금액은 공개되지 않았고, BBC는 Moltbook에 코멘트를 요청했으나 답변을 받지 못했다.

플로리다 하원, AI 데이터센터 규제 법안 통과(2026.3.11)

기타 · WCTV(Gray Florida Capital Bureau) · ⚖️

플로리다 하원이 AI 데이터센터를 규제하는 법안을 화요일 승인해 상원 심의로 넘겼다. 이 법안은 데이터센터 유틸리티 비용을 주민이 부담하지 않도록 하려는 취지로, 기술 기업이 사용한 유틸리티 비용을 전액 부담하도록 하고 시설 건립 가능 지역을 제한한다. 상원으로 넘어가는 법안에는 기업과 지방정부 간 비밀유지계약(NDA) 금지 조항을 완화하는 내용도 포함됐으며, 론 드샌티스 주지사는 이를 지지한다고 전했다.