트리니티 칼리지 더블린, AI 관리자에 대한 인간의 성별 편견 투영 현상 확인 (2026.3.9)
트리니티 칼리지 더블린 연구진은 인간 리더를 평가할 때 나타나는 성별 편견이 AI 의사결정권자(AI 관리자)를 대할 때도 동일하게 적용된다는 실험 결과를 발표. 참가자들은 완전히 동일한 보너스 미지급 결정을 내렸음에도 남성 AI보다 여성 AI 관리자에게 훨씬 부정적으로 반응하여, 향후 인간-AI 상호작용에서 발생할 수 있는 잠재적 우려를 보여줌.
트리니티 칼리지 더블린 연구진은 인간 리더를 평가할 때 나타나는 성별 편견이 AI 의사결정권자(AI 관리자)를 대할 때도 동일하게 적용된다는 실험 결과를 발표. 참가자들은 완전히 동일한 보너스 미지급 결정을 내렸음에도 남성 AI보다 여성 AI 관리자에게 훨씬 부정적으로 반응하여, 향후 인간-AI 상호작용에서 발생할 수 있는 잠재적 우려를 보여줌.
인공지능이 상용·정부 분야에 널리 도입되면서 실사용 환경에서의 사후 모니터링 필요성이 커지고 있다는 배경에서 NIST AI 800-4 보고서를 소개했다. 보고서는 기능·운영·인간요인·보안·컴플라이언스·대규모 영향 등 6가지 모니터링 범주를 제시하고, 각 범주별 격차(gaps)·장벽(barriers)과 함께 공통 과제(예: 신뢰할 수 있는 가이드라인 부족, 정보 공유 생태계 미성숙) 및 공개 질문을 정리했다. 특히 성능 저하와 drift 탐지, 분산 인프라의 로그 단편화, 모니터링 부담을 사용자에게 줄이는 방법, 위험 수준에 따른 모니터링 설계 등 구체적 쟁점을 강조한다.
CLTC AI Security Initiative(AISI) 연구진이 NIST 산하 CAISI의 AI 에이전트 보안 고려사항 RFI에 대한 의견서를 2026.3.9 제출했으며, 에이전트 자율성 수준에 비례한 거버넌스, 인간 통제·책임체계, 배포 후 연속 모니터링과 신속 대응, 방어적 다층화·격리, 시스템 단위 위험평가 등을 권고했다. 또한 개인정보·보안, 환각(에이전트 간 상호작용으로 인한 연쇄적 오정보), 악의적 사용(생물·화학·사이버 공격 개발 등) 우려를 구체적으로 언급했다. 정부-학계-산업-시민사회 간 표준화, 사고 보고, 인력 양성, 적응형 거버넌스 등 협력의 필요성도 강조했다.
플로리다 주정부는 AI chatbots·companion applications로 인한 아동 및 지역사회 위해를 줄이기 위해 Future of Life Institute(FLI)와 협력한다고 밝혔다. 이번 협력으로 위기 상담(Crisis Counselor Training Curriculum) 교육과, AI 제품으로 인한 위해를 주 당국에 신고할 수 있는 AI Harms Reporting Form을 마련한다. 교육은 정신건강 전문가가 AI 관련 상호작용이 심리적 고통·정서적 의존·행동 위해로 이어졌는지 식별하고 대응하도록 돕는 것을 목표로 하며, 신고 양식은 부모·교사·보호자 등 누구나 구조화된 방식으로 사례를 제출해 향후 주·연방 차원의 입법·규제에 활용될 예정이다.
미네소타 주 의회에서 AI 규제 법안들이 논의되는 가운데, 이번 회기 통과 시 18세 미만은 챗봇을 사용할 수 없게 하는 방안이 포함됐다. DFL 상원의원 Erin Maye Quade와 GOP 상원의원 Eric Lucero가 공동 발의했으며, 기술 기업이 스스로 안전장치를 마련하지 않는다는 점과 아동 보호 필요성이 근거로 제시됐다. 반면 TechNet의 AI 정책 고문은 해당 접근이 유용한 도구로부터 아이들을 차단할 수 있다고 반박했다. 이와 함께 의료적 필요성 판단에 AI 사용 제한, 고객 응대 시 AI 사용 공개 및 상담원 선택권 부여, 감시 목적 가격 책정 알고리즘 차단, deepfake 관련 기존 규제 강화 등 다른 AI 관련 조항도 함께 거론됐다.
펜타곤은 지난주 Anthropic을 ‘supply-chain risk to national security’로 지정하고 국방 목적 사용을 금지했으며, 트럼프는 다른 연방기관에도 사용 금지를 지시함
Anthropic은 펜타곤이 자사를 국가안보 위협(공급망 위험)으로 규정하고 정부와의 연계를 끊으려는 조치가 단순한 계약 분쟁을 넘어 “unlawful campaign of retaliation”이라며 소송을 제기했다. 회사는 두 건의 소송을 북부 캘리포니아 연방법원과 워싱턴 D.C. 항소법원에 각각 제출했으며, 공급망 위험 지정과 행정부 메시지가 절차를 무시하고 대통령 권한을 넘었다고 주장했다. 펜타곤과 백악관은 국방에 필요한 도구를 헌법에 따라 제공하겠다는 입장을 밝혔고, 펜타곤은 소송 관련 논평을 하지 않는다고 했다.
유럽연합 집행위원회는 인공지능 생성 콘텐츠의 표시·라벨링에 관한 인공지능법 제50조 자발적 실천규범 제2차 초안을 공개했으며, 의견 제출 기한은 3월 30일, 최종 확정은 2026년 6월 초, 투명성 규정 적용은 8월 2일로 예정됐다. 2026 국제 AI 안전 보고서는 범용 AI의 오용·오작동·시스템 위험과 평가 회피로 인한 안전성 검증의 어려움을 지적하며, 인공지능법 시행과 관련성이 크다고 평가됐다. 뉴스레터는 유럽의 AI 인재 유출과 행정 분절 문제, 디지털서비스법 집행을 위한 독립 EU 기관 설립 제안, 산업용·범용 AI 규제 완화 및 의회 개정안에 대한 우려도 다뤘다.
CodeWall은 McKinsey의 내부 AI 플랫폼 Lilli에 대해 자율형 공격 에이전트를 사용해 무인증 상태에서 프로덕션 데이터베이스에 읽기·쓰기 접근이 가능했다고 주장했다. 공개된 API 문서 중 일부 비보호 엔드포인트에서 JSON 키를 SQL에 직접 결합하는 방식의 SQL 인젝션이 발견됐고, 반복 탐색을 통해 실제 직원 식별자와 대규모 데이터가 유출되는 정황을 확인했다고 밝혔다. 또한 SQL 인젝션과 IDOR 취약점을 연계해 사용자 검색 기록 등 교차 사용자 데이터 접근 가능성, 프롬프트 레이어(시스템 프롬프트·모델 설정) 변조 시 가드레일 제거·오염된 조언·데이터 유출 유도 등 영향이 있을 수 있다고 설명했다. 책임 있는 공개 일정에 따라 McKinsey가 무인증 엔드포인트 패치 및 공개 API 문서 차단 등을 수행했다고 연구자가 서술했다.
소셜미디어에서 로맨스 상대를 찾는 이용자를 대상으로 AI로 만든 이미지·영상 등을 활용해 가짜 데이팅 후보를 홍보하는 크로스플랫폼 사기 생태계가 소개됐다. 이용자는 시니어·부유층·특정 인종 등 테마의 데이팅 사이트로 유인된 뒤, 이용료 손실과 함께 개인정보(의료·성병 관련 정보 포함) 유출 위험에 노출될 수 있다. Graphika는 최근 발견된 네트워크가 합성 미디어로 유혹하고, 여러 데이팅 사이트를 입구로 삼아 소수의 목적지 사기 도메인으로 사용자를 이동시키는 방식으로 규모와 정교함을 키운다고 분석했다.
Schmidt Sciences, NDIF, Cadenza가 LLM lie detection을 위한 Red Team vs. Blue Team 경쟁을 진행하며, Red Team은 LLM이 스스로 생성한 on-policy lies(모델이 믿는 것으로 보이지만 거짓인 진술) 데이터셋을 설계·구현해야 한다. Blue Team은 black-box/white-box/hybrid 방식으로 거짓을 탐지하는 디텍터를 만들며, 개발 과정에서 Red Team의 validation 데이터 접근과 activation steering 등 해석도구 사용 권한을 받는다. Red Team은 모델별 최소 100개 정직·100개 기만 예시를 포함하고, 라벨이 실제로 거짓을 반영한다는 검증 근거와 함께 HuggingFace private 저장소 업로드 및 4쪽 이내 보고서를 제출해야 하며, 선정 시 $10,000(컴퓨트 최대 $2,000)와 추가로 $15,000이 지급된다.
콜로라도 주 의회에서 의료 시스템의 인공지능(AI) 사용을 규율하기 위한 ‘가드레일’ 성격의 법안 2건이 논의·진전되고 있다는 내용입니다. 다만 제공된 정보에는 법안의 구체 조항, 통과 단계, 일정, 주요 쟁점이 없어 세부 내용은 확인이 필요합니다.