AI 안전 다이제스트

2026-04-13 · 28건

Kimi K2.6 (Moonshot AI) (2026.4.13)

기업 · DemandSphere · 🔓🚀

Reasoning · Open · 262K ctx · $0.6/M · $2.5/M

벤치마크 미공개

1T MoE / 32B active. Four variants: Instant, Thinking, Agent, Agent Swarm (300 sub-agents, 4K coordinated steps). Open-weight, Modified MIT. 262K context.

🇺🇸 스탠퍼드 HAI, '2026년 AI 인덱스 보고서' 발간 (2026.4.13)

K-AISI 주간동향 · Stanford HAI · 📜

스탠퍼드 대학교 HAI는 2026년 AI 지수 보고서를 발표했으며, 동 보고서에서 기술 성능, 경제, 정책 등 전 분야에서 미국과 중국의 격차가 좁혀지고 세계적으로 AI 채택률이 기하급수적으로 늘어났다고 밝힘. 모델 성능은 고도화되었지만 책임감 있는 AI 조치는 여전히 뒤처져 관련 사고가 급증했으며, 전 세계적으로 AI 인프라 주권과 규제를 둘러싼 복잡한 지형이 형성되고 있음을 조명.

유네스코·톰슨 로이터 재단, 기업의 책임 있는 AI 정보 공개 현황 분석 보고서 발간 (2026.4.13)

K-AISI 주간동향 · UNESCO · 📜

유네스코와 톰슨 로이터 재단은 세계 최대 규모의 기업 AI 정보 공개 데이터를 바탕으로 민간 기업의 책임 있는 AI 실천 및 거버넌스 현황을 분석한 보고서를 발표. AI 기술 도입 속도에 비해 기업의 거버넌스와 투명성이 뒤처져 있음을 지적하며, 단순한 기술적 설명을 넘어 의사결정 주체 및 피해 구제 절차 등 실질적 책임을 규명할 것을 정부 수준의 기준으로 촉구.

AI 거버넌스 진단 평가(2026.4.13)

기업 · AI Career Pro(assess.aicareer.pro)

무료 15분 진단형 평가이며, 결과는 즉시 제공됨

AI 거버넌스를 수행하는 개인과 조직을 대상으로 역량·조직 역량을 진단하는 ‘Adaptive Governance Assessment’(두 가지 평가)를 제공한다. 개인은 지식·적용·자원·영향력·판단 등 5개 차원에서, 조직은 가시성·리스크·통합·리더십·역량 등 5개 차원에서 현재 수준과 보완점을 확인하도록 설계되어 있다. 각 평가는 평가(합격/불합격)가 아니라 진단이며, 결과는 성숙도 프로필 형태로 제시되고 개인-조직 역량의 정합성도 함께 볼 수 있다.

🇺🇸

공공 · Epoch AI(에폭 AI) 뉴스레터 Epoch AI Gradient Updates · 🦾

이란-미국(및 이스라엘)의 전쟁으로 호르무즈 해협을 통한 해상 운송이 크게 차질을 빚었고, 2026년 4월 8일 2주간 휴전 합의가 있었지만 운송 재개가 즉각적이지 않다고 설명한다. 호르무즈 폐쇄는 LNG 등 에너지 공급 차질로 유럽·아시아의 가스·전기 비용을 끌어올려, 특히 데이터센터의 신규 투자에는 비용 부담이 커질 수 있다고 본다. 다만 반도체 파운드리(fab)는 높은 수익성과 전력비 비중이 낮아, 전쟁이 급격히 확대되지 않는 한 AI 칩 생산 자체를 크게 흔들 가능성은 낮다고 평가한다. 또한 페르시아만 지역의 드론·미사일 공격이 걸프 지역 데이터센터 운영 차질이나 투자 보류로 이어질 수 있으며, 이는 지정학적 리스크 인식에 의해 더 확대될 수 있다고 언급한다.

공공 · ⚖️🛡️🚀

출처: Center for AI Safety(뉴스레터 safe.ai)

AI 소프트웨어 인프라를 노린 대규모 사이버공격이 발생해 개발자 컴퓨터에 백도어를 심고, 머코(Mercor)에서 개인·생체정보 등 민감 데이터가 탈취·경매된 정황이 전해졌다. 또한 LLM이 사이버공격 수행 장벽을 낮추고 복제 가능해져 공격이 더 광범위하고 저비용으로 확산될 수 있다는 내용이 포함됐다. 한편 버니 샌더스·알렉산드리아 오카시오-코르테스가 AI 데이터센터 건설을 안전 조건 충족 전까지 금지하고 ‘상응하는’ 안전조치가 없는 국가로의 수출을 막는 법안을 발의했으며, 앤트로픽은 미 국방부(DoW)의 공급망 위험(SCR) 지정에 대해 소송을 제기해 예비금지명령을 받은 것으로 정리됐다.

🇺🇸 The AI Doc 상영(미국 2026.3.27) 및 AI 로드맵·7대 원칙 소개 (2026.4.13)

공공 · humanetech.com

미국 내 영화 상영 시작: 2026.3.27

The AI Doc 영화가 미국에서 3월 27일부터 상영되며, 관람 후에는 무엇을 해야 하는지에 대한 질문을 이어가도록 구성되어 있다. 페이지는 AI 로드맵과 7대 원칙을 통해 안전·투명한 AI 구축, 기업의 공공에 대한 책임, 인간의 안녕 중심 설계, 의미 있는 일과 존엄의 보존, 권리·자유 침해 방지, 국제적 한계 설정, 사회 내 AI 권력 균형 등을 제시한다. 또한 일반 시민이 AI 의사결정에 참여하기 위한 ‘Human Movement’ 참여를 유도한다.

트럼프의 주(州) AI 규제 무력화(선점) 추진이 지연(2026.4.13)

언론 · axios.com · ⚖️

본문 확인 필요

트럼프가 주(州) 차원의 AI 규제를 연방법/연방 차원으로 대체하려는 ‘선점(preemption)’ 추진이 지연되고 있다는 내용입니다. 다만 본문 세부 내용(지연 원인, 관련 법안/절차, 이해관계자 반응)은 제공되지 않아 확인이 필요합니다.

🇺🇸 Anthropic, 워싱턴 D.C. 내 존재감 확대(2026.4.13)

언론 · axios.com · 🚀

Anthropic이 워싱턴 D.C.에서의 활동(존재감)을 확대한다는 내용의 기사로 보입니다. 다만 본문 정보가 없어 구체적인 조치(예: 인력·사무소·정책 대응 범위)와 일정은 확인이 필요합니다.

트럼프의 AI 계획 관련, 의회가 주(州) 규정을 우선해 재검토하도록 촉구(2026.4.13)

언론 · axios.com

확인 필요: 본문 내용(구체적 조항·일정·요구사항) 확인 필요

트럼프 행정부의 AI 계획이 의회에 대해 주(州) 차원의 규정을 뒤집거나 우선순위를 재조정하도록 촉구한다는 취지로 보인다. 다만 기사 본문을 확인하지 못해 구체적인 정책 내용과 근거, 적용 범위는 확인 필요다.

🇺🇸 미국인들은 AI 가드레일을 원하지만 핵심 ‘트레이드오프’에는 저항(2026.4.13)

언론 · Axios · 🧪

미국 내 설문 결과를 바탕으로, 응답자들이 AI 가드레일(안전장치) 도입에는 대체로 찬성하는 경향이 있다는 내용입니다. 다만 가드레일을 위해 수반될 수 있는 비용·제한 등 핵심 트레이드오프에 대해서는 반대 또는 수용이 낮게 나타났다고 전해집니다. 구체 수치와 조사 방법, 어떤 트레이드오프 항목에서 저항이 컸는지는 본문 확인이 필요합니다.

🇪🇺 EU, Anthropic의 신형 Claude Mythos 출시 지연(단계적 롤아웃)에 대해 사이버 위험 우려를 이유로 환영 (2026.4.13)

언론 · POLITICO.eu · 🔒

유럽 집행위는 Anthropic과 EU AI 규정·코드에 따른 사이버보호 이행 방식에 대해 대화를 진행 중이라고 밝혔으나 구체 내용은 공개하지 않음

유럽 규제당국은 Anthropic이 신형 모델 Claude Mythos의 출시를 미루기로 한 결정을 대규모 사이버 침해로 이어질 수 있다는 우려와 관련해 환영했다. 유럽 집행위 대변인은 “대규모 사이버 위험 가능성이 있어 단계적 롤아웃을 환영한다”고 밝혔다. Anthropic은 Claude Mythos가 소프트웨어 취약점을 찾아 악용하는 데서 대부분의 인간보다 성과가 좋았다고 평가한 뒤, 12개 사이버보안 기업 등 40개 내외 조직에 모델 접근을 제공해 방어 역량 구축과 시스템 점검·스트레스 테스트를 돕도록 했다고 전했다. 또한 EU AI 규정에 따라 적절한 수준의 사이버보호를 갖추고, 대규모 정교한 사이버공격을 가능하게 하는 위험을 다루는 EU 코드에도 참여했다고 설명했다.

🇺🇸 (2026.4.13) 이란 IRGC, 4월 1일 이후 미국 주요 IT 기업 공격 예고

언론 · WIRED(wired.com) · 🛡️🦾

4월 1일(테헤란 기준 오후 8시 이후)부터 공격이 시작될 수 있다고 경고 이란 혁명수비대(IRGC)가 4월 1일(테헤란 기준 오후 8시 이후)부터 미국의 주요 IT·기술 기업을 포함해 중동 지역에서 공격을 시작할 수 있다고 경고했다. 애플, 구글, IBM, 인텔, 마이크로소프트, 테슬라, 보잉 등이 명단에 포함됐으며, 이들 기업이 미국의 군사 표적 작전에 기여했다고 주장했다. IRGC는 직원 대피와 지역 민간인 접근 자제를 촉구했으며, 앞서 3월에 아마존웹서비스(AWS) 데이터센터에 대한 드론 공격과 금융·결제·소비 서비스 장애 등도 언급됐다.

🇨🇳 ChinAI #354: 업계 뒷이야기—연체된 학습비 지급과 과장된 embodied AI (2026.4.13)

언론 · ChinAI · 🦾

중국의 한 주요 LLM 기업이 지난해 클라우드 업체에 1억 위안이 넘는 학습비를 연체했으며, 다른 AI 기업도 수개월간 임금을 지급하지 못했다는 업계 소문을 소개한다. 한 대형 기술기업은 1년 안에 실물 데이터 100만 시간을 수집하겠다고 홍보했지만, 실제 데이터 수집용 물리 로봇은 30대에 불과해 고객들의 실망을 샀으며 해당 규모에는 약 1,000대가 필요하다고 전한다. 중국 AI 칩 기업들은 대기업 인수 협상이 잇따라 무산된 뒤 상하이 과학기술혁신판이나 홍콩증시에 상장했고, 일부 컴퓨팅 기업은 보상체계 조정과 소프트웨어 분야 전환을 검토하고 있다.

NeurIPS 2026 포지션 페이퍼 트랙 모집(2026.4.13)

기타 · neurips.cc

제출 일정: OpenReview 제출 사이트 오픈 2026.4.15, 본논문 제출 마감 2026.5.6(AoE), 최종 결정 발표 2026.9.24 NeurIPS 2026에서 포지션 페이퍼(관점·입장을 주장하는 글)를 모집하며, 다른 트랙의 ‘이미 이뤄진 성과 보고’와 구분된 트랙으로 운영된다. 심사는 참신성·엄밀성·중요성(논쟁의 동시대성)을 중심으로 하되, 포지션 트랙은 더 넓은 방법론을 허용하고 중요성 판단 기준을 달리한다. 제출물은 명확한 입장 제시, 3문장 이내로 핵심 주장 요약 가능, 타깃 커뮤니티의 논의 필요성 설득, 엄밀한 근거 제시, 토론과 반박(선택)을 포함해야 하며, 다른 트랙에 해당하거나 문헌리뷰 성격인 경우는 부적합하다. 또한 제출·리뷰 과정에서 AI 사용에 대한 가드레일(최종 원고는 인간이 실질적으로 작성, 리뷰 작성에 AI 사용 금지 등)을 명시하고, OpenReview를 통해 제출하며 계정 생성 마감(2026.4.21 AoE)과 본논문 마감(2026.5.6 AoE) 등 주요 일정이 안내된다.

AI R&D를 ‘사과 따기’로 비유한 모델 제안(2026.4.13)

기타 · tecunningham.github.io · 🤖

AI R&D에서 자율 에이전트가 프런티어를 밀어낼 수는 있지만, 일정 수준 이후에는 수익이 급격히 감소한다는 ‘사과 따기(apple-picking) 모델’을 제시한다. 에이전트는 낮은 높이의(쉽게 도달 가능한) 최적화는 빠르게 찾지만, 이미 인간/이전 작업으로 어느 정도 정리된 상태에서는 추가 개선 효과가 줄어든다고 설명한다. 또한 2026년 3월 기준 에이전트의 효과를 인간 노동 시간(대략 1주~1개월 수준의 상당치)으로 환산할 수 있으나, 반복 실행한다고 해서 효과가 선형으로 누적되지는 않는다고 주장한다. AlphaEvolve, autoresearch, nanoGPT speedrun, TTT-Discover 등 사례를 들어 에이전트가 특정 최적화 문제에서 성과를 내고(일부는 누적·적층되는 개선), 다만 개선의 깊이/종류에 따라 효과가 달라질 수 있음을 함께 논의한다.

🇰🇷 「DIR26-1」 정보화에서 디지털포용까지 디지털포용 30년사(2026.4.13)

공공 · 한국지능정보사회진흥원(NIA) · ⚖️

본 보고서는 「정보화촉진 기본법」부터 「디지털포용법」까지의 법과 사업을 종합 분석해 AI시대 전환에 대응한 디지털포용 정책 추진 방향을 도출하는 것을 목적으로 한다. 지난 30년간 디지털포용 관련 법률과 정책 대상·추진체계의 변화를 살펴보고, 데이터 기반 운영과 제도적 기반 강화를 통해 지속가능한 정책 추진체계를 구축할 필요가 있음을 제시한다. 디지털 기술 확산이 새로운 격차와 위험을 동반하므로 사전 예방적·통합적 정책 접근과 민관 협력 기반의 정책 전환이 필요하다고 결론 내린다.