AI 안전 다이제스트

2025-10-03 · 4건

🇺🇸 AI 기반 사이버 방어자 지원을 위한 AI 개발 (2025.10.3)

기업 · Anthropic · 🔒

Anthropic은 사이버 보안 분야에서 AI의 활용을 강화하기 위해 노력하고 있으며, 특히 Claude 모델 시리즈를 통해 사이버 공격자들에 대항하는 방어자들을 지원하고 있습니다. 최근 업데이트된 Claude Sonnet 4.5 모델은 코드 취약점 탐지, 패치 작성, 그리고 시뮬레이션된 보안 인프라의 약점 테스트 등 중요한 사이버 보안 작업에서 뛰어난 성능을 보여주고 있습니다. Cybench와 CyberGym 같은 평가 지표에서 Claude Sonnet 4.5는 이전 모델들보다 향상된 성과를 기록했습니다. 이 모델은 기존 취약점을 찾아내고 해결하는 능력뿐만 아니라 새로운 취약점을 발견하는 데서도 우수한 성과를 보여주고 있습니다. 또한, 보안 파트너들과의 협력을 통해 실제 사이버 보안 문제 해결에 Claude 모델이 효과적으로 활용되고 있음을 확인했습니다. 이러한 발전은 사이버 보안 분야에서 AI의 역할을 더욱 강화하고, 공격자들에 대항하는 방어자들의 능력을 향상시키는 중요한 전환점이 될 것으로 보입니다.

AI 기반 사이버 방어자 지원을 위한 AI 개발 (2025.10.3)

기업 · Anthropic Research · 🔒

Claude Sonnet 4.5 모델은 사이버 취약점 탐지, 분석, 보완 능력에서 이전 모델들을 능가하며, 특히 Cybench와 CyberGym 평가에서 뛰어난 성과를 보였다. 이 모델은 기존 취약점을 찾아내고 보완하는 데 효과적이며, 새로운 취약점을 발견하는 능력도 향상되었다. 또한, 보안 팀과 연구 기관들이 실제 사이버 보안 문제 해결에 활용할 수 있도록 파트너들과 협력하여 모델의 실용성을 강화하고 있다. 이러한 발전은 사이버 보안 분야에서 AI의 활용을 가속화하고, 공격자들보다 앞서 나갈 수 있는 중요한 시점을 제공한다.

🇯🇵 AISI事業実証WG上期報告会 개최(2025.10.3)

공공 · 독립행정법인 정보처리추진기구(IPA) 보도자료 · 📏🏥🦾

AISI(인공지능 세이프티·인스티튜트)는 2025년 10월 2일 AISI 사업실증 워킹그룹(WG) 상반기 활동에 대한 첫 보고회를 열었다. 행사에는 온라인을 포함해 약 80명이 참석해 2025년도 상반기 진행 상황을 공유하고 하반기 및 차년도 사업실증의 추가 전개를 위한 정보 공유와 의견 교환을 진행했다. 헬스케어·로보틱스·데이터 품질·적합성 평가 등 각 SWG는 AI 세이프티 평가 가이드/체크리스트, 안전 설계·평가 방법, 평가 도구 정비, 국제규격 기반 적합성 평가 제도(안) 검토 등 추진 상황을 보고했다.

🇺🇸 마이클 클라인먼, 획기적인 AI 안전 법안에 논평 (2025.10.3)

공공 · 미래생명연구소(FLI) · ⚖️🗳️🧪

미래생명연구소의 미국 정책 책임자 마이클 클라인먼은 개빈 뉴섬 캘리포니아 주지사의 SB 53 서명을 환영하며, 고도화된 AI 시스템에 대한 기본적인 안전장치 마련이 시작됐다고 평가했다. 그는 공화당원의 82%와 전체 유권자의 70% 이상이 AI 규제 또는 정부의 안전 기준 마련을 지지한다고 밝혔다. 또한 연방 차원의 강력한 AI 안전 기준이 마련될 때까지 각 주가 관련 규제를 계속 추진할 수밖에 없다고 주장했다.