AI 안전 다이제스트

2025-05-14 · 2건

🇰🇷 첨단 그래픽 처리장치(GPU) 1만 장 연내 확보 및 국내 인공지능 생태계 순차 지원 (2025.5.14)

공공 · 과학기술정보통신부

정부는 총 1조 4,600억 원 규모의 추가경정예산을 바탕으로 첨단 GPU 1만 장을 확보하기 위한 추진 방안을 마련했다. 민관 협력을 통해 GPU 구매·구축·사용 전 과정을 진행하고, 클라우드 기업을 공모·선정해 신속히 확보·운용할 계획이다. 구축된 GPU는 국가 인공지능 컴퓨팅 센터를 중심으로 국내 산학연과 국가적 프로젝트에 전략적으로 배분한다.

🇺🇸 Anthropic, 새로운 버그 바운티 프로그램으로 안전 장치 테스트 시작 (2025.5.14)

기업 · Anthropic · 🛡️🔒🧪🚀

Anthropic은 최신 안전 조치를 스트레스 테스트하기 위해 새로운 버그 바운티 프로그램을 시작했습니다. 이 프로그램은 HackerOne과 협력하여 진행되며, 참여자들은 업데이트된 Constitutional Classifiers 시스템을 통해 Claude 3.7 Sonnet 모델의 보편적인 '탈옥' 취약점을 찾아내는 데 집중합니다. 특히 CBRN(화학, 생물학, 방사능, 핵) 관련 주제에서의 악용 가능성을 탐색합니다. 발견된 보편적인 취약점에 대해 최대 $25,000의 보상을 제공하며, 프로그램은 5월 18일까지 진행되었습니다. 이 노력은 AI 안전성 수준 3(ASL-3) 표준을 충족하기 위한 Anthropic의 책임 있는 확장 정책의 일환입니다. 이후 새로운 버그 바운티 프로그램이 시작되어 Claude Opus 4 모델의 안전성을 테스트하고 있습니다. 또한, 생물학적 위협 관련 정보를 유발할 수 있는 보편적인 취약점에 대한 공개 플랫폼 보고도 수용하고 있습니다.