AI 안전 다이제스트

2024-10-30 · 2건

🇺🇸 Claude 3.5 Sonnet의 성능 향상: SWE-bench Verified에서 49% 달성 (2024.10.30)

기업 · Anthropic

Anthropic의 최신 모델인 Claude 3.5 Sonnet이 SWE-bench Verified에서 49%의 성적을 기록하며 이전 최고 기록인 45%를 경신했습니다. 이 모델은 소프트웨어 엔지니어링 작업을 수행하는 능력을 평가하는 SWE-bench 벤치마크에서 뛰어난 성과를 보여주며, 특히 개선된 도구와 스캐폴딩 덕분에 향상된 에이전트 기능을 발휘합니다. SWE-bench는 실제 오픈소스 프로젝트의 엔지니어링 작업을 기반으로 하며, 모델의 전체 에이전트 시스템 성능을 평가합니다. Claude 3.5 Sonnet은 기존 모델들보다 높은 추론, 코딩, 수학 능력을 보여주며, 에이전트 도구와 설계의 최적화로 인해 더욱 우수한 성과를 달성했습니다. SWE-bench Verified 점수는 다음과 같습니다:

- Claude 3.5 Sonnet (신규): 49% - 이전 최고 모델 (Claude 3.5 Sonnet 이전 버전): 45% - Claude 3 Opus: 33%

이 성과는 모델 자체의 능력 향상뿐만 아니라 에이전트 시스템 설계의 정교함에 기인합니다.

🇺🇸 Commerce 연방 AI 규제 제안, 주목받지 못해 (2024.10.30)

공공 · Law-AI-Institute · 🛡️

BIS(Bureau of Industry and Security)가 제안한 새로운 규칙은 미국에서 가장 중요한 AI 규제 중 하나로, AI 모델 훈련과 관련된 정기적인 보고 의무를 부과한다. 이 규칙은 고급 AI 모델, 특히 "이중 사용 기반 모델"에 대한 정보 수집을 허용하여 정부가 AI 시스템의 안전성과 국가 안보에 대한 최신 정보를 확보할 수 있게 한다. 이는 자발적인 정보 공유와 달리 법적으로 강제력이 있어 준수하지 않을 경우 처벌을 받을 수 있다. 그러나 이 제안은 법적 논란에도 불구하고 큰 주목을 받지 못하고 있다. 주요 비판은 주로 DPA(Defense Production Act)의 평화 시기 사용에 대한 우려지만, 법적 측면에서는 합법적이라는 평가가 주를 이룬다. 이 규칙은 국가 안보와 국방 산업 기반에 대한 최신 정보 확보를 목표로 하고 있다.