AI 안전 다이제스트

2025-02-14 · 2건

🇺🇸 Anthropic와 영국 정부, AI로 공공 서비스 혁신 MOU 체결 (2025.2.14)

기업 · Anthropic

Anthropic는 영국 정부와 협력하여 고급 AI 기술을 활용해 영국 공공 서비스를 혁신하는 방안을 탐색하기 위해 양해각서(MOU)를 체결했습니다. 특히, Anthropic의 AI 모델인 Claude를 통해 시민들이 정부 정보와 서비스를 온라인으로 더 효과적으로 접근하고 상호작용할 수 있도록 하는 데 초점을 맞출 계획입니다. 이 협력은 AI의 윤리적이고 안전한 적용을 위한 최선의 관행을 설정하는 것을 포함하며, 영국의 AI 혁신과 경제 발전을 지원하기 위한 여러 분야에서 추가적인 협력 기회를 모색할 예정입니다. 이를 통해 영국은 AI 기반 미래에 대비한 인력 전략과 혁신 전략을 개발할 수 있을 것입니다.

🇺🇸 자동화된 커널 엔지니어링 측정 연구 (2025.2.14)

공공 · METR

METR은 자동화된 커널 엔지니어링의 측정을 통해 AI 개발 속도를 높이는 AI의 능력을 평가하는 연구를 발표했습니다. 연구에서는 AI가 GPU 커널을 최적화하는 능력을 측정하기 위해 수정된 KernelBench 테스트 세트를 사용했습니다. 주요 발견으로는 KernelAgent를 활용한 모델들이 기존 KernelBench 리더보드 대비 평균 1.81배의 속도 향상을 보였으며, 특히 o3-mini 모델은 1.81배의 속도 향상을 달성했습니다. 이 연구는 모델들이 실제 ML 작업에 비용 효율적인 속도 향상을 제공할 수 있음을 보여주며, 최근 6개월 동안의 성능 향상이 두 배로 증가했다는 점을 강조합니다. 그러나 실제 세계의 커널 엔지니어링과의 차이와 평가의 한계점도 지적되었습니다.