AI 안전 다이제스트

2025-03-19 · 2건

🇺🇸 캘리포니아 주지사 뉴스옴의 AI 프론티어 모델 작업 그룹 초안 보고서에 대한 응답 (2025.3.19)

기업 · Anthropic · 📋🛡️🚀

Anthropic은 캘리포니아 주지사 뉴스옴의 AI 프론티어 모델 작업 그룹이 발표한 초안 보고서에 대해 긍정적으로 반응했습니다. 보고서의 투명성 강조와 객관적인 기준, 증거 기반 정책 지침의 필요성에 동의하며, 특히 모델 보안과 국가 안보 위험에 대한 공개적인 설명의 중요성을 강조했습니다. Anthropic은 이미 자체 안전 및 보안 정책을 공개적으로 공유하고 있으며, 모델 테스트 결과와 외부 테스트 결과를 공개하고 있습니다. 정부는 이러한 투명성을 증진시키는 데 건설적인 역할을 할 수 있으며, 이는 혁신을 저해하지 않는 방식으로 이루어질 수 있습니다. 또한 경제적 영향 등 다른 중요 영역에 대한 추가적인 논의를 환영하며, 최종 보고서 완성에 도움을 줄 것입니다.

AI 에이전트가 수행 가능한 ‘장시간 작업’ 길이를 지표로 제안(2025.3.19)

DB · METR(Machine Intelligence Research Institute) 블로그 · 🤖

METR은 AI 에이전트 성능을 “인간 전문가가 걸리는 시간 기준으로, AI가 자율적으로 완료할 수 있는 작업의 길이”로 측정하는 방식을 제안한다. 지난 6년간 이 지표가 지수적으로 증가했으며, 50% 성공 기준 작업 완료 시간의 두 배가 되는 데 약 7개월이 걸렸다고 설명한다. 또한 이러한 추세를 외삽하면 10년 내에 인간이 며칠~몇 주가 걸리는 소프트웨어 작업의 상당 부분을 AI 에이전트가 독립적으로 수행할 수 있을 것으로 전망한다. 인간 작업 소요 시간이 모델 성공률을 강하게 예측하며, 단일 단계 지식·텍스트 예측은 이미 인간을 크게 앞서지만 장시간의 연속 행동을 안정적으로 수행하는 데는 아직 한계가 있다고 덧붙인다.