AI 안전 다이제스트

2025-10-16 · 3건

🇺🇸 Anthropic, 에이전트 스킬 소개 및 기능 확장 (2025.10.16)

기업 · Anthropic · 📋🚀

Anthropic은 새로운 기능인 '에이전트 스킬(Agent Skills)'을 발표하여 Claude 플랫폼의 성능을 향상시켰습니다. 에이전트 스킬은 특정 작업에 필요한 지침, 스크립트, 리소스를 포함하는 폴더로, 필요할 때만 로드되어 효율성을 유지합니다. 이 기능은 조직 전체에서 스킬을 관리하고 파트너가 구축한 스킬 디렉토리를 제공하며, 교차 플랫폼 호환성을 위한 오픈 표준으로 공개되었습니다. 스킬을 활용하면 Excel 작업이나 조직의 브랜드 가이드라인 준수와 같은 전문적인 작업을 더 잘 수행할 수 있습니다. 개발자와 사용자는 스킬을 생성, 관리, 확장하여 다양한 작업을 자동화하고 효율성을 높일 수 있습니다. 하지만 코드 실행 기능을 제공하기 때문에 신뢰할 수 있는 출처에서 스킬을 사용하는 것이 중요합니다.

🇺🇸🇨🇳 AI 안전 뉴스레터 64호: 새로운 AGI 정의와 AI 피해에 대한 책임을 규정하는 상원 법안 (2025.10.16)

공공 · 인공지능 안전 센터(CAIS) · ⚖️

미국 상원의 AI LEAD Act는 AI 시스템을 제품으로 규정하고, 설계·경고·보증상의 과실이나 결함으로 피해가 발생하면 AI 기업이 책임지도록 하며, 배포자의 위험한 수정·오용에도 책임을 부과하는 내용을 담고 있다. 중국은 희토류 금속과 전기차 배터리 제조 장비의 수출 통제를 강화해 각각 12월 1일과 11월 8일부터 시행할 예정이며, 미국은 중국산 제품에 대한 추가 관세와 핵심 소프트웨어 수출 통제를 11월 1일부터 시행한다고 발표했다. 새 연구는 AGI를 교육받은 성인 수준의 인지적 다양성과 능숙함을 충족하는 AI로 정의하고 10개 인지 영역을 평가하는 AGI 점수를 제안했으며, GPT-4의 점수는 27%, 예상 GPT-5는 58%로 추정하고 현재 모델의 장기기억 저장 능력은 거의 0%라고 분석했다.