AI 안전 다이제스트

2025-09-29 · 5건

🇺🇸 Claude Sonnet 4.5 (Anthropic) (2025.9.29)

기업 · DemandSphere · 🚀

General · Closed · 200K ctx · $3/M · $15/M

GPQA 83.4% · SWE 77.2% · MMLU 82% · HE 94% · MATH 88% · AIME 87%

Leading coding model. 77.2% SWE-bench Verified. 30+ hour autonomous task operation. Computer use, extended thinking.

🇺🇸 Claude Sonnet 4.5 최신 버전 출시 (2025.9.29)

기업 · Anthropic · ⚖️

Claude Sonnet 4.5는 세계 최고의 코딩 모델로, 복잡한 에이전트 구축과 컴퓨터 활용에 최적화되어 있으며 추론과 수학 능력에서 획기적인 향상을 보여줍니다. 이번 업데이트는 코드 편집 기능 강화, 터미널 인터페이스 개선, VS Code 확장 프로그램 추가 등 다양한 기능 향상을 포함하며, 특히 코드 진행 상태 저장 및 롤백 기능이 새롭게 도입되었습니다. 또한, 이 모델은 다양한 분야에서 뛰어난 성능을 보여주며 특히 금융, 법률, 의학, STEM 분야에서 이전 모델 대비 크게 향상된 도메인 특화 지식과 추론 능력을 제공합니다. 보안 측면에서도 개선되어 위험 감소에 기여하며, 개발자들을 위한 Claude Agent SDK도 공개되어 다양한 작업에 활용 가능합니다. 가격은 이전 버전과 동일하게 유지됩니다.

앤써픽, 클라이드 코드 자율성 향상 업데이트 발표 (2025.9.29)

기업 · 앤써픽

앤써픽은 클라이드 코드의 기능을 향상시키는 여러 업데이트를 발표했습니다. 이 업데이트에는 VS Code 확장 프로그램, 터미널 인터페이스 버전 업그레이드, 그리고 자율 운영을 위한 체크포인트 기능이 포함됩니다. 클라이드 코드는 이제 더 복잡하고 긴 개발 작업을 터미널과 IDE에서 처리할 수 있습니다. 주요 업데이트 내용은 다음과 같습니다:

- VS Code 확장 프로그램: 클라이드 코드를 IDE 내에서 실시간으로 확인할 수 있는 사이드바 패널을 제공합니다. - 터미널 인터페이스 개선: 상태 표시 개선과 검색 가능한 프롬프트 이력 기능을 추가하여 이전 프롬프트를 쉽게 재사용하거나 수정할 수 있습니다. - 클라이드 에이전트 SDK: 사용자 정의 에이전트 경험을 구축하기 위한 도구와 기능을 제공합니다. - 체크포인트 기능: 복잡한 작업 중 코드 변경 전후 상태를 자동으로 저장하여 작업의 안정성을 높입니다.

이러한 기능들은 클라이드 코드가 더욱 자율적으로 작동하도록 지원하며, 개발자들이 복잡한 작업을 더욱 신뢰성 있게 수행할 수 있게 합니다. 업데이트는 현재 클라이드 코드 사용자들에게 즉시 제공됩니다.

(2025.09.29) SB-53, Frontier AI 대형 개발자에 ‘Frontier AI framework’ 공개·위험 평가 보고 의무 등 신설

공공 · 캘리포니아 주 의회 입법정보(leginfo.legislature.ca.gov) · 🚀🚨

캘리포니아 SB-53은 ‘Transparency in Frontier Artificial Intelligence Act(TFAIA)’를 제정해, 2022년 이후 출시(또는 중대한 수정)된 생성형 AI 중 ‘frontier model’을 개발하는 대형 개발자에게 인터넷 웹사이트에 frontier AI framework를 작성·구현·명확히 공개하도록 요구합니다. 또한 내부 사용으로부터 발생할 수 있는 catastrophic risk 평가 요약을 Office of Emergency Services에 제출하고, 공공이 critical safety incident를 신고할 수 있는 메커니즘과 대형 개발자가 위험 평가 요약을 기밀로 제출할 수 있는 메커니즘도 마련하도록 합니다. critical safety incident 및 특정 위험 평가 보고는 California Public Records Act 적용에서 제외되며, 미준수에 대해 Attorney General이 민사상 제재(민사벌)를 집행하고, covered employee에 대한 whistleblower 보호 및 익명 내부 신고 절차도 포함합니다.

AI 여행 계획 시 주의해야 할 위험들 (2025.9.29)

DB · AIID · 🚨

AI 도구를 이용해 여행 계획을 세울 때 여행객들은 정보의 정확성을 철저히 확인해야 한다. 실제 존재하지 않는 장소로 안내되거나 위험한 상황에 처할 수 있는 위험이 있기 때문이다. 예를 들어, AI가 생성한 잘못된 장소 정보로 인해 비용 낭비와 심지어 생명의 위협까지 받을 수 있다. AI의 정보 생성 방식으로 인해 실제와 가상의 경계가 모호해져 여행객들이 실제 세계와 AI가 만든 상상의 세계 사이에서 혼란을 겪을 수 있다는 경고가 제기되었다. 전문가들은 구체적인 질문을 하고 모든 정보를 검증하는 것이 중요하다고 조언한다.