아프리카의 AI 위험을 선거 개입을 돕는 딥페이크, 데이터 식민 의존, 컴퓨트 자원 부족, 노동시장 교란, 기후 비용의 불균형 노출 등으로 정리하고, 현재 글로벌 AI safety 논의에 아프리카 관점이 충분히 반영되지 못했다고 지적한다. 이에 아프리카 취약계층의 인권 보호를 우선하는 정책, 아프리카 AI Safety Institute 설립, 공공 AI 리터러시·인식 제고, 25개+ 아프리카 언어를 포함한 조기경보 시스템과 벤치마크 개발, AU(아프리카연합) 수준의 연례 AI Safety & Security Forum 개최를 포함한 5점 실행계획을 제안한다.
Anthropic은 Claude의 유용성을 높이면서도 실제 피해로 이어질 수 있는 오남용을 막기 위해 Safeguards 팀이 정책·학습·평가·실시간 집행·모니터링 전 과정을 다룬다고 밝혔다. Usage Policy를 기반으로 Unified Harm Framework와 Policy Vulnerability Testing을 통해 위험을 파악하고, fine-tuning 및 system prompt 조정, 안전·편향·고위험 도메인 평가를 사전 수행한다. 배포 후에는 classifier 기반 탐지와 CSAM 해시 대조, response steering 및 계정 수준 집행(경고·종료 가능) 등을 통해 위반을 실시간으로 억제하며, 계층 요약·threat intelligence·공개 threat intelligence reports 등으로 지속적으로 공격 패턴을 추적한다.
K-AISI 주간동향 · 호주 의사협회(Australian Medical Association, AMA) · 🏥
호주 의사협회(AMA)는 의료 분야 AI 도입·규제에 대해 보건 전문가로 구성된 전담 그룹을 만들어 임상 리더십과 가이드를 제공할 것을 촉구했다. AMA는 AI가 환자 안전·프라이버시·윤리·위험 관리를 위한 견고한 체계와 정기적 검토가 필요하며, AI는 임상의 판단을 대체하지 않는 보조 도구여야 한다고 밝혔다. 또한 환자 진료의 최종 결정은 반드시 인간이 내려야 한다고 강조했다.
Anthropic은 연방 민간인 행정부 기관, 입법부, 사법부를 포함한 미국 정부의 세 기관 모두에게 Claude AI 서비스를 $1의 비용으로 제공하여 정부의 AI 채택 장벽을 제거하고 있습니다. 이 서비스는 민감하지 않은 민감 정보 작업을 위한 FedRAMP High 인증을 받은 'Claude for Government'와 기업용 'Claude for Enterprise'를 포함합니다. 기술 지원도 함께 제공되어 연방 기관들이 AI를 빠르게 업무에 통합할 수 있도록 돕습니다. 이미 국방부와 로렌스 리버모어 국립연구소 등에서 Claude가 중요한 임무를 지원하고 있으며, 이 확장된 접근성은 정부 부문의 복잡한 도전 과제 해결을 위한 최첨단 AI 기술의 접근성을 높이는 데 중점을 둡니다. 참여를 원하는 기관은 pubsec@anthropic.com으로 연락하면 됩니다.
METR의 연구자들은 AI의 영향을 설명하는 데 있어 정확성과 독자의 오해를 최소화하는 균형을 찾는 데 주력하고 있다. 특히, 예상치 못한 연구 결과를 전달할 때, 결과를 왜곡하지 않으면서도 독자가 올바르게 해석할 수 있도록 하는 커뮤니케이션 전략을 고려한다. 예를 들어, 개발자 생산성 연구에서 AI 도구 사용이 개발자의 생산성을 저하시킨 결과를 전달할 때, "AI가 개발자를 느리게 만든다"는 표현 대신 "개발자들이 AI를 통해 예상보다 더 느린 속도로 작업을 수행한다"는 방식으로 결과를 설명함으로써 오해를 줄이려 노력한다. METR은 정확성과 연구의 엄격성을 우선시하면서도, 결과의 영향력을 극대화하려는 시도와 균형을 맞추는 데 중점을 둔다.
OpenAI가 빠른 응답과 추론 작업에 특화된 두 모델을 결합한 시스템 GPT-5를 출시했으며, Humanity’s Last Exam·SWE-bench Verified 등 여러 평가에서 최고 수준의 성능을 보였다. GPT-5의 환각률은 이전 모델보다 낮아졌고, 의료 대화에서 GPT-5(thinking)는 1.6%로 o3의 12.9%보다 낮았지만, 일부 추상적 패턴 인식·코딩 평가에서는 Grok 4나 o3에 뒤졌다. 뉴스레터는 GPT-5를 GPT-4 이후 검색·도구 사용, 추론, 이미지 처리, 긴 문맥 등 OpenAI의 개선 사항을 통합한 모델로 평가했으며, 미국의 AI 정책·반도체 수출 규제와 Anthropic의 Claude Opus 4.1 출시 등 관련 소식도 전했다.