Anthropic은 도쿄에 첫 아시아태평양 사무소를 개장하고 일본 AI 안전 연구소와 협력 양해각서를 체결했습니다. CEO Dario Amodei는 도쿄에서 총리와의 만남, 정부 관계자들과의 대화, 고객 미팅 등을 통해 국제적 파트너십을 강화했습니다. 이 협력은 AI 평가 방법론 개발과 분야의 최신 트렌드 모니터링을 목표로 하며, 기존의 글로벌 협력들과 함께 Anthropic의 안전하고 신뢰할 수 있는 AI 개발 철학을 반영합니다. 일본 기업들은 AI를 인간의 능력을 보완하는 도구로 인식하고 있으며, 이는 창의성과 의사소통 품질 향상에 중점을 두고 있습니다. 또한, Mori 미술관과의 장기 파트너십을 통해 예술 분야에도 기여할 계획입니다. 앞으로 Anthropic은 아시아태평양 지역에서의 확장을 지속할 예정입니다.
대형 언어 모델(LLM)이 자신의 생각을 인식하고 제어할 수 있는 능력이 일부 존재함을 연구 결과가 보여주고 있다. 특히 Anthropic의 Claude 모델 시리즈에서 이러한 자기반성 능력이 관찰되었는데, 이는 모델의 내부 상태를 인식하고 조절하는 데 관련된 것으로 나타났다. 그러나 이러한 능력은 아직 불안정하고 제한적이며, 인간과 동일한 수준으로 작동하지는 않는다. 실험을 통해 모델이 주입된 개념을 인식하는 경우와 의도치 않은 출력을 감지하고 수정하려는 시도를 보여주었다. 이러한 발견은 AI 모델의 투명성과 신뢰성을 향상시키는 데 중요한 의미를 지니며, 향후 모델의 발전과 함께 이러한 능력이 더욱 정교해질 가능성이 있다. 그러나 모델의 자기반성 보고를 검증하는 데 주의가 필요하다는 점도 강조되었다.
구글 딥마인드와 Google.org는 임페리얼 칼리지 런던, 고등연구소(IAS), IHES, UC 버클리의 시몬스 계산이론연구소, 타타 기초연구소 등 5개 연구기관과 AI for Math Initiative를 출범시켰다. 참여 기관들은 AI 활용 가능성이 높은 수학 문제를 발굴하고, 연구 인프라와 도구를 구축해 수학적 발견을 가속화할 계획이다. 지원 기술에는 Gemini Deep Think, 알고리즘 발견 에이전트 AlphaEvolve, 형식 증명 완성 시스템 AlphaProof가 포함되며, AlphaEvolve는 4×4 행렬 곱셈에서 48회의 스칼라 곱셈만 사용하는 알고리즘을 찾아 기존 50년 기록을 경신했다.
CAIS와 Scale AI는 실제 경제 활동의 다양한 컴퓨터 작업을 AI가 자동화할 수 있는지를 평가하는 Remote Labor Index(RLI)를 공개했으며, 가장 뛰어난 AI 에이전트도 전체 프로젝트의 2.5%만 자동화한 것으로 나타났다. Future of Life Institute가 주도한 초지능 개발 유예 공개서한에는 5만 명 이상이 서명했으며, 안전성과 통제 가능성에 대한 광범위한 과학적 합의와 강한 대중적 지지가 형성될 때까지 초지능 개발을 금지하자는 내용이 담겼다. 동시에 공개된 여론조사에서는 미국 성인의 약 3분의 2가 초지능이 안전하고 통제 가능하다고 입증될 때까지 개발해서는 안 된다고 답했다.
네덜란드 개인정보보호당국(AP)은 2025.10.29 총선 전까지 AI 챗봇을 투표 선택에 쓰지 말라고 경고했으며, EU AI Act는 2026.8부터 ‘high-risk’ 적용 가능성을 검토 중
네덜란드 개인정보보호당국(AP)은 ChatGPT·Gemini 등 생성형 AI 챗봇이 투표 조언을 할 때 신뢰하기 어렵고 편향될 수 있다고 경고했다. AP는 네 개 챗봇에 정당별 200개 투표 성향 프로필을 넣어 테스트한 결과, 사용자의 질문과 무관하게 좌·우 스펙트럼의 특정 정당 2곳을 반복 추천했으며, 중도나 소수 정당은 거의 제시되지 않았다고 밝혔다. 대신 StemWijzer·Kieskompas 같은 데이터 기반 온라인 투표도구와, 당 강령 등 출처를 통제해 편향을 줄이려는 Wahl.Chat 같은 접근이 대안으로 언급됐다.