GPQA 92% · MMLU 83.1% · HE 94.5% · MATH 92.4% · AIME 100%
OpenAI March 2026 flagship. First model with native Computer Use API (75% OSWorld, above human baseline of 72.4%). 1M context in Codex/API. 33% fewer hallucinations vs GPT-5.2. 83% GDPval. GPT-5.2 retires June 5, 2026.
Future of Life Institute의 주도로 스티브 배넌 등 진보와 보수를 아우르는 각계 리더들이 모여 AI 시대에 인간의 가치와 통제권을 강조하는 '인간 중심 AI 선언(Pro-Human AI Declaration)'에 합의. 이 선언문은 AI가 인간의 일자리를 대체하거나 소수 기관에 권력을 집중시키는 것을 방지하고, 인류의 존엄성을 보호하며 잠재력을 극대화하는 신뢰할 수 있는 도구가 되어야 한다고 강조.
K-AISI 주간동향 · Department of Industry Science and Resources · 📋
※ 단신. 호주와 캐나다 정부는 고급 AI 시스템의 위험을 완화하고 국제 가이드라인을 지원하기 위해 기술 및 위험 평가 도구 정보를 교환하는 AI 안전 협력 양해각서를 체결. 양국의 AI 안전 연구소를 중심으로 AI 생성 콘텐츠의 위험 감소를 위한 공동 연구를 수행하고, 각자의 전문 지식을 바탕으로 자국의 AI 시스템 역량을 강화할 계획.
캐나다 CIFAR AI 석좌교수 박미정은 차등 프라이버시 기술을 활용해 개인 식별 위험을 줄이면서도 의료 데이터를 효과적으로 분석할 수 있는 방안을 연구. 또한 유해 콘텐츠를 생성할 수 있는 확산 모델의 오용을 방지하기 위해, 전체 모델의 재학습 없이도 안전성을 확보할 수 있는 데이터 생성 제어 기술을 함께 개발.
글로벌 커뮤니케이션 기업 LLYC는 주요 거대 언어 모델들이 응답 과정에서 사회의 구조적 성별 고정관념을 그대로 재현하고 증폭시킨다고 발표. 1만여 개의 AI 응답을 분석한 결과, AI가 중립적인 미래를 제시하기보다 불평등한 과거의 데이터를 학습해 특정 성별에 편향된 역할을 부여하고 있음을 경고.
메타는 AI 스마트글라스의 프라이버시 부족으로 인해 스웨덴 신문들의 조사 결과와 함께 케냐 기반 하청업체 작업자들이 고객의 글라스에서 누드, 성관계, 기타 민감한 콘텐츠를 검토한 사실로 인해 새로운 집단 소송에 직면해 있다. 메타는 이미지에서 얼굴을 흐리게 처리한다고 주장했으나, 이 주장은 일관성 없이 작동했다는 비판을 받았다. 이 사건은 영국 정보위원회 사무소의 조사로 이어졌으며, 미국에서도 소송이 제기되었다. 원고들은 메타가 프라이버시 법을 위반하고 허위 광고를 했다고 주장하며, 메타의 광고가 사용자들이 글라스의 민감한 콘텐츠가 해외 작업자들에 의해 검토되고 있다는 사실을 인지하지 못하게 했다고 주장한다. 메타는 콘텐츠 공유 시 일부 데이터를 검토하기 위해 하청업체를 사용한다고 밝혔으나, 이 과정에서 사용자의 동의 없이 데이터가 전송된다는 비판이 제기되었다.
메타의 AI 기반 스마트 안경이 케냐의 계약자들에게 화장실 이용 장면, 누드 상태, 그리고 사생활이 담긴 영상을 보여주고 있다는 조사 결과가 나왔다. 이는 스웨덴의 두 신문인 Svenska Dagbladet과 Göteborgs-Posten의 조사에 따른 것으로, Meta는 이러한 기능이 사용자의 가장 사적인 순간들을 전 세계의 낯선 사람에게 보여줄 수 있다는 사실을 숨겼다는 비판을 받고 있다. Meta는 이러한 안경이 프라이버시를 보호하도록 설계되었다고 주장해 왔으나, 이로 인해 소비자들이 제품을 구매할 때 필요한 정보를 충분히 제공하지 못했다는 주장이 제기되고 있다. Meta는 이러한 데이터 검토 과정이 사용자 경험 개선을 위해 이루어지며, 프라이버시 보호를 위한 필터링 조치를 취한다고 밝혔다. 그러나 이에 대한 의문과 법적 문제 제기가 이어지고 있다.
앤트로픽은 LLM의 이론적 수행 가능성과 실제 업무 사용 데이터를 결합한 ‘관측 노출도(observed exposure)’라는 새 지표를 제시했다. 이 지표를 바탕으로 보면, AI는 이론적으로 가능한 수준에 비해 실제 업무 적용 범위가 매우 낮으며(이론 대비 실제 커버리지는 일부), 2022년 말 이후 고노출 노동자들의 실업률이 체계적으로 증가했다는 증거는 찾지 못했다. 다만 노출이 높은 직군에서 젊은 인력 채용이 둔화됐다는 ‘시사적’ 신호는 관찰된다고 밝혔다. 또한 BLS(미 노동통계국) 2034년까지의 고용 전망과 비교하면, 노출이 높을수록 고용 성장 전망이 약해지는 경향이 있으며, 고노출 직군 종사자는 상대적으로 고령·여성·고학력·고소득 비중이 높다고 설명했다.
GPT-5.4 Thinking은 GPT-5 시리즈의 최신 추론 모델로, 안전 완화 전략은 이전 모델과 유사하되 사이버보안의 ‘고(High) 역량’에 대한 완화를 최초로 일반 목적 모델에 구현했습니다. 사이버 안전 접근은 GPT-5.3 Codex에서 적용된 최신 방식과 ChatGPT 및 API에서의 접근을 기반으로 합니다. 또한 GPT-5.3 Thinking 모델은 없으며, 비교 기준은 GPT-5.2 Thinking이라고 명시했습니다.