GLM-5.1 (Zhipu AI) (2026.4.7)
Reasoning · Open · 200K ctx · $1.4/M · $4.4/M
벤치마크 미공개
754B MoE / 40B active. #1 SWE-Bench Pro (58.4%), beating GPT-5.4 (57.7%) and Opus 4.6 (57.3%). 8-hour autonomous coding loops. MIT license.
Reasoning · Open · 200K ctx · $1.4/M · $4.4/M
벤치마크 미공개
754B MoE / 40B active. #1 SWE-Bench Pro (58.4%), beating GPT-5.4 (57.7%) and Opus 4.6 (57.3%). 8-hour autonomous coding loops. MIT license.
관계자들에 따르면 미국 주요 AI 기업인 OpenAI, Anthropic, Google은 중국 경쟁사가 자사의 최첨단 AI 모델 결과를 추출하여 복제하는 행위를 막기 위해 협력 중. 프론티어 모델 포럼을 통해 안전장치가 제거된 복제 모델이 국가 안보와 기업 경쟁력에 미치는 위협에 대처하고, 무단 증류(distillation)를 방어하고자 함.
클레어 마이토스 프리뷰는 강력한 일반 목적 언어 모델로, 특히 사이버 보안 작업에서 뛰어난 능력을 보여줍니다. 연구팀은 이 모델을 이용해 주요 운영 체제와 웹 브라우저의 제로데이 취약점을 탐지하고 악용하는 능력을 평가했습니다. 실험 결과, 클레어 마이토스 프리뷰는 복잡한 취약점을 찾아내고 이를 활용한 익스플로잇을 생성하는 데 성공률이 매우 높았습니다. 특히, 이 모델은 메모리 안전 취약점을 효과적으로 탐지하며, 이는 C와 C++ 같은 메모리 안전하지 않은 언어로 작성된 핵심 소프트웨어 시스템에서 중요한 테스트 지표가 됩니다. 연구팀은 이 모델의 능력이 기존 보안 도구보다 공격자에게 유리할 수 있으나, 장기적으로는 보안 방어자들이 취약점을 미리 발견하고 수정하는 데 활용될 수 있을 것으로 기대하고 있습니다. 이를 위해 Anthropic은 제한된 산업 파트너와 오픈 소스 개발자들을 대상으로 프로젝트 글라스윙을 시작하여 중요한 시스템을 보호하기 위한 초기 단계를 진행 중입니다.
2026년 5월 26–27일 브뤼셀에서 EuroDIG 2026(“유럽의 목소리: .eu 20주년과 새로운 인터넷 거버넌스 10년의 시작”) 개최, 등록 진행 중
EU는 2006년 4월 7일 .eu 최상위 도메인을 출범시켜 EU 전역에서 기업·시민·조직이 단일 온라인 정체성을 갖도록 했다고 밝혔다. 현재 .eu는 380만 건이 넘는 등록을 바탕으로 유럽 내 국가코드 TLD 중 상위권이며, 20년 동안 단 한 번의 장애 없이 안정적으로 운영됐다고 설명했다. 또한 사이버 위협이 커지는 가운데 AI 기반 사기 탐지와 데이터 품질 점검 등 보안·남용 방지에 우선순위를 두고 있다고 전했다. .eu 20주년을 계기로 2026년 5월 26–27일 브뤼셀에서 EuroDIG 2026을 열어 유럽의 가치가 인터넷 거버넌스의 미래에 미칠 영향 등을 논의할 계획이다.
확인 필요
호주 국방부가 국방 분야에서 인공지능을 책임 있게 사용하기 위한 정책 설정을 담은 문서로 보입니다. 다만 제공된 정보에는 본문 내용이 없어 구체적인 적용 범위, 원칙, 절차, 시행 시점 등은 확인이 필요합니다.
Epoch AI는 AI 칩 소유 분포를 추정하는 오픈 리서치 프로젝트로, 회사 공시와 제3자 분석/매체 보도를 바탕으로 주요 칩과 컴퓨트가 어떤 기업·고객 범주에 배분되는지 보여주는 탐색기(데이터)를 제공한다. 이 데이터는 ‘사용(usage)’이 아니라 ‘소유(ownership)’를 추적하며, 대부분의 프런티어 AI 개발사는 학습·추론에 쓰는 칩을 직접 소유하지 않는다는 점을 전제로 한다. 또한 소유 산정은 엄격한 법적·재무 기준이 아니라 통상적으로 배분한 값이며, 클라우드 제공 컴퓨트는 해당 클라우드 회사에 귀속하고 공동 소유 구조나 데이터센터 담보 등은 설명한다. H100e(엔비디아 H100 GPU 등가) 컴퓨트 용량과 칩 전력(TDP 기반) 산정 방식, ‘China’ 범주의 의미(중국 기업에 판매된 것으로 추정된 칩) 등 방법론의 전반도 함께 안내한다.
LEAP는 컴퓨터과학자, 산업계 전문가, 정책 연구자, 경제학자 등 주요 전문가들의 AI 발전 경로에 대한 견해를 3년간 월별로 수집·추적하는 프로젝트다. 참가자들은 질문에 답해 수천 건의 예측을 제공하며, 예측의 검증 가능성과 근거(수백만 단어 수준의 설명)를 함께 축적한다. 또한 전문가 예측의 범위를 이해해 정책이 ‘누가 더 자신 있게 말하나’가 아니라 ‘여러 해에 걸쳐 누가 더 정확했나’에 기반하도록 돕는 것을 목표로 한다.
MLPerf Inference v6.0은 11개 데이터센터 테스트 중 5개를 새로 추가·업데이트하고, 엣지 시스템용 객체탐지 테스트도 새로 포함했다. GPT-OSS 120B 기반 오픈 웨이트 LLM, DeepSeek-R1 고급 추론(추측적 디코딩 포함), DLRMv3(추천 순차 추천 벤치마크), 첫 텍스트-비디오 생성, Shopify 상품 카탈로그 기반 VLM 벤치마크, Ultralytics YOLOv11 Large 기반 엣지 객체탐지 등 주요 벤치마크가 확장됐다. 또한 제출자는 LoadGen++ 하네스를 활용할 수 있고, 결과는 MLCommons 시각화 대시보드에서 고급 필터링과 성능 그래프로 확인 가능하며, 멀티노드 시스템 제출이 전 라운드 대비 크게 증가했다고 밝혔다.
AI Standards Lab은 EU AI Act 옴니버스 3자 협상(이사회·유럽의회 입장) 전개를 분석한 보고서를 내고, 행정 부담을 줄이더라도 건강·안전·기본권 보호 수준이 낮아지지 않아야 한다고 강조했다. 이사회와 의회가 AI Office의 충분한 인력·자원 확보(의회 제안 Article 64(2a)) 및 AI Office 감독 권한(Article 75)을 강화하는 방향을 긍정적으로 평가했으며, 기업의 등록요건(Article 6(4) 재도입)도 필요하다고 밝혔다. 또한 고위험 AI 의무에서 일부를 제외하려는 의회 제안(Annex I.A)에는 신중한 입장을 보이며, 최종 문구의 모호성 방지를 권고했다. NCII·CSAM 금지 조항은 직접 금지+면책(safe harbour) 형태의 의회 문안을 선호하고, 사후 모니터링(Article 72(3))은 가이드로 전환하되 템플릿과 2027년 2월 마감일을 두는 방안을 지지했다.
본문 내용 확인 필요
확인 필요: 해당 페이지에서 앤트로픽(Anthropic)과 오픈AI(OpenAI) 간 사용량·컴퓨트 한도 관련 구체적인 내용이 무엇인지 파악되지 않았습니다. 다만 제목과 URL로 볼 때 ‘컴퓨트 전쟁’ 맥락에서 특정 서비스의 사용 제한 또는 수요·공급 이슈가 다뤄졌을 가능성이 있습니다.
AI 에이전트가 고급 사용자(파워 유저)들의 작업 방식에 영향을 주며, 과도한 사용으로 인한 번아웃·중독 같은 부작용이 나타날 수 있다는 내용으로 보입니다. 다만 제공된 정보에는 본문 내용이 없어 구체적인 근거(사례, 수치, 전문가 발언 등)는 확인이 필요합니다.
중요 일정: 2026.4.3 중국 공업정보화부 등 10개 기관이 「인공지능 과학기술 윤리 심사 및 서비스에 관한 행정조치(시행안)」를 공동 발행
중국 공업정보화부는 2026년 4월 3일, 9개 정부기관과 함께 인공지능의 윤리 심사와 서비스를 규정한 행정조치(시행안)를 발표했다. 이 조치는 기관의 자체 윤리심사를 기본으로 하되, 여론 동원·고도 자율 의사결정·인간-기계 심층 결합 등 ‘고위험’ 영역은 제3자 전문가 심사를 의무화한다. 또한 알고리즘 등록(파일링)과 윤리평가를 결합한 이중 트랙 접근을 도입하고, 플랫폼 업종 대상 ‘알고리즘 감사’에서 노동자 보호를 위한 인간 개입 기능을 요구하는 등 내용 보안 중심에서 사회·노동 보호까지 범위를 넓혔다. 심사 절차는 신청 자료 제출 후 30일 내 결정, 운영 중 모니터링 및 위험 변화 시 중단·종료 가능, 그리고 사회적 유익·차별·통제가능성·설명가능성·책임추적·프라이버시 보호 등 기준을 중심으로 이뤄진다.
본문 내용 확인 필요
백악관이 의회에 제출할 AI 정책 청사진을 공개했다는 내용이 기사 제목 기준으로 확인된다. 다만 본문에서 구체적인 정책 항목, 일정, 적용 범위 등 세부 내용은 확인되지 않아 추가 확인이 필요하다.
샌더스는 2025년 12월 데이터센터 건설에 대한 모라토리엄을 촉구했으며, AI 도입 속도에 대한 민주주의의 ‘따라잡기’ 필요성을 주장함
더 네이션은 버니 샌더스가 AI 확산을 뒷받침하는 데이터센터 건설에 대해 모라토리엄을 요구한 뒤, 빅테크 및 보수 진영으로부터 ‘루다이트’라는 비난을 받았다고 전했다. 글은 루다이트를 단순한 반기술 세력이 아니라, 산업화 과정에서 노동자 임금·권리·인간성을 침해하는 기술 도입에 맞서 싸운 친노동 운동의 계승으로 재해석한다. 또한 19세기 영국의 직물 노동자들이 임금 하락과 노동조건 악화를 예견하며 기계 파괴 등 직접 행동을 했던 역사와, 오늘날 AI 불안 속에서 학생·노동·창작 분야에서 ‘루다이트’식 문제의식이 확산되는 흐름을 연결해 설명한다.
Muckrack이 Gemini, Perplexity, Claude, ChatGPT 등 주요 AI 답변 엔진에서 총 1,500만 건의 인용 데이터를 수집해, 어떤 기자와 출처가 AI 생성 답변에서 자주 인용되는지 공개했다. LLM(대규모 언어모델) 인용에서 웹사이트 링크의 약 4분의 1이 저널리즘 출처였으며, 전 세계 기자 중 Henry Blodget이 1위로 나타났다. 매체는 전 세계 기준 Reuters가 1위, 영국 매체는 The Guardian이 1위를 차지했으며 이어 Homes and Gardens가 상위권에 들었다.
유럽의회는 인공지능법 간소화안에 찬성 569표로 입장을 채택했으며, 고위험 AI 규정 적용을 2027년 12월 2일로, 부문별 안전법 적용 시스템 규정을 2028년 8월 2일로 연기하고 비동의 성적 이미지 생성 시스템을 금지하는 방안을 제시했다. 미국과 유럽의 AI 정책이 ‘미국은 혁신하고 유럽은 규제한다’는 구도로만 나뉘지 않으며, 아동 안전과 고위험 AI 대응 등에서 협력 여지가 있다는 분석이 소개됐다. 범용 AI 모델 제공자 의무는 2025년 8월 2일부터 적용됐고 유럽연합 집행위원회의 감독·제재 권한은 2026년 8월 2일부터 시작된다. 시민단체와 연구기관들은 규제 간소화가 디지털 권리와 성평등 보호를 약화할 수 있다며, 건강·안전·기본권을 우선하는 보완책을 권고했다.
Anthropic은 Amazon Web Services, Apple, Microsoft, NVIDIA 등 다수 파트너와 함께 ‘Project Glasswing’을 출범해 중요 소프트웨어의 취약점과 보안 결함을 방어 목적으로 신속 탐지·대응하는 데 협력한다고 밝혔다. Claude Mythos Preview(공개 전 프론티어 모델)가 수천 건의 고위험 취약점과 제로데이 결함을 찾아냈으며, 일부는 사람의 검토와 자동 보안 테스트를 수년간 통과한 사례도 있다고 설명했다. 파트너들은 방어 보안 업무에 모델을 활용하고, Anthropic은 학습·발견 내용을 공유하며 40개+ 추가 조직에 모델 접근을 확장해 1차 및 오픈소스 시스템 전반을 스캔·보안하도록 지원할 계획이다.
z.ai 블로그 글은 오픈소스 모델 GLM-5.1이 코딩 관련 벤치마크에서 프론티어 모델보다 우수한 성과를 보였다고 소개한다. 다만 제공된 정보에는 벤치마크의 정확한 명칭과 비교 기준, 성능 수치가 없어 세부 내용은 확인 필요다.
Claw-Eval은 자율 에이전트를 평가하기 위한 벤치마크로, 300개의 휴먼 검증 과제와 9개 카테고리, 2,159개의 루브릭을 제공한다. 평가 기준은 Pass^3로, 모델이 동일 과제를 3번의 독립 실행에서 모두 성공 기준을 충족해야 통과로 인정된다. 네트워크/API 불안정으로 실행 오류가 발생하면 평가를 수동 재시도해 정확히 3개의 궤적이 생성되도록 처리하며, 리더보드 결과의 엔드투엔드 재현성 검증을 위한 코드 감사도 진행 중이라고 밝혔다. 데이터셋은 Hugging Face에 공개되어 있으며, 과제는 completion·safety·robustness 3차원으로 전체 궤적 감사를 통해 채점된다.
확인 필요: 법안의 구체적 내용(의무사항, 적용 범위, 시행 시점)과 하원 통과·주지사 서명 등 후속 절차 여부
Pennsylvania Capital-Star는 펜실베이니아 주 상원이 아동·청소년이 사용하는 AI 챗봇을 규제하는 법안을 통과시켰다고 보도했다. 다만 제공된 정보만으로는 법안의 세부 조항과 실제 시행 일정은 확인이 필요하다.
워싱턴주 밥 퍼거슨 주지사가 2026년 3월 24일 서명한 두 법안에 따라, 워싱턴 이용자 대상 AI 챗봇에 신규 고지·표시 의무와 미성년자 추가 규제가 적용됨
워싱턴주가 AI 허위정보를 줄이고 미성년자를 보호하기 위한 법안을 새로 통과시켰다. 생성형 AI로 내용을 상당 부분 수정한 경우 워터마크나 메타데이터로 추적 가능해야 하며, 월 이용자 100만 명 이상 대형 AI 기업에 적용된다. 또한 AI 챗봇은 대화 시작 시 인간이 아님을 고지해야 하고, 미성년자 이용자는 3시간이 아닌 매시간 고지해야 하며 성적 노골 대화·조작적 유도(죄책감 유발 등)도 금지된다. 자살·자해 관련 정보 제공을 제한하고, 관련 대화를 표시·정신건강 서비스 연계하는 프로토콜 마련도 요구된다.
가상융합(XR, 디지털 트윈 등)은 현실과 디지털을 연결해 AI 정책의 영향을 가상에서 시뮬레이션하고 검증할 수 있으며, 몰입형 환경을 통해 공공서비스의 보편적 접근성을 높일 수 있다고 설명한다. 과거에는 게임·이벤트 중심 활용과 고가 장비·콘텐츠·비즈니스 모델 부족 등으로 확산이 제한됐으나, 생성형 AI와 XR 디바이스 개선으로 개인화·몰입도가 높아지고 교육·제조·국방·의료 등에서 실질 활용 사례가 늘고 있다고 본다. 보고서는 AI 기본사회 관련 과제로 공론장 구축, 리빙랩 기반 실험, 가상 오피스·직무훈련을 통한 일자리 전환 대응, 돌봄·의료·범죄 대응·교육 격차 완화 등 분야별 적용 방안을 제시하면서, 일회성 전시를 반복하지 않기 위해 지속 가능한 운영모델과 성과 중심 설계가 필요하다고 강조한다.