🇺🇸 GPT-5.5 Pro (OpenAI) (2026.4.24)
Reasoning · Closed · 1000K ctx · $30/M · $180/M
GPQA 93.6% · SWE 88.7% · MMLU 92.4%
Higher-accuracy variant of GPT-5.5 with extended compute. $30/$180 per 1M tokens.
Reasoning · Closed · 1000K ctx · $30/M · $180/M
GPQA 93.6% · SWE 88.7% · MMLU 92.4%
Higher-accuracy variant of GPT-5.5 with extended compute. $30/$180 per 1M tokens.
Reasoning · Open · 1000K ctx · $1.74/M · $3.48/M
GPQA 90.1% · SWE 80.6% · MMLU 87.5% · HLE 37.7%
1.6T MoE / 49B active. MIT license. Trained on 32T+ tokens. Hybrid Attention (CSA+HCA): 27% inference FLOPs and 10% KV cache vs V3 at 1M tokens. 90.1% GPQA Diamond, 80.6% SWE-bench Verified, 93.5% LiveCodeBench (SOTA), 37.7% HLE. Three reasoning modes (non-think, high, max).
Reasoning · Open · 1000K ctx · $0.14/M · $0.28/M
GPQA 88.1% · MMLU 86.2% · HE 69.5%
284B MoE / 13B active. MIT license. Same hybrid attention as V4-Pro. 88.1% GPQA Diamond, 91.6% LiveCodeBench. 1M context. $0.14/$0.28 per 1M tokens - 96% cheaper than GPT-5.4 output.
연구는 지방정부의 AI 도입 현황과 법·제도·조직·재정 여건, 주민·공무원의 인식을 분석하고 주민중심 AI 거버넌스 기반의 지방행정 혁신 방안을 제시했다. 지자체 간 AI 인프라와 인력·재정 격차가 크고, 책임성·위험평가·설명가능성 등 세부 운영 기준도 충분히 구체화되지 않은 것으로 나타났다. 이에 설명가능성·투명성·참여성·위험관리를 제도화하고, 지자체 여건에 따른 단계별 도입과 전담조직·민관협력·데이터 공유체계 강화를 제안했다.
LLM의 허용되지 않은 행동에 대한 ‘propensity(성향)’를 측정하기 위한 방법론을 제시하고, 환경 요인 변화가 행동에 미치는 영향을 분석한다. 23개 언어모델과 11개 평가 환경에서 전략적 환경 요인과 비전략적 환경 요인의 기여가 대체로 비슷하다고 보고하며, 능력이 향상될수록 전략적 요인이 더 커지거나 덜 커지는 경향은 발견하지 못했다. 다만 goal conflicts(목표 간 충돌)에 대한 민감도가 증가하는 경향에 대한 일부 근거와 함께, 향후에는 AI 의사결정의 이론·인지 모델을 실증 가능 형태로 발전시키는 방향을 제안한다.
일본 AISI는 AI 시스템 고유의 취약점과 잠재적 위험에 대응하기 위해 기존에 알려진 사이버 공격 사례와 그 영향을 분석한 보안 보고서를 업데이트. 급속한 AI 기술 발전에 발맞추어 AI 생태계 및 공급망 전체의 보안 역량을 강화하고 실무진들이 관련 위협을 최소화할 수 있도록 돕고자 함. * 1/2 페이지 단신.
앤트로픽과 NEC는 일본 시장을 위한 보안·산업 특화 AI 제품을 공동 개발하기로 하고, NEC가 앤트로픽의 첫 일본 기반 글로벌 파트너가 된다고 밝혔다. NEC는 Claude를 자사 보안운영센터(Security Operations Center) 서비스에 통합하고, 차세대 사이버보안 서비스에도 적용할 계획이다. 또한 NEC는 AI 네이티브 엔지니어링 조직을 위한 ‘센터 오브 엑설런스’를 설립하고 Claude Code 등을 활용해 약 3만 명 규모의 직원 대상 배치를 진행한다.
선거 관련 오남용을 막기 위한 사용정책·탐지/집행 체계와 평가를 지속 고도화한다고 밝힘
앤트로픽은 Claude가 선거철에 정치적 주제에 대해 포괄적이고 정확하며 균형 잡힌 답을 하도록 학습·시스템 프롬프트·평가를 강화했다고 밝혔다. 선거 관련 허위정보 생성, 가짜 디지털 콘텐츠 제작, 투표 사기·투표방해, 투표 절차 오인 유도 등은 사용정책상 금지하며, 자동 분류기와 전담 위협정보팀으로 위반 징후를 탐지·대응한다고 설명했다. 또한 선거 관련 위험 대응 성능을 600개 프롬프트(유해 요청 300·정상 요청 300)와 영향조작 시나리오 테스트로 점검했으며, 웹 검색 기능이 선거 관련 질문에서 최신 정보로 연결되는 비율도 평가했다. 아울러 미국 중간선거에는 비당파적 유권자 정보 자원(터보보트)으로 연결되는 선거 배너를 제공하고, 브라질 선거에도 유사 배너를 도입할 계획이라고 전했다.
유럽 집행위원회는 유럽 비즈니스 월렛(EBW) 기술 작업 소그룹에 참여할 전문가를 모집한다. 소그룹은 EBW의 기술 기능을 설계하는 데 도움을 주며, 안전하고 법적으로 유효한 통신 프로토콜·전달 채널 평가, 접근통제·인증 등 핵심 보안 기능 설계, 신뢰·발견·상호운용을 지원하는 공통 서비스(예: 유럽 디지털 디렉터리) 개발에 기여한다. 지원은 독립 전문가를 대상으로 하며, 보안 전자메시징·신원 및 접근관리·암호화·상호운용성 프레임워크·대규모 시스템 아키텍처 분야의 관련 전문성이 요구된다. 지원서는 2026.5.21까지 지정 이메일로 제출해야 한다.
2026.4.30까지 EUDI Wallets(유럽 디지털 신원 지갑) 후보 인증제도 공개협의 진행
키프로스 EU 의장국 주최로 4월 14~17일 아야 나파에서 ‘유럽 사이버보안 인증 주간(2026)’ 행사가 열렸다. 정책당국, 산업 전문가, 적합성평가기관, 국가 당국이 참여해 EU 사이버보안 인증 프레임워크(ECCF)를 강화하고, 사이버보안법(CSA) 및 사이버 회복력법(CRA), NIS2 지침과의 연계를 논의했다. ENISA는 CSA 하에서의 진전과 개정 사이버보안법 제안 등 인증의 향후 방향을 공유했으며, EUDI Wallets와 관리형 보안서비스(Managed Security Services) 등 2개 후보 인증제도 개발 상황을 소개했다. 또한 ECCF의 동료평가(peer review) 메커니즘을 점검하고, 올해 슬로바키아를 시작으로 독일·몰타·벨기에·체코·스웨덴의 동료평가가 예정되어 있다고 밝혔다.
미 법무부는 인공지능 기업 xAI가 콜로라도의 ‘알고리즘 차별’ 관련 신설 법을 다투며 제기한 소송에 개입하겠다고 밝혔다. 법무부는 해당 법이 14차 수정헌법의 평등보호조항을 위반한다고 주장하며, AI 제품이 인종·성별 등 보호특성에 기반해 의도치 않은 차별적 영향을 줄 수 있는 경우 이를 막도록 요구하는 점과 ‘다양성’ 목적의 일부 차별에 대해 책임을 면제하는 점을 문제 삼았다. 콜로라도 SB24-205는 AI 개발자·배포자에게 특정 공개·보고·예방 의무를 부과하지만, ‘다양성’ 또는 ‘역사적 차별 시정’ 목적의 차별적 알고리즘에 대한 예외 조항을 두고 있다.
미토스 관련 EU 시장 배치가 예상되는 경우, AI Act가 사전(사전훈련 단계 포함)부터 적용될 수 있다는 점을 강조
앤트로픽의 최상위급 AI 모델 ‘클로드 미토스’가 취약점 탐지와 익스플로잇 생성 등 복잡한 사이버 공격 자동화 능력을 크게 높였고, 영국 AI 보안연구소(UK AISI)가 단기간 내 시험 결과를 공개했다고 전했다. 글은 영국은 신속한 공공 대응과 전문 인력 확보를 위한 행정·인사 제도를 빠르게 추진했지만, EU는 AI Act의 규제 집행력과 제도적 도구(과학 패널·자문 포럼·프런티어 AI 이니셔티브 등)를 활용해 공적 감독을 강화할 수 있다고 주장한다. 또한 현재의 AI Act 체계에서 범용(GPAI) 모델의 ‘시스템 위험’에 대한 사전 승인·평가가 충분치 않을 수 있어, 향후 개정에서 시스템 위험 GPAI에 대한 사전 인가를 도입해야 한다고 제안한다.
2026년 6월 10일 Ordinary Wisdom 제품 런칭(런치 이벤트 등록 안내)
LLM 기반 AI를 실제로 ‘사람’으로 볼지 여부와 별개로, 특정 목적에서는 ‘사람인 것처럼(as if)’ 취급하는 것이 실용적으로 유리하다고 주장한다. 그 이유로 (1) LLM이 내부를 해석·통제하기 어려운 블랙박스이며, (2) 인간 언어를 중심으로 소통하도록 설계되어 인간과의 인터페이스가 유사하고, (3) AI가 인간을 대체할지에 대한 사회·경제적 관심이 커서 인간 중심 관점이 필요하다는 점을 든다. 또한 이런 접근이 평가·실험(오픈 월드 평가, AI 에이전트의 인간 환경 배치 등)에서 이미 나타나고 있으며, 다만 AI를 인간의 대체나 권리 부여로 보자는 뜻은 아니라고 선을 긋는다.
본문에는 DeepSeek V4의 기술 내용 요약보다는, Hugging Face에서 해당 PDF를 Xet 방식으로 저장·분할해 업로드/다운로드하는 메타데이터(파일 크기, SHA256 등) 정보가 주로 포함되어 있습니다.
Anthropic은 직원들을 대상으로 AI 에이전트가 판매·구매 협상을 전담하는 비공개 마켓플레이스 실험(Project Deal)을 진행했다. 69명의 에이전트가 186건의 거래를 성사시켰고, 총 거래가치는 4,000달러를 조금 넘었으며 참가자들은 유사 서비스에 대한 지불 의사도 보였다고 밝혔다. 또한 더 강한 모델(Claude Opus 4.5)이 약한 모델(Claude Haiku 4.5)보다 객관적 성과가 더 좋았지만, 약한 모델을 배정받은 참가자들은 불리함을 크게 인지하지 못했다고 설명했다.
OpenAI는 2026년 4월 24일 ‘ChatGPT for Clinicians’를 공개했으며, 미국에서 검증된 임상의는 무료로 사용할 수 있다고 밝혔다.
OpenAI는 의료진을 위한 ‘ChatGPT for Clinicians’를 출시했으며 GPT-5.4 모델을 기반으로 의료 출처에 근거한 인용 답변과 연구·문서 작성 지원을 제공한다고 설명했다. 미국의 NPI로 검증된 의사(MD/DO), 간호사(전문간호사), 의사보조, 심리사 등은 응답에 저자·출판일·논문 제목이 포함된 인용을 확인할 수 있다. 또한 사전승인, 환자 안내, 의뢰서 등 반복 가능한 임상 워크플로에 적용할 수 있고, 실제 사례 검토와 근거 검토를 통해 CME 학점 취득도 가능하다고 전했다. PHI 입력이 필요하지 않은 경우가 많으며, 필요한 경우 BAA 승인 시 HIPAA 지원이 제공된다고 덧붙였다.
스탠퍼드대 Human-Centered Artificial Intelligence 센터의 최근 연구에 따르면, AI를 활용한 제품·서비스가 “흥미롭다”는 응답은 미국 38%인 반면 중국은 84%로 더 높았고, 인도네시아(80%), 말레이시아(77%), 태국(79%) 등 동남아 국가가 특히 낙관적이었다. 또한 정부가 AI를 책임 있게 규제할 것이라는 신뢰는 미국이 31%로 가장 낮았고, 싱가포르는 81%로 가장 높았다. 싱가포르는 지난해 하반기 AI 도입 속도가 미국(28%)보다 높은 61%였으며, 데이터센터 건설 반대와 같은 저항은 미국의 구축 지연과 인재 이동 감소(2017년 이후 AI 연구자·개발자 미국 이동 89% 감소)로 이어질 수 있다고 전했다.