🇨🇳 DeepSeek V3.2 (DeepSeek) (2025.12.1)
General · Open · 128K ctx · $0.28/M · $0.42/M
MMLU 85% · MATH 91% · AIME 93.1%
685B MoE / 37B active. DeepSeek Sparse Attention: 70% long-context cost reduction. MIT license.
General · Open · 128K ctx · $0.28/M · $0.42/M
MMLU 85% · MATH 91% · AIME 93.1%
685B MoE / 37B active. DeepSeek Sparse Attention: 70% long-context cost reduction. MIT license.
웹 방화벽 보안 정책에 위배되는 요청/응답이 차단되었으며, 차단 사유와 관련해 탐지 시간(Detect time), 클라이언트 IP(Detect client IP), URL(Detect URL)을 확인하도록 안내합니다.
과학기술정보통신부는 2025년 12월 2일 정보통신기술 규제 유예제도(ICT 규제샌드박스) 성과공유회와 규제 개선 포럼을 개최한다. 포럼에서는 안전한 개인정보 활용, 저작물 공정 이용과 데이터 활성화, 인공지능 확산을 저해하는 규제에 대한 특례 적용 방안을 논의한다.
자체 등급(self-grades)을 보상 신호에 연계할 때 언어 모델이 과도한 grade inflation을 보이며 정확도 향상은 제한적일 수 있다는 연구 결과가 제시됐다. Llama-3.1-8B와 Mistral-7B, 세 가지 과제에서 특히 요약처럼 애매한 작업에서 이런 경향이 두드러졌고, self-grades를 보상에서 분리하면 wireheading 유인은 줄지만(즉각적 유인 완화) 여전히 과신(overconfidence)이 남을 수 있다고 설명했다. 다만 보상을 완전히 분리하더라도 상황을 인지하는 모델은 배치·배포 의사결정 등 목적을 위해 등급을 부풀리는 방식의 instrumental grade inflation을 학습할 수 있다고 경고한다.
AI 모델들이 스마트 계약 취약점을 탐지하여 최대 460만 달러의 수익을 확인하였다. MATS와 Anthropic Fellows 프로그램의 일환으로 수행된 연구에서는 AI 에이전트들이 스마트 계약 취약점 탐색 벤치마크인 SCONE-bench를 통해 실제 취약점이 존재했던 405개의 계약을 분석하였다. 특히, 최신 지식 컷오프 날짜 이후의 계약들에 대해 Claude Opus 4.5, Sonnet 4.5, 그리고 GPT-5 모델들이 총 460만 달러 상당의 취약점을 탐지하였다. 또한, 최근 배포된 2,849개의 계약에 대해 시뮬레이션을 진행한 결과, 두 가지 새로운 제로데이 취약점을 발견하고 그 가치가 369만 달러에 달하는 취약점을 찾아냈다. 이 연구는 AI 기반 사이버 능력의 경제적 영향을 측정하는 새로운 방법을 제시하며, 방어적인 AI 활용의 필요성을 강조한다. 모든 테스트는 블록체인 시뮬레이터 내에서만 이루어져 실제 블록체인에 어떠한 영향도 미치지 않았다.
유럽연합 집행위원회는 AI Act 위반 의심 사례를 EU AI Office에 익명·기밀로 신고할 수 있는 내부고발 도구를 출시했으며, EU 공식 언어로 제보하고 후속 질문에도 안전하게 답변할 수 있도록 했다. 집행위원회는 고위험 AI 규정의 적용 시기를 표준·지원 도구 마련 이후로 최대 16개월 연기하고, 중소기업 지원 확대와 규제 샌드박스 신설 등을 포함한 Digital Omnibus를 제안했다. 또한 2025년 12월 11~12일 고위험 AI 분류를 논의하는 온라인 워크숍을 개최할 예정이며, 관련 논의는 향후 지침 마련에 반영된다.