AI 안전 다이제스트

2026-02-24 · 6건

🇺🇸 GPT-5.3-Codex (OpenAI) (2026.2.24)

기업 · DemandSphere · 🚀

General · Closed · 400K ctx · $1.75/M · $14/M

벤치마크 미공개

Agentic coding model. SOTA on SWE-Bench Pro, Terminal-Bench 2.0, OSWorld-Verified. 400K context. Combines Codex + GPT-5 training stacks. 25% faster than predecessor.

언론에 보도된 인공지능 사건·위험 동향 (2026.2.24)

공공 · 경제협력개발기구(OECD) · 🧒🎭

이 보고서는 OECD.AI 사건·위험 모니터(AIM)의 실시간 데이터를 분석해 언론 보도에 나타난 인공지능 관련 피해의 유형·빈도·영향을 살폈다. 언론 보도를 14개 주제군으로 분류한 결과, 보도 비중은 증가형·간헐형·감소형의 세 가지 패턴으로 나타났다. 합성 미디어, 아동 안전, 사이버공격, 개인정보보호, 보건 등 주제별로 관심도가 변화했으며, 일부 위험은 상대적으로 주목도가 높아진 반면 다른 위험에 대한 보도는 감소했다.

🇨🇳🇺🇸 미 정부 관계자, 중국 DeepSeek가 수출 금지된 엔비디아 칩으로 AI 모델를 훈련했다는 의혹 제기 (2026.2.24)

K-AISI 주간동향 · Reuters

미국 정부 관계자는 중국 AI 기업 DeepSeek가 미국의 수출 금지 조치에도 불구하고 엔비디아의 최신 칩 '블랙웰'을 사용해 새 모델을 훈련했다고 주장. 이는 칩 수출 통제 위반 가능성을 시사하며, 중국의 AI 추격을 억제하려는 미국 정책의 실효성 및 미중 간 AI 패권 경쟁을 둘러싼 논쟁을 심화.

🇺🇸 미 국방부, 앤트로픽에 '국방물자생산법' 발동을 위협하며 AI 기술 강제 공유 압박 (2026.2.24)

K-AISI 주간동향 · The Washington Post · 🛡️🚀

Pete Hegseth 미 국방장관은 자율 무기나 대량 감시에 자사 AI를 사용하는 것을 꺼리는 Anthropic에 '국방물자생산법(DPA)'을 발동해 기술을 강제 징발하겠다고 경고. Anthropic CEO Dario Amodei는 윤리적 한계를 준수할 것을 요구했으며, 합의가 이루어지지 않을 경우 2억 달러 규모의 국방부 계약을 파기할 것으로 추측.

METR, 개발자 생산성 실험 설계 변경…AI 사용 효과 추정 신호 신뢰도 낮아짐 (2026.2.24)

DB · METR(Machine Intelligence Research Institute)

METR은 2025년 2~6월 데이터로 AI 도구 사용이 숙련 오픈소스 개발자의 작업 완료를 약 20% 지연시킨다는 결과를 발표했으나, 이를 시간에 따라 보기 위해 2025년 8월부터 더 많은 개발자를 대상으로 새 실험을 진행했다. 다만 참가자 피드백과 설문을 근거로, AI 없이 일하기를 원치 않아 참여를 포기하는 개발자가 늘어 선택 편향이 커져 현재 실험 데이터가 AI의 생산성 효과를 “신뢰할 만한 신호”로 제공하기 어렵다고 밝혔다. 초기 결과와 비교해 일부 하위집단에서는 속도 개선 추정이 음수(지연)로 나타났지만, 실제 효과는 더 클 수 있으며 편향 때문에 추정치가 하한일 가능성이 크다고 설명했다. METR은 향후 더 짧고 집중적인 실험, 관찰 데이터, 설문, 고정 과제 실험, 에이전트 평가, 개발자 단위 무작위 배정 등 대안적 방법으로 측정 설계를 재검토할 계획이다.