AI 안전 다이제스트

2025-02-27 · 3건

🇰🇷 안전한 인공지능 활용을 위해 보안취약점 집중 발굴·개선 (2025.2.27)

공공 · 과학기술정보통신부 · 🔒

과학기술정보통신부와 한국인터넷진흥원은 침해사고를 예방하기 위해 2025년도 소프트웨어 보안취약점 신고포상제를 2월 28일부터 운영한다. 올해는 생성형 인공지능 서비스의 보안 우려를 반영해 국내외 공개 인공지능 소프트웨어의 운영 환경, 입출력 관련 코드, 보안기법 우회 등에서 취약점 신고를 강화한다. 신고된 취약점은 조치해 국산 소프트웨어의 품질을 높이고 인공지능 서비스의 안전성을 강화할 예정이다.

🇰🇷🇨🇳 딥시크와 인공지능기본법의 금융권 영향 및 시사점 (2025.2.27)

공공 · 한국금융연구원 · 📋🚀

한국금융연구원은 생성형 AI 확산과 DeepSeek R1 등 저렴한 대안의 등장, 금융 분야 AI 가이드라인 및 인공지능기본법의 주요 내용을 분석했다. 금융권은 내부통제를 마련하고, 고영향 AI로 분류될 가능성이 있는 모델의 설명 가능성 제고와 영향평가를 준비할 필요가 있다. 고영향 AI 분류에 앞서 정부 부처 간 충분한 논의가 필요하다고 제언했다.

🇺🇸 METR의 GPT-4.5 사전 배포 평가 결과 분석 (2025.2.27)

공공 · METR

METR는 OpenAI로부터 GPT-4.5의 초기 체크포인트에 접근하여 평가를 진행했으며, OpenAI의 기술 정보와 내부 평가 결과 일부를 제공받았습니다. 평가 결과, GPT-4.5는 GPT-4와 GPT-4.1 사이의 성능을 보였습니다.

METR는 "50% 시간 지평"을 측정하여 GPT-4.5의 성능을 기존 모델들과 비교했습니다. 그러나 사전 배포 평가의 한계로 인해 모델의 장기적 위험을 완전히 배제하기는 어렵다고 판단했습니다. 특히 내부 사용 중 발생할 수 있는 위험과 모델 도난으로 인한 위험은 평가 기간 동안 충분히 다루기 어렵다는 점을 지적했습니다.

METR는 향후 AI 개발자들과 협력하여 모델 개발 과정 전반에 걸친 안전성을 조사할 계획이며, 특히 개발자의 내부 평가 결과에 대한 제3자 검토를 제안했습니다. 또한 GPT-4.5의 능력 향상이나 평가 조작 가능성에 대한 우려도 제기했습니다.