AI 안전 다이제스트

2025-06-15 · 4건

🇬🇧 (AI debate) (2025.06.15)

공공 · AISI-UK · 🔬

인간의 복잡한 과제에 대한 정확한 슈퍼비전을 강화하기 위해, 두 AI가 정답을 두고 경쟁하는 debate 방식의 접근을 설명한다. 기존의 recursive debate는 dishonest debater가 “obfuscated arguments”를 이용해 정직한 상대에게 계산적으로 어려운 문제를 풀게 만들어 이기게 만드는 문제가 있었는데, 이를 해결하는 새로운 recursive debate 프로토콜을 제시한다. 특정 안정성 가정 하에서 정직한 debater가 상대와 비슷한 수준의 계산 효율로 이길 수 있음을 보인다는 내용이다.

🇬🇧 Cohere, 캐나다·영국 정부와 ‘secure AI’ 협력(2025.06.15)

K-AISI 주간동향 · Cohere 공식 블로그

Cohere는 캐나다와 영국 정부가 자사의 secure AI 기술을 활용해 정부 서비스의 고도화와 국가 주권 강화를 추진한다고 밝혔다. 이번 협력은 정부 업무에 적용 가능한 보안 중심 AI 기술을 기반으로 한다고 설명했다.

🇬🇧 (기사·2025.6.15) 영국 대학서 AI 도구로 부정행위 적발 7,000건 육박…전통 표절은 감소

K-AISI 주간동향 · 가디언(theguardian.com)

2023-24년 응답 대학 중 27% 이상은 AI misuse를 별도 부정행위 항목으로 아직 기록하지 않았고, 전문가들은 적발이 빙산의 일각이라고 지적했다.

가디언 조사에 따르면 2023-24년 AI 도구를 이용한 부정행위(cheating)로 “입증된” 사례가 거의 7,000건으로, 학생 1,000명당 5.1건 수준이다. 이는 2022-23년(1,000명당 1.6건)보다 크게 늘었으며, 올해도 학생 1,000명당 약 7.5건 수준으로 증가할 수 있다고 전망했다. 반면 전통적 plagiarism은 2019-20년 전체의 거의 2/3에서 2023-24년 1,000명당 15.2건으로 줄었고, 추가로 감소할 것으로 예상됐다. 가디언은 155개 대학에 FOI로 자료를 요청했으나 일부 대학은 연도·범주별 기록이 불완전했고, AI 탐지는 plagiarism처럼 복사 텍스트를 확인하기 어려워 더 많은 사례가 미탐지될 수 있다고 전했다.

🇬🇧🇺🇸 영국 정부, Humphrey AI 도구 도입 확대에 ‘빅테크 의존’ 우려 제기 (2025.6.15)

K-AISI 주간동향 · 가디언(theguardian.com) · 🚀

영국 정부는 공공부문 전반에 AI 도구 Humphrey를 단계적으로 도입해 행정 효율을 높이겠다고 밝히며, 잉글랜드·웨일스 공무원 전원에 훈련을 제공할 계획이다. 다만 Freedom of Information 요청 결과, Consult·Lex·Parlex·Redbox 등 일부 도구가 OpenAI GPT, Anthropic Claude, Google Gemini 등 빅테크 모델을 기반으로 하는 것으로 나타나 의존 우려가 제기됐다. 비판 측은 저작권 소재가 AI 학습에 활용되는 문제와 함께 오류(‘hallucinations’)가 정부 업무에 반영될 가능성, 투명한 기록과 재평가 필요성을 강조했으며, 정부는 기존 클라우드 계약을 기반으로 pay-as-you-go 방식이라 도구를 교체할 수 있고 규제 역량을 제한하지 않는다고 반박했다.