AI 안전 다이제스트

2026-02-22 · 1건

(스탠퍼드 HAI 기사 게재일: 2026.02.22) AI 챗봇의 당일 뉴스 응답은 전반적으로 높지만 지역·언어별 편차와 오답 취약성이 큼

공공 · 스탠퍼드 HAI(Stanford HAI)

스탠퍼드 HAI 연구진은 6개 상용 AI 챗봇을 6개 지역·언어의 당일 뉴스 2,100개(총 12,600개 응답) 객관식 질문으로 평가해 대체로 90%대 정확도를 보였다고 밝혔다. 다만 지역 간 성능 격차가 컸으며 특히 Hindi는 최저로, 오류율이 다른 지역 대비 크게 높게 나타났다. 또한 질문의 전제가 약간 틀리면 견고성이 급격히 떨어져, 적대적 조건에서 Grok 4는 70.0% 정확도인 반면 GPT-5는 19.0%까지 하락했다. 오류는 추론 자체보다 ‘증거 검색 실패’와 ‘출처 대체로 인한 사실 불일치’ 비중이 높고, 인용 URL 또한 합의되지 않은 방식으로 영어권 소스에 의존하는 경향이 관찰됐다.