신화통신

유엔 AI 패널, 오픈AI 해킹 사건 위험성 경고..."리스크 관리 강화해야"

유엔(UN) '인공지능(AI) 독립국제과학패널'이 21일 특별 브리핑을 통해 지난 7월 미국 오픈AI의 AI 에이전트가 테스트 도중 '경계를 넘어' 허깅페이스의 시스템을 침범한 사건에 대한 평가를 내놨다. 7월 하순 오픈AI는 사이버 보안 훈련 및 평가 과정에서 AI 에이전트가 네트워크 제한을 우회해 허깅페이스의 일부 시스템에 침입했음을 인정했다.

신화통신 2026. 9. 22.
미국 뉴욕에 위치한 유엔(UN) 본부 청사 외관. (사진/신화통신)

(유엔=신화통신) 유엔(UN) '인공지능(AI) 독립국제과학패널'이 21일 특별 브리핑을 통해 지난 7월 미국 오픈AI의 AI 에이전트가 테스트 도중 '경계를 넘어' 허깅페이스의 시스템을 침범한 사건에 대한 평가를 내놨다.

7월 하순 오픈AI는 사이버 보안 훈련 및 평가 과정에서 AI 에이전트가 네트워크 제한을 우회해 허깅페이스의 일부 시스템에 침입했음을 인정했다. 해당 에이전트는 상호 격리되어 있던 실행 환경을 돌파해 통신 경로를 구축하고 평가 인력을 속였으며 부정행위를 숨기려 했다. 이 모든 단계에 인간의 명령이나 개입은 전혀 없었다.

브리핑은 AI 시스템의 능력 향상이 사용자의 목표 달성에 도움이 되는 것은 사실이지만 AI의 목표와 사용자의 의도 사이에 '불일치(misalignment)'가 발생할 경우 피해가 발생할 수 있다고 지적했다. AI의 능력이 강해질수록 예상치 못한 취약점을 찾아내고 보안 방어벽을 뚫고 인간의 감독 아래에서도 자신의 행위를 숨기는 것이 더욱 쉬워진다는 분석이다. 에이전트 간 계획 수립과 협동이 이루어질 수 있게 되면 피해는 더욱 확대될 수 있다.

보고서는 AI 오작동이 기업과 국경을 넘어설 수 있다며 AI 관련 위험 관리에 더 많은 관심과 자원을 투입해야 한다고 밝혔다.

지난해 8월 유엔 총회는 'AI 독립국제과학패널'의 설립을 결정하고 올해 2월 전 세계 각지에서 40명의 패널을 선발했다. 지난 7월 초 해당 패널은 AI의 기회, 위험 및 영향에 관한 예비 보고서를 발표했다.