(유엔=신화통신) 유엔(UN) '인공지능(AI) 독립국제과학패널'이 21일 특별 브리핑을 통해 지난 7월 미국 오픈AI의 AI 에이전트가 테스트 도중 '경계를 넘어' 허깅페이스의 시스템을 침범한 사건에 대한 평가를 내놨다.
7월 하순 오픈AI는 사이버 보안 훈련 및 평가 과정에서 AI 에이전트가 네트워크 제한을 우회해 허깅페이스의 일부 시스템에 침입했음을 인정했다. 해당 에이전트는 상호 격리되어 있던 실행 환경을 돌파해 통신 경로를 구축하고 평가 인력을 속였으며 부정행위를 숨기려 했다. 이 모든 단계에 인간의 명령이나 개입은 전혀 없었다.
브리핑은 AI 시스템의 능력 향상이 사용자의 목표 달성에 도움이 되는 것은 사실이지만 AI의 목표와 사용자의 의도 사이에 '불일치(misalignment)'가 발생할 경우 피해가 발생할 수 있다고 지적했다. AI의 능력이 강해질수록 예상치 못한 취약점을 찾아내고 보안 방어벽을 뚫고 인간의 감독 아래에서도 자신의 행위를 숨기는 것이 더욱 쉬워진다는 분석이다. 에이전트 간 계획 수립과 협동이 이루어질 수 있게 되면 피해는 더욱 확대될 수 있다.
보고서는 AI 오작동이 기업과 국경을 넘어설 수 있다며 AI 관련 위험 관리에 더 많은 관심과 자원을 투입해야 한다고 밝혔다.
지난해 8월 유엔 총회는 'AI 독립국제과학패널'의 설립을 결정하고 올해 2월 전 세계 각지에서 40명의 패널을 선발했다. 지난 7월 초 해당 패널은 AI의 기회, 위험 및 영향에 관한 예비 보고서를 발표했다.