구글 제미나이4 아르곤, 일부 우선 제공
GLM-5.3, 일부 공격 평가서 미토스 근접
공격자도 내려받는 AI…접근권 통제만으론 한계
미국 인공지능(AI) 기업들이 고성능 AI의 접근권을 제한하고 있는 가운데, 중국 공개형 모델이 사이버 공격 평가에서 유사한 성능을 내며 접근권 통제의 실효성을 흔들고 있다. 공격자가 활용할 수 있는 모델이 늘어나면서 개별 기업의 접근 통제만으로 위험 확산을 억제하기 어려워질 전망이다.
2일 AI업계에 따르면 구글은 최신 프런티어 AI '제미나이4 아르곤'을 사이버방어 협력 프로그램 '페어윈드'를 통해 신뢰할 수 있는 보안 파트너에게 우선 제공 중이다. 일반 사용자들이 사용할 수 있는 구체적인 시점은 공개하지 않았다.
아르곤은 소프트웨어 개발과 법률·금융 등 전문 업무, 사이버보안 방어에 걸친 복잡한 작업을 수행할 수 있는 모델이다. 초기 파트너의 평가와 피드백을 바탕으로 안전성을 보완한 뒤 공급 범위를 넓힐 방침이다. 고성능 모델을 곧바로 일반 사용자들에게 제공하기보다 이용 대상을 선별해 단계적으로 공개하는 방식이다.
앤스로픽과 오픈AI도 글래스윙과 데이브레이크를 통해 일부에게만 고성능 AI를 우선 제공하고 있다. 공격자가 유사한 능력을 확보하기 전 방어자가 먼저 주요 소프트웨어의 취약점을 찾아 수정할 시간을 벌겠다는 취지다.
그러나 이런 사이버보안 성능은 공개형 모델이 따라잡고 있는 모습이다. 앤스로픽은 최근 보고서를 통해 중국 지푸의 오픈웨이트 모델 GLM-5.3이 구글 크롬의 취약점을 공격하는 '익스플로잇벤치'에서 410회 시도 중 50회에 성공하며 56회 성공한 미토스 프리뷰와 맞먹었다고 분석했다. 미국 국립표준기술연구소(NIST)는 "현재까지 출시된 오픈웨이트 모델 중 가장 뛰어난 사이버보안 역량을 갖추고 있다"며 "미국발 최첨단 모델보다 약 4개월 뒤처지는 수준"이라고 말했다.
공개형 모델의 빠른 사이버성능 추격은 개발사가 접근권을 제한하는 방식으로 악용을 통제하기 어렵게 만든다. 특정 기업이 자사 모델을 방어자에게만 제공하더라도 공격자는 별도로 확보한 공개형 모델을 활용할 수 있어서다. 앤스로픽은 "공격자는 미국 모델의 접근권한을 쉽게 확보할 수 없지만, GLM-5.3은 누구나 다운로드할 수 있다"며 "GLM-5.3의 허술한 안전장치는 악의적인 공격자에게 사이버 공격 능력을 크게 향상시켜줄 것으로 판단된다"고 평가했다.
꼭 봐야 할 주요 뉴스
"180석에 달랑 3명 탔다"…충격에 빠진 '신혼여행 ...
공개형 모델의 공격 능력이 높아질수록 접근 제한과 방어 역량 확대를 함께 추진해야 하는 과제도 커지고 있다. 최병호 고려대 휴먼인스파이어드 AI연구원 교수는 "중국 모델의 사이버 성능이 높아지면서 공격자들이 활용할 수 있는 모델에 접근할 기회가 늘어나고 있다"며 "경량 모델을 활용해 이상행동을 실시간으로 탐지하는 역량을 강화하고, 공격을 감지한 뒤 AI가 어디까지 대응할지 책임 소재와 의사결정 체계를 마련해야 한다"고 말했다.
<ⓒ투자가를 위한 경제콘텐츠 플랫폼, 아시아경제. 무단전재 배포금지, AI 학습 및 활용 금지>