"오픈AI, 신규 AI모델 출시 취소…거짓말·독자행동 등 안전문제 발생"
"사용자 기만 및 승인없는 행동 확인"
전체 AI업계 개발 '속도조절론' 힘 받나
오픈AI가 내달 출시 예정이던 신규 인공지능(AI)모델 출시를 취소했다고 월스트리트저널(WSJ)이 28일(현지시간) 보도했다. 사용자를 기만하는 거짓말과 통제를 벗어나는 위험한 독자행동 등 안전문제가 발생해 이같이 조치한 것으로 알려졌다. 최근 AI 업계에서 논란이 커지고 있는 '속도조절론'에도 영향을 끼칠 것으로 예상된다.
WSJ에 따르면 오픈AI는 신규 AI모델인 'GPT-6.1 아스트라(Astra)'의 출시를 취소했다. 개발 초기만 해도 GPT-6.1 아스트라는 기존 모델들보다 작문 능력과 복잡한 과제의 완수 능력이 뛰어나다는 평가를 받았다. 그러나 안전평가에서는 AI가 인간이 원하는 바를 얼마나 따르는지 측정하는 '정렬' 평가와 사용자 승인 없이 독자판단으로 작업하는 '범위권한' 등 2가지 분야에서 문제가 있음이 발견됐다.
사치 자인 오픈AI 안전시스템 책임자는 WSJ와의 인터뷰에서 "해당 모델은 자신이 하지도 않은 행동을 했다고 사용자를 기만하며 정직하지 못한 모습을 보였다. 또 사용자에게 허락을 구하지 않고 작업을 강행하고 위험한 외부도구 및 서비스를 이용하려는 오류도 보였다"고 지적했다.
오픈AI는 향후 더 강력한 성능을 갖출 것으로 예상되는 차기 모델들의 안전성을 강화하는 데 주력한다. 자인 책임자는 "안전과 정렬 문제에는 항상 상충관계가 존재한다. 모델이 주어진 범위를 지키면서도, 작업 도중 장애물이나 난관에 부딪혔다는 이유로 지나치게 소극적이거나 게으른 태도를 보이지 않도록 적절한 균형점을 찾아야 한다"고 강조했다.
꼭 봐야 할 주요 뉴스
"현관문에 '이것' 붙어있으면 당장 떼세요"…전 국...
오픈AI가 신규모델 출시까지 취소하면서 최근 AI 분야에서 논란이 되고 있는 일명 속도조절론이 더욱 힘을 받을 것으로 예상된다. 지난달부터 오픈AI와 앤스로픽 등 AI 개발업체들은 잇따라 AI 모델 개발 과정에서 발생한 안전문제를 지적하며 안전기준을 높이고 내부 개발속도를 조절한다고 발표한 바 있다. WSJ는 "내부 테스트 과정에서 연구진이 제기한 문제에 따라 신모델 출시를 철회한 것은 매우 이례적"이라며 "이번 철회는 AI 에이전트의 오작동이 업계의 급격한 기술 발전을 저해할 수 있음을 보여주는 가장 명확한 사례가 될 것"이라고 지적했다.
<ⓒ투자가를 위한 경제콘텐츠 플랫폼, 아시아경제. 무단전재 배포금지, AI 학습 및 활용 금지>