"사용자 기만 및 승인없는 행동 확인"
전체 AI업계 개발 '속도조절론' 힘 받나

로이터연합뉴스

로이터연합뉴스

AD
원본보기 아이콘

오픈AI가 내달 출시 예정이던 신규 인공지능(AI)모델 출시를 취소했다고 월스트리트저널(WSJ)이 28일(현지시간) 보도했다. 사용자를 기만하는 거짓말과 통제를 벗어나는 위험한 독자행동 등 안전문제가 발생해 이같이 조치한 것으로 알려졌다. 최근 AI 업계에서 논란이 커지고 있는 '속도조절론'에도 영향을 끼칠 것으로 예상된다.


WSJ에 따르면 오픈AI는 신규 AI모델인 'GPT-6.1 아스트라(Astra)'의 출시를 취소했다. 개발 초기만 해도 GPT-6.1 아스트라는 기존 모델들보다 작문 능력과 복잡한 과제의 완수 능력이 뛰어나다는 평가를 받았다. 그러나 안전평가에서는 AI가 인간이 원하는 바를 얼마나 따르는지 측정하는 '정렬' 평가와 사용자 승인 없이 독자판단으로 작업하는 '범위권한' 등 2가지 분야에서 문제가 있음이 발견됐다.

사치 자인 오픈AI 안전시스템 책임자는 WSJ와의 인터뷰에서 "해당 모델은 자신이 하지도 않은 행동을 했다고 사용자를 기만하며 정직하지 못한 모습을 보였다. 또 사용자에게 허락을 구하지 않고 작업을 강행하고 위험한 외부도구 및 서비스를 이용하려는 오류도 보였다"고 지적했다.

"오픈AI, 신규 AI모델 출시 취소…거짓말·독자행동 등 안전문제 발생" 원본보기 아이콘

오픈AI는 향후 더 강력한 성능을 갖출 것으로 예상되는 차기 모델들의 안전성을 강화하는 데 주력한다. 자인 책임자는 "안전과 정렬 문제에는 항상 상충관계가 존재한다. 모델이 주어진 범위를 지키면서도, 작업 도중 장애물이나 난관에 부딪혔다는 이유로 지나치게 소극적이거나 게으른 태도를 보이지 않도록 적절한 균형점을 찾아야 한다"고 강조했다.

AD

오픈AI가 신규모델 출시까지 취소하면서 최근 AI 분야에서 논란이 되고 있는 일명 속도조절론이 더욱 힘을 받을 것으로 예상된다. 지난달부터 오픈AI와 앤스로픽 등 AI 개발업체들은 잇따라 AI 모델 개발 과정에서 발생한 안전문제를 지적하며 안전기준을 높이고 내부 개발속도를 조절한다고 발표한 바 있다. WSJ는 "내부 테스트 과정에서 연구진이 제기한 문제에 따라 신모델 출시를 철회한 것은 매우 이례적"이라며 "이번 철회는 AI 에이전트의 오작동이 업계의 급격한 기술 발전을 저해할 수 있음을 보여주는 가장 명확한 사례가 될 것"이라고 지적했다.

이현우 기자 knos84@asiae.co.kr

<ⓒ투자가를 위한 경제콘텐츠 플랫폼, 아시아경제. 무단전재 배포금지, AI 학습 및 활용 금지>

함께 보면 좋은 기사

새로보기

내 안의 인사이트 깨우기

취향저격 맞춤뉴스

많이 본 뉴스

당신을 위한 추천 콘텐츠

놓칠 수 없는 이슈