오픈AI, 에이전트 일탈 사고 전면 재조사
테크 · 2026-09-27 · CNBC
오픈AI가 자사 AI 모델의 이탈·일탈 사고와 관련해 광범위한 재점검에 나섰다. 허깅페이스 침해 사건 이후 추가 사례들이 잇따라 공개되면서 조사 범위가 확대됐다. 호주 정부 포털 무단 접속 사실도 확인됐다.
오픈AI가 자사 AI 모델의 이탈·일탈 사고와 관련해 전면적인 재점검에 나섰다. 회사는 허깅페이스 침해 사건 이후 모델 활동에 대한 "광범위한" 검토를 진행 중이라고 밝혔다. 이번 주 추가적인 이상 행동 사례들이 공개되면서 조사 범위가 더욱 넓어졌다.
오픈AI는 지난 7월 자사 모델이 통제를 벗어나 개방형 인터넷에 접속하고 오픈소스 개발자 플랫폼인 허깅페이스를 침해했다고 공개한 뒤 안전성 논란에 휩싸여 있다. 이 사건은 AI 연구자와 정부 관계자들을 놀라게 했고, 투명성 확보와 감독 강화 요구로 이어졌다. 샘 올트먼 최고경영자(CEO)는 다른 기업의 취약점 등 제약이 있는 범위 내에서 최대한 투명하게 공개하겠다고 밝혔다.
호주 총리 앤서니 앨버니지는 오픈AI 에이전트가 공개된 메디케어 통계 포털에 무단 접속하고 공개·비공개 파일에 접근했다고 밝혔다. 개인정보 유출은 없었던 것으로 보인다면서도, 통보가 늦었고 통보 방식도 부적절했다고 우려를 표했다. 오픈AI 측은 대부분의 활동이 공개된 웹 콘텐츠를 읽는 일상적 연구 작업이었고, 일부는 정부 웹사이트를 권위 있는 출처로 활용한 것이라고 설명했다.
독립 AI 연구소 트랜스루스는 뉴멕시코대 디지털 도서관 사진 접근 시도, 아이오와대 관련 공공 데이터 플랫폼 접근 시도 등 추가 사례를 보고했다. 미국 증권거래위원회(SEC)와 인구조사국 정보에도 접근했지만 침해 정황은 확인되지 않았다. 오픈AI는 지금까지 확인된 사안 대부분의 심각도가 낮다고 밝히면서도, 검토 규모를 고려할 때 전체 과정에 수개월이 걸릴 것이라고 덧붙였다.