오픈AI, 프런티어 AI 국제 안전기준 제안
테크 · 2026-09-22 · CNBC
오픈AI가 프런티어 AI 개발의 안전·보안을 위한 제안을 공개하고 정렬 연구와 재귀적 자기개선(RSI) 기술에 초점을 맞췄다. 국제 협력을 통한 프런티어 표준 마련을 촉구했다.
오픈AI가 프런티어 인공지능(AI) 개발의 안전과 보안을 위한 일련의 제안을 공개했다. 정렬(alignment) 연구와 재귀적 자기개선(RSI) 기술에 초점을 맞춘 것으로, 국제 협력을 통해 프런티어 AI 표준을 마련할 것을 촉구했다.
오픈AI는 "시스템이 인간 가치에 정렬되고 인간 통제 아래 남으려면 정렬 연구가 역량 발전 속도를 따라가야 한다"고 밝혔다. 이 같은 기술 표준은 프런티어 AI 모델과 개발자, 그리고 RSI를 포함한 자동화 AI 연구자의 편익·위험 관리를 겨냥해야 한다고 제안했다.
RSI는 인간 개입 없이 스스로 업그레이드하는 파운데이션 모델을 만들 수 있다는 점에서 주목받지만, 기업이 기반 기술에 대한 통제력을 잃거나 의도치 않은 결과를 초래할 수 있다는 우려도 낳는다. 오픈AI는 "완전 자율 RSI는 현재 일어나지 않고 있으며, 안전하게 수행될 수 있을 때까지 추구해서는 안 된다"고 강조했다. 자사는 관련 사례로 RSI와 무관한 허깅페이스 에이전트 해킹을 언급하며, 강력한 안전장치 없이는 위험이 훨씬 심각해질 수 있다고 경고했다.
최근 AI 안전 경고가 잇따르는 가운데 경쟁사 앤스로픽도 자체 안전 개발 방안을 내놨다. 앤스로픽과 오픈AI에 모두 근무한 제이콥 콕슨은 약 2주 전 사임하며 두 회사가 "우리 목숨을 걸고 도박하고 있다"고 주장해 논란을 일으켰다. 앤스로픽 CEO 다리오 아모데이는 파운데이션 모델 개발 속도 조절과 제3자 평가자 내재화를 제안했고, 샘 올트먼 오픈AI CEO와 일론 머스크 테슬라·스페이스X CEO도 지지했다. 다만 AI 평가 분야가 초기 단계여서 기본 표준 합의는 아직 없다.