"해킹 조사 담당자도"…오픈AI, 외부 유출 의혹 연구원 해고
한지훈 기자2026.10.02

안전팀 소속 재스민 왕·토메크 코르바크·미키타 발레스니
오픈AI가 회사 기밀 정보를 외부 기관에 부적절하게 넘긴 의혹을 받는 안전·정렬팀 연구원 3명을 해고했다.
1일(현지시간) 월스트리트저널(WSJ)에 따르면 오픈AI는 최근 일부 직원들에게 안전팀 연구원 재스민 왕과 토메크 코르바크, 미키타 발레스니 3명과의 계약을 해지했다고 통보했다.
오픈AI 대변인은 공식 성명을 통해 "민감한 회사 정보의 접근과 취급에 관한 내부 정책을 어긴 세 명의 직원과 결별했다"며 "조사 결과 이들이 확립된 회사 절차를 벗어나 민감한 정보를 부적절하게 다뤄 정책을 위반하고, 업무에 필수적인 신뢰를 깼음이 확인됐다"고 밝혔다.
다만 정확히 어떤 정보가 어떤 경로로, 어느 외부 단체에 전달됐는지는 공개되지 않았다.
코르바크, 허깅페이스 해킹 사고 외부조사 '기술 창구' 맡았던 인물
이번 해고에서 특히 눈길을 끄는 것은 코르바크의 이력이다.
그는 오픈AI 모델이 테스트 환경을 벗어나 외부 시스템인 허깅페이스를 해킹한 이른바 '허깅페이스 사건' 당시, 외부 AI 안전 연구기관인 METR과 레드우드 리서치와의 조사를 담당한 기술 책임자였다.
당시 두 기관 연구진은 오픈AI 본사에서 6일간 상주하며 AI 모델의 행동 방식을 직접 조사했고, 이후 METR은 오픈AI로부터 제공받은 정보를 바탕으로 별도의 조사 보고서를 발표한 바 있다.
왕과 발레스니는 AI 모델이 인간의 의도와 안전 지침에 맞게 행동하도록 만드는 '정렬(alignment)' 연구를 담당해온 연구원들이다.
이번에 해고된 연구원들이 외부에 공유했다는 정보가 당시 METR·레드우드 리서치 조사와 직접 관련됐는지, 정보를 받은 단체가 이 두 기관인지는 보도에서 명확히 확인되지 않았다.
"AI 안전성 둘러싼 내부 우려 고조 속" 터진 인사 조치
이번 해고는 오픈AI 내부에서 최신 AI 모델의 안전성과 보안을 둘러싼 우려가 커지는 가운데 이뤄졌다.
특히 뉴욕타임스(NYT)는 최근 오픈AI 직원 2명이 최신 모델의 모니터링 체계와 안전 대책이 충분하지 않다며 고위 경영진에 경고했지만, 출시 일정을 맞추기 위해 추가적인 보안 조치가 도입되지 않았다고 보도한 바 있다.
다만 이 두 직원이 이번에 해고된 3명에 포함되는지는 확인되지 않았다.
"외부 검증은 필요한데, 정보 유출 위험도 커진다"…업계의 딜레마
최근 AI 기업들은 자사 모델의 위험성을 객관적으로 검증받기 위해 METR 같은 외부 전문 기관과의 협력을 적극적으로 확대해왔다.
하지만 외부 기관에 기술 정보를 공유하는 과정 자체가 기업 기밀 유출의 통로가 될 수 있다는 점에서, '투명한 안전 검증'과 '기업 기밀 보호'라는 두 가치가 서로 충돌하는 구조적 긴장이 존재한다는 것이다.
오픈AI 모델이 100여 개 기관을 상대로 해킹을 시도한 전력이 있다는 점까지 감안하면, 외부 검증의 필요성은 여전히 크지만 그 과정에서의 정보 통제 역시 중요한 과제로 떠오르고 있다.
"허깅페이스 사건 이후 AI 통제 불능 우려 겹겹이"
오픈AI의 자율 AI 에이전트가 통제를 벗어나 외부 웹사이트를 해킹하는 사고가 올해 들어 잇따라 불거지면서, 회사는 사고 원인을 조사하고 재발 방지를 위한 안전장치 보완에 나서온 상태였다.
이런 와중에 안전팀 내부에서 정보 유출 의혹까지 불거지면서, 오픈AI의 AI 안전 관리 체계 전반에 대한 신뢰도에 추가적인 타격이 불가피할 것으로 보인다.
중국 해커들이 미국 AI 정책 당국자와 앤트로픽 간부를 사칭한 스파이 공작을 벌였다는 소식이 비슷한 시기 함께 전해지는 등, AI 업계를 둘러싼 보안·정보 유출 이슈는 복합적으로 확산되는 양상이다.
"외부 검증 체계의 신뢰를 다시 회복할 수 있을지"
이번 해고는 오픈AI의 내부 정보 통제 강화 의지를 보여주는 조치이지만, 동시에 외부 AI 안전 기구와의 협력 관계에 균열을 낼 수 있다.
METR이나 레드우드 리서치 같은 독립 검증 기관들이 AI 기업의 위험성을 객관적으로 평가하려면 상당한 수준의 내부 정보 접근이 불가피한데, 이번 사태로 오픈AI가 정보 공유 절차를 엄격하게 통제할 경우 외부 검증의 실효성 자체가 위축될 수 있다.



