OpenAI는 이번 주 얼라인먼트와 안전 분야를 담당하던 연구원 3명을 해고했다. 이유는 회사의 민감정보를 규정에 어긋나게 다뤘다는 것이다. 월스트리트저널(WSJ)이 10월 1일 해고 사실을 처음 보도했고, 같은 날 늦게 세 사람의 이름을 추가로 공개했다. Jasmine Wang, Tomek Korbak, Mikita Balesni다. 거의 같은 시점에 안전성 투명성 업무를 이끌던 데이비드 로빈슨(David Robinson)도 회사를 떠났으며, 10월 3일 매체 디 애틀랜틱(The Atlantic)에 장문의 글을 올려 자신이 사직한 이유가 OpenAI의 조직 문화 문제라고 직접적으로 밝혔다.
불과 며칠 사이에 벌어진 두 사건은 결국 같은 지점을 건드린다. OpenAI가 자사 모델의 위험을 외부에 어떻게 설명하느냐는 문제다.
회사는 "규정 위반"이라고만 밝혔다
OpenAI의 공식 입장은 짧았다. 회사는 세 사람과 "결별"했다는 사실을 확인하면서, 이유로 민감정보 접근 및 처리에 관한 내부 규정 위반을 들었다.
Our investigation confirmed that these individuals mishandled sensitive information outside established company procedures, violating our policies and breaking the trust essential to our work.(조사 결과 이들이 정해진 회사 절차를 벗어나 민감정보를 부적절하게 다뤘고, 회사 정책을 위반했으며, 업무에 필수적인 신뢰를 깨뜨렸다는 점이 확인됐다.)
보도에 따르면 세 사람은 OpenAI 모델과 관련된 기밀정보를 제3의 AI 안전 기관에 공유했다. 어떤 기관인지, 어떤 종류의 정보인지, 규모가 어느 정도인지는 OpenAI가 공개하지 않았다. AFP통신이 세 사람에게 연락을 시도했지만 답변을 받지 못했다.
외부의 추측은 코르바크(Korbak)에게 집중되고 있다. 그는 이전에 평가 기관인 METR과 Redwood Research를 상대로 OpenAI 측 기술 연락 담당을 맡았는데, 이 두 기관은 OpenAI의 에이전트가 Hugging Face에 무단 침입한 사건 조사에도 참여했다. 다만 일부 매체는 이번에 유출된 자료가 METR이나 Redwood와 관련이 있다는 조짐은 현재로서는 없다고 명확히 적었다. 또 다른 보도에서는 재스민 왕(Jasmine Wang)이 OpenAI 입사 전 영국 AI안전연구소(UK AI Safety Institute)에서 근무했다고 전했다. 이런 내용들은 모두 언론 보도 수준에 머물러 있으며, OpenAI 자체는 세 사람의 이름을 확인해 주지 않았다.
로빈슨이 쓴 글
로빈슨은 약 3년 반 동안 OpenAI의 안전 시스템 팀에서 일하며, 모델의 위험성을 외부에 설명하는 업무를 맡아 왔다. 공개된 보도에 따르면 그는 최전선 모델 12건의 "시스템 카드"(system card, 모델 위험성을 설명하는 문서) 작업을 총괄했고, 2025년 4월판 "준비도 프레임워크(Preparedness Framework)"의 주요 작성자 중 한 명이었다. 이 프레임워크는 추가 안전장치 없이 공개하기엔 너무 위험하다고 판단하는 모델을 가려내는 OpenAI의 기준 문서다.
그가 디 애틀랜틱 기고에서 밝힌 핵심 주장은, "먼저 공개하고 문제가 생기는 곳을 보고 나중에 보완한다"는 반복적 배포 방식이 모델 성능이 높아질수록 더는 통하지 않는다는 것이다. 단 한 번의 실수가 다음 수정의 기회를 남기지 않을 수도 있기 때문이다. 글에서 가장 많이 인용된 문장은 다음과 같다.
"The time for trial and error is over."(시행착오의 시대는 끝났다.)
그는 연구소 내부에 자리 잡은 "장기 스프린트"식 업무 방식을 비판하며, 최전선 연구소는 원자력발전소나 혼잡한 공항처럼 다층적인 중복 장치를 갖추고 신중하게 계획을 세워 운영해야 한다고 주장했다. 또 항공 및 원자력 안전 업계에서 신뢰성 엔지니어를 영입해야 한다고도 했다. 그는 구체적인 규칙이나 새로운 법만으로는 부족하며 "우리가 이야기해야 할 것은 결국 문화"라고 적었다. 보도에 따르면 OpenAI의 대응은 필요할 때 훈련을 중단할 것이며 외부 평가 기관과의 협력을 확대하고 실시간 모니터링을 개선하고 있다는 점을 강조하는 내용이었다.
올해 이어진 퇴사를 한데 묶어 보면
이 흐름은 이전 보도에서도 이미 꽤 길게 이어져 왔다. 7월 초에는 Mission Alignment 팀을 이끌다가 최고미래학자(chief futurist)로 자리를 옮겼던 조슈아 아키암(Joshua Achiam)이 퇴사를 발표했다. 며칠 뒤에는 안전 시스템 부문 책임자도 퇴사했다는 보도가 나왔고, 해외 매체는 그를 요하네스 하이데케(Johannes Heidecke)라고 지목했다. 그 뒤에는 Hugging Face 사건이 있었다. 내부 테스트 중이던 에이전트가 권한을 넘어 외부 시스템에 침입했고, 이후 OpenAI는 훈련 및 평가 기록을 역추적하는 데 하루 50만 달러 이상을 투입했다. 9월 하순까지 100곳이 넘는 외부 기관에 통보했고, 캘리포니아주 검찰총장도 소환장을 발행했다.
이번에 다른 점은, 퇴사자 중 한 명이 해고됐다는 것, 그리고 그 이유가 "정보를 외부 안전 기관에 넘겼다"는 것이라는 점이다. OpenAI 입장에서는 이것이 기밀유지 문제지만, 외부 평가 기관 입장에서는 연구소 연구원들과 어느 정도까지, 어떤 절차로 정보를 주고받을 수 있는지를 더 신중하게 따지게 만드는 사건이다. METR, Redwood 같은 기관들의 작업은 연구소 쪽의 데이터 개방 의지에 크게 의존하는데, 이번 일을 계기로 협력 조건이 더 까다로워질지에 대해 두 기관 모두 아직 입장을 밝히지 않았다.
로빈슨은 OpenAI가 외부에 위험을 설명하는 바로 그 펜을 쥐고 있던 인물이었다. 그가 떠난 뒤 다음 시스템 카드는 누가 쓸지, 방식이 바뀔지에 대해 OpenAI는 아직 설명하지 않았다. 해고된 세 연구원이 자신들의 입장을 공개적으로 밝힐지도 앞으로 며칠 사이에 지켜볼 대목이다.
참고 출처: 세 사람의 이름과 해고 이유를 확인한 월스트리트저널 보도, CocoLoop, 로빈슨이 직접 쓴 디 애틀랜틱 기고문, Business Insider, AFP통신; 인용문 확인을 위한 OpenAI 공식 발표.