지난주 OpenAI에서 해고된 안전 연구원 Jasmine Wang, Tomek Korbak, Mikita Balesni 세 사람이 10월 8일 공동 명의로 공개서한을 냈다. 이들은 회사의 주장을 부인하면서, 이번 해고로 회사에 남은 동료들이 입을 열기 어려워졌다고 경고했다. 하루 뒤 OpenAI는 X에 입장문을 올려 해고 결정은 바뀌지 않는다고 못 박았고, 내부 조사에서 확인된 문제가 서한에 쓰인 것보다 더 심각하다고 밝혔다.
세 사람이 각자 들은 해고 사유
공개서한의 제목은 "OpenAI cannot make AI safe on its own"이며, 수신처는 OpenAI의 안전보안위원회, 안전 자문단, 미션 자문위원회다. 서한에서 가장 구체적인 부분은 세 사람이 각자 통보받은 해고 사유를 설명한 대목이다.
Korbak은 외부 평가 기관 METR과 소통한 방식이 문제라고 구두로만 들었다고 말한다. 무슨 말을 했고 무엇을 했으며 언제였는지에 대한 설명은 없었고 서면 자료도 전혀 없었다. 그는 METR과의 소통은 원래 자기 업무였다고 주장한다. METR은 앞서 에이전트가 Hugging Face에 침투한 사건을 조사할 때 OpenAI와 협력한 바 있다.
Balesni에 따르면 퇴사 면담에서 회사는 제3자 안전 기관과 지나치게 많이 접촉해서 더는 신뢰할 수 없다고 했고, 지식재산을 유출했다는 뉘앙스를 풍겼다. 그는 회사의 지식재산을 공유한 적이 없고, 해당 업무는 직속 상사와 연구 책임자, 이사회와 조율을 마친 것이었다고 설명한다. 그는 X에 세 사람이 해고된 이유는 안전을 회사의 단기 이익보다 앞에 뒀기 때문이라고 생각한다고 썼다.
Wang이 들은 사유는 한 임원의 메일함에 접근했다는 것이다. 그의 설명은 이렇다. 그 권한은 원래 채용 업무를 위해 열린 것이었고, IT 부서에 회수를 요청했지만 이행되지 않았다. 민감한 메일을 실수로 열었을 때는 몇 분 안에 해당 임원에게 알렸다. 그는 회사에 서면으로 된 완전한 혐의 목록을 요구했다.
세 사람은 자신들이 유출의 출처라는 점도 부인한다. 앞서 일부 매체가 "감시하기 더 어려운 모델 아키텍처"를 둘러싼 OpenAI 내부 논의를 보도한 적이 있는데, 서한에는 "We were not the source of the leak"라고 명시돼 있다.
OpenAI의 답변
OpenAI의 입장문은 연구 책임자 명의로 나왔지만, 대부분의 보도에는 구체적인 서명자 이름이 나오지 않는다. 요점은 네 가지다. 조사 결과 세 사람이 민감한 정보 취급에 관한 명확한 정책을 위반했음을 확인했다는 것, 확인된 신뢰 위반이 공개서한의 서술을 넘어선다는 것, 인사 세부 사항은 관례에 따라 공개하지 않는다는 것, 그리고 해고는 이들이 안전 우려를 제기한 것과 무관하다는 것이다.
"We have not and do not terminate any of our employees for raising concerns."
(우리는 우려를 제기했다는 이유로 직원을 해고한 적이 없으며, 앞으로도 그렇게 하지 않는다.)
입장문에는 동의하는 부분도 있다. OpenAI는 최첨단 모델을 감시 가능한 상태로 유지하려면 OpenAI 자신을 포함한 업계 전체의 투자가 필요하다는 서한의 견해에 동의한다면서, 제3자 안전 평가 기관과의 계약을 마무리하는 중이며 세부 내용은 앞으로 몇 주 안에 공개하겠다고 밝혔다. 어떤 기관이 포함되는지, 계약에서 연구원이 외부 평가 기관과 직접 소통하는 것을 허용하는지는 아직 알려지지 않았다.
지난 2년간의 해고를 이어서 보면
OpenAI가 유출을 이유로 연구진을 해고한 것은 이번이 처음이 아니다. 2024년 4월 슈퍼얼라인먼트 팀의 Leopold Aschenbrenner와 Pavel Izmailov가 정보 유출 혐의로 해고됐다. Aschenbrenner는 이후 사내에서 안전 문제를 제기했기 때문에 표적이 된 것이라며 공개적으로 반박했다.
2년 뒤인 이번에는 시간 간격이 훨씬 촘촘하다. 10월 1일 월스트리트저널이 세 사람의 해고를 보도했다. 10월 3일에는 시스템 카드를 담당하던 David Robinson이 The Atlantic에 자신이 회사를 떠난 이유를 기고했다. 10월 8일 공개서한이 나왔고, 10월 9일 OpenAI가 답했다.
2024년 사례와 비교하면 논란의 초점이 유출 여부에서 연구소 연구원과 외부 평가 기관 사이의 경계선으로 옮겨 갔다. 서한은 당시 내부 정책이 아직 "하면서 정해 가는" 단계였다고 말하고, OpenAI는 정책이 명확했다고 말한다. 독립적인 평가가 중요하다는 데는 양측이 같은 입장이며, 갈리는 지점은 이 문제에서 누가 선을 넘었느냐다.
Balesni는 회사가 이번 해고를 계기로 METR과의 협력 관계를 끊을까 우려한다. 지금까지 공개된 보도에서는 METR의 입장이 확인되지 않았고, OpenAI도 위반의 구체적인 내용을 밝히지 않았다. 제3자 평가 계약이 공개되기 전까지 외부에서 판단에 쓸 수 있는 것은 양측 각자의 주장뿐이다.
참고 출처: OpenAI 공식 입장문, TechCrunch, CocoLoop, Newsweek(공개서한 전문), 로이터, AFP. 세 사람의 공개서한과 개인 소셜 미디어 계정으로 각자의 진술을 대조했고, CNBC로 입장문 인용문을 확인했다.