Ba nhà nghiên cứu bị sa thải gửi thư ngỏ, OpenAI nói còn vi phạm khác

Ba nhà nghiên cứu an toàn bị OpenAI sa thải tuần trước, gồm Jasmine Wang, Tomek Korbak và Mikita Balesni, đã cùng ký một thư ngỏ vào ngày 8/10. Họ bác bỏ các cáo buộc của công ty và cảnh báo rằng vụ sa thải đã khiến những đồng nghiệp còn ở lại không dám lên tiếng. Một ngày sau, OpenAI đăng tuyên bố trên X, khẳng định quyết định sa thải không thay đổi, đồng thời cho biết cuộc điều tra nội bộ phát hiện những vấn đề nghiêm trọng hơn so với những gì thư nêu.

Mỗi người được thông báo điều gì

Thư ngỏ có tiêu đề “OpenAI cannot make AI safe on its own”, gửi tới Ủy ban An toàn và An ninh, Nhóm cố vấn An toàn và Ủy ban Cố vấn Sứ mệnh của OpenAI. Phần cụ thể nhất của thư là nơi từng người kể lại lý do sa thải mà mình được thông báo.

Korbak cho biết anh chỉ được thông báo bằng miệng, lý do là cách anh trao đổi với tổ chức đánh giá bên ngoài METR. Không có chi tiết nào về việc anh đã nói gì, làm gì, vào lúc nào, và cũng không có tài liệu bằng văn bản. Anh cho rằng trao đổi với METR vốn là một phần công việc của mình. Trước đó, METR đã cùng OpenAI điều tra vụ tác tử AI xâm nhập Hugging Face.

Balesni kể rằng trong buổi nói chuyện khi nghỉ việc, công ty nói họ không còn tin anh vì anh tiếp xúc quá nhiều với các tổ chức an toàn bên thứ ba, ngụ ý anh đã làm lộ tài sản trí tuệ. Anh khẳng định chưa bao giờ chia sẻ tài sản trí tuệ của công ty, và công việc liên quan đã được phối hợp với cấp trên trực tiếp, người phụ trách nghiên cứu và hội đồng quản trị. Trên X, anh viết rằng anh tin ba người bị sa thải vì đặt an toàn lên trên lợi ích ngắn hạn của công ty.

Wang được thông báo lý do là đã truy cập hộp thư của một lãnh đạo cấp cao. Theo lời cô, quyền truy cập đó ban đầu được cấp cho công việc tuyển dụng; cô đã yêu cầu bộ phận IT thu hồi nhưng không được thực hiện. Sau khi lỡ mở một email nhạy cảm, cô báo cho vị lãnh đạo đó chỉ trong vài phút. Cô yêu cầu công ty đưa ra danh sách cáo buộc đầy đủ bằng văn bản.

Ba người cũng phủ nhận mình là nguồn gây rò rỉ. Trước đó, một số tờ báo đã đưa tin về các thảo luận nội bộ của OpenAI xung quanh “kiến trúc mô hình khó giám sát hơn”; thư ngỏ viết rõ: “We were not the source of the leak”.

OpenAI đáp lại thế nào

Tuyên bố của OpenAI do người phụ trách nghiên cứu đưa ra, nhưng phần lớn các bài báo không nêu tên người ký. Tuyên bố có bốn ý chính: sau điều tra, công ty xác nhận ba người đã vi phạm chính sách rõ ràng về xử lý thông tin nhạy cảm; những hành vi vi phạm lòng tin được phát hiện vượt quá phạm vi trong thư ngỏ; theo thông lệ, chi tiết nhân sự không được công bố; và việc sa thải không liên quan đến việc họ nêu lên mối lo ngại về an toàn.

"We have not and do not terminate any of our employees for raising concerns."
(Chúng tôi chưa từng và sẽ không sa thải bất kỳ nhân viên nào vì họ nêu lên mối lo ngại.)

Tuyên bố cũng có phần đồng tình. OpenAI nói họ đồng ý với quan điểm trong thư rằng việc giữ cho các mô hình tiên phong có thể giám sát được đòi hỏi sự đầu tư của cả ngành, trong đó có chính OpenAI, và cho biết đang chốt các hợp đồng với những tổ chức đánh giá an toàn bên thứ ba, chi tiết sẽ được công bố trong vài tuần tới. Hiện vẫn chưa rõ đó là những tổ chức nào, cũng như hợp đồng có cho phép nhà nghiên cứu trao đổi trực tiếp với bên đánh giá bên ngoài hay không.

Đặt các vụ sa thải của hai năm qua cạnh nhau

Đây không phải lần đầu OpenAI sa thải nhà nghiên cứu với lý do rò rỉ thông tin. Tháng 4/2024, Leopold Aschenbrenner và Pavel Izmailov của nhóm siêu căn chỉnh (superalignment) bị sa thải vì bị cho là làm lộ thông tin. Sau đó, Aschenbrenner cũng công khai phản bác, nói rằng ông bị nhắm tới vì nêu các vấn đề an toàn trong nội bộ.

Hai năm sau, diễn biến của đợt này diễn ra dồn dập hơn: ngày 1/10, The Wall Street Journal đưa tin ba người bị sa thải; ngày 3/10, David Robinson, người phụ trách system card, đăng bài trên The Atlantic giải thích lý do ông rời đi; ngày 8/10, thư ngỏ được gửi đi; ngày 9/10, OpenAI lên tiếng đáp lại.

So với vụ năm 2024, tâm điểm tranh cãi lần này đã chuyển từ chuyện “có rò rỉ hay không” sang ranh giới giữa các nhà nghiên cứu trong phòng thí nghiệm và các tổ chức đánh giá bên ngoài. Thư ngỏ nói chính sách nội bộ khi đó vẫn đang “vừa làm vừa định”, còn OpenAI cho rằng chính sách đã rõ ràng. Hai bên đều đồng ý đánh giá độc lập là quan trọng; bất đồng nằm ở chỗ ai đã vượt qua lằn ranh trong chuyện này.

Balesni lo ngại công ty sẽ nhân vụ sa thải này để cắt đứt quan hệ hợp tác với METR. Hiện chưa thấy phản hồi của METR trong các bài báo công khai, và OpenAI cũng chưa tiết lộ nội dung vi phạm cụ thể. Cho đến khi hợp đồng đánh giá của bên thứ ba được công bố, thứ duy nhất bên ngoài có thể dựa vào để nhận định chỉ là lời của mỗi bên.

Nguồn tham khảo: tuyên bố chính thức của OpenAI, TechCrunch, CocoLoop, toàn văn thư ngỏ đăng trên Newsweek, Reuters, AFP; thư ngỏ của ba người và các tài khoản mạng xã hội cá nhân được dùng để đối chiếu lời kể của từng người, CNBC được dùng để đối chiếu trích dẫn trong tuyên bố.