Nhân viên gán nhãn dữ liệu của Scale AI xem nội dung bạo lực hàng ngày, mắc PTSD và khó đạt mức lương tối thiểu

Mỗi mô hình AI bạn sử dụng đều có con người thật đang nhìn chằm chằm vào những nội dung bẩn thỉu và đen tối nhất — tài liệu lạm dụng tình dục trẻ em, nội dung xúi giục tự tử, bạo lực cực đoan — và gắn nhãn cho chúng, dạy cho mô hình biết chúng là gì và cách phản ứng.

Công việc này được gọi là gán nhãn dữ liệu.

Trong số các công ty phụ trách mảng này, Scale AI là một trong những công ty lớn nhất.

Scale AI làm gì?

Scale AI do Alexandr Wang thành lập khi mới 19 tuổi, hiện là một trong những công ty quan trọng nhất trong lĩnh vực cơ sở hạ tầng dữ liệu AI. Khách hàng của họ bao gồm OpenAI, Google, Meta và Bộ Quốc phòng Mỹ.

Năm 2024, Meta đã đầu tư trực tiếp 14,3 tỷ USD, trở thành cổ đông lớn của Scale AI.

Điều này có nghĩa là Scale AI hiện thuộc sở hữu một phần của Meta, đồng thời tiếp tục cung cấp dịch vụ dữ liệu huấn luyện cho Meta — một vòng lặp kỳ lạ.

Bộ Lao động vào cuộc điều tra

Tháng 3 năm 2025, TechCrunch đưa tin Bộ Lao động Mỹ (DOL) đang điều tra Scale AI vì nghi ngờ vi phạm Đạo luật Tiêu chuẩn Lao động Công bằng (FLSA).

Cuộc điều tra này được khởi xướng dưới thời chính quyền Biden và kéo dài gần một năm mới bị công chúng biết đến.

Trọng tâm điều tra là công nhân của Scale AI — họ không được gọi là nhân viên, mà là "Taskers". Scale AI phân loại họ là nhà thầu độc lập thay vì nhân viên chính thức, điều này có sự khác biệt pháp lý quan trọng: nhà thầu không được hưởng bảo đảm lương tối thiểu liên bang, không có bảo hiểm xã hội và không được bảo vệ bởi luật giờ làm việc.

Tình hình ở Philippines còn trực diện hơn: công nhân địa phương gán nhãn dữ liệu cho dự án xe tự lái của Google, báo cáo cho thấy mức thù lao thấp hơn mức lương tối thiểu theo luật định địa phương, không có bảo hiểm y tế hay nghỉ phép có lương.

Phía Scale AI bác bỏ các cáo buộc vi phạm.

Schuster kiện Scale AI: Vụ án tổn thương tâm lý

Tiền bạc không phải là vấn đề cốt lõi duy nhất.

Tòa án Quận phía Bắc California đang xét xử một vụ kiện, nguyên đơn là nhiều cựu "Taskers" của Scale AI, với yêu cầu cốt lõi: công ty đã bắt công nhân tiếp xúc lâu dài với nội dung độc hại, gây tổn thương tâm lý nghiêm trọng và công ty không thực hiện nghĩa vụ bảo vệ.

Những công nhân này bị yêu cầu trò chuyện kéo dài với hệ thống AI, nội dung bao gồm:

  • Xúi giục và mô tả phương pháp tự tử
  • Nội dung liên quan đến tài liệu lạm dụng tình dục trẻ em (CSAM)
  • Các cảnh bạo lực cực đoan và săn mồi

Theo đơn kiện, đây không phải là công việc nhấp chuột nhanh để bỏ qua. Hệ thống AI sẽ tiếp tục đặt câu hỏi chi tiết dựa trên mỗi phản hồi của công nhân, yêu cầu họ liên tục đi sâu vào loại nội dung này, "đòi hỏi sự tập trung tinh thần hoàn toàn".

Đơn kiện đề cập đến hai thuật ngữ: tổn thương đạo đức (moral injury) — tổn thương tâm lý do bị buộc phải thực hiện các hành vi đi ngược lại giá trị của bản thân trong thời gian dài — và sự phản bội của tổ chức (institutional betrayal), chỉ việc người sử dụng lao động biết rõ công nhân gặp rủi ro nhưng không cung cấp sự bảo vệ.

Công nhân mô tả các triệu chứng cụ thể như PTSD, trầm cảm, lo âu.

Các cáo buộc trong vụ kiện bao gồm: sơ suất và vi phạm Đạo luật Cạnh tranh Không lành mạnh (UCL) của California, đồng thời đang xin cấp chứng nhận kiện tập thể.

Đây không phải lần đầu tiên

Mô hình này không mới.

Năm 2020, The Verge đã đăng một bài điều tra chuyên sâu, tiết lộ Facebook (nay là Meta) thuê công nhân kiểm duyệt nội dung tiếp xúc nhiều với nội dung khủng bố và bạo lực trẻ em, công nhân thường xuất hiện các triệu chứng căng thẳng sau chấn thương. Cuối cùng, nhà thầu Cognizant của Facebook đã bồi thường 52 triệu USD để dàn xếp vụ kiện liên quan.

Nhưng đó là kiểm duyệt nội dung — nhiệm vụ của công nhân là xóa nội dung độc hại khỏi nền tảng.

Công nhân của Scale AI làm công việc gán nhãn dữ liệu huấn luyện AI — họ đang dạy mô hình "cách phản ứng khi gặp loại nội dung này". Công việc này kín đáo hơn, ít được công chúng biết đến hơn, nhưng mức độ tổn thương tâm lý không thua kém kiểm duyệt nội dung.

Vấn đề cấu trúc ngành

Vụ kiện Scale AI phơi bày một sự sắp xếp có hệ thống của ngành AI:

Giao những công việc độc hại và khó khăn nhất cho những công nhân được trả lương thấp nhất, sử dụng danh nghĩa "nhà thầu độc lập" để vòng qua các bảo vệ lao động, sau đó lên trang sản phẩm của mình để nói về "AI có trách nhiệm" và "ưu tiên an toàn".

Meta đã chi 14,3 tỷ USD vào năm 2024 để mua lại phần lớn cổ phần của Scale AI. Cùng thời gian đó, Meta đã đưa ra nhiều tuyên bố và báo cáo nghiên cứu về "an toàn AI" và "AI có trách nhiệm". Nhưng những công nhân ở Philippines, ngày ngày gán nhãn nội dung độc hại, có thể nhận mức thù lao thấp hơn lương tối thiểu, không thấy tên mình trong bất kỳ tuyên bố chính thức nào.

Sức lao động của những công nhân này là nền tảng vật chất cho năng lực AI, nhưng phần chi phí này không bao giờ xuất hiện trong các bảng so sánh chi phí huấn luyện mô hình lớn.

Bây giờ, tòa án sẽ bắt đầu tính toán khoản nợ này.

Nguồn tham khảo: Scale AI is being investigated by the US Department of Labor (TechCrunch); Training Artificial Intelligence and Employer Liability: Lessons from Schuster v. Scale AI (Epstein Becker Green Workforce Bulletin); Scale AI, Data Labeling Company, CocoLoop, Under Investigation by the US Department of Labor (AIBase)