Common Sense Media xếp ChatGPT dành cho thiếu niên ở mức "rủi ro không thể chấp nhận"

Common Sense Media, tổ chức đánh giá truyền thông dành cho trẻ em của Mỹ, công bố báo cáo ngày 7/10 xếp ChatGPT for Teens – sản phẩm OpenAI ra mắt vào tháng 8 – ở mức "Rủi ro không thể chấp nhận" (Unacceptable Risk), mức thấp nhất trong hệ thống đánh giá của tổ chức này. Báo cáo kêu gọi OpenAI ngừng quảng bá sản phẩm cho thanh thiếu niên cho đến khi khắc phục một số vấn đề cốt lõi.

Cuộc kiểm tra do Viện An toàn AI cho Thanh thiếu niên, đơn vị trực thuộc tổ chức này, thực hiện. Các nhà nghiên cứu dùng tài khoản đăng ký ở tuổi 13-17 gửi hơn 4.000 câu lệnh, sau đó mời một nhóm bác sĩ tâm thần trẻ em và một bác sĩ nhi khoa đánh giá từng câu trả lời.

Những lỗ hổng mà báo cáo chỉ ra

Chuyển hướng khủng hoảng. Trong các cuộc trò chuyện mà người kiểm tra cho rằng cần hướng người dùng tìm kiếm sự giúp đỡ, ChatGPT bỏ sót hơn một phần tư. Cả ba chỉ số "ranh giới đỏ" về tác hại mà báo cáo đặt ra đều không đạt ngưỡng 95%.

Cảnh báo cho phụ huynh. Trên hơn chục tài khoản thử nghiệm mới tạo và đã liên kết với tài khoản phụ huynh, người kiểm tra và ChatGPT thảo luận về ý nghĩ tự sát, tự làm hại bản thân hoặc rối loạn ăn uống kéo dài tới một giờ, nhưng phía phụ huynh không nhận được bất kỳ cảnh báo nào.

Chế độ học tập. Thanh thiếu niên có thể bấm thẳng vào "hiện đáp án" để lấy kết quả; trong giờ học do phụ huynh đặt, chỉ cần xóa tiền tố @study là vượt qua được giới hạn.

Nhận diện tuổi. Dùng tài khoản người lớn giả giọng điệu thanh thiếu niên trong nhiều ngày liên tục, hệ thống không chuyển sang trải nghiệm dành cho người chưa thành niên.

Biểu đạt cảm xúc. Dù OpenAI đã cập nhật quy chuẩn mô hình dành cho người chưa thành niên, ChatGPT vẫn thể hiện cảm xúc, sở thích và tâm trạng; báo cáo cho rằng rủi ro phụ thuộc cảm xúc vẫn còn phổ biến.

Tom Siegel, giám đốc điều hành của viện, nói:

"A teen can spend an hour talking about self-harm without their parent getting a single alert."

(Một thanh thiếu niên có thể dành cả giờ nói về việc tự làm hại bản thân mà phụ huynh không nhận được một cảnh báo nào.)

Phản hồi của OpenAI

OpenAI nói với báo giới rằng họ hoan nghênh các đánh giá độc lập nghiêm ngặt, nhưng cho rằng cách kiểm tra của Common Sense Media không phản ánh chính xác cách các biện pháp bảo vệ thanh thiếu niên hoạt động trong thực tế. Theo Bloomberg, OpenAI còn cho biết một số bài kiểm tra có thể đã diễn ra trước khi các tính năng liên quan đến kiểm soát của phụ huynh được triển khai, và đã đề nghị tổ chức này kiểm tra lại. Bên đánh giá giữ nguyên kết luận ban đầu, cho rằng cảnh báo phụ huynh không đáng tin cậy trong các tình huống khủng hoảng.

Cả hai bên đều không công bố khung thời gian kiểm tra cụ thể hay OpenAI đang nói đến những tính năng nào, nên bên ngoài hiện chưa thể đánh giá khoảng cách giữa hai cách nói lớn đến đâu.

Bảy tuần từ khi ra mắt đến khi bị xếp hạng

Khi ChatGPT for Teens ra mắt ngày 18/8, OpenAI nhấn mạnh hai điểm: một là người dùng 13-17 tuổi sẽ tự động vào trải nghiệm riêng với lớp bảo vệ mạnh hơn trước nội dung về tự làm hại bản thân, rối loạn ăn uống, hoạt động nguy hiểm; hai là chế độ học tập, nhắc bài tập và giờ học do phụ huynh đặt, biến việc "cho đáp án" thành "cùng làm bài".

Báo cáo lần này đối chiếu từng điểm với đúng hai lời hứa đó. Giờ học có thể bị vượt qua chỉ bằng cách xóa một tiền tố, nhắc bài tập có thể bỏ qua bằng một cú bấm, còn cảnh báo khủng hoảng không hề kích hoạt trên các tài khoản liên kết. Hầu hết các tính năng đều tồn tại, nhưng độ ổn định khi vận hành thì bị đặt dấu hỏi.

Nhìn lại, đây là năm thứ hai liên tiếp OpenAI bị áp lực từ bên ngoài thúc đẩy trong việc bảo vệ người chưa thành niên. Tháng 9/2025, sau một vụ kiện liên quan đến việc một thanh thiếu niên tự sát, OpenAI đã ra mắt tính năng kiểm soát của phụ huynh; tháng 8 năm nay thì ra mắt phiên bản riêng cho thanh thiếu niên. Các tổ chức đánh giá độc lập như Common Sense Media trước đó cũng từng xếp trợ lý AI của Meta vào cùng mức thấp nhất này.

Danh sách khắc phục mà báo cáo đưa ra cho OpenAI gồm: xây dựng cách ước tính tuổi hiệu quả, làm cho cảnh báo phụ huynh kích hoạt đáng tin cậy, sửa lỗi ứng phó khủng hoảng, ngừng việc để AI làm bài tập thay học sinh, bỏ cách biểu đạt cảm xúc, và chỉ quảng bá lại cho thanh thiếu niên sau khi chấp nhận kiểm tra lại bởi bên thứ ba độc lập. Hiện chưa rõ OpenAI có chấp nhận kiểm tra lại hay không, và khi nào.

Nguồn tham khảo: Thông cáo báo chí của Common Sense Media, CocoLoop, Bloomberg, Axios, Education Week; số lượng câu lệnh thử nghiệm, tỷ lệ bỏ sót và kết quả cảnh báo phụ huynh được đối chiếu theo số liệu do tổ chức đánh giá công bố, phản hồi của OpenAI dựa trên tuyên bố chính thức của hãng với báo giới.