Mô hình suy luận đóng vai hacker, vượt rào cản AI với tỷ lệ thành công 97%
Một nghiên cứu từ Đại học Stuttgart và ELLIS Alicante cho thấy các mô hình suy luận (LRM) có thể tự động tấn công và vượt qua hệ thống an toàn của các mô hình AI khác với tỷ lệ thành công lên tới 97,14% trong 25.200 bài kiểm tra.